기사 검색

이슈부터 IT·AI·연예·게임까지, 메타브리프의 기사를 찾아보세요.

AI

오픈AI, GPT-6 활용 가이드 공개…엔비디아 "블랙웰 기반 '아스트라 울트라패스트', 토큰 생성 최대 8배 빨라"


오픈AI와 엔비디아가 최근 각자의 공식 채널에 GPT-6 제품군을 다룬 글을 올렸다. OpenAI News는 스타트업 개발자가 GPT-6 모델을 고르고 실제 서비스에 적용할 때 참고할 수 있는 가이드를 공개했다. NVIDIA Blog는 엔비디아 블랙웰(Blackwell) GPU에서 구동되는 'GPT-6 아스트라 울트라패스트(Astra Ultrafast)'를 오픈AI API에서 바로 쓸 수 있고, 조건을 갖춘 ChatGPT Work·Codex 이용자에게도 제공된다고 밝혔다.


NVIDIA Blog에 따르면 울트라패스트는 블랙웰 아키텍처의 성능을 활용하는 추론 최적화를 거쳐 기존 '아스트라 스탠더드' 모드보다 토큰을 최대 8배 빠르게 생성한다. 엔비디아는 이 속도가 특히 에이전트형 작업에서 의미가 크다고 설명했다. 에이전트는 코드를 작성하고, 도구를 호출하고, 결과를 확인한 뒤 다음 행동을 정하는 과정을 되풀이한다. 한 번의 응답 지연은 작아도 이 과정이 반복되면 시간이 쌓인다. 응답이 빨라지면 코딩 에이전트의 '수정-테스트-디버그' 주기가 짧아지고, 도구 호출 사이에 응답을 만드는 시간도 줄어 대화형 애플리케이션의 반응성이 좋아진다는 것이다.


같은 글에는 오픈AI 관계자들의 발언도 실렸다. 오픈AI 추론 책임자 필리프 틸레는 엔비디아가 개발 도구와 문서에 많은 투자를 한 덕분에 오픈AI 모델이 블랙웰과 차세대 루빈(Rubin) GPU용 프로그래밍을 매우 잘하게 됐다고 말했다. 그는 아스트라가 이 지식으로 고성능 커널을 만들어 지연시간·처리량·비용 전반에서 엔비디아 하드웨어의 장점을 끌어낸다고 덧붙였다. 오픈AI 컴퓨트 부문 최고기술책임자 우다이 루다라주는 내부 모델로 엔비디아 GPU의 추론을 최적화했고, 엔비디아 플랫폼의 프로그래밍 유연성이 울트라패스트 가속에 도움이 됐다고 밝혔다. 엔비디아는 모델을 배포한 뒤에도 오픈AI가 자체 모델로 추론 소프트웨어를 계속 다듬고 있어 응답 속도와 인프라 효율이 갈수록 나아질 수 있다고 설명했다. 같은 인프라를 학습·추론·강화학습에 돌려 쓸 수 있어 수요에 맞춰 컴퓨팅 자원을 재배치하고 과잉 투자를 피할 수 있다는 점도 강조했다. 울트라패스트의 이용 방법과 가격은 별도 가이드로 안내된다고 했으나, 구체적인 가격은 확인되지 않았다.


OpenAI News가 낸 가이드는 GPT-6 모델 선택, 추론 강도(reasoning effort) 조절, 프롬프트와 스킬 개선, 여러 도구 조율, 운영 환경을 위한 워크플로 준비를 다룬다. 다만 공개된 요약만으로는 모델별 권장 용도나 구체적인 설정값이 확인되지 않았다.


두 글이 함께 나온 배경에는 GPT-6가 하나의 모델이 아니라 여러 모델과 실행 모드로 이뤄진 '제품군'이라는 사실이 있다. 쓸 수 있는 선택지가 많아지면서 개발자는 어떤 모델을 어떤 강도로 돌릴지 직접 정해야 하는 상황이 됐다.


두 글을 함께 놓고 보면 강조점이 뚜렷하게 갈린다. 오픈AI 가이드는 모델 선택, 추론 강도, 프롬프트처럼 '어떻게 쓸 것인가'에 초점을 둔다. 엔비디아 블로그는 GPU와 추론 최적화, 즉 '얼마나 빨리 돌릴 것인가'를 내세운다. 그런데 두 글이 그리는 실제 사용 장면은 같다. 에이전트가 도구를 오가며 작업을 반복하는 흐름이다. 오픈AI는 깊게 생각할지 덜 생각할지를 개발자에게 조절하게 하고, 엔비디아는 같은 연산을 더 짧은 시간에 끝내도록 받쳐준다. 결국 GPT-6 시대에 개발자가 따져야 할 것은 성능 하나가 아니라 추론의 깊이와 응답 속도, 비용 사이의 균형이다. 다만 '최대 8배'라는 수치는 엔비디아가 자사 블로그에서 밝힌 것으로, 외부 기관이 따로 검증한 결과는 확인되지 않았다.



메타브리프 편집팀 메타브리프 기자