2026년 9월 23일 수요일
METABRIEF — Insights. Connection. Innovation.
AI

OpenAI, GPT-6 'Sol'·'Luna' 공개…프롬프트 캐싱도 개편해 비용·지연 줄인다


OpenAI가 공식 뉴스 채널 OpenAI News에 올린 두 편의 글을 종합하면, 회사는 차세대 모델군 GPT-6의 두 모델 'Sol(솔)'과 'Luna(루나)'를 공개했다. 이와 함께 GPT-6에서 달라진 프롬프트 캐싱 기능도 별도 글로 안내했다. 모델 소개 글 'Introducing GPT-6 Sol and Luna'는 두 모델이 최상위급(frontier) 지능을 일상 업무에 쓸 수 있게 하되, 성능과 비용의 균형을 서로 다르게 맞췄다고 설명한다. 캐싱 안내 글 'Better prompt caching for GPT-6'는 캐시 적중률 향상, 새 진단 기능, 명시적 브레이크포인트, 지연 시간과 비용을 줄이는 제어 기능을 주요 개선점으로 내세웠다. 두 글이 게시된 날짜는 제공된 자료에 나와 있지 않다.


모델 소개 글의 요지는 GPT-6를 모델 하나가 아니라 두 가지 선택지로 내놓았다는 점이다. OpenAI는 Sol과 Luna를 '일상 업무'를 위한 모델로 소개했고, 두 모델의 차이는 성능과 비용의 배분에 있다고 밝혔다. 다만 어느 모델이 더 높은 성능을 내는지, 요금이 얼마인지, 벤치마크 결과가 어떤지는 제공된 자료로는 확인되지 않았다. 모델 이름이 각각 태양과 달을 뜻하는 단어라는 점은 눈에 띄지만, 이름을 어떻게 지었는지에 대한 회사 설명도 자료에는 없다. ChatGPT와 API 중 어디에 먼저 적용되는지, 어떤 순서로 제공되는지도 아직 확인되지 않았다.


캐싱 안내 글은 개발자와 기업 고객이 모델을 운영할 때 드는 부담을 다룬다. 프롬프트 캐싱은 요청마다 반복되는 입력의 앞부분을 매번 새로 처리하지 않고, 이전 계산 결과를 다시 쓰는 기술이다. 긴 시스템 지시문이나 공통 문서를 여러 번 보내는 서비스일수록 응답이 빨라지고 비용이 줄어든다. OpenAI는 GPT-6에서 캐시 적중률을 높였다고 밝혔다. 또 캐시가 제대로 작동하는지 확인할 수 있는 진단 기능과, 캐시로 저장할 구간을 명시하는 브레이크포인트를 새로 넣었다고 설명했다. 다만 각 기능이 구체적으로 어떻게 작동하는지, 비용과 지연이 얼마나 줄어드는지 같은 수치는 자료에서 확인되지 않았다.


두 발표가 함께 나온 배경에는 생성형 AI가 시범 사용을 넘어 업무 도구로 자리 잡는 흐름이 있다. 기업이 AI를 업무에 본격적으로 쓰면 모델이 얼마나 똑똑한지만큼 호출 한 번에 드는 비용과 응답 속도가 중요해진다. 에이전트처럼 같은 맥락을 여러 번 주고받는 사용 방식이 늘수록 반복되는 입력을 얼마나 싸게 처리하느냐가 전체 비용을 크게 좌우한다.


두 글을 나란히 놓으면 강조점이 뚜렷하게 나뉜다. 모델 소개 글은 '어떤 모델을 고를 것인가'라는 선택의 문제를, 캐싱 글은 '고른 모델을 얼마나 싸고 빠르게 돌릴 것인가'라는 운영의 문제를 다룬다. 한 글은 사용자에게 보이는 제품 구성을, 다른 글은 개발자에게 필요한 인프라 세부 사항을 설명하는 셈이다. 그런데 두 글 모두 '비용'이라는 단어를 핵심에 두고 있다. 모델 단계에서는 성능과 비용을 달리 맞춘 두 모델로, 운영 단계에서는 캐싱 개선으로 비용 문제를 다룬다. 이번 GPT-6 발표는 성능 경쟁에 더해 '같은 지능을 얼마나 경제적으로 쓰게 하느냐'를 두 방향에서 동시에 공략한 것으로 볼 수 있다.


실제 절감 효과는 Sol과 Luna의 요금, 캐싱이 적용되는 범위와 할인 조건이 공개돼야 따져볼 수 있다.



메타브리프 편집팀