안내
기간 설정

AI 성능당 비용 급락…이용자 지갑은 왜 가벼워질까
딜사이트 김진욱 기자, 이승연 인턴기자
2026-10-06 14:37:15
동일 성능 구현비용 연간 1/13로 급락…고성능 이용 가격 문턱 높아지고 에이전트 업무당 추론비 5배↑
이 기사는 2026-10-06 14:37:15 유료콘텐츠서비스 딜사이트 플러스 에 표출된 기사입니다.
(그래픽=딜사이트)

[딜사이트 김진욱 기자, 이승연 인턴기자] 인공지능(AI) 기술 발전으로 같은 수준의 성능을 얻는 데 드는 비용은 빠르게 낮아지고 있다. 하지만 고성능 AI의 실제 이용 부담은 오히려 커지는 흐름이다.


오픈AI와 구글은 최근 고속 서비스에 별도 이용 조건을 적용하거나 일부 모델의 API 가격 인상을 예고했다. 여기에 AI 활용이 단순 질의응답에서 여러 단계를 스스로 수행하는 ‘에이전트형 AI’로 확장되면서 업무당 추론비용도 증가할 수 있다는 전망이 나온다.


◆같은 성능 구현비용 연 13분의 1…AI ‘가격 하락’ 가속


지난달 22일(현지시간) AI 연구기관 에포크AI(Epoch AI)가 발표한 ‘생각의 가격 급락(The plunging price of thought)’ 보고서에 따르면 2023년 이후 동일한 수준의 AI 성능을 얻는 데 드는 최소 비용은 분기마다 평균 47%씩 감소했다. 연간으로 환산하면 같은 수준의 성능을 얻는 비용이 약 13분의 1로 낮아지는 속도다.


보고서를 작성한 루크 엠버슨(Luke Emberson) 연구원과 데이비드 루드먼(David Roodman) 연구원은 수학과 과학, 게임 등 5개 AI 성능 벤치마크를 토대로 비용과 성능의 관계를 분석했다. 이들이 추산한 AI 성능 대비 가격 하락 속도는 DNA 염기서열 분석보다 4배, 컴퓨팅보다 6배, 리튬이온배터리보다 18배 빨랐다.


특정 성능 구간에서는 비용 격차가 더 컸다. 보고서에 다르면 오픈AI가 지난해 1월 출시한 추론 모델 o3는 박사급 과학 문제를 다루는 GPQA 다이아몬드에서 75%의 성능을 내는 데 문제당 약 0.30달러(약 403원)가 들었다. 이후 출시된 GPT-5.6 루나(Luna)는 비슷한 성능을 문제당 0.0004달러(약 0.5원)에 구현했다. 18개월도 되지 않아 같은 벤치마크 성능을 내는 비용이 약 725분의 1로 줄어든 셈이다.

관련기사 more

◆고성능 AI 이용 문턱은 높아져…오픈AI·구글 요금제 개편


같은 성능을 얻는 최소 이용비용이 빠르게 낮아지는 것과 달리 실제 AI 서비스의 가격체계에서는 다른 움직임도 나타나고 있다.


오픈AI는 지난달 29일(현지시간) 개인 이용자를 대상으로 월 500달러(약 67만원)의 ‘프로(Pro) 500’ 요금제를 새로 내놨다. 프로 500에서는 GPT-6 아스트라(Astra)의 고속 서비스인 울트라패스트(Ultrafast)를 이용할 수 있다. 기존 월 100달러와 200달러 프로 요금제에서는 울트라패스트를 이용할 수 없다. 같은 모델이라도 처리 속도가 빠른 서비스를 이용하려면 더 높은 요금제가 필요한 구조다.


기존 월 200달러(약 27만원)인 프로 200은 구독료가 유지됐지만 신규 가입자에게 제공되는 기본 사용량은 종전보다 줄었다. 기존 가입자에게는 일정 기간 종전 사용량을 유지할 수 있는 유예기간이 적용된다.


고성능 기능은 이용한도도 더 빠르게 소진한다. 오픈AI에 따르면 같은 아스트라 모델이라도 울트라패스트를 선택하면 포함 사용량이 표준 모드보다 8배 빠르게 줄어든다. 오픈AI는 모델과 추론량, 도구 사용, 처리 속도 등에 따라 실제 사용량이 달라질 수 있다고 설명했다.


구글도 개인용 제미나이(Gemini)의 요금제별 모델 접근 범위를 조정하고 있다. 지난 4일(현지시간) 구글 고객센터 공지사항에 따르면 무료 이용자는 오는 9일부터 경량 모델인 제미나이 플래시-라이트(Flash-Lite)만 이용할 수 있다. 무료 이용자는 기존에 접근할 수 있었던 플래시와 프로 모델은 사용할 수 없게 된다.


‘AI 플러스(Plus)’ 가입자도 프로 모델을 이용할 수 없게 된다. 플러스 요금제에서는 플래시-라이트와 플래시까지만 제공된다. 가장 높은 성능의 프로 모델을 이용하려면 월 19.99달러(약 2만7000원)의 ‘AI 프로(Pro)’ 이상 요금제를 구독해야 한다.


개발자와 기업이 사용하는 제미나이 응용프로그램인터페이스(API)에서도 가격 조정이 예정돼 있다. 구글은 제미나이 3.7 플래시에 적용 중인 프로모션 가격을 올해 말 종료하고 내년 1월1일부터 표준 가격을 적용한다.


현재 제미나이 3.7 플래시의 입력 가격은 100만 토큰당 0.75달러, 출력 가격은 3.75달러다. 내년부터는 각각 1.50달러와 7.50달러로 두 배 오른다. 현재 환율을 적용하면 입력 100만 토큰당 약 2000원, 출력 100만 토큰당 약 1만원 수준이다.


우선 처리 서비스인 프라이어리티(Priority)의 가격도 같은 폭으로 조정된다. 입력 토큰 100만개당 가격은 1.35달러에서 2.70달러로, 출력 가격은 6.75달러에서 13.50달러로 변경된다. 구글은 현재 가격을 프로모션 가격으로 명시하고 있다.


◆에이전트 확산에 업무당 추론비 증가…인프라도 ‘학습→추론’


AI 모델 자체의 단위 경제성이 개선되더라도 복잡한 업무를 맡길수록 총비용이 늘어날 수 있다는 분석도 나온다.


글로벌 IT 리서치·자문회사 가트너는 지난 8월17일(현지시간) 공개한 ‘추론의 역설(Inference Paradox)’ 분석에서 에이전트형 AI 한 건당 추론비용이 2028년까지 5배 이상 증가할 것으로 전망했다. AI가 단순한 보조 기능에서 여러 단계를 스스로 수행하는 방식으로 진화하면서 필요한 토큰과 연산량이 늘어날 수 있다는 분석이다.


윌 소머(Will Sommer) 가트너 연구원은 AI 성능이 발전할수록 더 많은 토큰이 필요하고 상대적으로 비싼 토큰의 활용도 늘어날 것으로 분석했다. 단순 챗봇은 질문을 해석한 뒤 답변을 생성하면 작업이 끝나지만 AI 에이전트는 추론과 검토, 판단을 여러 단계에 걸쳐 반복한다는 설명이다.


소머 연구원은 기본적인 챗봇 상호작용과 에이전트형 추론 작업의 비용 차이도 지적했다. 하나의 작업을 에이전트형 추론 모델에 맡기면 공급자의 추론비용이 최소 5배 증가한다고 분석했다. 작업이 복잡해질수록 비용 증가폭은 더 커질 수 있다고 봤다.


AI 인프라 투자에서도 학습보다 추론의 비중이 커지고 있다. 가트너가 지난 8월 10일(현지시간) 발표한 ‘2026년 전 세계 AI 최적화 IaaS 전망’에 따르면 올해 전 세계 AI 최적화 서비스형 인프라(IaaS) 지출은 422억7600만달러로 전년보다 96.4% 증가할 전망이다. 이는 약 56조7000억원 규모다. IaaS는 서버와 저장장치 등 컴퓨팅 자원을 클라우드로 빌려 쓰는 서비스다.


하딥 싱(Hardeep Singh) 가트너 연구원은 기업들이 AI 모델 개발에서 실제 서비스 배치 단계로 이동하면서 실시간 추론 수요가 커지고 있다고 분석했다. 가트너는 올해 추론용 인프라 지출이 233억달러(약 31조3000억원)로 학습용 인프라 지출 190억달러(약 25조5000억원)를 처음 넘어설 것으로 전망했다.

ⓒ새로운 눈으로 시장을 바라봅니다. 딜사이트 무단전재 배포금지