OpenAI, GPT-5.6 Luna 80% 가격 인하
OpenAI의 GPT-5.6 Luna 대규모 가격 인하가 모델 선택을 비용 중심으로 재편하는 가운데, Thinking Machines의 Inkling‑Small과 MCP의 무상태 전환은 운영·인프라 측면에서 비용·효율성 선택지를 더 세분화하고 있다.
OpenAI가 GPT‑5.6 Luna 가격을 80% 인하하고 Terra도 일부 인하하면서 모델 운영 비용 계산 방식이 빠르게 변하고 있다.
동시에 Thinking Machines의 Inkling‑Small(모델-혼합 전문가, 276B·활성 12B)은 동일한 컨텍스트(1M 토큰)에서 계산량을 크게 낮추려는 설계로 비용-성능 선택지를 확장한다.
운영 쪽에서는 MCP 스펙이 상태 기반 세션을 버리고 무상태 HTTP로 전환되어 에이전트 서비스의 로드밸런싱과 확장이 쉬워진 점이 배포 비용·복잡성에 직접적인 영향을 준다.
이번 발행본에서는 모델별 토큰당 비용, 지연, 컨텍스트 한계, 그리고 에이전트 세션 설계 방식을 비교해 보는 것이 유용하다.
https://www.cogni-ai.xyz/latest
위 링크에서 본문 확인 가능합니다!