클러드 소형 모델 Haiku 4.5 출시
출시 배경
Anthropic의 차세대 소형 모델
이전 세대 Haiku 3.5 대비 성능 향상, Sonnet 4 대비 2배 빠른 속도
비용은 약 1/3 수준, 실시간 응답 중심 서비스에 최적화
성능 포인트
일부 코딩 및 분석 작업에서 Sonnet 4보다 더 높은 점수
긴 문맥 처리, 코드 이해, 디버깅, 요약, 구조화 작업에서 강세
응용 시나리오
실시간 대화, 고객 지원, 페어 프로그래밍, 빠른 응답이 필요한 LLM 앱에 적합
멀티 에이전트 구조에서 하위 작업을 수행하는 “실행 담당 모델”로 이상적
모델 조합 전략
복잡한 문제는 Sonnet 4.5가 계획 (planning)
여러 Haiku 4.5 인스턴스가 병렬로 세부 작업 실행
효율적 협업형 LLM 아키텍처 기반 마련
비용 구조 (API 기준)
입력 토큰 $1 / 출력 토큰 $1 / 5 $ 요율
대형 모델 대비 현저히 낮은 단가로 운영 가능
안전성 및 정렬(Alignment)
Haiku 3.5보다 정렬 안정성 강화
Sonnet 4.5, Opus 4.1보다 오동작률 최소화
ASL-2 (AI Safety Level 2) 등급으로 공개됨 — 보다 안전한 대중 접근 가능
지원 플랫폼
Claude Code, Anthropic App, API, Amazon Bedrock, Google Vertex AI 등에서 사용 가능
기존 Haiku 3.5 또는 Sonnet 4 기반 시스템과 호환
의미
“작고 빠른 모델이 곧 실용형 AI의 표준이 될 수 있다”는 Anthropic의 선언
코딩 및 실시간 응답형 서비스에 LLM 실전화의 중심축으로 자리 잡을 가능성
향후 프론티어 모델(대형)과 소형 모델의 역할 분리 전략이 본격화될 전망
