앤트로픽 공식 발표 페이지의 클로드 하이쿠 5.5 제목 화면에 한글 제목과 앤트로픽 로고를 얹은 대표 이미지
|

AI 핫토픽 – 클로드 하이쿠 5.5(Claude Haiku 5.5) 출시

클로드 하이쿠 5.5(Claude Haiku 5.5)는 앤트로픽(Anthropic)이 2026년 10월 7일 공개한 소형 모델로, 발표문은 이 회사가 지금까지 낸 소형 모델 가운데 “가장 싸고, 가장 빠르고, 가장 유능하다”고 소개합니다. Claude API에서 쓰는 모델 ID는 claude-haiku-5-5예요.

이 글은 앤트로픽 공식 발표 페이지와 Claude 플랫폼 릴리스 노트에 적힌 내용만 옮겼습니다. 앞서 다룬 컴팩션 온디맨드처럼 Claude API를 쓰는 사람이라면 가격과 마이그레이션 항목이 가장 먼저 눈에 들어올 거예요. 직접 써 본 결과는 없습니다.

앤트로픽 공식 발표 페이지에 뜬 클로드 하이쿠 5.5 첫 화면. 앤트로픽 로고와 2026년 10월 7일 날짜, Claude Haiku 5.5 제목, 모델 ID claude-haiku-5-5가 보인다
앤트로픽 클로드 하이쿠 5.5 발표 페이지 (anthropic.com)

공식 발표 페이지 화면을 짚어 정리한 영상 (소리 없음)

클로드 하이쿠 5.5는 어떤 모델인가

앤트로픽 공식 로고
앤트로픽 로고 (anthropic.com 헤더)

발표문에 따르면 클로드 하이쿠 5.5는 대량으로 돌리는, 비용에 민감한 작업을 겨냥합니다. 요약, 컴팩션(compaction), 데이터베이스 질의, 분류 같은 빠르고 반복적인 일을 안정적으로 처리한다고 하고요. 코딩 작업에서는 오퍼스 5.5(Opus 5.5)나 소네트 5.5(Sonnet 5.5)와 짝을 이뤄 하위 에이전트(subagent)로 쓰기 좋다고 합니다.

앤트로픽은 클로드 하이쿠 5.5가 지금까지 낸 모델 중 가장 빠르다고 적었어요. 각주에는 각 모델의 표준 속도 기준이고, 오퍼스 모델의 패스트 모드(Fast Mode)보다는 느리다는 단서가 붙어 있습니다. 그래서 실시간 고객 지원이나 브라우저 사용(browser use)처럼 속도가 중요한 작업에 잘 맞는다는 것이 발표문의 설명이에요.

릴리스 노트의 사양은 이렇습니다. 컨텍스트 창(context window)은 100만 토큰, 최대 출력은 12만 8천 토큰이고, 노력 매개변수(effort parameter)로 조절하는 적응형 사고(adaptive thinking)를 지원합니다. 발표문은 클로드 하이쿠 5.5가 조절 가능한 노력 설정이 붙은 첫 하이쿠급 모델이라고 밝히며, 비용을 우선할지 지능을 우선할지 사용자가 정할 수 있다고 해요.

발표문은 하이쿠 5.5의 자리를 좁게 잡습니다. 이전 모델로는 비용 부담이 컸던, 범위가 분명한 작업이 대상이고 컴팩션과 요약, 하위 에이전트 작업이 예로 나와요. 속도와 능력, 가격을 함께 갖춰 브라우저 사용과 컴퓨터 사용에 특히 잘 맞는다는 말도 덧붙입니다.

공식 벤치마크 표를 읽는 법

발표 페이지의 Performance 표. 하이쿠 5.5, 하이쿠 4.5, GPT-6 Luna, 참고용 소네트 5.5의 지식 업무, 컴퓨터 사용, 추론, 코딩, 시각 추론 점수가 보인다
발표 페이지의 벤치마크 표 (anthropic.com)

표는 앤트로픽이 직접 공개한 것이고, 평가 방법은 하이쿠 5.5 시스템 카드(System Card)에 있다고 안내합니다. 클로드 하이쿠 5.5 열의 값을 하이쿠 4.5, GPT-6 Luna와 나란히 놓으면 다음과 같아요.

평가 하이쿠 5.5 하이쿠 4.5
GDPval-AA v2.1 (지식 업무) 1620 735
OSWorld 2.1 (컴퓨터 사용, 오프라인 부분 집합) 72.4% 15.7%
Terminal-Bench 4.0 (에이전트 코딩) 39.2% 0.0%
Humanity’s Last Exam (도구 없음) 45.9% 10.2%

GPT-6 Luna는 같은 평가에서 GDPval-AA 1437, OSWorld 48.9%, Terminal-Bench 16.4%로 표에 올라 있고, HLE에는 값이 없어요. 참고용으로 함께 실린 소네트 5.5는 모든 줄에서 하이쿠 5.5보다 높습니다. 예를 들어 Terminal-Bench 4.0은 70.6%입니다.

발표문도 이 차이를 직접 언급해요. 복잡한 에이전트 코딩에는 소네트 5.5와 오퍼스 5.5가 계속 더 나은 선택이고, 클로드 하이쿠 5.5는 컴팩션, 요약, 하위 에이전트처럼 범위가 좁은 작업에 맞는다는 설명입니다. 표의 일부 평가 이름은 외부 기관이 만든 것(예: GDPval-AA는 Artificial Analysis)이라, 점수는 앤트로픽이 보고한 값이라는 점을 함께 기억하면 됩니다.

표를 인용할 때

OSWorld 2.1은 “오프라인 부분 집합” 기준이고 Humanity’s Last Exam은 도구 사용 여부에 따라 값이 두 줄로 갈립니다. 숫자만 따로 떼어 쓰지 말고 조건을 같이 적어야 합니다.

함께 읽기AI 기술 설명 – 컴팩션 온디맨드(Compaction on Demand) – 긴 대화를 서버가 요약해 주는 Claude API 기능컴팩션 온디맨드는 앱이 정한 시점에 Claude 서버가 긴 대화를 요약 블록 하나로 바꿔 줍니다. 쓰는 순서와 옵션, 이미지가 사라지는…

노력 설정과 고객사가 밝힌 초기 결과

발표 페이지에는 노력 설정(낮음, 중간, 높음, 엑스트라 하이(Xhigh), 맥스)별로 OSWorld 2.1, GDPval-AA, Humanity’s Last Exam 세 평가의 정확도와 비용을 그린 그래프도 실려 있습니다. 그래프 값은 발표문 본문에 숫자로 풀려 있지 않아 이 글에서는 옮기지 않았어요. 다만 비용과 점수를 함께 보고 설정을 고르도록 만든 구조라는 점은 확인됩니다.

발표문은 초기 테스트에 참여한 고객사의 말도 소개합니다. 모두 각 회사가 자기 평가에서 밝힌 수치이고, 조건이 서로 달라 한데 묶어 비교할 수는 없어요.

  • 아사나(Asana): 자사 AI 에이전트 평가에서 지금 쓰는 모델보다 작업 완료 지연이 30% 넘게 줄었고, 에이전트 한 턴당 추론은 최대 2.5배 빨랐다는 설명이고요.
  • 허브스팟(HubSpot): CRM 작업 시뮬레이션에서 세 번 평균 92.8%로, 이 평가 세트에서 지금까지 본 가장 높은 점수라고 밝혔습니다.
  • 알파센스(AlphaSense): 문서 질의응답 400건에서 하이쿠 4.5의 0.76 대비 0.84로, 통계적으로 의미 있는 개선이라는 평가예요.
  • 박스(Box): 하이쿠 4.5보다 11점 높은 점수에 지연은 약 절반이었다고 전했어요.
  • 코그니션(Cognition): 데빈 퓨전(Devin Fusion)에서 하이쿠 5.5를 보조로, 오퍼스 5.5를 주도 모델로 쓰면 FrontierCode 66.2를 유지하면서 비용과 지연을 줄였다고 밝혔습니다.

하이쿠 4.5보다 낮아진 가격표

클로드 하이쿠 5.5 가격표. 100만 토큰당 캐시 읽기, 캐시 쓰기, 입력, 출력 가격이 하이쿠 5.5, 하이쿠 4.5, 소네트 5.5별로 보인다
100만 토큰당 가격표 (anthropic.com)

가격은 100만 토큰 단위이고, 클로드 하이쿠 5.5는 프롬프트가 10만 토큰 이하일 때와 초과일 때가 나뉩니다. 발표문은 10만 토큰 이하 요청이 이전 하이쿠로 들어온 요청의 약 90%였다고 적어요.

항목 하이쿠 5.5 (10만 이하 / 초과) 하이쿠 4.5
입력 $0.10 / $0.50 $1.00
출력 $0.50 / $2.50 $5.00
캐시 읽기 $0.01 / $0.05 $0.10

캐시 쓰기는 하이쿠 5.5가 $0.125 / $0.625, 하이쿠 4.5가 $1.25입니다. 소네트 5.5는 입력 $2.00, 출력 $10.00이고요. 각주는 10만 토큰 이하 요청에서 90%, 초과 요청에서 50% 낮은 가격이며, 새 토크나이저 때문에 같은 일에 토큰이 조금 더 쓰이는 점까지 반영하면 평균 약 75% 저렴하다고 설명합니다. 캐시 구조가 궁금하다면 캐시 진단 글을 같이 보면 좋아요.

이 가격 구조에서 눈여겨볼 곳은 캐시 읽기예요. 하이쿠 5.5의 캐시 읽기는 입력 가격의 10분의 1 수준으로 표에 적혀 있고, 같은 프롬프트를 반복해 보내는 요약이나 분류 작업은 캐시를 얼마나 맞추느냐에 따라 청구액이 달라집니다. 다만 발표문은 실제 절감 폭을 작업별로 계산해 주지 않으니, 내 요청 길이와 반복 패턴으로 직접 어림해 봐야 합니다.

함께 읽기AI 기술 설명 – 캐시 진단(Cache Diagnostics) – 프롬프트 캐싱이 빗나간 이유를 알려 주는 Claude API 기능캐시 진단은 이전 응답 id를 넘기면 프롬프트 캐싱이 빗나간 지점을 model, system, tools, messages로 알려 줍니다…

같은 날 나온 소네트 캐시 인하와 API 크레딧

같은 날 앤트로픽은 클로드 하이쿠 5.5 외에도 두 가지를 알렸습니다. 소네트 5.5의 캐시 읽기를 100만 토큰당 $0.20에서 $0.10으로 내렸고, 그 결과 대부분의 에이전트 작업에서 소네트 5.5 비용이 약 20% 줄어든다고 해요. 릴리스 노트도 캐시 쓰기와 다른 가격은 그대로라고 적습니다.

다른 하나는 맥스(Max)와 팀(Team) 구독자에게 주는 월간 API 크레딧입니다. 이번 주 안에 순차 적용하며 맥스 5x는 월 $100, 맥스 20x는 월 $200, 팀은 사용자 전체가 나눠 쓰는 합산 최대 $500로 발표됐어요. 크레딧은 어느 모델에서든 쓸 수 있습니다.

4.5용 코드를 옮길 때 깨질 수 있는 부분

릴리스 노트가 가장 먼저 경고하는 것은 하이쿠 4.5용으로 짠 코드가 5.5에서 깨질 수 있다는 점입니다.

400 오류가 날 수 있는 것

  • 수동 확장 사고(budget_tokens)
  • temperature, top_p, top_k 샘플링 매개변수
  • 어시스턴트 메시지 프리필(prefill)
  • computer_20250124 도구 (새 도구 세트로 교체)

동작이 달라지는 것

  • 적응형 사고가 기본으로 켜져 응답이 사고 블록으로 시작할 수 있음
  • 사고 텍스트는 thinking.display를 “summarized”로 해야 보임
  • 같은 텍스트가 토큰으로도 더 셈
  • 아마존 베드록에서는 구조화된 출력 미지원

컴퓨터 사용 도구는 Claude API와 구글 클라우드에서는 computer_toolset_20260801, 아마존 베드록에서는 computer_20251124를 쓰라고 안내돼 있어요. 각 항목의 자세한 변경은 공식 마이그레이션 가이드(migration guide)에 있습니다.

SDK 쪽에서는 파이썬과 타입스크립트 SDK에 브라우저 사용 도구와 컴퓨터 사용 도구 클래스가 베타로 들어왔고, SDK가 도구 루프와 URL·파일 정책, 승인 콜백을 실행해 준다고 해요.

안전 장치와 제공 범위

앤트로픽은 하이쿠 5.5가 4.5보다 대부분의 정렬(alignment) 평가에서 크게 나아졌고, 오용 요청에 협조하려는 경향이 낮아졌다고 밝혔습니다. 사이버 보안 안전장치는 4.5보다 엄격하고 다른 최근 모델보다는 다소 느슨하다고 하며, 침투 테스트처럼 공격에 쓰이기 쉬운 기법은 막는다고 적어요. 생물학 안전장치는 소네트 5, 소네트 5.5, 오퍼스 5와 같아요.

클로드 하이쿠 5.5의 제공 범위는 Claude API, 아마존 베드록, 구글 클라우드, 마이크로소프트 애저(Azure)와 파운드리(Foundry) 등이고, 발표문은 모든 플랫폼에서 바로 쓸 수 있다고 적습니다.

2026-10-07발표일모델 ID claude-haiku-5-5
100만 토큰컨텍스트 창최대 출력 12만 8천
약 75%평균 비용 인하하이쿠 4.5 대비, 앤트로픽 산정

참고한 공식 문서

본문은 앤트로픽의 클로드 하이쿠 5.5 발표 페이지와 Claude 플랫폼 릴리스 노트를 기준으로 삼았어요. 고객사 후기 전문과 시스템 카드 본문은 옮기지 않았습니다. 가격과 사양은 바뀔 수 있으니 원문을 확인하세요. 이미지는 공식 페이지 화면의 캡처입니다.

클로드 하이쿠 5.5 자주 묻는 질문

클로드 하이쿠 5.5는 언제 나왔고 모델 ID는 무엇인가요?

앤트로픽이 2026년 10월 7일 공식 발표했고, Claude API에서 쓰는 모델 ID는 claude-haiku-5-5입니다. 발표문은 AWS, 구글 클라우드, 마이크로소프트 애저를 포함한 모든 플랫폼에서 지금 쓸 수 있다고 밝힙니다.

하이쿠 4.5보다 얼마나 싸졌나요?

앤트로픽은 100만 토큰당 입력 0.10달러, 출력 0.50달러(프롬프트 10만 토큰 이하 기준)로 안내하고, 하이쿠 4.5는 입력 1달러, 출력 5달러입니다. 발표문은 토크나이저가 바뀌어 같은 일에 토큰이 조금 더 든다는 점까지 반영해 평균 약 75% 저렴하다고 설명합니다.

하이쿠 4.5용으로 짠 코드를 그대로 써도 되나요?

릴리스 노트는 그대로 쓰면 오류가 날 수 있다고 경고합니다. 수동 확장 사고(budget_tokens), temperature·top_p·top_k 같은 샘플링 매개변수, 어시스턴트 메시지 프리필이 400 오류를 낼 수 있어 이전 가이드를 확인해야 합니다.

글에 나온 규칙 파일과 에이전트는 Claude Code에서 쓰는 방식이고, 공식 안내는 Claude Code 공식 문서에 있습니다.

이 글은 직접 만들고 운영하며 남긴 기록입니다. 적힌 수치는 작성 시점의 제 계정 기준이며, 같은 결과나 수익을 보장하지 않습니다.

Similar Posts

One Comment

답글 남기기

이메일 주소는 공개되지 않습니다. 필수 필드는 *로 표시됩니다