Anthropic が Claude Haiku 5.5 をリリース: 価格は大幅に値下げされましたが、新しいトークナイザーはより多くのトークンを消費します

📅 2026-10-08

要約:

Anthropic は、Claude Haiku 5.5 を正式にリリースします。これは、Claude 5.5 シリーズの 3 番目のモデルであり、Claude Haiku 4.5 からほぼ 1 年後に発売された新世代の Haiku モデルです。 Anthropic は、Haiku 5.5 を、同時実行性が高く、レイテンシが低く、コスト重視のタスク向けの軽量モデルと位置付けており、API 価格を大幅に削減することで、Haiku 5.5 は現在の低コスト AI モデルの競争力のあるランクに直接入ります。

人工分析インテリジェンス インデックス (26 年 10 月 7 日).png

Anthropic が発表した価格によると、100,000 トークン以内のリクエストの場合、Claude Haiku 5.5 の入力価格は 100 万トークンあたり 0.10 米ドル、出力価格は 100 万トークンあたり 0.50 米ドルです。前世代の Haiku 4.5 の価格 (それぞれ 1 米ドルと 5 米ドル) と比較すると、書籍の価格は直接 90% 引き下げられました。

リクエストが 100,000 トークンを超える場合、Haiku 5.5 の価格は大幅に上昇し、入力価格と出力価格はそれぞれ 100 万トークンあたり 0.50 米ドルと 2.50 米ドルに上昇します。つまり、100,000 トークンのしきい値を超えると、インプット価格とアウトプット価格は基本価格の 5 倍になります。

Anthropic は、実際のワークロードの計算に基づいて、Haiku 5.5 の平均運用コストは Haiku 4.5 の平均運用コストよりも約 75% 低いと述べています。平均下落率が公示価格の 90% に達していない重要な理由の 1 つは、Haiku 5.5 が新しい単語セグメンターを使用していることです。

新しいトークナイザーは、Claude Sonnet 5.5 および Opus 5.5 で使用されるトークナイゼーション方法に似ています。 Haiku 5.5 では、同じテキストがより多くのトークンとして計算される場合があります。 Anthropic 自身の指示によると、新しい単語分割方法により、同じタスクを完了するときに生成されるトークンの数がわずかに増加します。いくつかの実際のテストでは、同じ長いテキストでも、Haiku 5.5 では Haiku 4.5 よりも約 25% ~ 30% 多くのトークンを消費する可能性があることが判明しています。

これは、Haiku 5.5 には見落とされがちな「隠れたコスト」があることを意味します。 100 万トークンあたりの価格は大幅に下がりましたが、ユーザーが実際に支払う料金は、タスクを完了するためにモデルが消費するトークンの数によっても異なります。したがって、単に 100 万トークンあたりの価格を比較するだけでは、2 世代のモデルの実際の運用コストを完全に反映することはできません。

Haiku 5.5 には依然として非常に大きなコンテキスト ウィンドウがあり、最大 100 万個のトークンをサポートし、最大出力長は 128K トークンに達します。また、タスクの複雑さに基づいてどれだけの推論リソースを投資する必要があるかを動的に決定できる適応的思考機能もサポートしています。

Anthropic は、Haiku 5.5 の焦点は、すべての複雑なタスクに関して Opus 5.5 や Sonnet 5.5 と競合することではなく、高頻度で反復的で応答速度に敏感な作業を大量に引き受けることであると特に強調しました。たとえば、テキストの要約、データ分類、情報抽出、データベース クエリ、リクエスト ルーティング、コンテキスト圧縮などはすべて、Haiku 5.5 に適したアプリケーション シナリオです。

AI エージェントの分野では、Haiku 5.5 は大規模モデルの補助モデルとしても設計されています。 Anthropic は、開発者が Sonnet 5.5 または Opus 5.5 に複雑なメイン タスクを担当させ、Haiku 5.5 をサブエージェントとして機能させて多数の単純な反復操作を処理させることで、エージェント システム全体の運用コストを削減することを推奨しています。

1780331851_scale_1200.webp

コード開発も、Haiku 5.5 の重要なアプリケーションの方向性の 1 つです。 Anthropic 氏は、このモデルを大規模なクロード モデルのコーディング サブエージェントとして使用して、コード検索、単純な変更、および分割できるその他の反復タスクを処理できると述べました。ただし、複雑なマルチステップのエージェント プログラミング タスクでは、Sonnet 5.5 と Opus 5.5 にはさらに明らかな利点があります。

スピードも Haiku 5.5 の大きなセールスポイントです。 Anthropic 氏によると、これは同社のこれまでで最も応答性の高いモデルであり、リアルタイムの顧客サービス、ブラウザ操作、素早いフィードバックが必要なアプリケーションに特に適しています。

Anthropic は、Haiku 5.5 自体の価格を下げることに加えて、同時に Claude Sonnet 5.5 のキャッシュ読み取り価格も調整しました。キャッシュ読み取り料金は、100 万トークンあたり 0.20 米ドルから 0.10 米ドルに減額され、50% 減少します。 Anthropic は、エージェント タスクはキャッシュ コンテンツを繰り返し読み取ることが多いため、この変更により、ほとんどのエージェント ワークロードにおける Sonnet 5.5 の実際のコストを約 20% 削減できると考えています。

しかし、Haiku 5.5 で最も興味深いのは、低価格モデルとの競合です。 100,000 トークン未満の標準価格に基づくと、Haiku 5.5 はすでに OpenAI の最新の低価格モデルと同じ価格帯にあります。これは、開発者が数百万のトークンのコンテキスト ウィンドウ、適応推論のサポート、強力なコーディング機能を備えたモデルを非常に低いトークン価格で入手できることを意味します。

一方で、100,000 トークンの価格分割線も、開発者が特別な注意を払う必要がある問題になる可能性があります。通常のショート テキスト リクエストの場合、このしきい値は通常影響を及ぼしません。ただし、長いドキュメント処理、複雑なエージェント、複数ラウンドのコード タスク、および同時に大量のコンテキスト入力が含まれるシナリオでは、モデルは簡単に 100,000 トークンに近づくか、それを超える可能性があります。この制限を超えると、投入価格と生産価格の両方が直接 5 倍に上昇します。

これにより、トークンの効率自体もますます重要になります。 AI モデルの価格が下がり続けているため、以前は「100 万トークンあたりのコストはいくらか」だけに注目する必要があった開発者は、同じタスクを完了するためにモデルが消費するトークンの数も考慮する必要があります。単価は低くても、タスクを完了するためにより多くのトークンを生成する必要があるモデルでは、実際の最終コストが常に低いとは限りません。

Anthropic は現在、Claude プラットフォームと Amazon Web Services、Google Cloud、Microsoft Foundry などのチャネルで Haiku 5.5 を提供しており、これを Claude Code にも追加しています。一般ユーザーは、クロードの Web ページ、iOS および Android アプリで Haiku 5.5 を使用できます。

Claude 5.5 製品ライン全体を見ると、Anthropic は比較的明確な分業を形成しています。Opus 5.5 は最も複雑な推論とエージェント タスクを担当し、Sonnet 5.5 はパフォーマンスとコストのバランスを担当し、Haiku 5.5 はさらに高同時実行性、低遅延、低コストのシナリオに重点を置いています。

したがって、Haiku 5.5 の本当の競争力は単なる「安さ」ではなく、より低い単価を使用して、強力な推論とエージェント機能を備えたモデルを大規模な通話シナリオに押し込もうとする Anthropic の試みにあります。ただし、新しいトークン測定方法と 100,000 トークンを超える価格の高騰により、企業は 100 万トークンあたりの公示価格だけを見るのではなく、導入前に実際のワークロードに基づいて総コストを計算する必要があることも意味します。

将来 AI エージェントがさらに普及すると、多数のモデル コールが現在の 1 つの質疑応答から数十、さらには数百の継続的なコールに変化するでしょう。この場合、1回の通話の価格、応答速度、トークンの消費効率がAIシステム全体の運用コストに直接影響します。 Haiku 5.5 はこのような背景のもとにリリースされました。その本当の目標はおそらく、最も強力なクロード モデルになることではなく、Anthropic の AI エコシステム全体で最大のコール量を担う「低コスト エンジン」になることです。

関連タグ

関連記事

コメント

0/500
Captcha (click to refresh)
コメントなし