要点
AnthropicはOct 7, 2026、小型モデル「Claude Haiku 5.5」を発表しました。同社は、これまでに出した小型モデルの中で最も安く、速く、高性能だと説明しています。要約、データベースへの問い合わせ、分類など、繰り返しの多い作業に向いたモデルです。
コストについては、Haiku 4.5と比べて平均で約75%低いと発表されています。あわせて、Sonnet 5.5のキャッシュ読み取り料金が、100万トークンあたり$0.20から$0.10へ50%引き下げられました。
仕事で変わること
Beforeは、大量の定型処理でも、安全を見て高性能なモデルを選びがちでした。Afterは、定型処理は小型のHaiku 5.5、複雑な判断や難しい実装はSonnet 5.5やOpus 5.5、というように、仕事の重さでモデルを分けやすくなります。
公式は想定する使い方として、要約、コンパクション(長くなった会話の圧縮)、データベースへの問い合わせ、分類のほか、コーディング作業でSonnet 5.5やOpus 5.5の下で動く補助役(サブエージェント)、速さが大事なカスタマーサポートやブラウザー操作を挙げています。
誰が使えるか
Claude Platformでは、モデル名 claude-haiku-5-5 で使い始められます。Amazon Web Services、Google Cloud、Microsoft Azureを含むプラットフォームでも使えると公式ページに書かれています。
料金は100万トークンあたり、10万トークン以下の入力で$0.10、出力で$0.50です。10万トークンを超える場合は、入力$0.50、出力$2.50です。比較のため、Haiku 4.5は入力$1.00・出力$5.00、Sonnet 5.5は入力$2.00・出力$10.00です。
公式ページには、プラン別の提供制限や地域の記載がありません。日本の個別のアカウントで使えるかどうかは、お使いの画面やコンソールで確認してください。
試すには
まず、すでに動いている定型処理の一つを選びます。例は、問い合わせメールの分類や、会議メモの要約です。同じ入力でいまのモデルとHaiku 5.5の両方を動かし、結果の違いと費用を並べて比べます。
結果をそのまま使うのではなく、人が数十件を見比べて、間違いの出方を確かめてください。問題がなければ、重要度の低い処理から切り替えます。複雑な判断が必要な処理は、上位のモデルのままにするほうが安全です。
注意点
約75%という数字は平均です。公式の脚注によれば、10万トークン以下のリクエストは約90%、超えるものは約50%安く、Haiku 4.5のリクエストの90%は前者に当たっていました。新しいトークナイザー(文章を区切る仕組み)のため、同じ作業でわずかに多くのトークンを使う点も計算に含まれています。ご自分の使い方で同じ割合になるとは限りません。
複雑なエージェント型のコーディングには、Sonnet 5.5やOpus 5.5のほうが向いていると公式は説明しています。安全対策も、サイバーセキュリティの面ではHaiku 4.5より厳しい一方、ほかの最近のモデルより緩やかだと書かれています。用途に合わせて確認してください。