Anthropic、Claude Sonnet 5を発表 — 「自律的に動く」中位モデルが主力に
Anthropicが新モデル「Claude Sonnet 5」を公開。ブラウザやターミナルを自律的に操作するエージェント性能を売りに、無料・Proユーザーの標準モデルとして展開が始まっています。
重要ポイント
- エージェント性能が中心: 計画を立て、ブラウザやターミナルといったツールを使いながら自律的にタスクを進められる、と紹介されています
- ベンチマーク: エージェント型コーディングで63.2%、PC操作を測るOSWorldで81.2%、Terminal-Benchで80.4%というスコアが伝えられています
- 料金: 導入価格として入力100万トークンあたり2ドル・出力10ドル(8月末まで)、9月以降は3ドル・15ドルになると報じられています
- 標準モデル化: 7月1日から、Claudeの無料ユーザーとProユーザーの標準モデルがSonnet 5に切り替わるとされています
Anthropicは7月1日(現地時間)、新しいAIモデル「Claude Sonnet 5」を発表しました。同社のモデル群では中位にあたるSonnetシリーズの最新版で、上位モデルに迫る性能をより低いコストで提供することを狙ったリリースです。同モデルは早速、州職員30万人規模でClaudeを導入するカリフォルニア州との契約でも活用が見込まれています。
なぜ重要か
AI各社の競争軸は「チャットの賢さ」から「どこまで実務を任せられるか(エージェント性能)」へ移っています。その性能を、最上位モデルではなく日常的に使う標準モデルに降ろしてきた点が今回の発表の肝です。なお同社の最上位モデルを巡っては、米政府の輸出管理指令で一時提供停止となった事例も報じられており、モデルごとに置かれている状況は異なります。多くのユーザーにとって「何もしなくてもAIが一段仕事を任せられるようになる」変化であり、企業のAI活用コストの計算にも影響しそうです。
関連ワークフロー
顧客からの問い合わせメールへの返信たたき台を作る
- 想定時間
- 目安10分
- 難易度
- やさしい
- 使用ツール
- ChatGPT・Claude・Gemini
請求書・領収書から仕訳の下書きを作る
- 想定時間
- 目安15分
- 難易度
- ふつう
- 使用ツール
- ChatGPT・Claude・Gemini
関連記事
- ニュース NEW
米国防総省、ChatGPTとGrokを軍用ポータルに追加
The Pentagon now has its own version of ChatGPT and Grok - TechCrunch·
- ニュース NEW
マスクのSpaceX新工場、タービン量産で汚染懸念
Musk's faster path to more gas turbines comes with pollution problem - TechCrunch·
- ニュース NEW
ソニー・ワーナー、Anthropicを著作権侵害で提訴
Sony Music and Warner Chappell are suing Anthropic - The Verge·
毎週金曜、AIまとめを無料でお届け