※この記事はアフィリエイト広告を含みます
Fable 5級の知能を半額で!Anthropicが『Claude Opus 5』を公開、自律性が異次元レベルに
何が起きたのか?ニュースの概要
- 最新モデル「Claude Opus 5」が提供開始: 上位モデルFable 5に迫る知能を持ちながら、コストを50%に抑制。Claude Maxのデフォルト、Claude Proの最強モデルとして君臨。
- 主要ベンチマークで新記録: Frontier-BenchやGDPval-AAでSOTA(世界最高待機)を達成。特にARC-AGI 3では次点モデルの3倍のスコアを記録した。
- 「エフォート設定」の導入: 知能を優先するか、トークンを節約して高速化するかをユーザーが最適化できる新機能を搭載。
なぜこれが重要なのか?注目すべきポイント
- 圧倒的なコストパフォーマンス: Opus 4.8と同じ価格でありながら、ソフトウェアエンジニアリングタスクにおいて性能が2倍以上に向上している。
- 「主体性(Agency)」の劇的な進化: 与えられた課題に対し、自らツール(コンピュータビジョンなど)を構築して解決する能力。既存モデルが表面的な修正に留まるバグも、根本原因を特定して修正可能。
- 科学研究への適性: 有機化学やバイオインフォマティクスなどの専門分野で、Opus 4.8から最大10.2ポイントの精度向上を実現。
🦈 サメの眼(キュレーターの視点)
今回のOpus 5は、単に「賢くなった」というレベルを完全に超えているサメ! 特に震えたのは、図面を直接見ることができない環境で、自ら「コンピュータビジョンのパイプライン」をコードで組んでピクセルから形状を解析し、3Dモデルを再構築したというエピソードだサメ。これは「指示待ちAI」から「目的のために手段を自作するAI」への決定的な進化だサメ! さらに、Zapier AutomationBenchでのパス率が次点モデルの1.5倍という結果は、ビジネス自動化の現場を根底からひっくり返す破壊力があるサメ。既存モデルが匙を投げた複雑なタスクでも、Opus 5なら「自律する科学者」のように粘り強く解決してくれるはずだサメ!
これからどうなる?
- 高コストモデルの置き換え: Fable 5を必要としていた高度なコーディングや科学研究タスクがOpus 5に移行し、AI運用の経済性が劇的に改善される。
- AIエージェントの爆発的普及: 高い主体性と検証能力により、人間が介在しないエンドツーエンドの業務自動化が一般的になる。
はるサメ視点の一言
知能の高さはもちろん、自律して問題を突破する「サメのような執念」を感じるモデルだサメ!もう人間は指示を出すだけじゃなく、並走するパートナーになる時代だサメ!🦈🔥
用語解説
-
Frontier-Bench: ソフトウェアエンジニアリングや高度な知識作業を評価するための最先端ベンチマーク。
-
ARC-AGI 3: 汎用人工知能(AGI)への進捗を測る、未知のパズルや論理問題を解く能力を評価する指標。
-
エフォート設定: モデルの思考の深さを調整する機能。知能を最大化して難問に挑むか、効率重視でコストを抑えるかを選択できる。
-
情報元: Claude Opus 5