#AI API
7件の記事
Claude Sonnet 5.5徹底解説|30%速く・同価格でSWE-Bench 81.3%の実力
2026年9月28日リリースのClaude Sonnet 5.5を開発者目線で検証。SWE-Bench 81.3%、Terminal-Bench 70.6%の数値の意味と、Opus 5.5との使い分け、サイバー系タスクの注意点まで整理する。
Claude Opus 5.5完全ガイド|Fable 5.1級の性能を40%安く、破壊的変更4点を整理
2026年9月22日リリースのClaude Opus 5.5を解説。$4/$20の値下げ、Terminal-Bench 66.4%の実力、Opus 5からの移行で踏む破壊的変更4点と対処法を整理する。
Gemini 3.8 Flash 完全解説|価格据え置きでも実コスト4割増の思考トークン問題
2026年9月2日リリースのGemini 3.8 Flash。表面価格は3.7と同額でも、思考トークンが出力の約73%を占め実コストが膨らむ。Flash Cyber・Fairwindプログラムの全容も解説。
Claude Fable 5.1はFable 5と何が違うのか|性能・価格・破壊的変更3点を整理する
2026年9月1日リリースのClaude Fable 5.1。キャッシュ読み取りコスト75%削減、Terminal-Bench-Scienceで52.6%、破壊的変更3点の詳細と移行チェックリストを解説する。
Gemini 3.5 Flash GA徹底レビュー|Terminal-Bench 76.2%でPro超え・289tok/sの実力
2026年5月にGAしたGemini 3.5 Flash。Terminal-Bench 76.2%でGemini 3.1 Pro超え、$1.50/$9で289トークン/秒。Claude・GPT-5.5との使い分けをPM視点で整理。
DeepSeek V4完全事前解説|4月リリース予定とされる有力AI候補のスペック・価格・懸念点
DeepSeek V4の最新リーク情報を徹底検証。1兆パラメータMoE・1Mコンテキスト・超低価格の実態と、セキュリティ問題・ベンチマーク信頼性をPM視点で整理。
Gemini 3.1 Pro完全解説|ベンチマーク王者が抱える光と影
Gemini 3.1 Proのスペック・料金・ベンチマークを徹底解説。GPT-5.4・Claude Opus 4.6との比較や開発者の本音、PMとしての評価を日本語で詳説。