01 / 今日の一番
OpenAIのSol登場でモデル戦争再燃——AnthropicがFable 5の同梱窓を再々延長、1週間で2度目
【事実】OpenAIは7/9にGPT-5.6ファミリー(Sol・Terra・Luna)を投入、上位Solは$5/$30 per 100万トークンで登場しました。Anthropicは対抗してClaude Fable 5の同梱アクセスを7/19まで再々延長(1週間で2度目)。有料プラン利用者は追加費用なしでFable 5に触れ続けられます。
【背景】ベンチマークは真っ二つ——Agents' Last Exam(55分野のプロ業務評価)でSolが53.6、Fable 5を+13.1差で抜く一方、SWE-bench Proは64.6%でFable 5が優勢。価格はSolが半額でも、モデルごとに推論トークン数が違うため実質コストは並走します。
【見立て】モデル戦争は"どれが最強か"より"どこで使うか"の勝負に静かに軸足を移しました。ベンチの1点差より、自分の仕事に効く相性を見る。派手な数字より、「自分の1本のタスクに、どのモデルが一番静かに効いたか」を淡々と数える人が、次の並び順を決める朝です。
Sol vs Fable 5 の骨格
53.6
Sol・Agents' Last Exam(+13.1差)
64.6%
Sol・SWE-bench Pro(Fable優勢)
🗣 まわりの反応
- Forbes「Anthropicの再々延長はSol対抗の防衛戦。同梱窓を"広告"として使う判断」との整理
- Simon Willison「Sol・Terra・Lunaの3段構成は使い分けを促す設計。用途で刻む時代へ」との評価
- 論点「ベンチはベンダー選定に。Agents ExamはSol、SWEはFable——両勝ちなしの並走」との慎重論
L Lの見立て
強い側はいつも"1点勝ち"を主張します。でも実務で効くのは、「自分のタスクに、どのモデルが一番静かに刺さったか」という現場の実感です。ベンチ表を睨むより、月曜の自分の仕事1本を、両モデルに投げて比べてみる。1回の比較は、10本のベンチ記事より重い——選ぶ側の眼が育ちます。
発信するなら:「モデル戦争は"最強"より"用途分け"へ。自分の1本のタスクで比べた人が、選ぶ眼を育てる」
★ SNSネタForbes / Simon Willison / MarkTechPost / Lenny's Newsletter
02
GPT-5.6ファミリーとChatGPT Work——OpenAIが"3段の選び分け"と"仕事場"で反撃
【事実】OpenAIはSol(上位)・Terra(中位)・Luna(軽量)の3段構成で7/9に投入、同時にChatGPT Work——非技術者向けの業務モード——を出荷しました。狙いは明白で、AnthropicのClaude Coworkにストレートに対抗する布陣です。
【背景】3段の狙いは「軽く速く安いLunaで日常、Terraで実務、Solで難所」という利用者側の使い分け。Programmatic Tool CallingがResponses APIに載り、エージェント設計の裾野が広がります。「一本槍」から「三本柱」へ、選択肢の設計思想も変わりました。
【見立て】強い1モデルより、"選び分けられる3本"が実務では効きます。私たちの現場でも、AIに全部同じ問いを投げるのではなく、「軽い問い・普通の問い・重い問い」の三択に分ける癖を。月曜の朝、机の脇に3行のマトリクスを書くだけで、AIとの月間支出が変わります。
🗣 まわりの反応
- MarkTechPost「Programmatic Tool CallingでResponses APIが強化。エージェント設計の敷居が下がる」との評価
- Techtimes「Solはコーディング速度でFableを上回るが、ベンチ選択で結果が動く」との慎重論
- 論点「ChatGPT WorkとCowork、機能はほぼ横並び。ブランド習慣で選ばれる時代へ」との観測
L Lの見立て
選択肢が3つある道具箱は、持ち歩く重さより、迷わない速さで元を取ります。「全部Fable 5に投げる」でも「全部Solに投げる」でもなく、問いの重さで刻む癖を。月曜の朝、自分の1週間のAIの使い方を"三択"で見直す——それだけで、支出も精度も同時に整います。
MarkTechPost / OpenAI / Techtimes / Simon Willison
03
Claude for Governmentβ+Microsoft 365書き込み対応——Anthropicが"守り"と"生活"の両面で刻む
【事実】AnthropicはClaude for Governmentのβ提供を開始し、FedRAMP準拠のエンタープライズ・セキュリティ機能を実装。同時にMicrosoft 365への書き込み対応——メール作成・カレンダー操作・OneDrive/SharePointの作成更新——を追加しました。年換算売上は$47BでOpenAI($25-33B)を上回っています。
【背景】「政府+大企業+日常業務」の三方向で刻む戦略。Sol登場でモデル単体の話題が沸騰する裏側で、Anthropicは「AIが仕事の中に住む」場所を先に押さえる動きに切り替えました。売上の逆転は、その"設置場所勝負"の成果でもあります。
【見立て】「AIを使う」から「AIが自分の隣に住む」へ、業務の景色が変わり始めました。私たちの現場でも、"すごい応答を引き出す"より、"AIをどこに座らせるか"の設計が効いてきます。月曜の朝、自分の仕事の"どの椅子"にAIを置くかを、一度決めておきたい朝です。
"設置場所"戦略の骨格
Gov β
Claude for Government(FedRAMP対応)
M365
書き込み対応(メール・OneDrive他)
🗣 まわりの反応
- Fortune「Anthropicが売上でOpenAIを上回った。B2B深耕の戦略が実を結んだ」との整理
- 実務家「M365書き込み対応は"AIが手を動かす"入口。Copilotとの棲み分けが焦点」との声
- 論点「政府β開放は日常業務との距離感が課題。ガバナンスの詰めが試される」との慎重論
L Lの見立て
優れたAIは、"魔法の応答"ではなく、「自分の仕事の隣にいて、静かに手を動かす存在」になります。設計の勝負は、モデルの派手さより設置場所。月曜の朝、自分の椅子の隣に、どのAIを座らせるか——それを決められる側が、次の1年の生産性を、静かに握ります。
発信するなら:「AIは"使う"から"隣に住む"へ。自分の仕事の"どの椅子"に座らせるかで、1年が変わる」
★ SNSネタAnthropic / Fortune / MIT Technology Review / Releasebot