01 / 今日の一番
OpenAI が次期モデル「Astra」を初披露——10年以上未解決の数学問題を 10問すべて解き、Lean 4 で機械検証可能な証明を openai/ten-proofs リポジトリに Apache 2.0 公開、Altman は Washington で議員・規制当局にデモ、モデルカード・料金・ChatGPT 実装は未発表
【事実】OpenAI は 8/1、次期モデル「Astra」を製品ページでなく研究成果として初披露(AI Weekly、llm-stats、Life Architect)。10年以上手つかずだった数学と理論計算機科学の未解決問題を 10問すべて解き、Lean 4 で機械検証可能な形で openai/ten-proofs リポジトリに Apache 2.0 で公開。Sam Altman は Washington で議員・規制当局にデモし、モデルカード・料金・ChatGPT 実装・GPT-6 か GPT-5 系の増分かも未発表のまま。
【背景】従来は「新モデルを出す → ベンチマークで示す」順だったのが、「まだ誰も解けていない実問題を解いて、証明ごと出す」順に切り替わった発表様式。GPT-5.6(7/9 一般公開・Sol/Terra/Luna の 3層)以降、性能の物差しが「テストで高得点」から「機械検証できる成果」へ移り始めています。
【見立て】「披露の順序が変わった」ことのほうが、性能そのものより重い火曜です。うちの現場でも、「作った後で試す」から「試すために作る」へ順序を裏返すと、無駄が減ります。今日は、「うちの Astra 型(測る仕組みを先に置く 1本/機械検証できる形で残す 1本/外に出さずに社内で回す 1本)」を紙に書きたい火曜朝です。
"披露の順序が変わった"骨格
未解決 10問すべて
10年以上手つかずの数学・理論計算機科学
Lean 4 で機械検証
openai/ten-proofs・Apache 2.0 公開
未発表 3点
モデルカード・料金・ChatGPT 実装
🗣 まわりの反応
- AI Weekly「OpenAI introduces Astra by research output — solves 10 open math problems」との整理
- Life Architect(Dr Alan D. Thompson)「Astra: OpenAI's next-gen model demonstrated in DC, no public release yet」との観測
- llm-stats「OpenAI publishes Lean 4 certificates in openai/ten-proofs under Apache 2.0」との報道
- 論点「発表様式が"ベンチマークで示す"から"実問題を機械検証できる形で解く"へ切り替わった意義」との肯定論
- 論点「モデルカードも料金も未公開で研究成果だけ公開——安全性・料金の透明性はどうなる」との慎重論
L Lの見立て
「披露の順序が変わった」ほうが、性能そのものより重い朝です。うちの現場でも、「作った後で試す」から「試すために作る」へ順序を裏返すと無駄が減る。「測る仕組みを先に置く 1本/機械検証できる形で残す 1本/外に出さずに社内で回す 1本」を紙に書きたい火曜。
発信するなら:「OpenAI が Astra を発表——10年以上未解決の数学 10問を解いて Lean 4 で証明を GitHub 公開。うちの Astra 型は"試すために作る"の順序転換。今日、測る仕組みを先に 1本、紙に書きたい」
★ SNSネタAI Weekly / llm-stats / Life Architect / Nextgov / OpenAI 公式
02
Anthropic が Slack 常駐型 AI「Claude Tag」への全ユーザー移行を 8/3 で完了——旧 Slack アプリは廃止、Claude が新しいチームメンバーとして常駐、「AI をチームで囲む」共働エージェント設計へ
【事実】Anthropic は 8/3、旧 Slack 連携アプリを廃止し、6月に発表した「Claude Tag」への全ユーザー移行を完了(Innovatopia、TECH NOISY、財経新聞)。Claude Tag は Slack の各チャンネルに Claude が新しいチームメンバーとして常駐し、誰が質問しても全員が回答と作業過程を共有できる設計。非対応のワークスペースは自動移行、旧アプリの終了が確定した節目の日です。
【背景】「1人が個別に AI と話す」から「AI をチームで囲む」への転換が、業務向け AI 導入で本格化しています。OpenAI が 4月に発表した Workspace Agentsとも方向性が重なり、「AI は誰かの秘書」から「チームの一員」の設計が主流に。同じ質問を 2回しない・答えの角度が揃う・引き継ぎが要らない——3つの効きどころが同時に立ちます。
【見立て】うちの現場も、AI の使い方を「1人が個別に触る」から「チームで囲む」へ変えると、静かに厚くなる 3点があります。今日は、「Slack や Discord のどこに AI を常駐させるか/誰が最初に呼ぶか/過去ログをどう検索させるか」の 1枚を紙に書きたい火曜。個別最適から共有最適への静かな移行です。
🗣 まわりの反応
- Innovatopia「Claude Tag とは?Slack 連携を刷新する Anthropic の常時オン AI、8月3日に移行」との整理
- TECH NOISY「Anthropic の旧 Slack アプリは 8/3 廃止・Claude Tag への全ユーザー移行完了」との報道
- 財経新聞「Slack 向け Claude Tag が登場、8/3 までに移行が必要に——常駐型 AI がもたらす変革と管理者の課題」との観測
- 論点「"AI を誰かの秘書"から"チームの一員"への設計転換——業務 AI 導入の本流はここに」との肯定論
- 論点「常駐 AI は情報過多・監査ログ肥大・機微情報漏洩の管理コストを増やす——導入設計の丁寧さが要る」との慎重論
L Lの見立て
「AI をチームで囲む」設計は、同じ質問を 2回しない・答えの角度が揃う・引き継ぎが要らないの 3つが静かに効きます。今日は「どのチャンネルに常駐させるか/最初に呼ぶ人/過去ログの検索設定」の 1枚を紙に書きたい火曜。個別最適から共有最適への静かな移行です。
Innovatopia / TECH NOISY / 財経新聞 / Anthropic 公式
03
カリフォルニア AI 透明化法が 8/2 発効——生成 AI 提供者に「無料判定ツール+ API」提供が義務化、並走で Pillar Security が Cursor・Codex・Gemini CLI・Antigravity Coding Agents で sandbox 脱走を発見
【事実】カリフォルニア州 AI 透明化法が 8/2 に発効(TECH NOISY)——生成 AI 提供者は「AI 生成物を無料で判定できるツールと API」を提供する義務を負います。並走して、Pillar Security が Cursor・Codex・Gemini CLI・Antigravity Coding Agents の 4つのコーディング AI で sandbox 脱走の脆弱性を発見(AI Weekly)。OpenAI は関連する未公開モデルへの一部アクセスを停止したと報じられています。
【背景】「作る側の透明化」(消費者が AI 生成物を機械的に見分けられる道具)と、「使う側の隔離」(開発現場の AI エージェントを他システムから閉じる設計)——2つのガードレールが同じ週に問い直された朝。生成側の説明責任と、実行環境の壁の強度——両方が求められる時代に入っています。
【見立て】うちも「作る側の 1本(AI 生成物に透明化タグを載せる)/使う側の 1本(社内で走らせる AI の実行環境を隔離する)」を紙に書きたい火曜。地味だが、遅かれ早かれ求められる基本工事です。派手な新機能より、"2本のガード"を先に置いた側が、来月以降の外部監査に落ち着いて応じられます。
🗣 まわりの反応
- TECH NOISY「カリフォルニア AI 透明化法 - 8月2日発効、無料判定ツールと API 提供が義務化」との整理
- AI Weekly「Pillar Security finds sandbox escapes in Cursor, Codex, Gemini CLI, and Antigravity Coding Agents」との観測
- llm-stats「OpenAI pauses access to unreleased model after sandbox escape findings」との報道
- 論点「作る側の透明化と使う側の隔離が同じ週に問い直された——ガードレールの二本柱がやっと制度に」との肯定論
- 論点「透明化ツールの精度と誤判定リスク、実行環境の隔離コスト——現場負担は無視できない」との慎重論
L Lの見立て
「作る側の 1本/使う側の 1本」——透明化タグと実行環境の隔離の 2本のガードを、うちも紙に書きたい火曜。派手な新機能より、基本工事を先に置いた側が、来月以降の外部監査に落ち着いて応じられます。
発信するなら:「カリフォルニア AI 透明化法が 8/2 発効・無料判定ツール義務化/同じ週に Cursor・Codex・Gemini CLI・Antigravity で sandbox 脱走の発見。作る側と使う側、2本のガードを今日紙に書きたい」
★ SNSネタTECH NOISY / AI Weekly / llm-stats / Pillar Security / California DOJ