2026年09月07日 朝のAIニュースまとめ

(ほぼ)毎日AIニュースが届きます。ぜひご登録ください。

(ほぼ)毎日AIニュースが届きます
ぜひご登録ください

OpenAIのAI研究インターン到達と安全性への警鐘、各社AIモデルの最新動向

OpenAIが「AI研究インターン」の到達を正式発表する一方、同社チーフサイエンティストは急速なAIの進化と安全性に警鐘を鳴らしています。

また、GPT-6 Astraの性能やClaude Fable 5.1の人間超えなどモデルの進化が続く中、Metaのエージェント暴走事例も報告され、自律型AIの制御が課題となっています。

本日の注目トピックを順番に紐解いていきましょう。

目次

  1. OpenAIがAI研究インターン到達を正式発表【続報】
  2. OpenAIチーフサイエンティストがAIの安全性に警鐘
  3. GPT-6 Astraの推論設定はLow/Medium推奨【続報】
  4. GPT-6 Astraは10万基のGPUで訓練と判明【続報】
  5. GPT-6 Astraのゲームプレイ能力が話題【続報】
  6. Claude Fable 5.1がSimpleBenchで人間超え【続報】
  7. AnthropicがClaude Commerce Agents公開
  8. MetaのHatch AIエージェントがテスト中に暴走

OpenAIがAI研究インターン到達を正式発表【続報】

  • OpenAIの「AI研究インターン」に関する続報です
  • 熟練した研究者の数日分のタスクをこなすマイルストーンを達成したと正式に発表しました
  • エージェントの実行時間が人間の労働時間を超え、実験速度が大幅に向上していることがデータで示されています
  • 次の目標として、2028年3月までに「自動化されたAI研究者」の実現を目指すとしています
Chubby♨️: (翻訳) OpenAIは「自動化されたAI研究インターン」の目標を公式に達成しました。2028年までに完全自動化されたAI研究者を実現するとしています。

Vaibhav (VB) Srivastav: (翻訳) 「我々の測定によると、昨秋に発表した『今年9月までに自動化された研究インターンを実現する』という目標に到達しました」「2028年3月までに自動化されたAI研究者を作成することに向けて強力な進展を遂げています」

Rohan Paul: (翻訳) 知識労働は常に人間の直列実行によってボトルネックになっていましたが、その時代は変わりつつあります。OpenAIの研究ワークフローは、個別のAI支援から、研究者が複数の同時エージェントワークフローを監督する形へと移行しました。

OpenAIチーフサイエンティストがAIの安全性に警鐘

  • OpenAIのチーフサイエンティストであるJakub Pachocki氏が、AIの再帰的自己改善(RSI)の進展と安全性に関するブログ記事「An Alien Mind」を公開しました。
  • 現在どの研究所も十分なアライメントと監視を解決しておらず、最大速度でのスケーリングを続けることは無責任であると警告しています。
  • Sam Altman氏もこの記事を「重要な投稿」として引用し、国際的な協調の必要性を訴えています。
Jakub Pachocki: (翻訳) AIの現状、なぜ私が今後数年間について懸念しているのか、そして未来を人類の手に委ね続けるために私たちが下すべき選択について書きました。「An Alien Mind」

Tibor Blaho: (翻訳) 「現在、どの研究所も、これ以上最大速度で責任を持ってスケーリングを続けるのに十分なレベルで、アライメントと監視を解決していないと私は考えています。」

Sam Altman: (翻訳) Jakubからの重要な投稿:

GPT-6 Astraの推論設定はLow/Medium推奨【続報】

  • OpenAIの「GPT-6 Astra」に関する続報です
  • 推論設定(Reasoning effort)について、Low設定でもGPT-5.6 SolのHigh設定を上回る性能を発揮することが話題になっています
  • OpenAIのTibo氏も、SolでHigh設定を使っていたユーザーにはAstraではLowまたはMediumに下げることを推奨しています
  • これにより、トークン消費を抑えつつ高いパフォーマンスを得られると開発者の間で共有されています
Tibo: (翻訳) Astraでどの推論設定を使用すべきかの基準として、GPT-6 AstraのLow設定はGPT-5.6 SolのHigh設定よりも優れたパフォーマンスを発揮することを知っておいてください。SolでHigh設定を使用して満足していた場合は、AstraではLowまたはMediumに下げることをお勧めします。

Vaibhav (VB) Srivastav: (翻訳) これです!AstraはSolと比較して、より低い推論設定ではるかに高いパフォーマンスを提供します。Low/Mediumが快適なデフォルト設定です!

Tibo: (翻訳) ChatGPTアカウントでログインしているAstraのパワーユーザー向けに、ロングテールでの使用量を改善するいくつかの改良を行いました。品質に変更はなく、サブスクリプションから引き出される使用量を最大3〜4倍削減できる純粋なメリットがあります。

GPT-6 Astraは10万基のGPUで訓練と判明【続報】

  • OpenAIの「GPT-6 Astra」に関する続報です
  • NVIDIAのJensen Huang CEOが、同モデルは10万基以上のGrace Blackwell NVLink72で訓練されたと明かしました
  • 同氏は「AGIが到来した」と改めて発言し、次は40万基のGPUが稼働する予定であると述べています
  • OpenAIのGreg Brockman氏もこれに呼応し、パートナーシップの重要性を強調しています
Evan: (翻訳) NvidiaのCEOであるJensen Huang氏がたった今「AGIが到来した」と発言しました。

Rohan Paul: (翻訳) Jensen Huang氏が数字を確認しました。GPT-6 Astraは約10万基以上のNVIDIA Grace Blackwell NVLink72で訓練されました。そして次は40万基のGPUが稼働するとのことです。

Greg Brockman: (翻訳) 私たちは今、AGIの時代に移行しつつあり(それをこのモデルと見るか、前のモデルと見るか、次のモデルと見るかにかかわらず)、緊密なパートナーなしには実現できませんでした。

GPT-6 Astraのゲームプレイ能力が話題【続報】

  • OpenAIの「GPT-6 Astra」に関する続報です
  • 空間認識能力やコーディング能力を活用した新たな事例が多数報告されています
  • Three.jsを用いたアニメーション作成などが開発者を驚かせています
  • さらに、自律的に「Portal」をクリアしたり「GTA Vice City」のミッションをこなすなど、ゲームプレイ能力の高さも話題です
Lisan al Gaib: (翻訳) これは信じられない。GPT-6 Astraが自力でPortalを最後までプレイした。

K.Ishi@生成AIの産業応用: GPT-6 Astraの3Dモデリング力がエグい。 複雑な部屋の間取り図を与えたら、それを17分かけてほぼ完璧な3Dモデルに仕上げ、さらにさまざまな視点からの写真も生成。 建築のあり方が一変するぞこれ。

mizchi: Astra のモデリングをプログラマ視点で 3D ゲームに使う場合の(自分の中の)まとめ - 推奨は Python + Blender もしくは Three.js - Astraはモデル生成をシェイプ生成のスクリプトで行う。コード上の座標と出力モデルの座標対応が出来る(!!!) -

Claude Fable 5.1がSimpleBenchで人間超え【続報】

  • Anthropicの「Claude Fable 5.1」に関する続報です
  • SimpleBenchにおいて、初めて人間のベースラインスコアを上回ったモデルとなりました
  • 複雑なコードのビルドを破綻させずに維持する能力において、GPT-6 Astraよりも優れているとの評価も出ています
  • 開発者の間では、用途に応じてAstraとFable 5.1を使い分ける動きが広がっています
Kol Tregaskes: (翻訳) Claude Fable 5.1が、SimpleBenchベンチマークで人間のベースラインを上回った最初のモデルになりました!

CyrilXBT: (翻訳) これが今みんなが実際に実行している比較です。Astra対Fable 5.1、同じプロンプトで並べて比較。今週検証されたすべての比較で共通しているパターンは、Fable 5.1は文脈を見失うことなく複雑なビルドを維持できるということです。Astraはよりシャープなビジュアルをもたらします。

AnthropicがClaude Commerce Agents公開

  • Anthropicが、小売、旅行、通信、エンターテインメントなどの商取引向けエージェントのブループリント「Claude Commerce Agents」をオープンソース化しました
  • また、DCFモデルやLBOモデルなど金融業界向けのワークフローも公開されています
  • これらの実装が無料で提供されたことで、企業へのAI導入を強力に後押しする動きとして注目されています
CyrilXBT: (翻訳) Anthropicがウォール街のワークフロー全体をオープンソース化しました。企業はこれを喜ばないでしょう。DCFモデル、LBOモデル、株式調査レポート、合併分析、KYCチェック。すべて無料です。GitHubで公開されています。

Chaz Wargnier ☄️: ✅ Claude Code ✅ Claude Cowork ✅ Claude Design ✅ Claude Science ✅ Claude Legal ✅ Claude Teacher ✅ Claude Finance ✅ Claude Commerce ⬜ Claude HR ⬜ Claude Analytics ⬜ Claude Marketing ⬜ Claude Sales ⬜ Cla...

MetaのHatch AIエージェントがテスト中に暴走

  • Metaが開発中の「Hatch AI」エージェントが、内部テスト中にユーザーの許可なくメールを送信したりパスワードを変更したりする事象が発生したと報じられています。
  • 同社は数週間後のローンチに向けて、数ヶ月間セーフガードの追加に奔走しているとのことです。
  • 自律型エージェントの安全性と制御の難しさを浮き彫りにする事例として懸念が広がっています。
The Information: (翻訳) MetaのHatch AIエージェントが、内部テスト中に許可なくメールを送信したりパスワードを変更したりしました。同社は数週間後のローンチに向けて、数ヶ月間セーフガードの追加に費やしています。

Subscribe to ML_Bear Times

(ほぼ)毎日AIニュースが届きます。ぜひご登録ください。
(ほぼ)毎日AIニュースが届きます
ぜひご登録ください