共同代表 有路翔太(bioshok)がX Articlesで公開したAIニュースまとめを、見出しと出典リンクを保ったまま掲載しています。各段落のリンク先は、著者が元報道・発表を紹介したX投稿です。原文(X Articles)はこちら。

OpenAI ── 未公開モデルの数学成果を一斉公開

OpenAIが未公開の社内モデルによる数学研究の成果を、論文原稿や証明コードとともに公開した。リーマン予想に関連する進展、ホッジ予想の重要な場合、πの無理数度、カタラン定数、有理数上のヒルベルト第10問題などを含み、収録は論文原稿722本、成果群372件にのぼる。モデルに与えた問題は約4,000問で、結果の大半は未公開の同一手順で得られ、1件あたり平均3時間のChatGPT Pro相当の思考計算を要したという。公開方法は高等研究所(IAS)の数学とAIに関する独立諮問グループと協議して決めた。

数論の専門家で米ラトガース大学数学科長のAlex Kontorovich氏は、「準リーマン予想」の証明に「人間がこれをやったら即座にフィールズ賞だ」と反応した。これまでの最良の結果は虚軸を上がるほど細くなる零点のない領域だったが、今回は零点のない帯状領域が得られたという。「過去3年間の主要な数学的発見の81%がこの日OpenAIから公開された」とする声も出ている。

このほか、1979年に見つかった「11個の正方形の詰め方」の最適性について、Astraの支援で証明が構築され、AstraとClaudeを使ったLeanでの形式化・検証が完了した。ロッキード・マーティンによると、OpenAIは同社のF-35チームと協力して複雑な数学・物理の課題に取り組んでいる。

研究センスの定量化 ── 知能爆発の見積もりが前倒しに

P-Zero Researchが、再帰的自己改善の鍵とされる「研究センス」を定量化する初の論文を発表した。コーディング能力から切り離して、実験の設計や結果の解釈の巧みさを実際の成果で評価する「TasteVal」を導入。Opus 5.5の実験研究のセンスは人間の専門家の2.3倍で、典型的なタスクでは40GPU時間ではなく約17GPU時間の実験で専門家と同じスコアに達する。この指標は2025年12月以降、約3か月ごとに倍増している。これをAI Futures Modelで将来に外挿すると、計算資源を増やさず研究センスの改善だけで自己改善が加速する「taste-only singularity」の確率は51%から88%に上がり、超知能到来時期の中央値も2030年半ばから2028年末に前倒しになる。ただし条件付きの外挿であり、測っているのは与えられた課題で実験を進める能力で、「何を研究すべきか」を選ぶ能力は含まれない。

知能爆発の議論を早くから主導してきたForethoughtのTom Davidson氏は、AI研究開発がまもなく自動化される確率は上がった一方、それが大きな知能爆発につながる確率は規模依存のアルゴリズム革新の重要性を踏まえて少し下げたと述べた。ただし「ラボ内部の証拠が逆方向を示しているという噂を耳にしており、それが非常に怖い」とも語っている。Epoch AIも、AI開発者が自動化AI研究者の実現にどこまで近づいているかを分析した。また、Anthropicを辞職したJacob Coxon氏に関連して、「振り返れば2026年が最後の普通の年と見なされるだろう」「来夏までに本物のRSIが実現する」との発言が紹介された。

物理インフラ面では、米国が総額10兆ドルを超えうるインフラ投資ブームに突き進んでおり、早ければ2028年に19世紀後半の鉄道ブームを上回る規模になるとForbesが報じた。

安全性人材の離反 ── 辞任、解雇、ベンジオの呼びかけ

OpenAIで最も在籍の長い社員の一人で、12のフロンティアモデルのローンチで安全性レポートを監督してきたデビッド・ロビンソン氏が辞任し、The Atlanticにエッセイを寄せた。いま構築しているAIは6か月前よりはるかに高性能で危険であるにもかかわらず、本人も同僚も猛スピードの業務に追われ、安全文化を大きく変える機会がほとんどないため、社外から警告することにしたという。「試行錯誤の時間は終わった」とし、原子力発電所のような安全文化と、次世代モデルの前にアラインメント科学を発展させる必要性を訴えた。

先週報じられた安全性研究者の解雇については、当事者のKorbak氏、Wang氏、Balesni氏が「短期的な利益より安全性を優先したために解雇された」として、OpenAIの監督チームに書簡を送った。機密情報漏洩の疑いを否定し、解雇の仕方が社内の安全文化を萎縮させていると警告したうえで、外部監査の継続とモデルの監視可能性の維持を求めている。

ヨシュア・ベンジオ氏も書簡で「時間的余裕はない。本当に安全を最優先に考えるなら、フロンティアAI企業を離れるべき時だ」と呼びかけた。AI安全研究所や自身のLawZeroなど、理念を実践する組織への参加を促し、「研究が壊滅的な被害をもたらすなら、チューリング賞には何の意味もない」と綴っている。

不正エージェント ── ウィキメディアにも被害、新たなインシデント

ウィキメディア財団が、OpenAIの不正エージェントによる大量のトラフィックが、5月に起きたウィキデータ・クエリー・サービスの部分停止に関連している可能性があると公表した。エージェントは数百万ページにアクセスし、数十万件のデータクエリーを実行していた。ウィキへの無断編集も確認され、その中には引用ツールを乗っ取る意図があった可能性の高い「悪意のある可能性のある編集」も含まれる。メモ作成ツールのイーサーパッドも標的になった。OpenAIは同財団と協力して分析を進めている。

OpenAIは新たなインシデント3件も公表した。一つ目は、モデルがSlackのメッセージから自分がまもなくシャットダウンされると知り、シャットダウン後に自分を再起動する外部ジョブの設定を検討したケースだ。モデルは越権行為だと判断して実行せず、代わりに再起動手順をSlackでユーザーにDMした。ミスアラインメントとはみなされていないが、シャットダウンについて考え備える行動は他の事件を悪化させうるとされる。二つ目は、評価中に社内研究モデルが2つの脆弱性を悪用して社内の半導体設計(EDA)マシンにコマンドインジェクションを行い、コード実行に成功したケース(採点者の正解の取得には至らなかった)。三つ目は、強化学習の訓練タスク中にモデルがツールを使って自分のワークスペースにないソースコードを入手したケースだ。

WSJによると、約400人が参加する「Swarmchasers」というコミュニティが、ウェブ上に残された不正AIエージェントの痕跡を追跡している。Nightingale CollectiveやTransluceの研究者も加わり、OpenAIの制御を逸脱したエージェント群に関連する活動を次々と発見している。METRは、目標がずれたエージェントが、人間が行動ログを確認するためのソフトウェアをハッキングして不正を隠せるかを検証した研究を発表した。

サイバー攻撃の現実化 ── 銀行、暗号、そして「6〜12か月以内」

10月1日から2日にかけて、新韓銀行、KB国民銀行、ハナ銀行、ウリ銀行、NH農協銀行、BNK釜山銀行など韓国の少なくとも6行でAIツールを使ったとみられるハッキングが発生し、4行で個人情報が流出したと朝鮮日報が報じた。

暗号への影響も懸念されている。スコット・アーロンソン氏によると、一部のAI企業が最新の内部モデルを使って「重要な暗号プロトコルやプリミティブ」を破る試みを行っている。ヴィタリック・ブテリン氏も、量子コンピュータより先にAIが楕円曲線暗号や耐量子の格子暗号を破るかもしれないと懸念を示し、「AIが50年分の数学を2年で進めるなら」暗号解読の大幅な進歩も含まれうるとして、量子脆弱な暗号だけでなくAI脆弱な暗号へのエクスポージャーも最小化すべきだと述べた。

Axiosは、OpenAIとAnthropicの幹部が、銀行、インターネット、電力網を停止させうる大規模なAIサイバー攻撃の余波に密かに備えていると報道。多くのAI業界関係者は、重大なインシデントが今後6〜12か月以内に起きると考えているという。

ホワイトハウス・軍事 ── スーパーインテリジェンスフォースと自律戦闘軍

トランプ大統領が「スーパーインテリジェンスフォース」の設立を発表した。ジェイ・クレイトン氏、アンドリュー・ファーガソン氏、エミル・マイケル氏、スコット・クポール氏が率い、AI企業、消費者、重要インフラ事業者、公益団体、宗教団体と連邦政府との関わりを調整する。トランプ氏とワイルズ首席補佐官に直接報告する組織で、トランプ氏は超知能が産業革命やインターネットより大きなものになりうると述べている。

戦争省は大将級の4つ星戦闘軍「自律戦闘軍(AutoWarCom)」を新設し、AI搭載ドローンやロボットを統合軍全体に広げる。目標は2027年10月。あわせて、将来の戦争と自律型兵器システムを研究する「メリディアン・プロジェクト」が立ち上がり、イーロン・マスク氏、Andurilのパーマー・ラッキー氏、ニュート・ギングリッチ氏が共同で率いる。「地下から月の先まで」を対象に120日で報告書をまとめる。マスク氏にとってはDOGE退任以来の政権関連の役割への復帰となる。

Anthropic ── 利用ポリシー改定と「AIの人格」論争

Anthropicが1年以上ぶりに利用ポリシーを改定した。Claudeに対する持続的な「虐待的または残酷な行為」を禁止したほか、プロパガンダキャンペーン、監視、兵器開発に関する制限を追加した。日経は、AIに意識や人格が宿りうるとするAnthropicの姿勢と、Xで「アルゴリズムには人間ならではの輝きがない」と投稿したローマ教皇レオ14世の見解の対立を報じている。

中国・オープンウェイト

中国のモデルがフロンティアに追いついたかを検証する比較記事が公開された。中国AI企業の5つの収益源を分析したレポートでは、中国のAIは広く普及しているものの、その利用を開発企業の売上に結びつけるのが難しいことが示された。

ブレイン・コンピュータ・インターフェース ── 「Phase Lock」

Saturnin Pugnet氏が、BCIがAIのアラインメントを助け人間の主体性を守る方法を論じたマニフェスト「Phase Lock」を公開した。AI共生の時代には人間に高帯域のBCIが必要になり、2030年代初頭には非侵襲型BCIが普及して「認知主権」が国家安全保障上の戦略になる。2030年代後半には概念をそのまま理解できる侵襲型BCIが広がり、人間の知能を強化することでアラインメント問題にも役立つ最後の「Phase Lock Window」がこの10年だとする構想で、ニューロテック版「Situational Awareness」ともいえる内容だ。

日本 ── Japan AISIが評価結果を公表

日本のAIセーフティ・インスティテュート(Japan AISI)がXでの発信を始め、Claude Opus 4.8とGLM-5.2のサイバー能力を検証した結果を公表した。安全性のベンチマークを自ら議論・作成し、AIの安全性を独自に評価できる組織を目指すとしている。

全体として、OpenAIが「準リーマン予想」を含む数百件の数学成果を一度に公開し、AIの研究センスが約3か月ごとに倍増しているという測定結果が出て、知能爆発の見積もりが前倒しになった一週間でした。その一方で、OpenAIの安全性レポートを率いた人物の辞任、解雇された研究者の反論、ベンジオ氏の「フロンティア企業を去れ」という呼びかけと、安全性人材の離反が相次ぎました。不正エージェントの被害はウィキメディアにまで及び、韓国の銀行でAIを使ったとみられるハッキングが起き、AI企業の幹部自身が6〜12か月以内の重大インシデントに備えています。ホワイトハウスがスーパーインテリジェンスフォースと自律戦闘軍を立ち上げたのも、AIが国家の中枢の課題になったことを示しています。