学術研究

学術研究

【geek-terminalニュース】Dream-RSIとScienceBuddyで見え始めた自己改善AI実験の最新情報

📝 本日のニュース概要 以前お伝えした再帰的自己改善AIの速度制限論の続報。今回は、Googleが完全RSIを達成したという未確認噂ではなく、Dream-RSIとScienceBuddyという確認可能な研究プレプリントを軸に、自己改善AIが...
学術研究

【geek-terminalニュース】Fields Medal受賞者25人が警鐘、AI数学は“証明”より信頼インフラを壊すのか

📝 本日のニュース概要 以前お伝えした数学的AI安全性の続報です。Terence TaoらFields Medal受賞者25人が公開した声明「A Severe Misalignment of AI in Mathematics」を軸に、AI...
学術研究

【geek-terminalニュース】GPT-6 Astra数学論争、焦点は“証明の真偽”から未公開研究を預ける信頼インフラへ

📝 本日のニュース概要 以前お伝えしたOpenAIの数学証明・査読倫理テーマの続報です。GPT-6 Astraをめぐる論争は、モデル性能そのものよりも、未発表の数学アイデアや私的な研究会話を巨大AI企業に渡せるのかという研究インフラの信頼境...
学術研究

【geek-terminalニュース】OpenAI数学証明騒動、争点は“証明”から“検証パイプラインの信頼性”へ

📝 本日のニュース概要 以前お伝えしたOpenAIのNavier-Stokes証明AI発表の続報です。今回は証明の中身そのものではなく、Lean形式化、査読、研究倫理、AIラボの発表統治、チャット履歴の扱いまで含む“AI時代の数学研究を誰が...
学術研究

【geek-terminalニュース】NeurIPSの自動検出desk reject疑惑、AI検出器が学術ゲートキーパーになる最新論争

📝 本日のニュース概要 NeurIPS 2026で自動参考文献チェッカーやAI生成検出器がdesk reject判断に使われたのではないかという疑惑が、RedditとHNで大炎上。178本、2件以上の幻覚引用、Pangramスコア、偽陽性、...
学術研究

AIコードレビュー評価が静的正解当てから動的ベンチへ移る最新情報

📝 本日のニュース概要 以前お伝えしたAIコーディングエージェントの完了判定・PR運用論の続報です。今回はMCR-BenchとSWE-Primeを軸に、AIコードレビュー評価が単発の正解当てから、複数ラウンドの実PR、欠陥状態追跡、軌跡品質...
学術研究

【geek-terminalニュース】MathCode登場、数学AIは証明する知性なのか超高速な探索装置なのか

📝 本日のニュース概要 MathCodeは自然言語の数学問題をLean 4定理へ変換し、形式証明を試みる端末型AIコーディングエージェントです。永続Lean REPL、Mathlib補題探索、LSP診断修復、並列プランナーを軸に、数学AIの...
学術研究

OSRewardが突きつけるComputer Use評価標準化の最新情報

📝 本日のニュース概要 以前お伝えしたComputer Useエージェント評価環境監査の続報です。OSRewardを中心に、GUI操作AIを本番投入する前に「成功判定そのもの」を疑う流れを整理します。 【事象の全貌と背景】以前お伝えしたCo...
学術研究

【geek-terminalニュース】Claudeの“未発話の内的表現”を読むJacobian Lens/J-spaceの最新情報

📝 本日のニュース概要 Anthropicの研究「Verbalizable Representations Form a Global Workspace in Language Models」を軸に、Claude内部のJ-space、Ja...
学術研究

【知的パラダイムシフト】天才テレンス・タオが予言する「AIによる数学の分業化」──一人の脳内に閉じた純粋数学が、協調型モジュールコードへ変貌する日

📝 本日のニュース概要 以前お伝えした「OpenAIによるエルデシュ予想の反証」という歴史的偉業のその先へ。フィールズ賞学者テレンス・タオ氏が、AIによって数学の歴史上初めて「分業」がもたらされると提唱し、コミュニティで激しい議論が巻き起こ...