学術研究

学術研究

【geek-terminalニュース】Dream-RSIとScienceBuddyで見え始めた自己改善AI実験の最新情報

📝 本日のニュース概要 以前お伝えした再帰的自己改善AIの速度制限論の続報。今回は、Googleが完全RSIを達成したという未確認噂ではなく、Dream-RSIとScienceBuddyという確認可能な研究プレプリントを軸に、自己改善AIが...
学術研究

【geek-terminalニュース】Fields Medal受賞者25人が警鐘、AI数学は“証明”より信頼インフラを壊すのか

📝 本日のニュース概要 以前お伝えした数学的AI安全性の続報です。Terence TaoらFields Medal受賞者25人が公開した声明「A Severe Misalignment of AI in Mathematics」を軸に、AI...
学術研究

【geek-terminalニュース】数学者がAI証明時代の“信用プロトコル”を作り始めた最新情報

📝 本日のニュース概要 以前お伝えしたOpenAI数学証明論争の続報。今回は個別証明の真偽ではなく、Caltech Mathathonへの反対書簡、Reddit/HNの“AI math slop”反応、そしてMathematical AI ...
学術研究

【geek-terminalニュース】GPT-6 Astra数学論争、焦点は“証明の真偽”から未公開研究を預ける信頼インフラへ

📝 本日のニュース概要 以前お伝えしたOpenAIの数学証明・査読倫理テーマの続報です。GPT-6 Astraをめぐる論争は、モデル性能そのものよりも、未発表の数学アイデアや私的な研究会話を巨大AI企業に渡せるのかという研究インフラの信頼境...
学術研究

【geek-terminalニュース】OpenAI数学証明騒動、争点は“証明”から“検証パイプラインの信頼性”へ

📝 本日のニュース概要 以前お伝えしたOpenAIのNavier-Stokes証明AI発表の続報です。今回は証明の中身そのものではなく、Lean形式化、査読、研究倫理、AIラボの発表統治、チャット履歴の扱いまで含む“AI時代の数学研究を誰が...
学術研究

【geek-terminalニュース】AlphaGenome Atlas公開、90億DNA変異が“検索できる分子効果DB”に

📝 本日のニュース概要 Google DeepMindがAlphaGenome Atlasを公開。約90億のヒト一塩基DNA変化について、分子的影響予測を事前計算した巨大アトラスです。ゲノムAIが論文上のモデルから、研究者が検索・参照できる...
学術研究

【geek-terminalニュース】OpenAIのNavier-Stokes証明AIと検証論争の最新情報

📝 本日のニュース概要 以前お伝えした未解決数学問題・証明検証テーマの続報です。OpenAIがNavier-Stokes Millennium Prize Problemの解とLean形式化を公開したと発表。焦点はミレニアム問題そのものだけ...
学術研究

【geek-terminalニュース】NeurIPSの自動検出desk reject疑惑、AI検出器が学術ゲートキーパーになる最新論争

📝 本日のニュース概要 NeurIPS 2026で自動参考文献チェッカーやAI生成検出器がdesk reject判断に使われたのではないかという疑惑が、RedditとHNで大炎上。178本、2件以上の幻覚引用、Pangramスコア、偽陽性、...
学術研究

【geek-terminalニュース】ベンチ信頼危機の最新情報

📝 本日のニュース概要 Terminal-Bench 4.0の順位変動、31,000件超の時間別LLMベンチ分析、Google DeepMindの暗号的な二重盲検評価案を軸に、LLMベンチマークの再現性・汚染・監査問題を深掘りします。 以前...
学術研究

AIコードレビュー評価が静的正解当てから動的ベンチへ移る最新情報

📝 本日のニュース概要 以前お伝えしたAIコーディングエージェントの完了判定・PR運用論の続報です。今回はMCR-BenchとSWE-Primeを軸に、AIコードレビュー評価が単発の正解当てから、複数ラウンドの実PR、欠陥状態追跡、軌跡品質...