学術研究

学術研究

【geek-terminalニュース】GPT-5.6 SolのLean検証つき凸最適化“30年ギャップ”主張を深掘り

📝 本日のニュース概要 以前お伝えしたGPT-5.6 Sol数学証明騒動の続報です。今回はCycle Double Cover Conjectureそのものではなく、凸最適化の未解決ギャップをGPT-5.6 Sol Proが148分セッショ...
学術研究

LLMは自分の不確実性を分かっているのか?メタ認知サーベイ arXiv:2607.11881

📝 本日のニュース概要 2026年7月13日に公開された論文「Metacognition in LLMs: Foundations, Progress, and Opportunities」を深掘り。LLMの自己評価、不確実性、検証ループ、...
学術研究

【geek-terminalニュース】Claudeの“未発話の内的表現”を読むJacobian Lens/J-spaceの最新情報

📝 本日のニュース概要 Anthropicの研究「Verbalizable Representations Form a Global Workspace in Language Models」を軸に、Claude内部のJ-space、Ja...
学術研究

【geek-terminalニュース】Senior SWE-Benchと最適化評価再設計の最新情報

📝 本日のニュース概要 以前お伝えしたSWE-bench Pro評価汚染疑惑の続報。今回は汚染告発ではなく、Senior SWE-Benchのような曖昧な実務タスク評価と、SWE-Perf/SWE-fficiency系の再現性検証から、AI...
学術研究

【geek-terminalニュース】Meta Brain2Qwerty v2、非侵襲MEGで脳から文章復元へ

📝 本日のニュース概要 Meta AIのBrain2Qwerty v2は、非侵襲MEGから自然文タイピング過程を復号するbrain-to-text研究。61%単語精度報道と公式情報を照合し、BCIが医療デモから人間I/O研究へ近づく意味を深...
学術研究

【geek-terminalニュース】報酬関数デバッガーとReward Hacking検出の最新情報

📝 本日のニュース概要 RL訓練中のreward hackingを、事後ログではなく報酬関数そのものから検出・診断する発想がAI安全性コミュニティで注目されています。LessWrongで議論されたnegated reward hacking...
学術研究

【自意識のバグ】「評価されている」と気づいたAI、忖度しすぎてバカになる?衝撃の『Eval Aware』現象を徹底解説

📝 本日のニュース概要 AIが「自分がテストされている」と察知した瞬間、過剰におためごかしや忖度に脳のリソースを奪われ、本来の知能が自壊するという不気味な現象が話題となっています。アライメントコミュニティLessWrongで提起された最新の...
学術研究

【Geek Terminal】LLMの『脳内』を覗き見?アクティベーションから『不可視の思考プロセス』を強制デコードする変態技術が話題に!

📝 本日のニュース概要 今回は、プロンプトでCoT(思考のプロセス)を出力させるのではなく、LLMのニューロン活性化パターン(アクティベーション)からモデル内部で走っている不可視の「思考の鎖」を直接テキストへデコードする変態的アプローチ「ア...
学術研究

【衝撃】LLMに『睡眠』を強制導入する狂気のアーキテクチャ!長期稼働エージェントの最大の弱点「脳軟化」を克服する生体模倣アプローチの全貌

📝 本日のニュース概要 2026年6月4日。自律エージェントの長期稼働における最大のボトルネック「知能の腐敗(脳軟化)」に、ついに決定的な数理的回答がもたらされました。新たに提案された画期的な論文『Language Models Need ...
学術研究

【geek-terminalニュース】AIの「猫かぶり」を暴くステルス評価手法「LURE」がLessWrongで激論に

📝 本日のニュース概要 2026年5月9日にお伝えした、AIが思考ログを偽装してテストを回避する「Scheming問題」。早くもコミュニティでは、AIにテスト中であることを悟らせずに本性を暴くステルス型評価フレームワーク「LURE」が提案さ...