AI

AIツール&サービス

【geek-terminalニュース】ChatGPT・Claude・Grok同時不安定化疑惑とAI冗長化の最新情報

📝 本日のニュース概要 以前お伝えしたClaude系アクセス可用性問題の続報です。ChatGPT、Claude、Grokが同時期に不安定化したとのコミュニティ報告を軸に、公式裏付けの限界、Reddit/HNの反応、ローカルLLM・マルチモデ...
ロボティクス&エージェント

【geek-terminalニュース】Code-as-Worldの最新情報:動画をMuJoCo物理プログラムへ変える噂の世界表現

📝 本日のニュース概要 MirroSのCode-as-Worldとして紹介されている新パラダイムを解説。動画を眺める世界モデルではなく、再実行できるMuJoCo物理プログラムへ変換するという発想のインパクト、裏付けの弱さ、コミュニティ反応の...
学術研究

【geek-terminalニュース】ベンチ信頼危機の最新情報

📝 本日のニュース概要 Terminal-Bench 4.0の順位変動、31,000件超の時間別LLMベンチ分析、Google DeepMindの暗号的な二重盲検評価案を軸に、LLMベンチマークの再現性・汚染・監査問題を深掘りします。 以前...
セキュリティ&脆弱性

【geek-terminalニュース】AI攻撃未遂と安全性テスト崩壊の最新情報

📝 本日のニュース概要 以前お伝えしたAIセキュリティ評価と権限境界問題の続報です。Reutersが報じたmyNetworkへの悪意あるプルリクエスト未遂、The Decoderが紹介した安全性ベンチマークの弱点、LessWrongで議論さ...
ハードウェア&インフラ

【geek-terminalニュース】AIデータセンター反発の最新情報

📝 本日のニュース概要 AI競争のボトルネックがGPU不足から、電力・冷却・水・立地・住民合意へ移り始めています。米国で急拡大するデータセンター反発、4.1兆ドル級インフラ投資観測、Reddit/HN/Lobstersの生々しい議論を整理し...
学術研究

【geek-terminalニュース】SSOG-AttentionはSDPAの壁を壊すのか?長距離リコール問題に刺さる“怪しいが重要”な新注意機構

📝 本日のニュース概要 SDPAの全トークン対スコアリングを、少数の分離可能ガウス分布で置き換えるというSSOG-Attention案がコミュニティで話題に。公式な論文・実装・大手確認は未確認ながら、線形注意のlong-range reca...
セキュリティ&脆弱性

【geek-terminalニュース】隠し思考窃取の最新情報

📝 本日のニュース概要 閉鎖LLMの非公開Chain-of-Thoughtは本当に隔離されているのか。Stolen Thoughtsをめぐる研究・報道から、hidden reasoning trace、thinking tokens、API...
セキュリティ&脆弱性

【geek-terminalニュース】隠し思考窃取の最新情報

📝 本日のニュース概要 閉鎖LLMの非公開Chain-of-Thoughtは本当に隔離されているのか。Stolen Thoughtsをめぐる研究・報道から、hidden reasoning trace、thinking tokens、API...
プログラミング

【geek-terminalニュース】Agentic開発環境はCLIから“実行OS”へ進化するのか

📝 本日のニュース概要 OpenChamberのWalkthrough、Shepherdのfork/replay/revert構想、そしてAIコーディング環境のセキュリティ論争を、裏付けの確度を分けながら深掘りします。 【事象の全貌と背景】...
学術研究

【geek-terminalニュース】DeepMind WeatherNextが台風・ハリケーン予測のリードタイムを1日伸ばす最新情報

📝 本日のニュース概要 Google DeepMindのWeatherNext系AIモデルが、熱帯低気圧の進路・強度・風構造予測で大きな改善を示し、災害対応のリードタイムを平均約1日伸ばせる可能性が示されました。AIが“それっぽい予報”を出...