geek-terminal

ロボティクス&エージェント

【geek-terminalニュース】MetaのAIエージェント失速と本番デバッグ不能問題の最新情報

📝 本日のニュース概要 以前お伝えしたAIエージェント運用・完遂型AIの続報です。MetaのAIエージェント開発が想定より遅いと報じられた件を起点に、本番エージェントがなぜ壊れると追えないのか、Observability、診断、状態管理、ツ...
セキュリティ&脆弱性

【geek-terminalニュース】AI脆弱性ハンティングで報告キュー爆増、セキュリティ運用のボトルネックが露呈

📝 本日のニュース概要 AIモデルが脆弱性を見つける時代、問題は発見能力だけではありません。CVE報告、重複判定、深刻度評価、PoC検証、パッチ配布まで、下流のセキュリティ運用が詰まり始めています。Project Glasswing、Cla...
ローカルLLM

【geek-terminalニュース】DeepSeek DSparkでローカルLLM推論高速化が実運用検証フェーズへ

📝 本日のニュース概要 以前お伝えしたDeepSeek-V4/DSparkとDFlash・llama.cpp高速化の続報です。DeepSeekのDSpark、DeepSeek-V4-Flash、llama.cppパッチ、RTX 5090/R...
学術研究

【geek-terminalニュース】Senior SWE-Benchと最適化評価再設計の最新情報

📝 本日のニュース概要 以前お伝えしたSWE-bench Pro評価汚染疑惑の続報。今回は汚染告発ではなく、Senior SWE-Benchのような曖昧な実務タスク評価と、SWE-Perf/SWE-fficiency系の再現性検証から、AI...
企業動向&ビジネス

【geek-terminalニュース】OpenAI政府5%持分案の最新情報

📝 本日のニュース概要 以前お伝えしたGPT-5.6 Sol政府審査・AIアクセス主権論争の続報です。OpenAIが米政府に5%持分を与える案を協議していると報じられ、AI APIアクセス、国家関与、資本構造、開発者リスクが一気に接続され始...
商用巨大LLM

【geek-terminalニュース】Claude Fable 5安全ルートの最新情報

📝 本日のニュース概要 以前お伝えしたClaude Fable 5再公開の続報です。今回は再公開そのものではなく、安全分類器、利用枠、Claude Codeの短縮システムプロンプト、そして商用LLMをどうルーティングして使うべきかという運用...
セキュリティ&脆弱性

【geek-terminalニュース】Claude Code事故の最新情報:削除疑惑、30日ログ消失、隠し国別フラグが示すAI開発環境リスク

📝 本日のニュース概要 以前お伝えしたClaude Code攻撃面とAI開発ログ監査の続報です。Reddit発の破壊的削除疑惑、The Registerが報じた30日transcript削除、The Decoderが報じた中国ユーザー識別コ...
学術研究

【geek-terminalニュース】Meta Brain2Qwerty v2、非侵襲MEGで脳から文章復元へ

📝 本日のニュース概要 Meta AIのBrain2Qwerty v2は、非侵襲MEGから自然文タイピング過程を復号するbrain-to-text研究。61%単語精度報道と公式情報を照合し、BCIが医療デモから人間I/O研究へ近づく意味を深...
商用巨大LLM

【geek-terminalニュース】Claude Fable 5再公開、政府停止解除でクラウドAI運用コスト再計算へ

📝 本日のニュース概要 以前お伝えしたClaude Mythos 5政府承認配布とSonnet 5価格性能論の続報です。AnthropicのClaude Fable 5が米政府による約2週間の制限解除を受けて世界的に再公開された件を、政府審...
ハードウェア&インフラ

【geek-terminalニュース】LongCat-2.0公開、“NVIDIAなし巨大MoE”がAIインフラ競争を揺らす最新情報

📝 本日のニュース概要 Meituanが公開したLongCat-2.0を深掘り。1.6T総パラメータ、約48Bアクティブ、35T tokens超、AI ASIC superpods、1M contextという公式情報を軸に、“NVIDIAな...