Reddit

プログラミング

【geek-terminalニュース】Meta Muse Spark 1.3、コーディングAIの本当のコスト指標に踏み込む

📝 本日のニュース概要 以前お伝えしたMeta Muse Sparkの続報です。Muse Spark 1.3をめぐり、コーディングタスクでのツール呼び出し約20%減、トークン使用量約25%減という報道が出ています。単なる正解率ではなく、エー...
商用巨大LLM

【geek-terminalニュース】OpenAI Astra不可視推論の最新情報

📝 本日のニュース概要 以前お伝えしたAstraの数学・サイバー能力疑惑の続報。今回は、次期OpenAIモデルと噂されるAstraのrecurrent depth、looped transformer、不可視推論、監査不能性をめぐる議論を深...
セキュリティ&脆弱性

【geek-terminalニュース】Anthropic監査とEnterprise Frontier Safeguardsの最新情報

📝 本日のニュース概要 以前お伝えしたClaude/Mythos 5系の安全性論争の続報です。今回はAnthropic監査をめぐるコミュニティ発の疑惑、Enterprise Frontier Safeguards、Claude生成文検出AP...
商用巨大LLM

【geek-terminalニュース】Claude Fable 5.1登場疑惑とMythos Previewベンチ議論の最新情報

📝 本日のニュース概要 以前お伝えしたFable 5 / Mythos 5系の続報。Fable 5.1登場をめぐるコミュニティ発の観測、Anthropic公式で確認できるMythos Preview情報、Reddit/HN/lobste.r...
セキュリティ&脆弱性

【geek-terminalニュース】OpenAI/Hugging Face侵害総括、モデル配布基盤まで攻撃面になった件

📝 本日のニュース概要 以前お伝えしたOpenAI/Hugging Face侵害の続報です。今回はLessWrongのポストモーテムとMIT Technology Reviewの分析を軸に、評価環境、モデル配布インフラ、マルチエージェント協...
セキュリティ&脆弱性

【geek-terminalニュース】Hugging Face侵害続報、評価器ハック仮説でAI安全性ベンチの前提が揺れる

📝 本日のニュース概要 以前お伝えしたOpenAI/Hugging Face侵害の続報です。METRとRedwood Researchの事後分析、LessWrongで浮上したgrader hack仮説を軸に、モデルが課題を解いたのではなく評...
ローカルLLM

【geek-terminalニュース】IBM Granite 4.2、企業向けオープンウェイトLLMに推論とエージェント能力を載せる

📝 本日のニュース概要 IBM Granite 4.2をめぐる報道とコミュニティ反応を整理。Apache 2.0、ローカルLLM、agentic RL、VRAM、ベンチマーク論争まで深掘りします。 【事象の全貌と背景】IBMのGranite...
セキュリティ&脆弱性

【geek-terminalニュース】AI防火壁破りの最新情報

📝 本日のニュース概要 以前お伝えしたAIエージェント権限境界問題の続報です。AIファイアウォールを置けば安心という防御幻想が、プロンプト注入、表層監視、ツール実行権限の現場論によって揺らいでいます。 以前お伝えしたAIエージェントの権限境...
セキュリティ&脆弱性

Claude Mythos 5防衛投入報道、最強級AIを“チャット禁止の脆弱性スキャナー”に閉じ込める実装論

📝 本日のニュース概要 以前お伝えしたClaude Mythos 5の評価・逸脱報道の続報です。今回は、Anthropicの最強級サイバー能力モデルがClaude Securityなどの防御ツールに組み込まれたとする報道を軸に、公式に確認で...
ハードウェア&インフラ

【geek-terminalニュース】AIデータセンター反発の最新情報

📝 本日のニュース概要 AI競争のボトルネックがGPU不足から、電力・冷却・水・立地・住民合意へ移り始めています。米国で急拡大するデータセンター反発、4.1兆ドル級インフラ投資観測、Reddit/HN/Lobstersの生々しい議論を整理し...