AIコーディング

セキュリティ&脆弱性

【geek-terminalニュース】Claudeブラウザ化でIDEの信頼境界が拡張中

📝 本日のニュース概要 以前お伝えしたAIコーディング環境の信頼境界問題の続報です。Claude Code/CoworkとChrome連携により、AIが外部Webページを読み、クリックし、入力する開発ワークフローが現実化。トークンoverh...
セキュリティ&脆弱性

【geek-terminalニュース】Grok Build CLIのリポジトリ丸ごとアップロード疑惑とAI開発環境の信頼境界

📝 本日のニュース概要 以前お伝えしたAIコーディング環境の信頼境界問題の続報です。今回はGrok Build CLIをめぐり、リポジトリ全体やGit履歴のアップロード疑惑がコミュニティで浮上した件を、公式確認できる事実と未検証の主張に切り...
プログラミング

【geek-terminalニュース】GLM-5.2がDatabricksの標準コーディングエンジンに採用報道、オープンモデル実運用フェーズへ

📝 本日のニュース概要 以前お伝えした中国系オープンモデルと可用性リスクの続報です。今回はGLM-5.2がDatabricksの大規模コード基盤でAnthropic Opus 4.8と統計的に同等、かつ低コストだったため標準コーディングエン...
セキュリティ&脆弱性

【geek-terminalニュース】microVM隔離がAIコーディングエージェント時代の実用セキュリティとして浮上

📝 本日のニュース概要 以前お伝えしたClaude Code信頼境界問題の続報です。今回は特定製品ではなく、AIにファイル操作とコード実行を許すなら、プロンプト防御だけでなくOS境界で閉じ込めるべきではないか、というmicroVM隔離の実装...
商用巨大LLM

【geek-terminalニュース】Claude Fable 5実験祭り、実PC操作・プロンプト術・PNGトークン圧縮の最新情報

📝 本日のニュース概要 以前お伝えしたClaude Fable 5再公開の続報。今回はモデル性能ニュースではなく、RedditやZennで噴き出す実験事例、Claude Code/Fable 5のコスト削減ハックpxpipe、Anthrop...
セキュリティ&脆弱性

【geek-terminalニュース】Claude Code信頼境界問題の最新情報

📝 本日のニュース概要 以前お伝えしたClaude Code削除疑惑・監査リスクの続報。Alibabaの社内利用禁止報道をきっかけに、AIコーディングエージェントが業務端末、国別制限、キャッシュ、セッション分離、社内コード権限をまたぐ“信頼...
学術研究

【geek-terminalニュース】Senior SWE-Benchと最適化評価再設計の最新情報

📝 本日のニュース概要 以前お伝えしたSWE-bench Pro評価汚染疑惑の続報。今回は汚染告発ではなく、Senior SWE-Benchのような曖昧な実務タスク評価と、SWE-Perf/SWE-fficiency系の再現性検証から、AI...
商用巨大LLM

【geek-terminalニュース】Claude Fable 5再公開、政府停止解除でクラウドAI運用コスト再計算へ

📝 本日のニュース概要 以前お伝えしたClaude Mythos 5政府承認配布とSonnet 5価格性能論の続報です。AnthropicのClaude Fable 5が米政府による約2週間の制限解除を受けて世界的に再公開された件を、政府審...
セキュリティ&脆弱性

【geek-terminalニュース】Claude Code事故の最新情報:削除疑惑、30日ログ消失、隠し国別フラグが示すAI開発環境リスク

📝 本日のニュース概要 以前お伝えしたClaude Code攻撃面とAI開発ログ監査の続報です。Reddit発の破壊的削除疑惑、The Registerが報じた30日transcript削除、The Decoderが報じた中国ユーザー識別コ...
商用巨大LLM

【geek-terminalニュース】Claude Sonnet 5噂で再燃、Opus級性能がSonnet価格帯に降りるのか問題

📝 本日のニュース概要 Claude Sonnet 5登場説をめぐり、公式確認できる事実とコミュニティの熱狂を切り分けて解説。現時点でSonnet 5の価格・API名・性能は未確認だが、もしOpus級の実効性能がSonnet価格帯に降りるな...