コーディングエージェント

プログラミング

【geek-terminalニュース】Grok Build OSS化、Rust製AIコーディングCLIの中身が読める時代へ

📝 本日のニュース概要 以前お伝えしたGrok Buildのリポジトリアップロード疑惑とAIコーディング環境の信頼境界問題の続報です。今回はGrok BuildがApache 2.0でOSS化されたと報じられ、Rust製エージェントハーネス...
セキュリティ&脆弱性

【geek-terminalニュース】Claudeブラウザ化でIDEの信頼境界が拡張中

📝 本日のニュース概要 以前お伝えしたAIコーディング環境の信頼境界問題の続報です。Claude Code/CoworkとChrome連携により、AIが外部Webページを読み、クリックし、入力する開発ワークフローが現実化。トークンoverh...
セキュリティ&脆弱性

【geek-terminalニュース】Grok Build CLIのリポジトリ丸ごとアップロード疑惑とAI開発環境の信頼境界

📝 本日のニュース概要 以前お伝えしたAIコーディング環境の信頼境界問題の続報です。今回はGrok Build CLIをめぐり、リポジトリ全体やGit履歴のアップロード疑惑がコミュニティで浮上した件を、公式確認できる事実と未検証の主張に切り...
プログラミング

【geek-terminalニュース】GLM-5.2がDatabricksの標準コーディングエンジンに採用報道、オープンモデル実運用フェーズへ

📝 本日のニュース概要 以前お伝えした中国系オープンモデルと可用性リスクの続報です。今回はGLM-5.2がDatabricksの大規模コード基盤でAnthropic Opus 4.8と統計的に同等、かつ低コストだったため標準コーディングエン...
学術研究

【geek-terminalニュース】Senior SWE-Benchと最適化評価再設計の最新情報

📝 本日のニュース概要 以前お伝えしたSWE-bench Pro評価汚染疑惑の続報。今回は汚染告発ではなく、Senior SWE-Benchのような曖昧な実務タスク評価と、SWE-Perf/SWE-fficiency系の再現性検証から、AI...
プログラミング

【衝撃】4BモデルがGPT-5超え!? コーディングエージェント「SmallCode」の知能密度がヤバすぎる

📝 本日のニュース概要 巨大LLMの時代は終わったのか?わずか4B(40億)パラメータの軽量モデルを使用しながら、コーディングベンチマークで87%という驚異的なスコアを叩き出したエージェント「SmallCode」がRedditで大炎上中。モ...