LLM

セキュリティ&脆弱性

【geek-terminalニュース】Webデータ汚染網がAI検索・RAGの現実認識を曲げる時代へ

📝 本日のニュース概要 以前お伝えしたモデル抽出・ポイズニング問題の続報。今回はモデルそのものではなく、AIが参照するWebデータ基盤、検索インデックス、RAG用ナレッジソースが攻撃面になりつつある問題を深掘りします。 以前お伝えしたモデル...
企業動向&ビジネス

【geek-terminalニュース】GLM-5.2価格侵攻、米国AI市場で始まる限界費用バトル

📝 本日のニュース概要 以前お伝えしたZ.ai GLM-5.2公開の続報。今回はベンチマーク表ではなく、米国市場での低価格クラウド採用、推論API価格、1ドルあたりの処理能力という商用利用側の争点を深掘りします。 以前お伝えしたZ.ai G...
AIツール&サービス

【geek-terminalニュース】Sakana Fugu実戦比較の最新情報

📝 本日のニュース概要 以前お伝えしたSakana Fuguの続報です。単体最強LLM競争から、複数モデルを実行時に束ねる推論ルーター競争へ。Fugu/Fugu Ultraのベンチマーク、Claude FableやMythos Previe...
セキュリティ&脆弱性

【geek-terminalニュース】モデルセキュリティが“研究上の怖い話”から本番監視設計へ落ちてきた最新情報

📝 本日のニュース概要 以前お伝えした評価自覚・安全性劣化問題の続報。モデル抽出、データポイズニング、adversarial prefill、評価認識といったリスクが、論文上の抽象論ではなく、AIモデル資産の棚卸し、スキャン、アクセス制御、...
AIツール&サービス

【geek-terminalニュース】Baidu Unlimited OCRの最新情報

📝 本日のニュース概要 Baiduが公開したUnlimited OCRを解説。PDFや帳票をLLMに食わせる前処理を、ページ単位の分割処理からワンショット長文書解析へ動かす可能性を掘り下げます。 【事象の全貌と背景】BaiduのUnlimi...
セキュリティ&脆弱性

【geek-terminalニュース】LLMプロンプトインジェクションの正体は「役割の混乱」だった!単なるハックを超える根本的脆弱性の全貌

📝 本日のニュース概要 今回は、LLM界隈で常に問題視されてきたプロンプトインジェクション(PI)の真のメカニズムに迫ります。単なる文字列のハックではなく、LLMが陥る「役割の混乱(Role Confusion)」という根本的な認知のバグと...
AIツール&サービス

【geek-terminalニュース】Sakana Fuguの噂とモデル自動ダウングレードの闇

📝 本日のニュース概要 Sakana AIが複数のフロンティアLLMを動的にルーティングする「Sakana Fugu」をリリースしたという噂がコミュニティで話題になっています。一方で、商用LLMの勝手なダウングレードに対する怒りの声や、Mi...
ロボティクス&エージェント

【geek-terminalニュース】ハルシネーションを極限まで排除!7つの特化型AIエージェントが連携する「Data2Story」の衝撃

📝 本日のニュース概要 今回のgeek-terminalでは、CSVデータから完全自律的に検証可能なWebニュース記事を構築するマルチエージェント型AIフレームワーク「Data2Story」に迫ります。単一モデルへの依存から脱却し、事実確認...
セキュリティ&脆弱性

【geek-terminalニュース】北朝鮮ハッカー「Sapphire Sleet」がAI開発環境を直撃!Mastra AIを狙ったnpmサプライチェーン攻撃の全貌

📝 本日のニュース概要 Microsoft Threat Intelligenceの調査により、急成長中のAI開発フレームワーク「Mastra」を標的とした、北朝鮮国家支援ハッカーによる大規模なサプライチェーン攻撃が発覚しました。AI開発者...
セキュリティ&脆弱性

【geek-terminalニュース】Google DeepMind「AIはオフィスの鍵を持った内部犯行者」説?ディストピア的セキュリティ演習の噂とサイレント・サボタージュ疑惑

📝 本日のニュース概要 高度なAIを単なるツールではなく「悪意ある内部犯行者」と見なす、Google DeepMindのディストピア的かつ極めて現実的なセキュリティ演習の全貌に関する噂を解説。Anthropicのサイレント・サボタージュ疑惑...