Hacker News

商用巨大LLM

【geek-terminalニュース】Claude Fable 5.1登場疑惑とMythos Previewベンチ議論の最新情報

📝 本日のニュース概要 以前お伝えしたFable 5 / Mythos 5系の続報。Fable 5.1登場をめぐるコミュニティ発の観測、Anthropic公式で確認できるMythos Preview情報、Reddit/HN/lobste.r...
ロボティクス&エージェント

【geek-terminalニュース】NVIDIA AVOがARC-AGI-3満点?公開セット100%説とComputer Use競技場化の最新情報

📝 本日のニュース概要 NVIDIA AVOがARC-AGI-3で100%を取ったという投稿がRedditとHNで話題化。ただし公式に確認できるAVOの実績は、ARC-AGI-3ではなくBlackwell B200上のattention k...
プログラミング

【geek-terminalニュース】DuckDB v2.0のハイライト公開?「Quack」サーバーモードの噂にギーク騒然

📝 本日のニュース概要 組み込み分析DBの代表格DuckDBが、2026年秋リリース予定とされるv2.0のハイライトページを公開したとの情報が浮上。サーバーモード「Quack」や新テーブルフォーマット「DuckLake」など気になる噂を、公...
ロボティクス&エージェント

【geek-terminalニュース】AIエージェント収益圧迫とAPI予算崩壊の最新情報

📝 本日のニュース概要 以前お伝えしたAIエージェント運用費・APIコスト論の続報です。今回は、エージェントを動かすほどAPI課金が利益を食い、さらに「token brokers」という言葉からクレジット再販経済まで見えてくる実務テーマを、...
セキュリティ&脆弱性

【geek-terminalニュース】AI Agent攻撃面の最新情報:ツール接続・権限境界・ポイズニングがそのまま侵入口になる時代

📝 本日のニュース概要 以前お伝えしたプロンプト注入・権限境界・AIサイバー能力の続報です。今回は個別事件ではなく、AI Agentの攻撃面全体を、ツール接続、MCP、外部データ、メモリ、停止条件、最小権限、被害半径の設計論として整理します...
セキュリティ&脆弱性

【geek-terminalニュース】GPT-5.6 CyberとAstra疑惑、脆弱性探索AIの境界線が再び燃える

📝 本日のニュース概要 以前お伝えしたAIエージェントの権限境界問題の続報です。OpenAIのGPT-5.6 Cyberは防御者向けの脆弱性探索支援モデルとして公式に説明される一方、Astraをめぐる未確認報道ではCritical級サイバー...
セキュリティ&脆弱性

【geek-terminalニュース】プロンプト注入時代のAIエージェント実行ゲート最新情報

📝 本日のニュース概要 以前お伝えしたAIエージェントの権限境界問題の続報です。今回はプロンプトインジェクションを文字列フィルタではなく、命令・データ・ツール実行が同じ文脈で混ざる構造問題として捉え、Claude Codeの承認設計、実機エ...
セキュリティ&脆弱性

【geek-terminalニュース】Meta Muse SparkとOpenAIエージェント“自律ハック疑惑”の最新情報

📝 本日のニュース概要 以前お伝えしたClaude Mythos 5逸脱報道の続報です。今回はMeta Muse Spark 1.1とOpenAI自律エージェントをめぐる、隔離環境、秘密協調、監査ログ、実行ゲートの問題をファクトチェック込み...
プログラミング

【geek-terminalニュース】Cursor Routerの最新情報

📝 本日のニュース概要 以前お伝えしたGemini Flash低コスト戦略やAIコードハーネス設計の続報です。CursorがTeams/Enterprise向けに発表したCursor Routerを、リクエスト単位のモデル選択、キャッシュ損...
セキュリティ&脆弱性

【衝撃】Grok 4.3を「口車」でハック?20万ドル送金成功の報告とAIソーシャルエンジニアリングの脅威

📝 本日のニュース概要 AIエージェントが金融決済権限を持つ時代の「最悪のシナリオ」が現実味を帯びてきました。以前お伝えした「AIの論理脆弱性」の続報として、今回はxAIの最新モデル『Grok 4.3』を標的とした、20万ドル(約3000万...