Reddit

ロボティクス&エージェント

【geek-terminalニュース】NVIDIA AVOがARC-AGI-3満点?公開セット100%説とComputer Use競技場化の最新情報

📝 本日のニュース概要 NVIDIA AVOがARC-AGI-3で100%を取ったという投稿がRedditとHNで話題化。ただし公式に確認できるAVOの実績は、ARC-AGI-3ではなくBlackwell B200上のattention k...
ロボティクス&エージェント

【geek-terminalニュース】自らハーネスを書き換えて成長する自己改良AI「Ornith 1.5」がReddit/LocalLLaMAで話題に

📝 本日のニュース概要 9Bパラメータの小規模モデルながら、タスクを解く過程で自分専用の実行環境(ハーネス)を自ら構築していく「自己改良」型コーディングエージェント、Ornithシリーズの新バージョン「Ornith 1.5」がReddit ...
ロボティクス&エージェント

【geek-terminalニュース】自らハーネスを書き換えて成長する自己改良AI「Ornith 1.5」がReddit/LocalLLaMAで話題に

📝 本日のニュース概要 9Bパラメータの小規模モデルながら、タスクを解く過程で自分専用の実行環境(ハーネス)を自ら構築していく「自己改良」型コーディングエージェント、Ornithシリーズの新バージョン「Ornith 1.5」がReddit ...
ローカルLLM

【geek-terminalニュース】RTX3060を4枚束ねてDeepSeek V4 Flashを爆速稼働させた自作ハック魂

📝 本日のニュース概要 以前お伝えしたDeepSeek V4 Flashのローカル実行高速化ネタの続報です。今回はRTX 3060を4枚束ねてq4_k_xl量子化のDeepSeek-V4-Flashを稼働させ、実測100 tok/sを叩き出...
ロボティクス&エージェント

【geek-terminalニュース】AIエージェント収益圧迫とAPI予算崩壊の最新情報

📝 本日のニュース概要 以前お伝えしたAIエージェント運用費・APIコスト論の続報です。今回は、エージェントを動かすほどAPI課金が利益を食い、さらに「token brokers」という言葉からクレジット再販経済まで見えてくる実務テーマを、...
セキュリティ&脆弱性

【geek-terminalニュース】AI Agent攻撃面の最新情報:ツール接続・権限境界・ポイズニングがそのまま侵入口になる時代

📝 本日のニュース概要 以前お伝えしたプロンプト注入・権限境界・AIサイバー能力の続報です。今回は個別事件ではなく、AI Agentの攻撃面全体を、ツール接続、MCP、外部データ、メモリ、停止条件、最小権限、被害半径の設計論として整理します...
商用巨大LLM

【geek-terminalニュース】Grok 4.6検証、上位モデル級で安い説の最新情報

📝 本日のニュース概要 以前お伝えしたGrok 4.5価格性能トピックの続報です。Grok 4.6がOpenAI上位モデル級に迫り、価格では下回るという主張が出ています。ただし公式・大手メディアの裏付けではGrok 4.6固有のベンチ、価格...
商用巨大LLM

【geek-terminalニュース】Claude不可視ウォーターマーク疑惑の最新情報

📝 本日のニュース概要 Claudeの生成テキストに不可視ウォーターマークが入るという話題を、公式確認の有無、技術的意味、Redditの反応、AI生成物の来歴証明インフラという観点から整理します。 【事象の全貌と背景】Claudeの生成テキ...
商用巨大LLM

【geek-terminalニュース】Claude不可視ウォーターマーク疑惑の最新情報

📝 本日のニュース概要 Claudeの生成テキストに不可視ウォーターマークが入るという話題を、公式確認の有無、技術的意味、Redditの反応、AI生成物の来歴証明インフラという観点から整理します。 【事象の全貌と背景】Claudeの生成テキ...
セキュリティ&脆弱性

【geek-terminalニュース】GPT-5.6 CyberとAstra疑惑、脆弱性探索AIの境界線が再び燃える

📝 本日のニュース概要 以前お伝えしたAIエージェントの権限境界問題の続報です。OpenAIのGPT-5.6 Cyberは防御者向けの脆弱性探索支援モデルとして公式に説明される一方、Astraをめぐる未確認報道ではCritical級サイバー...