RAG

ロボティクス&エージェント

【geek-terminalニュース】MCP無状態化とToken Saverの最新情報

📝 本日のニュース概要 以前お伝えしたMCPとPDF/RAGをめぐるエージェント基盤論の続報です。MCP新仕様のステートレス化、企業運用への影響、Token Saver型ローカルハイブリッドRAGによるPDFトークン削減ハックを整理します。...
ハードウェア&インフラ

【geek-terminalニュース】NVIDIA Nemotron 3 Embedの最新情報

📝 本日のニュース概要 NVIDIAがオープンな埋め込みモデル群「Nemotron 3 Embed」を公開。8B BF16チェックポイントのRTEB首位、1B BF16/NVFP4の実運用向け設計、RAG・コード検索・エージェント記憶への影...
セキュリティ&脆弱性

【geek-terminalニュース】本番AIエージェントの注入耐性不足、外部コンテンツ時代の最新防御論

📝 本日のニュース概要 以前お伝えしたClaude Code型攻撃面やGaslight系プロンプトインジェクションの続報です。今回は特定製品ではなく、外部Web、文書、メール、RAG、MCPを読む本番AIエージェント一般に広がる注入耐性不足...
AIツール&サービス

【geek-terminalニュース】Mistral OCR 4でPDF RAGの入口が構造化レイヤー化する最新情報

📝 本日のニュース概要 以前お伝えしたBaidu Unlimited OCRの続報。今回はMistral OCR 4を中心に、OCRが単なる文字起こしから、引用付きJSON、構造化出力、RAG投入前の文書理解レイヤーへ進化している流れを深掘...
セキュリティ&脆弱性

【geek-terminalニュース】Webデータ汚染網がAI検索・RAGの現実認識を曲げる時代へ

📝 本日のニュース概要 以前お伝えしたモデル抽出・ポイズニング問題の続報。今回はモデルそのものではなく、AIが参照するWebデータ基盤、検索インデックス、RAG用ナレッジソースが攻撃面になりつつある問題を深掘りします。 以前お伝えしたモデル...
AIツール&サービス

【geek-terminalニュース】Baidu Unlimited OCRの最新情報

📝 本日のニュース概要 Baiduが公開したUnlimited OCRを解説。PDFや帳票をLLMに食わせる前処理を、ページ単位の分割処理からワンショット長文書解析へ動かす可能性を掘り下げます。 【事象の全貌と背景】BaiduのUnlimi...
ロボティクス&エージェント

【geek-terminalニュース】AIがバカになった?いや、DBが『腐って』いる。長期運用エージェントの急所「メモリの経年劣化(Rotting)」と解決策

📝 本日のニュース概要 24時間稼働するAIエージェントの知能が低下する本当の理由。以前お伝えした「知能の腐敗」や「稼働崩壊パターン」の続報として、今回はLLMそのものではなく、その下層に位置する「コンテキストデータベース」や「ベクトルメモ...
ローカルLLM

【衝撃】Qwen 3.7-Max降臨!100万文脈×推論エンジンの破壊力。RAG終焉のカウントダウンか?

📝 本日のニュース概要 2026年5月20日、アリババが「Qwen 3.7-Max」を正式発表。100万トークンの巨大コンテキスト窓と、推論特化型エージェント機能を統合した「真の怪物」の登場にLocalLLaMA界隈が揺れています。以前お伝...
学術研究

【衝撃】1200万トークンを52倍速で処理!Transformerを殺す「SubQアーキテクチャ」がAIの歴史を塗り替える

📝 本日のニュース概要 2026年5月20日、AIの歴史に刻まれる構造的革命が起きました。Transformerの宿命であった計算量O(n^2)の壁を突破する「劣二次(Sub-quadratic)」モデルがついに1200万トークンの文脈窓を...
ローカルLLM

【geek-terminal】128K長文を数秒で処理?llama.cppを10倍速める「PFlash」の衝撃

📝 本日のニュース概要 2026年5月2日、Local LLM界隈に激震。4月に登場した推論加速技術「DFlash」の正統進化、あるいは対となる新技術「PFlash」の噂がReddit(r/LocalLLaMA)を中心に急浮上しています。1...