1M Context

ローカルLLM

【geek-terminalニュース】DeepSeek V4.1 Flashで1M文脈とFP4 KV Cacheが来た件

📝 本日のニュース概要 DeepSeek V4.1 Flashを、単なる新モデルではなく長時間エージェントの記憶コストを変える推論ランタイム部品として深掘りします。1Mコンテキスト、FP4 KV Cache、Cross-Layer Atte...
ローカルLLM

【geek-terminalニュース】Kimi K3参戦、2.8T級MoEと1M contextがオープンウェイト最前線を押し広げる

📝 本日のニュース概要 以前お伝えしたKimi K3の続報です。Moonshot AIの2.8兆パラメータ級open-weight MoE、1Mトークン文脈、Kimi Delta Attention、Artificial Analysis上...
商用巨大LLM

【geek-terminalニュース】Kimi K3公開でAPI価格と1Mコンテキスト疑惑が同時炎上

📝 本日のニュース概要 Moonshot AIのKimi公式サイトがK3を掲げ、RedditではWeb/App公開、API価格、ベンチマーク、巨大コンテキスト仕様をめぐって議論が急加速。公式に確認できる事実と、コミュニティ発の未確認情報を切...
ローカルLLM

【衝撃】Qwen 3.7-Max降臨!100万文脈×推論エンジンの破壊力。RAG終焉のカウントダウンか?

📝 本日のニュース概要 2026年5月20日、アリババが「Qwen 3.7-Max」を正式発表。100万トークンの巨大コンテキスト窓と、推論特化型エージェント機能を統合した「真の怪物」の登場にLocalLLaMA界隈が揺れています。以前お伝...