DeepSeek

ローカルLLM

【geek-terminalニュース】DeepSeek V4.1 Flashで1M文脈とFP4 KV Cacheが来た件

📝 本日のニュース概要 DeepSeek V4.1 Flashを、単なる新モデルではなく長時間エージェントの記憶コストを変える推論ランタイム部品として深掘りします。1Mコンテキスト、FP4 KV Cache、Cross-Layer Atte...
ローカルLLM

【geek-terminalニュース】Qwen3.8-Flash-Next疑惑、125B MoEなのに6B activeというQwen4先出し級アーキテクチャの最新情報

📝 本日のニュース概要 以前お伝えしたQwen3.8-27B評価の続報です。今回は、Qwen3.8-Flash-Nextと呼ばれる125B MoE・6B active・マルチモーダル・Qwen4アーキテクチャ先行プレビュー疑惑を、公式確認済...
ローカルLLM

【geek-terminalニュース】DeepSeek V4 Flash Vision Expの噂で画像理解コスト再計算へ

📝 本日のニュース概要 以前お伝えしたDeepSeek V4 Flashの続報です。今回は、コミュニティで話題化しているVision対応Flashモデル疑惑を、公式確認済みのDeepSeek-VL情報と切り分けながら、低コストAPI、ローカ...
ローカルLLM

【geek-terminalニュース】RTX3060を4枚束ねてDeepSeek V4 Flashを爆速稼働させた自作ハック魂

📝 本日のニュース概要 以前お伝えしたDeepSeek V4 Flashのローカル実行高速化ネタの続報です。今回はRTX 3060を4枚束ねてq4_k_xl量子化のDeepSeek-V4-Flashを稼働させ、実測100 tok/sを叩き出...
ロボティクス&エージェント

【geek-terminalニュース】DeepSeek Harness開発者プレビュー公開の最新情報

📝 本日のニュース概要 DeepSeek Harnessが開発者プレビューへ移行したと報じられています。CLIツール`dsh`、MITライセンス、「Everything is a Plugin」という設計思想、そして公式発表と並走するように...
ロボティクス&エージェント

【geek-terminalニュース】DeepSeek V4 Pro正式展開、Harness公開、API値上げの最新情報

📝 本日のニュース概要 以前お伝えしたDeepSeek V4 Pro API展開観測の続報です。今回はV4 Pro更新、DeepSeek Harnessのオープンソース公開、API価格改定が同時に動いたことで、モデル性能だけでなく、エージェ...
AIツール&サービス

【geek-terminalニュース】DeepSeek V4 Pro 0813 API展開で揺れる推論インフラ戦争

📝 本日のニュース概要 以前お伝えしたDeepSeek APIコスト論とV4 Flash実務評価の続報です。OpenRouter上で話題化したDeepSeek V4 Pro 0813を起点に、1Mトークン文脈、MoE、APIルーティング、キ...
ローカルLLM

【geek-terminalニュース】DeepSeek V4 Flash 0731の癖評価、ARC-AGI高得点と実運用の不安定さが同時に燃える

📝 本日のニュース概要 以前お伝えしたDeepSeek V4 Flash低価格推論・ローカル実行の続報です。今回はベンチ順位ではなく、ARC-AGI、コーディング、非コーディング、ツール呼び出し、KV cache量子化、キャッシュ設計で挙動...
AIツール&サービス

【geek-terminalニュース】DeepSeek値上げ観測でAI推論コスト競争が新フェーズへ

📝 本日のニュース概要 以前お伝えしたDeepSeek V4 Flash低価格推論競争の続報です。今回は性能ベンチではなく、DeepSeek APIの値上げ観測、割引、クラウド経由の実効単価、エージェント運用コストを深掘りします。 以前お伝...
ローカルLLM

OpenWeight免除でローカルLLM配布の前提が変わる

📝 本日のニュース概要 以前お伝えしたOpen-weight AI規制論争の続報です。米AI安全フレームワークでopen-weightモデルが政府の安全性レビュー対象から外れる見通しが報じられ、LocalLLaMA界隈ではモデル公開、ミラー...