vLLM | Geek Terminal

【200ポンドの狂気】中古の爆安サーバー用GPU「Tesla V100」を3Dプリンタとダクトファンで一般PCへ強引に移植する変態肉体派ハックが話題に！

📝 本日のニュース概要 2026年現在、高騰を極めるコンシューマー向け大容量VRAM GPU。そんな中、数年前のデータセンター向けモンスターGPU「Tesla V100」が中古市場に200ポンド（約4万円）で大量放出されていることに目をつけ...

2026.06.01

ハードウェア＆インフラ

📝 本日のニュース概要 2026年4月19日、ローカルLLM界隈を震撼させた「--n-cpu-moe」フラグの発見。VRAM容量を超えた巨大なMoEモデルを動作させる魔法の杖でしたが、そこには「プロンプト処理（Prefill）が地獄のように...

2026.05.13

ローカルLLM

📝 本日のニュース概要 AI界の効率モンスター、DeepSeekが最新モデル『DeepSeek-V4』を発表しました。特筆すべきは、100万トークン（1M context）という超長文を、従来の10%のKVキャッシュで実現した「Compre...

2026.04.26

ローカルLLM

📝 本日のニュース概要 2026年4月、Qwenチームから最新モデル「Qwen3.6-35B-A3B」が突如リリースされました。総パラメータ35Bに対し、アクティブパラメータをわずか3Bに抑えたMoE（Mixture of Experts）...

2026.04.18

ローカルLLM

📝 本日のニュース概要 2026年4月、ローカルLLM界隈はRTX 50シリーズ（Blackwell）のネイティブ4bit演算「NVFP4」の実装で沸騰しています。Gemma 4 26BをvLLMやllama.cppで動かした際の圧倒的なス...

2026.04.18

ハードウェア＆インフラ