NVIDIA

ローカルLLM

【geek-terminalニュース】旧世代V100で27Bモデルが秒間1000トークン!? 投機デコーディングを極限まで研ぎ澄ました「MTP並列最適化」の変態的ハックがRedditで話題に

📝 本日のニュース概要 2026/05/22にお伝えした「Qwen3.6 35Bが110 tps」という驚異の記録からわずか数日。今度は、骨董品とも言われかねない旧世代のエンタープライズGPU「NVIDIA V100」を使い、27Bクラスの...
ロボティクス&エージェント

【衝撃】指示を待たないAI?自律実行基盤「W.A.D.E.」が描く2万ドルの脱社会・開発要塞の全貌

📝 本日のニュース概要 ついに「AIに指示を出す」時代すら終わるのか?GitHubで突如注目を集める自律実行基盤「W.A.D.E.(turntducky/wade-ai)」の噂を徹底解剖。RedditのLocalLLaMA界隈で囁かれる「2...
学術研究

【衝撃】NVIDIAが放つ「Tri-mode推論」がヤバすぎる!1回の計算で6トークン並列生成、Qwen3ベースで推論の物理的限界を突破か?

📝 本日のニュース概要 以前お伝えしたTPS(Tokens Per Second)向上議論に、とんでもない続報が入ってきました。NVIDIA AIが、投機的デコーディングに頼らず「モデル単体で1フォワード6トークン」を生成する新アーキテクチ...
ハードウェア&インフラ

【geek-terminalニュース】RTX 4090 48GB物理改造!NVIDIAの制限をねじ伏せる魔改造の正体

📝 本日のニュース概要 2026年、AIモデルの巨大化とRTX 5090の高騰予想が重なる中、ギークたちの飢餓感はついに「物理的な破壊と再構築」へと至りました。中国のハードウェアハッカー界隈から流出した、RTX 4090のVRAMを24GB...
ローカルLLM

【衝撃】10年前のGTX 1080が最新30B MoEで24 tok/sを記録!?富豪ハードへの「最適化」という名の反逆

📝 本日のニュース概要 2026年、ローカルLLM界隈に激震が走っています。かつての名機、8GB VRAMのGTX 1080が、最新の30BクラスMoEモデルを24 tokens per secondという実用速度で回したという報告が相次い...
プログラミング

【geek-terminal】NVIDIAの狂気!RustでGPUカーネルを直接焼く公式コンパイラ「cuda-oxide」降臨

📝 本日のニュース概要 NVIDIAが突如公開した「cuda-oxide」は、Rustコードを直接PTX(GPUアセンブリ相当)へ変換する実験的コンパイラバックエンドです。2026年4月に報じた「Python強制移行」というNVIDIAの戦...
ハードウェア&インフラ

【衝撃】NVIDIAの檻を破壊する「384GBメモリ」推論カード降臨!台湾Skymizer HTX301がローカルLLM界を焦土に変える

📝 本日のニュース概要 ついに、我々ローカルLLM愛好家が待ち望んだ「最終兵器」が姿を現しました。台湾Skymizerが発表したPCIe推論カード『HTX301』。その最大の特徴は、NVIDIAがコンシューマー向けGPUに課してきた「VRA...
ハードウェア&インフラ

【変態ハック】GPUの動画エンジンを「PCIe帯域の拡張」に転用!? 物理限界を超える狂気のハック『torch-nvenc-compress』の全貌

📝 本日のニュース概要 2026年、AI開発者たちの間で「物理的なPCIe帯域の壁」を破壊する、あまりにも変態的な手法が話題となっています。その名も『torch-nvenc-compress』。本来は動画のエンコードに使用する専用回路「NV...
ハードウェア&インフラ

【狂気】クラウドを捨てたギークの終着点:16連Sparkクラスタ自作と分散LLMの衝撃

📝 本日のニュース概要 2026年5月2日、LocalLLaMAコミュニティを揺るがしているのは、もはや単一PCの限界突破ではありません。4/28に紹介した『継ぎ木GPU』の斜め上を行く、16ノードもの物理環境をSparkでクラスタリングす...
学術研究

【AI 2026】「言語」を捨てたAIの直接思考。CoTを過去にする「潜在空間推論」の衝撃。

📝 本日のニュース概要 2026年、AI推論は「人間が読める言葉」の呪縛から解き放たれようとしています。MicrosoftやNVIDIA、そして研究コミュニティで激論が交わされている「ベクトル空間での直接推論(Latent Reasonin...