GPU

ハードウェア&インフラ

【geek-terminalニュース】CUDA RustでGPUカーネル開発はC++職人芸から変わるのか

📝 本日のニュース概要 NVIDIAがCUDA Rustを発表。cuda-oxide SIMTとcutile-rs Tileの2系統で、Rustの所有権・借用規則をGPUカーネル開発に持ち込み、aliasingやlaunch設定の危険をコン...
ハードウェア&インフラ

【geek-terminalニュース】KVキャッシュが“エージェント実行基盤”になる説の最新情報

📝 本日のニュース概要 以前お伝えしたKVキャッシュ高速化・圧縮・量子化の続報です。今回は、KVキャッシュを単なる推論最適化ではなく、AIエージェントの状態、記憶、実行文脈として扱う発想を深掘りします。KV cache routing、pr...
企業動向&ビジネス

NVIDIAのHugging Face買収、オープンモデル配布基盤の主権戦争へ

📝 本日のニュース概要 NVIDIAがHugging Faceを約129億ドルで買収する正式契約を締結。GPU供給側がモデル配布、データセット、推論導線、アクセス制御の入口まで握ると何が起きるのか。RedditとHNの反応を交え、オープンモ...
ハードウェア&インフラ

【geek-terminalニュース】AIデータセンター反発の最新情報

📝 本日のニュース概要 AI競争のボトルネックがGPU不足から、電力・冷却・水・立地・住民合意へ移り始めています。米国で急拡大するデータセンター反発、4.1兆ドル級インフラ投資観測、Reddit/HN/Lobstersの生々しい議論を整理し...
ローカルLLM

【geek-terminalニュース】RTX3060を4枚束ねてDeepSeek V4 Flashを爆速稼働させた自作ハック魂

📝 本日のニュース概要 以前お伝えしたDeepSeek V4 Flashのローカル実行高速化ネタの続報です。今回はRTX 3060を4枚束ねてq4_k_xl量子化のDeepSeek-V4-Flashを稼働させ、実測100 tok/sを叩き出...
ハードウェア&インフラ

【geek-terminalニュース】IBMサブ1nmチップ技術、AI推論の電力壁に半導体側から殴り込む

📝 本日のニュース概要 IBMが2026年6月25日に発表した世界初とされるサブ1nmチップ技術を深掘り。nanostack、0.7nm世代トランジスタ、爪サイズ1000億トランジスタ級という主張が、AI推論・ローカルLLM・データセンター...
ローカルLLM

【変態的最適化】1兆パラメータモデルを「普通のGPU」で秒間1000トークン駆動!? XiaomiのMiMoとTileRTがVRAMの限界を粉砕した衝撃的な噂を解説

📝 本日のニュース概要 前日に初期情報をお伝えした、超巨大モデルを普通のGPUで動かす技術「TileRT」。今回はXiaomiの「MiMo」技術との驚異的な統合アーキテクチャの続報が舞い込んできました。富豪的なエンタープライズ用ハードウェア...
ローカルLLM

【物理法則崩壊?】1兆パラメータLLMをローカルGPUで爆速駆動!驚異の並列投機エンジン『TileRT』の噂を徹底解剖

📝 本日のニュース概要 データセンターを占有するはずの「1兆パラメータ(1T)」超巨大AIモデルを、一般向けGPU(コモディティハードウェア)上で「秒間1000トークン」でぶん回すという、物理法則を疑うレベルの極限最適化ハックが浮上!並列投...
ハードウェア&インフラ

【geek-terminalニュース】NVIDIA依存脱却へ?個人開発者が狂気の「ポータブルGPU命令セット(ISA)」をフルスクラッチ設計、低レイヤーギーク歓喜の噂

📝 本日のニュース概要 今回は、アーキテクチャマニュアルを読み漁った個人開発者が、Nvidiaなどの大手ベンダーに依存しない「ポータブルな自作GPU命令セット(ISA)」をフルスクラッチで設計したという、低レイヤーのロマンと狂気が詰まったプ...
ローカルLLM

【geek-terminalニュース】旧世代V100で27Bモデルが秒間1000トークン!? 投機デコーディングを極限まで研ぎ澄ました「MTP並列最適化」の変態的ハックがRedditで話題に

📝 本日のニュース概要 2026/05/22にお伝えした「Qwen3.6 35Bが110 tps」という驚異の記録からわずか数日。今度は、骨董品とも言われかねない旧世代のエンタープライズGPU「NVIDIA V100」を使い、27Bクラスの...