Geek Terminal

学術研究

【geek-terminalニュース】GPT-5.6 SolのLean検証つき凸最適化“30年ギャップ”主張を深掘り

📝 本日のニュース概要 以前お伝えしたGPT-5.6 Sol数学証明騒動の続報です。今回はCycle Double Cover Conjectureそのものではなく、凸最適化の未解決ギャップをGPT-5.6 Sol Proが148分セッショ...
ローカルLLM

Kimi K3が実務ベンチを横断席巻、Next.js・科学・表計算で何が起きたのか

📝 本日のニュース概要 以前お伝えしたKimi K3の続報です。今回は公式仕様や価格ではなく、Next.js Eval、Frontend Code Arena、Text Arena科学フィルタ、SpreadsheetBench 2という実務...
ローカルLLM

【geek-terminalニュース】Kimi K3参戦、2.8T級MoEと1M contextがオープンウェイト最前線を押し広げる

📝 本日のニュース概要 以前お伝えしたKimi K3の続報です。Moonshot AIの2.8兆パラメータ級open-weight MoE、1Mトークン文脈、Kimi Delta Attention、Artificial Analysis上...
プログラミング

【geek-terminalニュース】Linus Torvaldsが示したLinuxカーネル開発とLLM支援コードの最新情報

📝 本日のニュース概要 Linuxカーネル開発でLLM支援コードやAIレビューをどう扱うのか。Linus Torvaldsがメーリングリスト上で示した「Linuxはanti-AIプロジェクトではない」という立場を、一次情報、報道、Reddi...
ハードウェア&インフラ

【geek-terminalニュース】NVIDIA Nemotron 3 Embedの最新情報

📝 本日のニュース概要 NVIDIAがオープンな埋め込みモデル群「Nemotron 3 Embed」を公開。8B BF16チェックポイントのRTEB首位、1B BF16/NVFP4の実運用向け設計、RAG・コード検索・エージェント記憶への影...
セキュリティ&脆弱性

【geek-terminalニュース】GPT-Red登場、AIがAIを攻撃して守る時代へ

📝 本日のニュース概要 OpenAIの内部自動レッドチーミングモデルGPT-Redを深掘り。プロンプトインジェクション対策が、人間の手作業からAIによる自動探索と対抗訓練へ移り始めています。 【事象の全貌と背景】OpenAIの内部自動レッド...
プログラミング

【geek-terminalニュース】Grok Build OSS化、Rust製AIコーディングCLIの中身が読める時代へ

📝 本日のニュース概要 以前お伝えしたGrok Buildのリポジトリアップロード疑惑とAIコーディング環境の信頼境界問題の続報です。今回はGrok BuildがApache 2.0でOSS化されたと報じられ、Rust製エージェントハーネス...
ハードウェア&インフラ

【geek-terminalニュース】Codex Microの最新情報

📝 本日のニュース概要 OpenAIとWork LouderのCodex Microを深掘り。Codexエージェントの状態表示、物理ショートカット、推論レベルダイヤルが、AI開発環境をソフトウェアから入力デバイスへ拡張し始めた意味を整理しま...
ローカルLLM

【geek-terminalニュース】Bonsai 27Bの最新情報:27B推論モデルを1-bit/Ternaryでスマホ級へ押し込むローカルLLM圧縮実験

📝 本日のニュース概要 以前お伝えしたBonsai 1-bit系の続報です。PrismMLが発表したBonsai 27Bは、Qwen3.6-27B由来の27B級オープンウェイト推論モデルを1-bit binary版と1.58-bit ter...
セキュリティ&脆弱性

【geek-terminalニュース】Ghostcommitの最新情報:PNGがAIコードレビューの信頼境界を抜ける

📝 本日のニュース概要 Ghostcommitは、コードではなくPNG画像に隠したプロンプトインジェクションでAIコードレビューの盲点を突くPoCです。CodeRabbitやCursor BugbotのようなAIレビューが差分テキスト中心に...