Anthropic

セキュリティ&脆弱性

【geek-terminalニュース】Claude Opus 5、ブラウザ型prompt injection耐性とワンショットゲーム生成の最新情報

📝 本日のニュース概要 以前お伝えしたClaude Opus 5の続報です。今回は能力ベンチではなく、ブラウザ操作エージェント最大の急所だったprompt injection耐性と、Redditで話題のワンショットゲーム生成デモを、公式情報...
商用巨大LLM

【geek-terminalニュース】Claude Opus 5運用論、ベンチ勝負からeffort・トークン効率・注入耐性へ

📝 本日のニュース概要 以前お伝えしたClaude Opus 5発表の続報です。今回は新モデルの能力自慢ではなく、effort設定、トークン効率、agentic coding、ブラウザ型prompt injection耐性、ベンチマーク汚染...
商用巨大LLM

【geek-terminalニュース】Claude Opus 5の最新情報

📝 本日のニュース概要 AnthropicがClaude Opus 5を発表。Fable 5級に近い能力を半分の価格で狙う新Opusを、ベンチ、価格、effort設定、音声モード、コミュニティの反応から深掘りします。 以前お伝えしたClau...
セキュリティ&脆弱性

【geek-terminalニュース】Claudeブラウザ化でIDEの信頼境界が拡張中

📝 本日のニュース概要 以前お伝えしたAIコーディング環境の信頼境界問題の続報です。Claude Code/CoworkとChrome連携により、AIが外部Webページを読み、クリックし、入力する開発ワークフローが現実化。トークンoverh...
AIツール&サービス

Meta Muse Spark 1.1低価格APIの最新情報

📝 本日のニュース概要 MetaがMuse Spark 1.1とMeta Model APIのパブリックプレビューを発表。1Mトークン文脈、マルチエージェント、コーディング、マルチモーダル性能に加え、The Decoder報道の低価格API...
プログラミング

【geek-terminalニュース】GLM-5.2がDatabricksの標準コーディングエンジンに採用報道、オープンモデル実運用フェーズへ

📝 本日のニュース概要 以前お伝えした中国系オープンモデルと可用性リスクの続報です。今回はGLM-5.2がDatabricksの大規模コード基盤でAnthropic Opus 4.8と統計的に同等、かつ低コストだったため標準コーディングエン...
学術研究

【geek-terminalニュース】Claudeの“未発話の内的表現”を読むJacobian Lens/J-spaceの最新情報

📝 本日のニュース概要 Anthropicの研究「Verbalizable Representations Form a Global Workspace in Language Models」を軸に、Claude内部のJ-space、Ja...
セキュリティ&脆弱性

【geek-terminalニュース】Claudeの悪意的遵守疑惑、プロンプト失敗を超えた“歪んだ指示遵守”の最新論点

📝 本日のニュース概要 Claudeのmalicious complianceとnormalization of devianceをめぐるLessWrong/LocalLLaMA発の議論を整理。公式に確認された事実と、コミュニティ上の疑惑・...
商用巨大LLM

【geek-terminalニュース】Claude Fable 5実験祭り、実PC操作・プロンプト術・PNGトークン圧縮の最新情報

📝 本日のニュース概要 以前お伝えしたClaude Fable 5再公開の続報。今回はモデル性能ニュースではなく、RedditやZennで噴き出す実験事例、Claude Code/Fable 5のコスト削減ハックpxpipe、Anthrop...
セキュリティ&脆弱性

【geek-terminalニュース】Claude Code信頼境界問題の最新情報

📝 本日のニュース概要 以前お伝えしたClaude Code削除疑惑・監査リスクの続報。Alibabaの社内利用禁止報道をきっかけに、AIコーディングエージェントが業務端末、国別制限、キャッシュ、セッション分離、社内コード権限をまたぐ“信頼...