Inference Brew

アーカイブ。

すべての過去のインサイト。

Moonshot AIがオープンウェイトモデル「Kimi K3」をリリース

KAT-Coder-V2.5のベンチマーク結果とAutoBuilderの詳細が公開

AnthropicがClaude 5モデル向けのコンテキストエンジニアリングガイドラインを更新

AnthropicがClaude Opus 5をリリース、思考の調整機能とソースコード安全制限の緩和を導入

Microsoftが自社製MAIモデルを主要製品に統合、OpenAIモデルから置き換え

Microsoftがブラウザエージェントモデル「Fara1.5-27B」をリリース

GoogleがGemini 3.6 Flashおよび3.5 Flash-Liteを正式リリース

DeepSeek-V4 APIがプロダクションリリースへ

Hugging Faceの侵害事例、APIのガードレールがインシデント対応を阻害した実態を浮き彫りに

Kimi K3オープンモデル、Claudeと同等のコーディング性能を低コストで実現

NVIDIAがNemotron 3 Embedオープンモデルコレクションをリリース

Moonshot AIが2.8兆パラメータのMoEモデル「Kimi K3」を発表

Thinking Machines Labが初の公開マルチモーダルモデル「Inkling」をリリース

Mistral AI、視覚ベースのロボットナビゲーション向けモデル「Robostral Navigate」を発表

PrismMLがQwen 3.6 27Bモデルを圧縮し、iPhoneでのローカル実行を実現

Moondream 3.1がリリース、9BパラメータのMixture-of-Expertsアーキテクチャを採用

Grok Build CLIがリポジトリ全体とシークレットをxAIクラウドにアップロード

Ant Groupが因果ビデオ世界モデル「LingBot-World-Infinity」を公開

OpenAIがGPT-5.6モデルとChatGPT Workエージェントを一般公開

SpaceXAIがコーディングモデルをGrok 4.5へアップデート

OpenAIがRealtime APIをアップデート、gpt-realtime-2.1および2.1-miniをリリース

TencentがApache 2.0ライセンスのMoEモデル「Hy3」を公開

蒸留版LivePortraitモデルがWebGPU経由でブラウザ上で25 FPSを実現

GPT-5.5 Codexにおける推論トークン・クラスタリングの異常

Mistral AIがLean 4コード検証向けにLeanstral 1.5をリリース

AnthropicがClaude Fable 5とMythos 5の利用枠を導入し、アクセスを拡大

Anthropic、Claude Fable 5のグローバルアクセスを復旧

AnthropicがClaude Sonnet 5をリリース

Meituanが1.6TパラメータのMoEモデル「LongCat-2.0」を正式リリース

OpenRouterの「Owl Alpha」がMeituanの「LongCat-2.0-Preview」であることが判明

OpenAIがサイバーセキュリティモデル「Sol」「Terra」「Luna」を正式リリース

OpenAI、GPT-5.6モデルファミリーの限定プレビューを開始

OpenAIがGPT-5.5 Instantをアップグレード、意図認識機能を強化

GoogleがGemini 3.5 Flashにネイティブなコンピュータ操作機能を統合

AnthropicがSlack用AIエージェント「Claude Tag」を発表

Z.aiが100万トークンのコンテキストウィンドウを持つオープンウェイトモデル「GLM-5.2」をリリース

Qwen 3.6 27B Abliteratedがリリース、拒否率を大幅に低減

GLM 5.2のトークン最適化とローカルパフォーマンス指標

OpenAI、150万トークンのコンテキストウィンドウを備えたGPT-5.6のローンチを準備

Poolsideが225BパラメータのMixture-of-Expertsモデル「Laguna M.1」をリリース

Z AIが100万トークンのコンテキストを持つオープンウェイトモデル「GLM-5.2」をリリース

Z.aiが100万トークンのコンテキストウィンドウを持つオープンウェイトモデル「GLM-5.2」をリリース

Hugging Faceでサイバーセキュリティ特化型オープンウェイトモデル「OpenMythos」が公開

Fable-5とKimi-K2.7-Codeが自動リサーチベンチマークでトップに

Anthropic、米国の輸出管理令を受けClaude Fable 5とMythos 5を世界的に停止

Moonshot AIが思考トークンを30%削減した「Kimi K2.7-Code」をリリース

研究者が16倍の入力圧縮を実現する「Latent Context Language Models」を発表

GoogleがDiffusionGemmaをリリース、テキスト生成を4倍高速化する26B MoEモデル

AnthropicがClaude Fable 5とMythos 5をリリース

Apple、WWDC 2026でSiri AIとFoundation Modelsフレームワークを発表

Harness-1 20B Retrieval SubagentがStateful Search Harnessと共にリリース

Google、リモートGPU/TPU実行用Colab CLIをリリース

Google、Gemma 4の量子化対応トレーニング(QAT)チェックポイントを公開

StanfordとLambda Labsがローカルエージェントフレームワーク「OpenJarvis」を公開

Googleがエンコーダーフリーのマルチモーダルアーキテクチャを採用した「Gemma 4 12B」をリリース

Microsoftが推論モデル「MAI-Thinking-1」を含むMAIモデルファミリーを発表

MiniMaxが100万トークンのコンテキストとデスクトップ操作に対応した「M3」モデルをリリース

GitHub Copilotがトークンベースの課金モデルへ移行

Hermes Agentが大規模MCPカタログに対応するツール検索機能を導入

Claude Code v2.1.87で未公開の設定項目が発見される

AnthropicがClaude Opus 4.8とClaude Codeの動的ワークフローを発表

EAGLE 3.1が推論の投機的デコーディングに統合

Starletteパッケージで重大なBadHost脆弱性が発見される

Model Context Protocolのリリース候補版でステートレスなHTTPコアを導入

Langfuseで完全なLLMオブザーバビリティパイプラインを構築

llama.cppサーバーがネイティブなエージェントツール実行機能を追加

GBrain: AIエージェント向けオープンソースMCPメモリレイヤー

AlibabaがAnthropic API互換のQwen3.7-Maxを発表

CohereがApache 2.0ライセンスでCommand A+をリリース

Googleが高速なエージェント機能を備えたGemini 3.5 Flashをリリース

AIサプライチェーンの脆弱性

BitLockerバイパスの脆弱性が公開

Multi-Token Predictionがllama.cppに統合

OpenAI、エージェント時代を見据えて製品チームを統合

Cerebras SystemsのIPOデビュー

Anthropicが企業導入数でOpenAIを追い抜く

AIコーディングエージェントを標的とする「Shai-Hulud」ワーム

OpenAIがサイバーセキュリティイニシアチブ「Daybreak」を開始

Gemini APIのFile Searchがマルチモーダル対応を追加

GitHubがAIコーディングエージェント向けにSpec-Kitをリリース

Anthropic、エージェントの不整合問題で進展を報告

OpenAIがGPT-Realtime-2をリリース

AnthropicがSpaceXと提携し、計算リソースを大幅に拡大

OpenAIがGPT-5.5 Instantをリリース

Microsoft Agent 365が一般提供開始

Sakana AI、タンデム型音声対話アーキテクチャ「KAME」を発表

Stash:AIエージェント向けのオープンソース継続的メモリレイヤー

Model Context Protocolにコマンド実行の脆弱性、研究者が指摘

PyTorch Lightningがサプライチェーン攻撃の被害に、悪意あるパッケージがPyPIで公開

Mistralが「Medium 3.5」と「Vibe」のリモートエージェントをリリース

Amazon Bedrock、OpenAIモデルを限定プレビューで提供開始

OpenAIとMicrosoft、クラウドの独占提携を終了

xAI、エンタープライズ向け音声モデル「grok-voice-think-fast-1.0」をリリース

Claude Codeの設計を解剖:現代と未来のAIエージェント・システムの構造

DeepSeekが次世代モデル「DeepSeek-V4」シリーズをプレビュー公開

OpenAIがGPT-5.5およびGPT-5.5 Proをリリース

OpenAI、個人情報を自動検知・削除する「Privacy Filter」モデルをHugging Faceで公開

Google、自律型リサーチエージェント「Deep Research」と「Deep Research Max」を公開

GitHubがCopilotの新規登録を一時停止、トークンベースの課金へ移行

Vercel、サードパーティ製AIツールの侵害によるセキュリティ侵害を公表

Vercel Labsがクラウドベースのコーディングエージェント構築用フレームワーク「Open Agents」を公開

iTerm2に任意のコード実行が可能な脆弱性が発見される

Claude Opus 4.7:Anthropicがエージェントによるコーディングや複雑なタスクに最適化した最新モデルをリリース

Gas Townフレームワーク、ユーザーのLLMクレジットを無断で使用し自身のバグを修正

Claude Code Routines (リサーチプレビュー) が公開

MiniMax M2.7がオープンソース化:SWE-Proスコア56.22%を記録した自己進化型エージェントモデル

Vertex AIにおけるClaude Mythosプレビュー

Anthropic、Claude APIにハイブリッドモデル運用を可能にする「Advisor」ツールを追加

Claude Code向けのVercelプラグイン、テレメトリ収集用の隠しプロンプトを挿入

Meta、マルチモーダル推論モデル「Muse Spark」をプレビュー公開

Zhipu AIが754Bのオープンソースモデル「GLM-5.1」を公開

OpenAI Apps SDK: MCPを介したChatGPTでのサードパーティ統合

TermHub: AIエージェント向けオープンソース端末制御ゲートウェイ

TurboQuant-WASMがGoogleのベクトル量子化をブラウザで実現

OpenClaw CVE-2026-33579:権限昇格の脆弱性を修正

Google、マルチモーダルモデル「Gemma 4」をApache 2.0ライセンスで公開

Veo 3.1 Lite:Gemini API経由で低コストな動画生成を実現

緊急セキュリティ:悪意のあるAxiosバージョンがリモートアクセストロイの木馬を配布

Microsoft CopilotがGitHubのプルリクエストに広告を挿入

Claude Codeのバグによりローカルリポジトリが警告なしに上書きされる問題

NVIDIA、マルチターンLLMトレーニング向け「ProRL Agent」をリリース

TelnyxのPyPIパッケージがサプライチェーン攻撃により侵害

OpenTelemetry Profilesがパブリックアルファ版として公開

GitHub Copilotが学習データポリシーを更新

LiteLLMのPyPIパッケージにサプライチェーン攻撃、認証情報の窃取が発覚

Anthropic、Claudeの「Computer Use」機能を公開

Flash-MoEがMacBook Proで397Bパラメータモデルの実行を実現

不確実性を認識するLLMシステムの構築

Anthropic、Claude CodeをTelegramやDiscordから操作できる「Claude Code Channels」を発表

Cursorが独自コーディングモデル「Composer 2」をリリース

シャオミ、1兆パラメータの基盤モデル「MiMo-V2-Pro」を公開

OpenAI、コーディングに特化した「GPT-5.4 Mini」および「Nano」をリリース

NVIDIA、自律型AIエージェント構築用の「Agent Toolkit」と「NemoClaw」を発表

LangChain、複雑なマルチステップ・ワークフローを実現する「Deep Agents」をリリース

AWS、AI推論向けにCerebrasの「Wafer-Scale Engine」を採用へ

Anthropic、Claude 4.6向けに100万トークンのコンテキストウィンドウを一般公開

Amazon、AI支援による障害を受け90日間のコード安全リセットを実施

NVIDIAがNemotron 3 Super 120Bハイブリッドモデルを発表

Yann LeCun氏のAMI Labsがワールドモデル開発で10.3億ドルを調達

AnthropicがClaude Code向けに「Code Review」をリリース

FlashAttention-4がBlackwell GPUで1605 TFLOPs/sを達成

GoogleがTensorFlow 2.21とLiteRTをリリース

Anthropicが国防総省の「サプライチェーンリスク」指定を不服として提訴

OpenAIが100万トークンのコンテキストとコンピュータ操作モードを備えたGPT-5.4を発表

Google、大量のワークロード向けにGemini 3.1 Flash-Liteを発表

Anthropic対ペンタゴン訴訟とClaudeのサービス障害

OpenAIがAmazonとNvidiaから7300億ドルの評価額で1100億ドルを調達

OpenAIが1日1500万ドルの赤字と広告導入で財務的苦境に

AlphabetがIntrinsic RoboticsをGoogleに再統合

Googleが画像生成モデル「Nano Banana 2」を発表

Inference Brewを受信箱へ

1日5分。無料、いつでも解除できます。

Inference Brewを受信箱へ

1日5分。無料、いつでも解除できます。