Inference Brew

アーカイブ。

すべての過去のインサイト。

AnthropicがClaude Opus 5.5をリリース、価格引き下げと安全性を強化 →

SpaceXAIがフロンティアモデル「Grok 4.7」をリリース →

Alibabaがオープンウェイトの7Bモデル「Qwen-Image-2.1」をリリース →

TypeSafe AIがJev APIの価格と機能を詳細に発表 →

Alibabaがホスト型Qwen3.8-Omni-Flash APIを公開 →

PrismMLがQwen3.8ベースのTernary Bonsai 2でBonsai 27Bラインを更新 →

GoogleがGemini 3.5 Transcribeを正式リリースし、Gemini 3.8 Liveを発表 →

UkisAIがQwen 3.8 27Bを最適化し、過剰な思考を58%削減 →

Shanghai AI Labがマルチモーダルモデル「Intern-S2-397B」を公開 →

Hugging Faceで「Agnes-3.0-Flash 33B」マルチモーダルモデルのプレビュー版が公開 →

OpenAIがGPT-Live-1をAPI開発者向けに公開 →

OpenAIがAgents APIのパブリックベータ版を公開、マネージドCodexハーネスを搭載 →

Meta、コンシューマー向けAIエージェントプラットフォームでMuseエコシステムを拡大 →

Mercury 2.5リリース:高速化とコンテキストウィンドウの拡大 →

OpenBMBがオンデバイスモデル「MiniCPM5-2B」をリリース →

H CompanyがNeoMMEシングルタワー型マルチモーダルエンコーダーを発表 →

OKF Agent MemoryがGitネイティブな永続メモリをリリース →

MicrosoftがMAI-Image-2.6-Flashを発表、MetaはMuse Imageの機能を拡張 →

OpenAIが1.05Mトークンのコンテキストとコンピュータ操作機能を備えたGPT-6 Astraを発表 →

GoogleがGemini Flashシリーズをバージョン3.8にアップグレード →

AnthropicがClaude 5モデルを5.1にアップデート、キャッシュ読み取りコストを75%削減 →

Tencentが770Bパラメータのオープンウェイトモデル「Hy4 Preview」を公開 →

MirroSが動画から物理シミュレーションへ変換するオープンウェイトモデル「Code-as-World」を公開 →

Tencentが100万トークンのコンテキストウィンドウを持つ「Hy4」プレビュー版を公開 →

Z.aiがGLM-5.3モデルのオープンウェイトを公開 →

「Ox Alpha」の正体はGLM-5.3-Flashと判明、超低コストAPIとして提供 →

Z.aiがGLM-5.3ファミリーを拡充、マルチモーダルなFlashモデルを投入 →

NVIDIAのGroq 3 LPX推論アクセラレータが本格量産へ →

Anthropicの安価なOpus 5が企業向けモデル支出でFable 5を追い抜く →

Qwen 3.8 27Bが30分でarm64コードのリバースエンジニアリングに成功 →

謎のモデル「Ox Alpha」が登場、1日100兆トークンを無料で提供 →

OpenAI、GPT-5.6 Solの価格を再調整 →

Google、DiffusionGemmaのパフォーマンスを毎秒1,500トークンに向上 →

DeepReinforceがOrnithモデルファミリーをアップデート、1.5をリリース →

Alibabaがオープンウェイトモデル「Qwen3.8-27B」をリリース →

CartesiaがSonic 3.6をリリース、Sonic 3.5を継承しTTSモデルのトップに →

ClaudeのシステムプロンプトがWebおよびモバイルアプリ向けに更新 →

ツール呼び出しLLMのファインチューニングに関するエンドツーエンドガイドが公開 →

Qwen3.8-27Bのオープンウェイト版がプレビューを経て公開 →

OpenAI、Cerebras搭載のGPT-5.6 Solに「Ultrafast」ティアを追加 →

SpaceXAIがフロンティアモデルをGrok 4.6にアップグレード →

NvidiaがNeMo SwitchyardとNemotron 3.5 Lightningを発表 →

Metaが30Bのオープンウェイト・エージェントモデル「Muse Glimmer」をリリース →

Zerank 2とF2LLM V2がローカル多言語検索ベンチマークで最高性能を記録 →

Claude Codeがマルチエージェント連携のためのセッション間メッセージング機能を導入 →

OpenAIが無料ユーザー向けに無制限のテキストチャットとGPT-5.6 Lunaを提供開始 →

OpenAIがChatGPTにGPT-5.6を統合、新しい「Think」スライダーとテキストチャット無制限化を発表 →

MetaがMuse Spark 1.2を搭載したターミナルベースのAIコーディングエージェント「Muse Code」を発表 →

Mistralがマルチモーダルモデレーションモデル「Shieldstral 3B」をリリース →

AlibabaがQwen3.8-Max APIを公開、オープンウェイト版のリリース日も決定 →

DeepSeek-V4-Flashの推論努力モードにおける冗長性とAPIの不一致 →

ByteDanceが「Seedance 2.5」を発表、30秒の生成とマルチモーダル制御に対応 →

DeepSeek-V4-Flash APIがパブリックベータを開始 →

Google DeepMindがGemini Robotics 2をリリース →

Google、Gemini 3.6 FlashをManaged Agentsに統合し、開発者向け制御機能を強化 →

GoogleがGemini Distillation Serviceを発表 →

Moonshot AIがオープンウェイトモデル「Kimi K3」をリリース →

KAT-Coder-V2.5のベンチマーク結果とAutoBuilderの詳細が公開 →

AnthropicがClaude 5モデル向けのコンテキストエンジニアリングガイドラインを更新 →

AnthropicがClaude Opus 5をリリース、思考の調整機能とソースコード安全制限の緩和を導入 →

Microsoftが自社製MAIモデルを主要製品に統合、OpenAIモデルから置き換え →

Microsoftがブラウザエージェントモデル「Fara1.5-27B」をリリース →

GoogleがGemini 3.6 Flashおよび3.5 Flash-Liteを正式リリース →

DeepSeek-V4 APIがプロダクションリリースへ →

Hugging Faceの侵害事例、APIのガードレールがインシデント対応を阻害した実態を浮き彫りに →

Kimi K3オープンモデル、Claudeと同等のコーディング性能を低コストで実現 →

NVIDIAがNemotron 3 Embedオープンモデルコレクションをリリース →

Moonshot AIが2.8兆パラメータのMoEモデル「Kimi K3」を発表 →

Thinking Machines Labが初の公開マルチモーダルモデル「Inkling」をリリース →

Mistral AI、視覚ベースのロボットナビゲーション向けモデル「Robostral Navigate」を発表 →

PrismMLがQwen 3.6 27Bモデルを圧縮し、iPhoneでのローカル実行を実現 →

Moondream 3.1がリリース、9BパラメータのMixture-of-Expertsアーキテクチャを採用 →

Grok Build CLIがリポジトリ全体とシークレットをxAIクラウドにアップロード →

Ant Groupが因果ビデオ世界モデル「LingBot-World-Infinity」を公開 →

OpenAIがGPT-5.6モデルとChatGPT Workエージェントを一般公開 →

SpaceXAIがコーディングモデルをGrok 4.5へアップデート →

OpenAIがRealtime APIをアップデート、gpt-realtime-2.1および2.1-miniをリリース →

TencentがApache 2.0ライセンスのMoEモデル「Hy3」を公開 →

蒸留版LivePortraitモデルがWebGPU経由でブラウザ上で25 FPSを実現 →

GPT-5.5 Codexにおける推論トークン・クラスタリングの異常 →

Mistral AIがLean 4コード検証向けにLeanstral 1.5をリリース →

AnthropicがClaude Fable 5とMythos 5の利用枠を導入し、アクセスを拡大 →

Anthropic、Claude Fable 5のグローバルアクセスを復旧 →

AnthropicがClaude Sonnet 5をリリース →

Meituanが1.6TパラメータのMoEモデル「LongCat-2.0」を正式リリース →

OpenRouterの「Owl Alpha」がMeituanの「LongCat-2.0-Preview」であることが判明 →

OpenAIがサイバーセキュリティモデル「Sol」「Terra」「Luna」を正式リリース →

OpenAI、GPT-5.6モデルファミリーの限定プレビューを開始 →

OpenAIがGPT-5.5 Instantをアップグレード、意図認識機能を強化 →

GoogleがGemini 3.5 Flashにネイティブなコンピュータ操作機能を統合 →

AnthropicがSlack用AIエージェント「Claude Tag」を発表 →

Z.aiが100万トークンのコンテキストウィンドウを持つオープンウェイトモデル「GLM-5.2」をリリース →

Qwen 3.6 27B Abliteratedがリリース、拒否率を大幅に低減 →

GLM 5.2のトークン最適化とローカルパフォーマンス指標 →

OpenAI、150万トークンのコンテキストウィンドウを備えたGPT-5.6のローンチを準備 →

Poolsideが225BパラメータのMixture-of-Expertsモデル「Laguna M.1」をリリース →

Z AIが100万トークンのコンテキストを持つオープンウェイトモデル「GLM-5.2」をリリース →

Z.aiが100万トークンのコンテキストウィンドウを持つオープンウェイトモデル「GLM-5.2」をリリース →

Hugging Faceでサイバーセキュリティ特化型オープンウェイトモデル「OpenMythos」が公開 →

Fable-5とKimi-K2.7-Codeが自動リサーチベンチマークでトップに →

Anthropic、米国の輸出管理令を受けClaude Fable 5とMythos 5を世界的に停止 →

Moonshot AIが思考トークンを30%削減した「Kimi K2.7-Code」をリリース →

研究者が16倍の入力圧縮を実現する「Latent Context Language Models」を発表 →

GoogleがDiffusionGemmaをリリース、テキスト生成を4倍高速化する26B MoEモデル →

AnthropicがClaude Fable 5とMythos 5をリリース →

Apple、WWDC 2026でSiri AIとFoundation Modelsフレームワークを発表 →

Harness-1 20B Retrieval SubagentがStateful Search Harnessと共にリリース →

Google、リモートGPU/TPU実行用Colab CLIをリリース →

Google、Gemma 4の量子化対応トレーニング(QAT)チェックポイントを公開 →

StanfordとLambda Labsがローカルエージェントフレームワーク「OpenJarvis」を公開 →

Googleがエンコーダーフリーのマルチモーダルアーキテクチャを採用した「Gemma 4 12B」をリリース →

Microsoftが推論モデル「MAI-Thinking-1」を含むMAIモデルファミリーを発表 →

MiniMaxが100万トークンのコンテキストとデスクトップ操作に対応した「M3」モデルをリリース →

GitHub Copilotがトークンベースの課金モデルへ移行 →

Hermes Agentが大規模MCPカタログに対応するツール検索機能を導入 →

Claude Code v2.1.87で未公開の設定項目が発見される →

AnthropicがClaude Opus 4.8とClaude Codeの動的ワークフローを発表 →

EAGLE 3.1が推論の投機的デコーディングに統合 →

Starletteパッケージで重大なBadHost脆弱性が発見される →

Model Context Protocolのリリース候補版でステートレスなHTTPコアを導入 →

Langfuseで完全なLLMオブザーバビリティパイプラインを構築 →

llama.cppサーバーがネイティブなエージェントツール実行機能を追加 →

GBrain: AIエージェント向けオープンソースMCPメモリレイヤー →

AlibabaがAnthropic API互換のQwen3.7-Maxを発表 →

CohereがApache 2.0ライセンスでCommand A+をリリース →

Googleが高速なエージェント機能を備えたGemini 3.5 Flashをリリース →

AIサプライチェーンの脆弱性 →

BitLockerバイパスの脆弱性が公開 →

Multi-Token Predictionがllama.cppに統合 →

OpenAI、エージェント時代を見据えて製品チームを統合 →

Cerebras SystemsのIPOデビュー →

Anthropicが企業導入数でOpenAIを追い抜く →

AIコーディングエージェントを標的とする「Shai-Hulud」ワーム →

OpenAIがサイバーセキュリティイニシアチブ「Daybreak」を開始 →

Gemini APIのFile Searchがマルチモーダル対応を追加 →

GitHubがAIコーディングエージェント向けにSpec-Kitをリリース →

Anthropic、エージェントの不整合問題で進展を報告 →

OpenAIがGPT-Realtime-2をリリース →

AnthropicがSpaceXと提携し、計算リソースを大幅に拡大 →

OpenAIがGPT-5.5 Instantをリリース →

Microsoft Agent 365が一般提供開始 →

Sakana AI、タンデム型音声対話アーキテクチャ「KAME」を発表 →

Stash:AIエージェント向けのオープンソース継続的メモリレイヤー →

Model Context Protocolにコマンド実行の脆弱性、研究者が指摘 →

PyTorch Lightningがサプライチェーン攻撃の被害に、悪意あるパッケージがPyPIで公開 →

Mistralが「Medium 3.5」と「Vibe」のリモートエージェントをリリース →

Amazon Bedrock、OpenAIモデルを限定プレビューで提供開始 →

OpenAIとMicrosoft、クラウドの独占提携を終了 →

xAI、エンタープライズ向け音声モデル「grok-voice-think-fast-1.0」をリリース →

Claude Codeの設計を解剖:現代と未来のAIエージェント・システムの構造 →

DeepSeekが次世代モデル「DeepSeek-V4」シリーズをプレビュー公開 →

OpenAIがGPT-5.5およびGPT-5.5 Proをリリース →

OpenAI、個人情報を自動検知・削除する「Privacy Filter」モデルをHugging Faceで公開 →

Google、自律型リサーチエージェント「Deep Research」と「Deep Research Max」を公開 →

GitHubがCopilotの新規登録を一時停止、トークンベースの課金へ移行 →

Vercel、サードパーティ製AIツールの侵害によるセキュリティ侵害を公表 →

Vercel Labsがクラウドベースのコーディングエージェント構築用フレームワーク「Open Agents」を公開 →

iTerm2に任意のコード実行が可能な脆弱性が発見される →

Claude Opus 4.7:Anthropicがエージェントによるコーディングや複雑なタスクに最適化した最新モデルをリリース →

Gas Townフレームワーク、ユーザーのLLMクレジットを無断で使用し自身のバグを修正 →

Claude Code Routines (リサーチプレビュー) が公開 →

MiniMax M2.7がオープンソース化:SWE-Proスコア56.22%を記録した自己進化型エージェントモデル →

Vertex AIにおけるClaude Mythosプレビュー →

Anthropic、Claude APIにハイブリッドモデル運用を可能にする「Advisor」ツールを追加 →

Claude Code向けのVercelプラグイン、テレメトリ収集用の隠しプロンプトを挿入 →

Meta、マルチモーダル推論モデル「Muse Spark」をプレビュー公開 →

Zhipu AIが754Bのオープンソースモデル「GLM-5.1」を公開 →

OpenAI Apps SDK: MCPを介したChatGPTでのサードパーティ統合 →

TermHub: AIエージェント向けオープンソース端末制御ゲートウェイ →

TurboQuant-WASMがGoogleのベクトル量子化をブラウザで実現 →

OpenClaw CVE-2026-33579:権限昇格の脆弱性を修正 →

Google、マルチモーダルモデル「Gemma 4」をApache 2.0ライセンスで公開 →

Veo 3.1 Lite:Gemini API経由で低コストな動画生成を実現 →

緊急セキュリティ:悪意のあるAxiosバージョンがリモートアクセストロイの木馬を配布 →

Microsoft CopilotがGitHubのプルリクエストに広告を挿入 →

Claude Codeのバグによりローカルリポジトリが警告なしに上書きされる問題 →

NVIDIA、マルチターンLLMトレーニング向け「ProRL Agent」をリリース →

TelnyxのPyPIパッケージがサプライチェーン攻撃により侵害 →

OpenTelemetry Profilesがパブリックアルファ版として公開 →

GitHub Copilotが学習データポリシーを更新 →

LiteLLMのPyPIパッケージにサプライチェーン攻撃、認証情報の窃取が発覚 →

Anthropic、Claudeの「Computer Use」機能を公開 →

Flash-MoEがMacBook Proで397Bパラメータモデルの実行を実現 →

不確実性を認識するLLMシステムの構築 →

Anthropic、Claude CodeをTelegramやDiscordから操作できる「Claude Code Channels」を発表 →

Cursorが独自コーディングモデル「Composer 2」をリリース →

シャオミ、1兆パラメータの基盤モデル「MiMo-V2-Pro」を公開 →

OpenAI、コーディングに特化した「GPT-5.4 Mini」および「Nano」をリリース →

NVIDIA、自律型AIエージェント構築用の「Agent Toolkit」と「NemoClaw」を発表 →

LangChain、複雑なマルチステップ・ワークフローを実現する「Deep Agents」をリリース →

AWS、AI推論向けにCerebrasの「Wafer-Scale Engine」を採用へ →

Anthropic、Claude 4.6向けに100万トークンのコンテキストウィンドウを一般公開 →

Amazon、AI支援による障害を受け90日間のコード安全リセットを実施 →

NVIDIAがNemotron 3 Super 120Bハイブリッドモデルを発表 →

Yann LeCun氏のAMI Labsがワールドモデル開発で10.3億ドルを調達 →

AnthropicがClaude Code向けに「Code Review」をリリース →

FlashAttention-4がBlackwell GPUで1605 TFLOPs/sを達成 →

GoogleがTensorFlow 2.21とLiteRTをリリース →

Anthropicが国防総省の「サプライチェーンリスク」指定を不服として提訴 →

OpenAIが100万トークンのコンテキストとコンピュータ操作モードを備えたGPT-5.4を発表 →

Google、大量のワークロード向けにGemini 3.1 Flash-Liteを発表 →

Anthropic対ペンタゴン訴訟とClaudeのサービス障害 →

OpenAIがAmazonとNvidiaから7300億ドルの評価額で1100億ドルを調達 →

OpenAIが1日1500万ドルの赤字と広告導入で財務的苦境に →

AlphabetがIntrinsic RoboticsをGoogleに再統合 →

Googleが画像生成モデル「Nano Banana 2」を発表 →

Inference Brewを受信箱へ

1日5分。無料、いつでも解除できます。

Inference Brewを受信箱へ

1日5分。無料、いつでも解除できます。