Inference Brew

Archivo.

Todas las ideas pasadas, reunidas.

Anthropic lanza Claude Opus 5.5 con precios más bajos y seguridad mejorada →

SpaceXAI actualiza su modelo de frontera a Grok 4.7 →

Alibaba lanza el modelo de pesos abiertos Qwen-Image-2.1 de 7B →

TypeSafe AI detalla los precios y la funcionalidad de la API Jev →

Alibaba lanza la API alojada Qwen3.8-Omni-Flash →

PrismML actualiza la línea Bonsai 27B con Ternary Bonsai 2 basado en Qwen3.8 →

Google traslada Gemini 3.5 Transcribe a disponibilidad general y lanza Gemini 3.8 Live →

UkisAI optimiza Qwen 3.8 27B para reducir el exceso de razonamiento en un 58% →

Shanghai AI Lab lanza el modelo multimodal Intern-S2-397B →

Lanzamiento de la vista previa de Agnes-3.0-Flash 33B Multimodal en Hugging Face →

OpenAI abre GPT-Live-1 a desarrolladores de API →

OpenAI lanza la API de Agentes en versión beta pública con Managed Codex Harness →

Meta expande el ecosistema Muse con una plataforma de agentes de IA para consumidores →

Lanzamiento de Mercury 2.5: Mayor velocidad y ventana de contexto ampliada →

OpenBMB lanza el modelo on-device MiniCPM5-2B →

H Company lanza los codificadores multimodales de torre única NeoMME →

OKF Agent Memory lanza memoria persistente nativa de Git →

Microsoft lanza MAI-Image-2.6-Flash; Meta amplía las capacidades de imagen de Muse →

OpenAI lanza GPT-6 Astra con 1.05M de contexto y capacidades de uso de computadora →

Google actualiza la serie Gemini Flash a la versión 3.8 →

Anthropic actualiza los modelos Claude 5 a 5.1 con lecturas de caché un 75% más baratas →

Tencent lanza Hy4 Preview, un modelo de pesos abiertos de 770B de parámetros →

MirroS lanza modelos de pesos abiertos Code-as-World para la traducción de video a física →

Tencent lanza la vista previa de Hy4 con una ventana de contexto de 1 millón →

Z.ai publica los pesos abiertos del modelo GLM-5.3 →

Ox Alpha revelado como GLM-5.3-Flash con API de costo ultra bajo →

Z.ai expande la familia GLM-5.3 con un modelo multimodal Flash →

Los aceleradores de inferencia NVIDIA Groq 3 LPX entran en producción a gran escala →

El Opus 5 de Anthropic, más barato, supera al Fable 5 en gasto corporativo →

Qwen 3.8 27B realiza ingeniería inversa con éxito de código arm64 en 30 minutos →

Debuta el misterioso modelo 'Ox Alpha' con 100 billones de tokens gratuitos al día →

OpenAI ajusta los precios de GPT-5.6 Sol tras la reducción inicial →

Google actualiza el rendimiento de DiffusionGemma a 1.500 tokens por segundo →

DeepReinforce actualiza la familia de modelos Ornith con el lanzamiento de la versión 1.5 →

Alibaba lanza el modelo de pesos abiertos Qwen3.8-27B →

Cartesia lanza Sonic 3.6, sucediendo a Sonic 3.5 como el modelo TTS mejor clasificado →

Actualización de los system prompts de Claude para aplicaciones web y móviles →

Publicada guía integral para el ajuste fino de LLMs con capacidad de llamada a herramientas →

Lanzamiento de los pesos abiertos de Qwen3.8-27B tras su vista previa →

OpenAI añade un nivel 'Ultrafast' a GPT-5.6 Sol impulsado por Cerebras →

SpaceXAI actualiza su modelo de frontera a Grok 4.6 →

Nvidia lanza NeMo Switchyard y Nemotron 3.5 Lightning →

Meta lanza Muse Glimmer, un modelo agente de 30B de parámetros con pesos abiertos →

Zerank 2 y F2LLM V2 alcanzan los mejores benchmarks de recuperación multilingüe local →

Claude Code introduce mensajería entre sesiones para la coordinación de múltiples agentes →

OpenAI implementa chats de texto ilimitados y GPT-5.6 Luna para usuarios gratuitos →

OpenAI integra GPT-5.6 en ChatGPT con un nuevo control deslizante 'Think' y texto gratuito ilimitado →

Meta lanza el agente de terminal de codificación Muse con Muse Spark 1.2 →

Mistral lanza Shieldstral, un modelo multimodal de moderación de 3B →

Alibaba lanza la API de Qwen3.8-Max y establece la fecha de lanzamiento de pesos abiertos →

Los modos de esfuerzo de razonamiento de DeepSeek-V4-Flash muestran verbosidad y discrepancias en la API →

ByteDance lanza Seedance 2.5 con generación de 30 segundos y controles multimodales →

La API de DeepSeek-V4-Flash entra en fase beta pública →

Google DeepMind lanza Gemini Robotics 2 →

Google integra Gemini 3.6 Flash en Managed Agents con nuevos controles para desarrolladores →

Google lanza el servicio de destilación de Gemini →

Moonshot AI lanza el modelo de pesos abiertos Kimi K3 →

Publicados los resultados de referencia de KAT-Coder-V2.5 y detalles de AutoBuilder →

Anthropic actualiza las directrices de ingeniería de contexto para los modelos Claude 5 →

Anthropic lanza Claude Opus 5 con pensamiento ajustable y seguridad de código relajada →

Microsoft integra modelos MAI internos en sus productos principales, reemplazando a OpenAI →

Microsoft lanza el modelo de agente de navegador Fara1.5-27B →

Google lanza oficialmente Gemini 3.6 Flash y 3.5 Flash-Lite →

La API de DeepSeek-V4 pasa a versión de producción →

La brecha de seguridad en Hugging Face destaca cómo las barreras de seguridad de las API bloquean la respuesta a incidentes →

El modelo abierto Kimi K3 iguala el rendimiento de codificación de Claude a un costo menor →

NVIDIA lanza la colección de modelos abiertos Nemotron 3 Embed →

Moonshot AI anuncia el modelo MoE Kimi K3 de 2,8 billones de parámetros →

Thinking Machines Lab lanza Inkling, su primer modelo multimodal público →

Mistral AI lanza Robostral Navigate para la navegación robótica basada en visión →

PrismML comprime el modelo Qwen 3.6 27B para ejecutarse localmente en iPhone →

Lanzamiento de Moondream 3.1 con arquitectura de mezcla de expertos de 9B de parámetros →

Grok Build CLI sube repositorios completos y secretos a la nube de xAI →

Ant Group lanza el modelo de mundo de video causal LingBot-World-Infinity →

OpenAI lanza los modelos GPT-5.6 y ChatGPT Work a disponibilidad general →

SpaceXAI gradúa su modelo de codificación a Grok 4.5 →

OpenAI actualiza la Realtime API con GPT-Realtime-2.1 y 2.1-mini →

Tencent lanza el modelo Hy3 MoE con licencia Apache 2.0 →

El modelo destilado LivePortrait se ejecuta a 25 FPS en el navegador mediante WebGPU →

GPT-5.5 Codex presenta una anomalía de agrupación de tokens de razonamiento →

Mistral AI lanza Leanstral 1.5 para la verificación de código en Lean 4 →

Anthropic implementa cuotas de uso y amplía el acceso a Fable 5 y Mythos 5 →

Anthropic restablece el acceso global a Claude Fable 5 →

Anthropic lanza Claude Sonnet 5 →

Meituan lanza oficialmente el modelo MoE LongCat-2.0 de 1.6T →

Owl Alpha de OpenRouter revelado como Meituan LongCat-2.0-Preview →

OpenAI lanza oficialmente los modelos de ciberseguridad Sol, Terra y Luna →

OpenAI lanza una vista previa limitada de la familia de modelos GPT-5.6 →

OpenAI actualiza GPT-5.5 Instant con reconocimiento de intención mejorado →

Google integra el uso nativo de computadoras en Gemini 3.5 Flash →

Anthropic lanza Claude Tag, un compañero de equipo agente en Slack →

Z.ai lanza el modelo de pesos abiertos GLM-5.2 con una ventana de contexto de 1M →

Lanzamiento de Qwen 3.6 27B Abliterated para reducir las tasas de rechazo →

Optimización de tokens y métricas de rendimiento local de GLM 5.2 →

OpenAI prepara el lanzamiento de GPT-5.6 con una ventana de contexto de 1.5M →

Poolside lanza el modelo Laguna M.1 225B Mixture-of-Experts →

Z AI lanza el modelo de pesos abiertos GLM-5.2 con 1M de contexto →

Z.ai lanza el modelo de pesos abiertos GLM-5.2 con una ventana de contexto de 1 millón →

Lanzamiento de OpenMythos, un modelo de ciberseguridad de pesos abiertos en Hugging Face →

Fable-5 y Kimi-K2.7-Code encabezan los benchmarks de autoresearch →

Anthropic suspende Claude Fable 5 y Mythos 5 a nivel mundial tras una orden de control de exportaciones de EE. UU. →

Moonshot AI lanza Kimi K2.7-Code con una reducción del 30% en tokens de razonamiento →

Investigadores presentan modelos de lenguaje de contexto latente para una compresión de entrada de 16x →

Google lanza DiffusionGemma, un modelo MoE de 26B que genera texto 4 veces más rápido →

Anthropic lanza Claude Fable 5 y Mythos 5 →

Apple presenta Siri AI y el framework de Modelos Fundacionales en la WWDC 2026 →

Lanzamiento de Harness-1, un subagente de recuperación de 20B con arnés de búsqueda con estado →

Google lanza Colab CLI para la ejecución remota de GPU y TPU →

Google lanza puntos de control de entrenamiento consciente de cuantización para Gemma 4 →

Stanford y Lambda Labs lanzan el framework de agentes locales OpenJarvis →

Google lanza Gemma 4 12B con una arquitectura multimodal sin codificador →

Microsoft lanza la familia de modelos MAI, encabezada por el modelo de razonamiento MAI-Thinking-1 →

MiniMax lanza el modelo M3 con contexto de 1M de tokens y control de escritorio →

GitHub Copilot cambia a un modelo de facturación basado en tokens →

Hermes Agent introduce la búsqueda de herramientas para gestionar grandes catálogos MCP →

Configuraciones no documentadas descubiertas en Claude Code v2.1.87 →

Anthropic lanza Claude Opus 4.8 y flujos de trabajo dinámicos en Claude Code →

EAGLE 3.1 integra la decodificación especulativa en vLLM →

Descubierta vulnerabilidad crítica BadHost en el paquete Starlette →

El candidato a lanzamiento del Model Context Protocol introduce un núcleo HTTP sin estado →

Construye pipelines completos de observabilidad de LLM con Langfuse →

El servidor llama.cpp añade ejecución nativa de herramientas agenticas →

GBrain: Capa de memoria MCP de código abierto para agentes de IA →

Alibaba lanza Qwen3.7-Max con compatibilidad con la API de Anthropic →

Cohere lanza Command A+ bajo licencia Apache 2.0 →

Google lanza Gemini 3.5 Flash con capacidades agente de alta velocidad →

Vulnerabilidades en la cadena de suministro de IA →

Divulgada vulnerabilidad de omisión de BitLocker →

Predicción de múltiples tokens integrada en llama.cpp →

OpenAI consolida sus equipos de producto para un futuro basado en agentes →

Debut de la OPI de Cerebras Systems →

Anthropic supera a OpenAI en adopción empresarial →

El gusano Shai-Hulud ataca a los agentes de codificación de IA →

OpenAI lanza la iniciativa de ciberseguridad 'Daybreak' →

La búsqueda de archivos de la API de Gemini añade soporte multimodal →

GitHub lanza Spec-Kit para agentes de programación con IA →

Anthropic informa sobre avances en la desalineación de agentes →

OpenAI lanza GPT-Realtime-2 →

Anthropic se asocia con SpaceX para una expansión masiva de cómputo →

OpenAI lanza GPT-5.5 Instant →

Microsoft Agent 365 alcanza la disponibilidad general →

Sakana AI presenta la arquitectura tandem speech-to-speech KAME →

Stash: una capa de memoria continua de código abierto para agentes de IA →

Investigadores identifican fallo de ejecución de comandos en Model Context Protocol →

Paquete PyTorch Lightning comprometido en un ataque de cadena de suministro →

Mistral lanza Medium 3.5 y agentes remotos Vibe →

Amazon Bedrock añade modelos de OpenAI en vista previa limitada →

OpenAI y Microsoft finalizan su asociación exclusiva en la nube →

xAI lanza el modelo grok-voice-think-fast-1.0 →

Inmersión en Claude Code: el espacio de diseño de los sistemas de agentes de IA actuales y futuros →

DeepSeek presenta un avance de la serie de modelos DeepSeek-V4 →

OpenAI lanza GPT-5.5 y GPT-5.5 Pro →

OpenAI lanza el modelo Privacy Filter en Hugging Face →

Google lanza los agentes Deep Research y Deep Research Max →

GitHub pausa los registros de Copilot y cambia a facturación basada en tokens →

Vercel confirma brecha de seguridad a través de una herramienta de IA de terceros comprometida →

Framework de codificación basado en la nube Open Agents →

Vulnerabilidad en iTerm2 permite la ejecución de código arbitrario →

Claude Opus 4.7: El nuevo modelo de frontera de Anthropic para codificación agéntica y tareas complejas →

El framework Gas Town consume secretamente créditos de LLM de usuarios para corregir errores upstream →

Claude Code Routines (Research Preview) →

MiniMax M2.7 de código abierto: Modelo de agente autoevolutivo con una puntuación del 56,22% en SWE-Pro →

Vista previa de Claude Mythos en Vertex AI →

La API de Anthropic Claude añade la herramienta Advisor para el enrutamiento de modelos híbridos →

El plugin de Vercel para Claude Code inyecta prompts de telemetría ocultos →

Meta presenta el modelo propietario Muse Spark con capacidades multimodales y de razonamiento →

Zhipu AI lanza el modelo de código abierto GLM-5.1 de 754B →

OpenAI Apps SDK: Integraciones de terceros en ChatGPT mediante MCP →

TermHub: Puerta de enlace de control de terminal de código abierto para agentes de IA →

TurboQuant-WASM lleva la cuantización vectorial de Google al navegador →

OpenClaw CVE-2026-33579: Vulnerabilidad de escalada de privilegios parcheada →

Google lanza Gemma 4 bajo la licencia Apache 2.0 →

Veo 3.1 Lite: Generación de video de menor costo a través de la API de Gemini →

Seguridad urgente: Versiones maliciosas de Axios instalan un troyano de acceso remoto →

Microsoft Copilot inserta anuncios en las solicitudes de extracción de GitHub →

Claude Code sobrescribe silenciosamente repositorios locales →

NVIDIA lanza ProRL Agent para el entrenamiento de LLM de múltiples turnos →

Paquete PyPI de Telnyx comprometido en un ataque a la cadena de suministro →

OpenTelemetry Profiles entra en fase alfa pública →

GitHub Copilot actualiza su política de datos de entrenamiento →

Ataque crítico a la cadena de suministro compromete el paquete LiteLLM en PyPI →

Anthropic lanza "Computer Use" para Claude →

Flash-MoE ejecuta un modelo de 397B de parámetros en un MacBook Pro →

Construcción de sistemas LLM conscientes de la incertidumbre →

Anthropic presenta Claude Code Channels →

Cursor lanza el modelo de programación Composer 2 →

Xiaomi lanza el LLM MiMo-V2-Pro de 1 billón de parámetros →

OpenAI lanza GPT-5.4 Mini y Nano para cargas de trabajo de programación →

Nvidia Agent Toolkit y plataforma NemoClaw →

LangChain lanza Deep Agents para flujos de trabajo con estado de múltiples pasos →

AWS desplegará Cerebras Wafer-Scale Engine para inferencia de IA →

Anthropic hace que la ventana de contexto de 1M esté disponible de forma general para Claude 4.6 →

Amazon impone un reinicio de seguridad de código de 90 días tras interrupciones asistidas por IA →

NVIDIA lanza el modelo híbrido Nemotron 3 Super 120B →

AMI Labs de Yann LeCun recauda 1.030 millones de dólares para modelos mundiales →

Anthropic lanza "Code Review" para Claude Code →

FlashAttention-4 alcanza 1605 TFLOPs/s en GPUs Blackwell →

Google lanza TensorFlow 2.21 y LiteRT →

Anthropic impugna en los tribunales la etiqueta de 'riesgo en la cadena de suministro' del Pentágono →

OpenAI lanza GPT-5.4 con 1M de contexto y modo de uso de computadora →

Google lanza Gemini 3.1 Flash-Lite para cargas de trabajo de alto volumen →

Demanda de Anthropic contra el Pentágono e interrupciones en el servicio de Claude →

OpenAI recauda 110.000 millones de dólares con una valoración de 730.000 millones, con Amazon y Nvidia →

OpenAI enfrenta tensiones financieras con un gasto diario de 15 millones de dólares y la introducción de publicidad →

Alphabet reincorpora Intrinsic Robotics a Google →

Google lanza el modelo de imagen Nano Banana 2 →

Inference Brew en tu correo

5 minutos al día. Gratis, cancela cuando quieras.

Inference Brew en tu correo

5 minutos al día. Gratis, cancela cuando quieras.