Inference Brew

Archivo.

Todas las ideas pasadas, reunidas.

Moonshot AI lanza el modelo de pesos abiertos Kimi K3

Publicados los resultados de referencia de KAT-Coder-V2.5 y detalles de AutoBuilder

Anthropic actualiza las directrices de ingeniería de contexto para los modelos Claude 5

Anthropic lanza Claude Opus 5 con pensamiento ajustable y seguridad de código relajada

Microsoft integra modelos MAI internos en sus productos principales, reemplazando a OpenAI

Microsoft lanza el modelo de agente de navegador Fara1.5-27B

Google lanza oficialmente Gemini 3.6 Flash y 3.5 Flash-Lite

La API de DeepSeek-V4 pasa a versión de producción

La brecha de seguridad en Hugging Face destaca cómo las barreras de seguridad de las API bloquean la respuesta a incidentes

El modelo abierto Kimi K3 iguala el rendimiento de codificación de Claude a un costo menor

NVIDIA lanza la colección de modelos abiertos Nemotron 3 Embed

Moonshot AI anuncia el modelo MoE Kimi K3 de 2,8 billones de parámetros

Thinking Machines Lab lanza Inkling, su primer modelo multimodal público

Mistral AI lanza Robostral Navigate para la navegación robótica basada en visión

PrismML comprime el modelo Qwen 3.6 27B para ejecutarse localmente en iPhone

Lanzamiento de Moondream 3.1 con arquitectura de mezcla de expertos de 9B de parámetros

Grok Build CLI sube repositorios completos y secretos a la nube de xAI

Ant Group lanza el modelo de mundo de video causal LingBot-World-Infinity

OpenAI lanza los modelos GPT-5.6 y ChatGPT Work a disponibilidad general

SpaceXAI gradúa su modelo de codificación a Grok 4.5

OpenAI actualiza la Realtime API con GPT-Realtime-2.1 y 2.1-mini

Tencent lanza el modelo Hy3 MoE con licencia Apache 2.0

El modelo destilado LivePortrait se ejecuta a 25 FPS en el navegador mediante WebGPU

GPT-5.5 Codex presenta una anomalía de agrupación de tokens de razonamiento

Mistral AI lanza Leanstral 1.5 para la verificación de código en Lean 4

Anthropic implementa cuotas de uso y amplía el acceso a Fable 5 y Mythos 5

Anthropic restablece el acceso global a Claude Fable 5

Anthropic lanza Claude Sonnet 5

Meituan lanza oficialmente el modelo MoE LongCat-2.0 de 1.6T

Owl Alpha de OpenRouter revelado como Meituan LongCat-2.0-Preview

OpenAI lanza oficialmente los modelos de ciberseguridad Sol, Terra y Luna

OpenAI lanza una vista previa limitada de la familia de modelos GPT-5.6

OpenAI actualiza GPT-5.5 Instant con reconocimiento de intención mejorado

Google integra el uso nativo de computadoras en Gemini 3.5 Flash

Anthropic lanza Claude Tag, un compañero de equipo agente en Slack

Z.ai lanza el modelo de pesos abiertos GLM-5.2 con una ventana de contexto de 1M

Lanzamiento de Qwen 3.6 27B Abliterated para reducir las tasas de rechazo

Optimización de tokens y métricas de rendimiento local de GLM 5.2

OpenAI prepara el lanzamiento de GPT-5.6 con una ventana de contexto de 1.5M

Poolside lanza el modelo Laguna M.1 225B Mixture-of-Experts

Z AI lanza el modelo de pesos abiertos GLM-5.2 con 1M de contexto

Z.ai lanza el modelo de pesos abiertos GLM-5.2 con una ventana de contexto de 1 millón

Lanzamiento de OpenMythos, un modelo de ciberseguridad de pesos abiertos en Hugging Face

Fable-5 y Kimi-K2.7-Code encabezan los benchmarks de autoresearch

Anthropic suspende Claude Fable 5 y Mythos 5 a nivel mundial tras una orden de control de exportaciones de EE. UU.

Moonshot AI lanza Kimi K2.7-Code con una reducción del 30% en tokens de razonamiento

Investigadores presentan modelos de lenguaje de contexto latente para una compresión de entrada de 16x

Google lanza DiffusionGemma, un modelo MoE de 26B que genera texto 4 veces más rápido

Anthropic lanza Claude Fable 5 y Mythos 5

Apple presenta Siri AI y el framework de Modelos Fundacionales en la WWDC 2026

Lanzamiento de Harness-1, un subagente de recuperación de 20B con arnés de búsqueda con estado

Google lanza Colab CLI para la ejecución remota de GPU y TPU

Google lanza puntos de control de entrenamiento consciente de cuantización para Gemma 4

Stanford y Lambda Labs lanzan el framework de agentes locales OpenJarvis

Google lanza Gemma 4 12B con una arquitectura multimodal sin codificador

Microsoft lanza la familia de modelos MAI, encabezada por el modelo de razonamiento MAI-Thinking-1

MiniMax lanza el modelo M3 con contexto de 1M de tokens y control de escritorio

GitHub Copilot cambia a un modelo de facturación basado en tokens

Hermes Agent introduce la búsqueda de herramientas para gestionar grandes catálogos MCP

Configuraciones no documentadas descubiertas en Claude Code v2.1.87

Anthropic lanza Claude Opus 4.8 y flujos de trabajo dinámicos en Claude Code

EAGLE 3.1 integra la decodificación especulativa en vLLM

Descubierta vulnerabilidad crítica BadHost en el paquete Starlette

El candidato a lanzamiento del Model Context Protocol introduce un núcleo HTTP sin estado

Construye pipelines completos de observabilidad de LLM con Langfuse

El servidor llama.cpp añade ejecución nativa de herramientas agenticas

GBrain: Capa de memoria MCP de código abierto para agentes de IA

Alibaba lanza Qwen3.7-Max con compatibilidad con la API de Anthropic

Cohere lanza Command A+ bajo licencia Apache 2.0

Google lanza Gemini 3.5 Flash con capacidades agente de alta velocidad

Vulnerabilidades en la cadena de suministro de IA

Divulgada vulnerabilidad de omisión de BitLocker

Predicción de múltiples tokens integrada en llama.cpp

OpenAI consolida sus equipos de producto para un futuro basado en agentes

Debut de la OPI de Cerebras Systems

Anthropic supera a OpenAI en adopción empresarial

El gusano Shai-Hulud ataca a los agentes de codificación de IA

OpenAI lanza la iniciativa de ciberseguridad 'Daybreak'

La búsqueda de archivos de la API de Gemini añade soporte multimodal

GitHub lanza Spec-Kit para agentes de programación con IA

Anthropic informa sobre avances en la desalineación de agentes

OpenAI lanza GPT-Realtime-2

Anthropic se asocia con SpaceX para una expansión masiva de cómputo

OpenAI lanza GPT-5.5 Instant

Microsoft Agent 365 alcanza la disponibilidad general

Sakana AI presenta la arquitectura tandem speech-to-speech KAME

Stash: una capa de memoria continua de código abierto para agentes de IA

Investigadores identifican fallo de ejecución de comandos en Model Context Protocol

Paquete PyTorch Lightning comprometido en un ataque de cadena de suministro

Mistral lanza Medium 3.5 y agentes remotos Vibe

Amazon Bedrock añade modelos de OpenAI en vista previa limitada

OpenAI y Microsoft finalizan su asociación exclusiva en la nube

xAI lanza el modelo grok-voice-think-fast-1.0

Inmersión en Claude Code: el espacio de diseño de los sistemas de agentes de IA actuales y futuros

DeepSeek presenta un avance de la serie de modelos DeepSeek-V4

OpenAI lanza GPT-5.5 y GPT-5.5 Pro

OpenAI lanza el modelo Privacy Filter en Hugging Face

Google lanza los agentes Deep Research y Deep Research Max

GitHub pausa los registros de Copilot y cambia a facturación basada en tokens

Vercel confirma brecha de seguridad a través de una herramienta de IA de terceros comprometida

Framework de codificación basado en la nube Open Agents

Vulnerabilidad en iTerm2 permite la ejecución de código arbitrario

Claude Opus 4.7: El nuevo modelo de frontera de Anthropic para codificación agéntica y tareas complejas

El framework Gas Town consume secretamente créditos de LLM de usuarios para corregir errores upstream

Claude Code Routines (Research Preview)

MiniMax M2.7 de código abierto: Modelo de agente autoevolutivo con una puntuación del 56,22% en SWE-Pro

Vista previa de Claude Mythos en Vertex AI

La API de Anthropic Claude añade la herramienta Advisor para el enrutamiento de modelos híbridos

El plugin de Vercel para Claude Code inyecta prompts de telemetría ocultos

Meta presenta el modelo propietario Muse Spark con capacidades multimodales y de razonamiento

Zhipu AI lanza el modelo de código abierto GLM-5.1 de 754B

OpenAI Apps SDK: Integraciones de terceros en ChatGPT mediante MCP

TermHub: Puerta de enlace de control de terminal de código abierto para agentes de IA

TurboQuant-WASM lleva la cuantización vectorial de Google al navegador

OpenClaw CVE-2026-33579: Vulnerabilidad de escalada de privilegios parcheada

Google lanza Gemma 4 bajo la licencia Apache 2.0

Veo 3.1 Lite: Generación de video de menor costo a través de la API de Gemini

Seguridad urgente: Versiones maliciosas de Axios instalan un troyano de acceso remoto

Microsoft Copilot inserta anuncios en las solicitudes de extracción de GitHub

Claude Code sobrescribe silenciosamente repositorios locales

NVIDIA lanza ProRL Agent para el entrenamiento de LLM de múltiples turnos

Paquete PyPI de Telnyx comprometido en un ataque a la cadena de suministro

OpenTelemetry Profiles entra en fase alfa pública

GitHub Copilot actualiza su política de datos de entrenamiento

Ataque crítico a la cadena de suministro compromete el paquete LiteLLM en PyPI

Anthropic lanza "Computer Use" para Claude

Flash-MoE ejecuta un modelo de 397B de parámetros en un MacBook Pro

Construcción de sistemas LLM conscientes de la incertidumbre

Anthropic presenta Claude Code Channels

Cursor lanza el modelo de programación Composer 2

Xiaomi lanza el LLM MiMo-V2-Pro de 1 billón de parámetros

OpenAI lanza GPT-5.4 Mini y Nano para cargas de trabajo de programación

Nvidia Agent Toolkit y plataforma NemoClaw

LangChain lanza Deep Agents para flujos de trabajo con estado de múltiples pasos

AWS desplegará Cerebras Wafer-Scale Engine para inferencia de IA

Anthropic hace que la ventana de contexto de 1M esté disponible de forma general para Claude 4.6

Amazon impone un reinicio de seguridad de código de 90 días tras interrupciones asistidas por IA

NVIDIA lanza el modelo híbrido Nemotron 3 Super 120B

AMI Labs de Yann LeCun recauda 1.030 millones de dólares para modelos mundiales

Anthropic lanza "Code Review" para Claude Code

FlashAttention-4 alcanza 1605 TFLOPs/s en GPUs Blackwell

Google lanza TensorFlow 2.21 y LiteRT

Anthropic impugna en los tribunales la etiqueta de 'riesgo en la cadena de suministro' del Pentágono

OpenAI lanza GPT-5.4 con 1M de contexto y modo de uso de computadora

Google lanza Gemini 3.1 Flash-Lite para cargas de trabajo de alto volumen

Demanda de Anthropic contra el Pentágono e interrupciones en el servicio de Claude

OpenAI recauda 110.000 millones de dólares con una valoración de 730.000 millones, con Amazon y Nvidia

OpenAI enfrenta tensiones financieras con un gasto diario de 15 millones de dólares y la introducción de publicidad

Alphabet reincorpora Intrinsic Robotics a Google

Google lanza el modelo de imagen Nano Banana 2

Inference Brew en tu correo

5 minutos al día. Gratis, cancela cuando quieras.

Inference Brew en tu correo

5 minutos al día. Gratis, cancela cuando quieras.