Blog — Página 52
Notas de ingenieria, estudios de caso y lecciones del campo.

GPT-5.4 de OpenAI incorpora uso nativo del ordenador — 75% en OSWorld, por encima de los humanos
GPT-5.4 añade capacidades nativas de control del ordenador a la API de OpenAI y Codex, permitiendo a los agentes operar con ratón y teclado en cualquier aplicación. Obtuvo el 75% en OSWorld-Verified, por encima del 72,4% de referencia humana.

Meta publica TRIBE v2 en código abierto: un modelo que predice respuestas cerebrales con resolución 70x mayor
El equipo FAIR de Meta lanzó TRIBE v2, un modelo trimodal entrenado con 451 horas de datos de fMRI de 720 sujetos. Predice actividad neuronal en 70.000 vóxeles cerebrales individuales y soporta generalización zero-shot a nuevos sujetos.

Google lanza Gemini 3.1 Flash Live: voz en tiempo real para agentes de IA en más de 90 idiomas
Gemini 3.1 Flash Live elimina el pipeline clásico de transcripción-razonamiento-síntesis y procesa audio de extremo a extremo de forma nativa. Alcanzó el 90,8% en ComplexFuncBench Audio y ya está disponible para desarrolladores vía la API de Gemini.

Anthropic confirma 'Mythos', su modelo más potente, tras una filtración accidental
El modelo de nueva generación de Anthropic, conocido internamente como Mythos o Capybara, quedó expuesto por un error de configuración en el gestor de contenidos. La empresa confirmó que representa un 'cambio de nivel' en capacidades, con implicaciones inéditas para la ciberseguridad.

El Asistente de Salud con IA de Amazon Ya Está Disponible para Todos los Clientes en EE.UU. — Sin Prime, Sin One Medical
Amazon ha abierto por completo su asistente Health AI a todos los clientes estadounidenses tras un despliegue gradual que comenzó en enero. Construido sobre Amazon Bedrock e integrado con la infraestructura clínica de One Medical, el agente interpreta resultados de laboratorio, gestiona recetas, reserva citas y conecta a los usuarios con un médico por mensaje directo — gratis con Prime.

ARC-AGI-3 Ofrece 2 Millones a Cualquier IA que Piense como un Humano — Todos los Modelos Punteros Quedan por Debajo del 1%
La ARC Prize Foundation acaba de publicar su benchmark más difícil: un test de razonamiento interactivo donde GPT-5.4, Claude Opus 4.6 y Gemini 3.1 Pro obtienen menos del 1%, mientras humanos sin entrenamiento alcanzan el 100%. El premio de 2 millones de dólares sigue sin reclamarse.

Google lanza Gemini 3 Deep Think: 41% en Humanity's Last Exam, disponible para suscriptores Ultra
Gemini 3 Deep Think de Google ya está disponible para suscriptores de AI Ultra, alcanzando un 41,0% en Humanity's Last Exam y un 45,1% en ARC-AGI-2 mediante razonamiento paralelo avanzado.

Mistral AI obtiene €830M en deuda para construir un centro de datos soberano cerca de París
Mistral AI cerró su primera ronda de deuda por €830 millones para construir un centro de datos de IA en Francia con unos 14.000 GPUs de Nvidia. La apuesta estratégica apunta directamente a la independencia tecnológica europea.

Mistral Small 4 Es un Solo Modelo que Hace el Trabajo de Tres — y es Completamente Open Source
El nuevo modelo Mixture-of-Experts de 119.000 millones de parámetros de Mistral unifica razonamiento, comprensión multimodal y codificación agéntica bajo una sola licencia Apache 2.0. Con solo 6.000 millones de parámetros activos por token y una reducción del 40% en latencia en configuraciones optimizadas, es el modelo de pesos abiertos más capaz que ha publicado Mistral.
Página 52 de 61 · 549 artículos