Lectura 7:00 min
¿Cuáles son los principales modelos de IA lanzados en septiembre de 2026?
Septiembre concentró lanzamientos de OpenAI, Anthropic, Google y otros desarrolladores que buscaron reducir costos y ampliar las capacidades de los modelos para tareas cada vez más complejas.

OpenAI canceló el lanzamiento de GPT-6.1 Astra, previsto para octubre, después de que sus pruebas internas detectaran problemas de seguridad y alineación. Reuters informó el 28 de septiembre que la empresa decidió no publicar el modelo, que estaba diseñado para realizar tareas complejas con un menor grado de intervención humana.
Un día después, OpenAI presentó GPT-6.1 Sol, una versión distinta que comenzó a desplegarse en ChatGPT Work y Codex y quedó disponible mediante su interfaz para desarrolladores. El modelo no está disponible en las conversaciones convencionales de ChatGPT.
OpenAI había iniciado septiembre con GPT-6 Astra, presentado el día 3 y distribuido inicialmente a un conjunto limitado de organizaciones. El 22 lanzó GPT-6 Sol y GPT-6 Luna, dos modelos de razonamiento con diferencias importantes de precio. Para solicitudes de hasta 272,000 tokens de entrada, Sol cuesta 2 dólares por millón de tokens de entrada y 10 por los de salida, mientras Luna cobra 10 centavos y 50 centavos, respectivamente.
Te puede interesar
Los tokens son las unidades en las que estos sistemas procesan el contenido. GPT-6.1 Sol conservó una tarifa base de 2 dólares por millón de tokens de entrada y 10 por salida, aunque OpenAI aplica precios mayores cuando una solicitud supera los 272,000 tokens de entrada.
Anthropic siguió otra ruta para reducir el costo de ejecutar tareas. Claude Sonnet 5.5, lanzado el 28, mantiene el precio de Sonnet 5, de 2 dólares por millón de tokens de entrada y 10 por salida. La empresa afirma que el nuevo modelo necesita menos tokens para completar buena parte de los trabajos y calcula un ahorro de hasta 30% por tarea.
Seis días antes, Anthropic había presentado Claude Opus 5.5 para trabajos que requieren periodos prolongados de razonamiento. La compañía asegura que su costo de ejecución es aproximadamente 40% menor que el de Opus 5 en cargas de trabajo típicas. Ambos modelos se sumaron a Claude Fable 5.1 y Claude Mythos 5.1, anunciados el 1 de septiembre.
Te puede interesar
Fable y Mythos comparten el mismo modelo subyacente, aunque Anthropic aplica salvaguardas y esquemas de acceso diferentes. Fable está disponible de manera general y Mythos permanece limitado a organizaciones autorizadas para trabajos especializados, principalmente de ciberseguridad y ciencias de la vida.
Google hizo una separación similar con Gemini 3.8 Flash y Gemini 3.8 Flash Cyber, presentados el 2 de septiembre. Flash fue lanzado con un precio introductorio de 75 centavos por millón de tokens de entrada y 3.75 dólares por los de salida. Google estableció que esas tarifas estarán vigentes hasta el 31 de diciembre y se duplicarán a partir de enero.
Flash Cyber está dirigido a actividades de ciberseguridad y se distribuye entre usuarios autorizados mediante Fairwind, el programa de acceso de la compañía para defensores de seguridad.
Meta presentó Muse Spark 1.3 también el 2 de septiembre. El modelo está orientado a programación y trabajos realizados por agentes durante periodos más extensos y puede utilizar herramientas mientras mantiene el contexto de una tarea. SpaceXAI lanzó Grok 4.7 el 21, después de aumentar durante su entrenamiento el peso de los problemas que requieren varias horas de trabajo. El modelo parte de 2 dólares por millón de tokens de entrada y 6 por salida.
Te puede interesar
DeepSeek presentó DeepSeek-V4.1-Flash el 10 de septiembre. El modelo tiene 552,000 millones de parámetros dentro de una arquitectura de mezcla de expertos, aunque activa alrededor de 8,000 millones al procesar la entrada y 16,000 millones durante la salida. La compañía asegura que su nueva arquitectura también reduce la memoria necesaria para almacenar la caché del contexto a una cuarta parte en memoria HBM y a una octava parte en almacenamiento SSD frente a la generación anterior, una variable que influye en el costo de tareas que reutilizan grandes cantidades de información.
Alibaba actualizó Qwen3.8-Max-0902 al comenzar septiembre con mejoras para programación y tareas prolongadas realizadas por agentes. Más adelante presentó Qwen3.8-Omni-Flash, capaz de analizar contenido escrito y audiovisual dentro de una ventana de contexto de un millón de tokens y de utilizar herramientas o realizar búsquedas en internet. El cambio amplía el tipo de trabajo que puede automatizar un agente, porque puede examinar grandes cantidades de audio o video y utilizar esa información para ejecutar acciones posteriores, en lugar de limitarse a producir una respuesta sobre el contenido recibido. El modelo admite audio en 113 idiomas y dialectos.
Te puede interesar
Xiaomi también actualizó durante septiembre sus modelos MiMo-V2.6-Pro y MiMo-V2.6-Flash. El 27, la empresa reconoció que ambas variantes podían quedar atrapadas repitiendo llamadas iguales o muy similares a herramientas, con consumo de tiempo y contexto sin avanzar en la tarea. Xiaomi informó que las versiones corregidas estaban disponibles en su API el 25 de septiembre.
Voz, imágenes y decisiones
Google amplió la conversación por voz con Gemini 3.8 Live y Gemini 3.8 Live Extended Thinking el 15. Ambos son modelos de audio a audio para conversaciones en tiempo real. Extended Thinking puede continuar razonando en segundo plano mientras permanece abierta la sesión de voz, lo que permite realizar llamadas a herramientas u otras operaciones durante un intercambio.
Inception lanzó Mercury 2.5 el 8 y utilizó ese anuncio para mostrar una versión preliminar de Mercury Voice. Inception reporta una mediana inferior a 320 milisegundos hasta que el modelo produce el primer token de la respuesta en sus pruebas con solicitudes de atención al cliente.
Alibaba presentó Qwen3.8-LiveTranslate el 18 para interpretación simultánea. El sistema mantiene cobertura de comprensión y traducción de texto para 60 idiomas y salida hablada para 29, mientras la compañía reporta que el retraso promedio de su métrica de interpretación simultánea bajó de 2.8 a 2.3 segundos. Ese mismo mes, Alibaba Cloud incorporó Qwen-Audio-3.1-Realtime-Plus el 20 para conversaciones de voz bidireccionales y Qwen3.8-Omni-Flash-Realtime el 21 para interacciones en tiempo real que combinan audio y video.
Google puso a disposición en su API Gemini 3.8 Flash TTS y Gemini 3.8 Flash-Lite TTS el 22, aunque el anuncio público fue publicado un día después. El primero está orientado a generación de voz con mayor control creativo, mientras Flash-Lite busca reducir el costo y el tiempo de respuesta en aplicaciones de gran volumen. ElevenLabs lanzó Eleven v4 y Eleven v4 Turbo el 28. La variante Turbo está diseñada para reducir la espera en aplicaciones conversacionales y ambos modelos están disponibles mediante la API y los productos de voz de la empresa.
La generación musical sumó Lyria 3.5 de Google el 3 de septiembre. El modelo produce canciones completas a partir de instrucciones de texto o imágenes, permite controlar la estructura y la duración y entrega audio estéreo a 44.1 kilohertz.
OpenAI lanzó GPT-Image-2.5 Sunburst y GPT-Image-2.5 Flare el 8 para generación y edición de imágenes. Sunburst está orientado a trabajos en los que importa la precisión de las modificaciones, mientras Flare prioriza una generación más rápida. Alibaba publicó Qwen-Image-2.1 el 20, un modelo con 7,000 millones de parámetros en su componente visual que reúne generación y edición y admite imágenes con transparencia.
La velocidad de estos lanzamientos ocurre cuando el uso empresarial de inteligencia artificial se extiende en México. En junio de 2026, 48.5% de los establecimientos con más de 100 trabajadores incluidos en la Encuesta Mensual de Actividad Económica Regional de Banco de México declaró utilizar al menos una tecnología de IA, y 64.8% esperaba emplear alguna durante los siguientes tres años. La medición abarca tecnologías distintas de los modelos generativos y tampoco permite conocer qué tan intensamente las utiliza cada establecimiento.






