Un modelo de IA gratis arrasa entre programadores y nadie sabe quién lo fabricó

Se llama Ox Alpha, resuelve casi seis de cada diez pruebas de programación y su dueño se niega a dar la cara. Qué se sabe, qué se especula y por qué conviene medir lo que le mandas.
Un modelo de inteligencia artificial apareció en internet el jueves pasado, empezó a resolver tareas de programación mejor que buena parte de la competencia, y a día de hoy ninguna empresa ha dicho que sea suyo.
Qué ha pasado
Se llama Ox Alpha y se publicó en OpenRouter, la plataforma que agrupa modelos de distintos fabricantes bajo una misma interfaz. Su ficha lo describe como «un modelo de razonamiento diseñado para programación, trabajo agéntico sostenido y cargas de producción», y lo etiqueta como modelo stealth: «desarrollado y operado por un proveedor externo que ha decidido permanecer anónimo durante esta vista previa».
Esa frase no es un detalle burocrático. Es toda la noticia. No hay artículo científico, no hay nota de prensa, no hay consejero delegado subido a un escenario con una gráfica de barras. Solo un modelo que funciona y una casilla de fabricante en blanco.
Patrick Collison, consejero delegado de Stripe —la empresa que está comprando OpenRouter—, lo describió públicamente como «muy impresionante». Xataka calcula que el modelo ya mueve del orden de 12 billones de tokens semanales.
Qué sabe hacer
Es un modelo de razonamiento orientado a programar y a tareas largas de tipo agéntico. Acepta texto, imágenes y vídeo como entrada, tiene una ventana de contexto de 1,05 millones de tokens y puede generar hasta 128.000 tokens de respuesta.
El dato más concreto que hay sobre la mesa es una prueba independiente con DeepSWE, un banco de pruebas de programación: resolvió 66 de 113 tareas, un 58,4%. Con un matiz que conviene leer entero: cerca del 10% de los fallos se debieron a errores en el formato de las llamadas a herramientas, no a que el modelo no supiera resolver el problema.
Las teorías sobre quién está detrás
Casi toda la especulación apunta a China. El analista Andrew Curran contaba el viernes que las primeras sospechas señalaban a los modelos GLM de la china Z.ai, pero que «esta mañana la gente parece menos segura de nada». Wccftech publicó primero que las pruebas apuntaban a GLM y después actualizó su artículo sugiriendo que podría tratarse de una versión no publicada de MAI, el modelo de Microsoft. En Reddit conviven un hilo que asegura que «no puede ser chino» y otro que declara «alta confianza» en que sí lo es.
Hay un indicio que enfría la hipótesis china: según Xataka, el modelo parece estar sirviéndose desde Estados Unidos. Nada de esto está confirmado por nadie que tenga acceso real a la respuesta.
La letra pequeña: es gratis, y esa es la parte importante
Estos días se puede usar sin pagar, y eso explica buena parte de la viralidad. Pero el uso gratuito trae la contrapartida de costumbre: el proveedor se queda con las peticiones y con las respuestas. Asegura que no las usa para entrenar el modelo.
El problema es que esa promesa la hace alguien de quien no sabemos el nombre, ni el país, ni la ley bajo la que opera. Con un proveedor conocido puedes leer su política de privacidad y decidir si te compensa. Aquí no hay a quién leer.
Qué significa para ti
Si programas, tienes gratis y durante unos días un modelo que rinde por encima de lo que suele ofrecerse sin pagar. Aprovecharlo para código de juguete, ejercicios o pruebas es razonable. Mandarle código de tu empresa, credenciales, datos de clientes o cualquier cosa que no publicarías en un foro abierto, no lo es.
Y si no programas, la historia sigue siendo útil, porque enseña cómo funciona hoy el sector: el misterio es la campaña de marketing. Un lanzamiento normal con benchmarks y titulares se olvida en 48 horas. Un modelo anónimo y gratuito lleva días consiguiendo que miles de desarrolladores lo prueben, lo analicen y hablen de él sin cobrar por ello.
¿Le confiarías tu código a un modelo del que no sabes ni quién lo opera?
Fuentes
Sigue leyendo

Hugging Face, el almacén donde vive la IA abierta, negocia venderse por 13.000 millones
La plataforma donde se comparten los modelos abiertos ha recibido ofertas por 13.000 millones de dólares. Su consejero delegado lleva meses diciendo que su responsabilidad es con la comunidad.

Un abogado citó 48 sentencias que no existían: se las inventó ChatGPT y acabó multado
El Tribunal Superior de Justicia de Canarias sancionó a un letrado que presentó un recurso con 48 citas de jurisprudencia inventadas. No es un caso aislado, y los estudios explican por qué se repite.

WhatsApp prueba agentes de IA de otras empresas, y esos chats no van cifrados
La beta de Android 2.26.35.3 permite conectar hasta cinco asistentes externos. Los mensajes pasan por un servicio de Meta que puede leerlos: el cifrado de extremo a extremo no aplica ahí.

Una IA corrigiendo los fallos de otra IA: 4 dólares la hora contra 150 del humano
Anthropic puso a Claude a buscar arreglos para diez fallos de comportamiento de sus propios modelos. Los encontró para los diez, superó a 28 investigadores humanos y cobró 4 dólares la hora en vez de 150.