Saltar al contenido principal
Iniciochevron_rightBlogchevron_rightUn modelo de IA gratis arrasa entre programadores y nadie sabe quién lo fabricó
smart_toyIA & ML

Un modelo de IA gratis arrasa entre programadores y nadie sabe quién lo fabricó

U
UNOVSUNO Editorial
··hace 24 días·schedule3 min lectura
Un modelo de IA gratis arrasa entre programadores y nadie sabe quién lo fabricó

Se llama Ox Alpha, resuelve casi seis de cada diez pruebas de programación y su dueño se niega a dar la cara. Qué se sabe, qué se especula y por qué conviene medir lo que le mandas.

Un modelo de inteligencia artificial apareció en internet el jueves pasado, empezó a resolver tareas de programación mejor que buena parte de la competencia, y a día de hoy ninguna empresa ha dicho que sea suyo.

Qué ha pasado

Se llama Ox Alpha y se publicó en OpenRouter, la plataforma que agrupa modelos de distintos fabricantes bajo una misma interfaz. Su ficha lo describe como «un modelo de razonamiento diseñado para programación, trabajo agéntico sostenido y cargas de producción», y lo etiqueta como modelo stealth: «desarrollado y operado por un proveedor externo que ha decidido permanecer anónimo durante esta vista previa».

Esa frase no es un detalle burocrático. Es toda la noticia. No hay artículo científico, no hay nota de prensa, no hay consejero delegado subido a un escenario con una gráfica de barras. Solo un modelo que funciona y una casilla de fabricante en blanco.

Patrick Collison, consejero delegado de Stripe —la empresa que está comprando OpenRouter—, lo describió públicamente como «muy impresionante». Xataka calcula que el modelo ya mueve del orden de 12 billones de tokens semanales.

Qué sabe hacer

Es un modelo de razonamiento orientado a programar y a tareas largas de tipo agéntico. Acepta texto, imágenes y vídeo como entrada, tiene una ventana de contexto de 1,05 millones de tokens y puede generar hasta 128.000 tokens de respuesta.

El dato más concreto que hay sobre la mesa es una prueba independiente con DeepSWE, un banco de pruebas de programación: resolvió 66 de 113 tareas, un 58,4%. Con un matiz que conviene leer entero: cerca del 10% de los fallos se debieron a errores en el formato de las llamadas a herramientas, no a que el modelo no supiera resolver el problema.

Las teorías sobre quién está detrás

Casi toda la especulación apunta a China. El analista Andrew Curran contaba el viernes que las primeras sospechas señalaban a los modelos GLM de la china Z.ai, pero que «esta mañana la gente parece menos segura de nada». Wccftech publicó primero que las pruebas apuntaban a GLM y después actualizó su artículo sugiriendo que podría tratarse de una versión no publicada de MAI, el modelo de Microsoft. En Reddit conviven un hilo que asegura que «no puede ser chino» y otro que declara «alta confianza» en que sí lo es.

Hay un indicio que enfría la hipótesis china: según Xataka, el modelo parece estar sirviéndose desde Estados Unidos. Nada de esto está confirmado por nadie que tenga acceso real a la respuesta.

La letra pequeña: es gratis, y esa es la parte importante

Estos días se puede usar sin pagar, y eso explica buena parte de la viralidad. Pero el uso gratuito trae la contrapartida de costumbre: el proveedor se queda con las peticiones y con las respuestas. Asegura que no las usa para entrenar el modelo.

El problema es que esa promesa la hace alguien de quien no sabemos el nombre, ni el país, ni la ley bajo la que opera. Con un proveedor conocido puedes leer su política de privacidad y decidir si te compensa. Aquí no hay a quién leer.

Qué significa para ti

Si programas, tienes gratis y durante unos días un modelo que rinde por encima de lo que suele ofrecerse sin pagar. Aprovecharlo para código de juguete, ejercicios o pruebas es razonable. Mandarle código de tu empresa, credenciales, datos de clientes o cualquier cosa que no publicarías en un foro abierto, no lo es.

Y si no programas, la historia sigue siendo útil, porque enseña cómo funciona hoy el sector: el misterio es la campaña de marketing. Un lanzamiento normal con benchmarks y titulares se olvida en 48 horas. Un modelo anónimo y gratuito lleva días consiguiendo que miles de desarrolladores lo prueben, lo analicen y hablen de él sin cobrar por ello.

¿Le confiarías tu código a un modelo del que no sabes ni quién lo opera?

Fuentes

Fuente original: techcrunch.com

Sigue leyendo

Comentarios

0/2000