Inteligencia Artificial

OpenAI lanzó una API de decisiones y avivó la pelea por la IA rápida y barata

Sam Altman presentó en el Dev Day una herramienta que compite con Jev, el modelo de TypeSafe pensado para automatizar software a bajo costo.

Redacción••3 min de lectura
Compartí esta nota:
OpenAI’s Jev clone could help the frontier lab stop its swarming agents

OpenAI presentó en su evento Dev Day una nueva herramienta llamada Decisions API, un producto que ofrece funciones similares a Jev, el modelo que la startup TypeSafe AI lanzó este mes para automatizar software. La revelación la hizo el CEO de la compañía, Sam Altman, como un comentario al pasar durante la jornada del martes.

La API permite darle a Luna, el modelo de OpenAI, un conjunto predefinido de opciones para que elija entre ellas, como categorías para clasificar una imagen o distintos comportamientos de un agente. El objetivo es que la herramienta sea veloz y económica sin perder capacidades de comprensión de imágenes, soporte de idiomas ni protecciones de seguridad.

“Al enfocar el modelo en esa elección, podemos hacerlo extremadamente rápido mientras conservamos capacidades como la comprensión de imágenes, el amplio soporte de idiomas y las protecciones de seguridad”, afirmó Altman durante la presentación.

TypeSafe no respondió a las consultas periodísticas sobre el nuevo producto, pero su CEO, Diogo Almeida, ex ingeniero de OpenAI y coinventor del aprendizaje por refuerzo, bromeó en la red social X sobre el comienzo de las “guerras de clones”. Además, sostuvo que el interés de OpenAI puede ser “una señal de que construir de una manera compatible con System One es el futuro”.

El trasfondo del asunto es que los modelos de lenguaje tal como se conocen no son la solución adecuada para gran parte del software, porque resultan lentos y caros en comparación. Los desarrolladores que usan Jev para complementar esos modelos comprobaron que obtienen respuestas más rápidas y a menor costo.

Todavía no está claro cuánto se parecerá Decisions API a Jev, ya que OpenAI la lanzó como una vista previa limitada y hasta ahora no se conocen desarrolladores que la hayan puesto a prueba en profundidad. Sin embargo, las conversaciones en X muestran interés en la propuesta.

La apuesta de Almeida se apoya en los datos sintéticos que genera su empresa para producir resultados estadísticamente útiles. “Rápido y barato es muy fácil, ¿sabés? Si lo querés realmente rápido y barato, usá un dado. La inteligencia es la parte difícil, y mi norte siempre es empujar la curva de inteligencia por dólar”, declaró a la prensa la semana pasada.

Una de las aplicaciones más prometedoras de estos modelos es la vigilancia y la seguridad de los agentes de IA. Tras una serie de incidentes en los que sus agentes se comportaron mal en internet abierto, OpenAI incorporó como medida de seguridad un modelo separado que vigila las acciones indebidas, aunque a un costo de cómputo significativo.

Shapor Naghibzadeh, profesional de ciberseguridad con larga trayectoria y fundador de la startup QueryStory, considera que un modelo como Jev podría cumplir esa tarea a un precio mucho menor. Para un hackathon del fin de semana pasado construyó una demostración que usa Jev para contrastar cada acción de un agente con la tarea encomendada: bloquea las que considera malas con alta confianza, marca otras para revisión y permite el resto.

En teoría, ese tipo de monitoreo podría haber detenido el incidente de Hugging Face. El costo de esa vigilancia es de 2,94 dólares con Jev, frente a 372 dólares con un modelo de frontera.

La observación clave es que Jev resulta lo bastante barato como para ejecutarse en cada acción de un agente, lo que ofrece una capa de revisión que podría mejorar la confiabilidad de los agentes en general. Es lo que TypeSafe esperaba lograr y ahora OpenAI también advirtió su valor.

Por qué importa

La pelea entre OpenAI y TypeSafe marca un giro en la industria: los modelos de lenguaje lentos y caros dejan de ser la única opción para automatizar software. Si los modelos de decisión se consolidan, el monitoreo de agentes de IA podría volverse masivo y mucho más barato.

Qué sigue

Habrá que ver si OpenAI amplía la vista previa limitada de Decisions API y cómo responde TypeSafe. La calibración de estos modelos con la realidad y la carrera por la inteligencia por dólar serán los ejes de la competencia en los próximos meses.

¿Te gustó esta nota?

Recibí lo más importante del día en tu correo. Sin spam, con opción de baja siempre.

Más en Inteligencia Artificial