OpenAI está a punto de lanzar dos modelos innovadores que podrían redefinir el panorama del aprendizaje automático. Con los nombres en código Strawberry y Orion, estos proyectos tienen como objetivo llevar las capacidades de la IA más allá de los límites actuales, en particular en el razonamiento, la resolución de problemas y el procesamiento del lenguaje, acercándonos un paso más a la inteligencia artificial general (AGI). Strawberry, anteriormente conocido como Q* o Q-Star, parece ser más que un simple chatbot; se centra en mostrar un salto significativo en las capacidades de razonamiento de la IA. Fuentes familiarizadas con el proyecto han dicho a diferentes medios de comunicación como Reuters o The Information que ha demostrado una notable competencia en la resolución de problemas matemáticos complejos y la mejora del análisis lógico. Orion, por su parte, se posiciona como el próximo modelo de lenguaje insignia de OpenAI, potencialmente sucediendo a GPT-4. Está diseñado para superar a su predecesor en la comprensión y generación del lenguaje, con la capacidad añadida de gestionar entradas multimodales, incluidos texto, imágenes y vídeos. Ambos proyectos han atraído la atención de los funcionarios de seguridad nacional de Estados Unidos, lo que subraya su posible importancia estratégica. Este desarrollo se produce mientras OpenAI continúa recaudando capital a pesar del crecimiento sustancial de los ingresos, probablemente debido a los altos costos asociados con el desarrollo y el entrenamiento de estos modelos avanzados.
Fresa y poder de razonamiento
A pesar de la interminable oleada de especulaciones en Internet, OpenAI no ha dicho nada oficialmente sobre el Proyecto Strawberry. Sin embargo, las supuestas filtraciones gravitan hacia sus capacidades de razonamiento sofisticado. A diferencia de los modelos tradicionales que proporcionan respuestas rápidas, se dice que Strawberry emplea lo que los investigadores llaman «pensamiento del Sistema 2», capaz de tomarse el tiempo para deliberar y razonar sobre los problemas, en lugar de predecir conjuntos más largos de tokens para completar sus respuestas. Este enfoque ha producido resultados impresionantes, ya que el modelo obtuvo una puntuación superior al 90 por ciento en el punto de referencia MATH (una colección de problemas matemáticos avanzados), según Reuters. Otra innovación clave que se espera de Strawberry es su capacidad para generar datos de entrenamiento sintéticos de alta calidad. Esto aborda un desafío crítico en todo el desarrollo de la IA: la escasez de datos diversos y de alta calidad para los modelos de entrenamiento. Si es cierto, Strawberry no solo mejora sus propias capacidades, sino que también allana el camino para modelos más avanzados como Orion. Teniendo en cuenta las enormes cantidades de datos que ya ha extraído OpenAI y el movimiento en pro de la privacidad que ahora está muy presente entre los usuarios que no están dispuestos a dar sus datos a los entrenadores de IA, esta característica puede desempeñar un papel importante en la calidad de los futuros modelos de IA, al igual que algunos usuarios entrenan hoy sus propios modelos personalizados utilizando imágenes generadas por Stable Diffusion. Sin embargo, el enfoque de procesamiento deliberado de Strawberry puede presentar desafíos para las aplicaciones en tiempo real. Según se informa, los investigadores de OpenAI están trabajando en «destilar» las capacidades de Strawberry, básicamente disminuyendo su calidad para que los consumidores puedan hacer cantidades masivas de inferencias a bajos costos de computación. Aun así, la posible integración de la tecnología de Strawberry en productos orientados al consumidor como ChatGPT podría marcar un impulso significativo en la forma en que OpenAI entrena nuevos modelos. Sin embargo, es posible que OpenAI use Strawberry como base para entrenar nuevos modelos en lugar de ponerlo ampliamente disponible para los consumidores.
Proyecto Orión o GPT Next
El proyecto Orion se presenta como el ambicioso sucesor de GPT-4o de OpenAI, con el objetivo de establecer nuevos estándares en la IA del lenguaje. Una presentación reciente de Tadao Nagasaki, director ejecutivo de OpenAI Japón, sugiere que podría llamarse GPT Next. Aprovechando los avances del proyecto Strawberry, Orion está diseñado para sobresalir en el procesamiento del lenguaje natural y, al mismo tiempo, expandirse hacia capacidades multimodales. Y OpenAI afirma que el salto no será gradual. «El próximo modelo de IA, que probablemente se llamará 'GPT Next', evolucionará casi 100 veces más que sus predecesores, a juzgar por el desempeño pasado», dijo Nagasaki en la KDDI SUMMIT 2024 en Japón, según informó IT Media, «A diferencia del software tradicional, la tecnología de IA crece exponencialmente. Por lo tanto, queremos apoyar la creación de un mundo donde la IA se integre lo antes posible».
'GPT Next' logrará un aumento de 3 OOM. Excelentes ideas de la #CumbreKDDIS. Tadao Nagasaki de @AiOpen Japón dio a conocer sus planes para 'GPT Next', que promete un salto de órdenes de magnitud (OOM). ⚡️ Este modelo de IA apunta a un volumen computacional 100 veces mayor que GPT-4, utilizando recursos similares pero… foto.twitter.com/fMopHeW5ww
— Shaun Ralston (@shaunralston) 3 de septiembre de 2024
El entrenamiento de Orion con datos producidos por Strawberry representaría una ventaja técnica para OpenAI. Sin embargo, esta técnica debe usarse con precaución. Los investigadores ya han demostrado que los modelos comienzan a degradarse después de ser entrenados con demasiados datos sintéticos, por lo que encontrar ese punto óptimo en el que Strawberry puede hacer que Orion sea poderoso sin afectar su precisión parece clave para que OpenAI siga siendo competitivo. Las capacidades multimodales nativas de Orion también representarán un avance significativo. El modelo se está desarrollando para integrar sin problemas entradas y salidas de texto, imagen e incluso video, como informó The Information, lo que abre nuevas posibilidades para los usuarios de ChatGPT y pone a la empresa en competencia directa con Gemini de Google, que puede procesar hasta 2 horas de entrada de video. Este es el modelo con el que interactuarán los usuarios cuando usen ChatGPT o API Playground de OpenAI. El desarrollo de Orion se alinea con la estrategia más amplia de OpenAI para mantener su ventaja competitiva en un panorama de IA cada vez más concurrido. Con modelos de código abierto como LLaMA-3.1 de Meta y modelos de última generación como Claude o Gemini haciendo rápidos progresos, Orion es básicamente la apuesta de OpenAI para mantenerse a la vanguardia.
Boletín informativo generalmente inteligente
Un viaje de IA semanal narrado por Gen, un modelo de IA generativa.


















