Publi

Grok-3, desarrollado por el Xai de Elon Musk, se presentó el lunes el lunes, con la compañía haciendo afirmaciones audaces sobre sus capacidades al tiempo que muestra una infraestructura informática masiva que indica ambiciones aún mayores. Características, aunque muchas de las manifestaciones reales se sintieron como repeticiones de lo que otras compañías de IA ya han logrado. La estrella de la parte inicial del programa no era la IA en sí misma, sino más bien «Coloso», un clúster gigante de 200,000 GPU que poderes Entrenamiento de Grok-3. El sistema se unió en dos fases: 122 días de entrenamiento sincrónico en 100,000 GPU, seguido de 92 días de escala hasta los 200,000 completos. Según los desarrolladores de XAI, construir esta infraestructura demostró ser más desafiante que desarrollar el modelo de IA en sí. La compañía ya tiene planes para un clúster aún más poderoso, con Musk diciendo que están apuntando cinco veces la capacidad actual, construyendo efectivamente lo que sería el grupo de GPU más poderoso en la Tierra.Cuando se trata de rendimiento, Grok-3 muestra resultados impresionantes en los puntos de referencia estándar de IA. El modelo base (el modelo regular sin cadena de pensamiento y razonamiento incrustado) supera consistentemente los gráficos en las pruebas de matemáticas (AIME), ciencia (GPOA) y codificación (LCB). También parece muy prometedor en las pruebas ciegas. Xai confirmó que el misterioso modelo con el nombre de «chocolate» era en realidad una versión de prueba temprana de Grok-3 que se cargó en la arena de LLM. Durante esas pruebas, logró el mejor elo entre todos los LLM, lo que significa que los usuarios prefirieron sus respuestas a lo largo de las generaciones proporcionadas por todos los demás modelos de IA en competencia directa sin saber qué modelo estaban evaluando. Esta es probablemente la forma más precisa de medir la calidad. Sin dar a los modelos ninguna posibilidad de hacer trampa en los puntos de referencia entrenando a sus AIS en esos conjuntos de datos. Este punto de referencia se basa exclusivamente en la preferencia y la elección ciega por miles de usuarios anónimos.El equipo de XAI muestra las pruebas de referencia de Grok 3 durante una presentación en vivo. Imagen: xai El equipo de XAI muestra las pruebas de referencia de Grok 3 durante una presentación en vivo. Imagen: XAIA Variante de «Beta de razonamiento beta» de XAIA de GROK-3, que emplea el procesamiento interno de la cadena de pensamiento y la computación adicional en el tiempo de prueba, empuja las puntuaciones de matemáticas aún más altas, lo que alcanza el 93% en el punto de referencia del AIME 2025 en comparación con el otro mejor- Realización de modelos que se clasifican por debajo del 87%. Interrumpentemente, una versión más pequeña llamada Beta de razonamiento GROK-3 Mini a veces supera a su hermano más grande, gracias a un tiempo de entrenamiento más largo. En otras palabras, el GROK-3 de tamaño completo todavía tiene margen de mejora una vez que recibe una duración de entrenamiento comparable, lo que parece prometedor dado su mayor recuento de parámetros. Pero cuando Xai se movió para demostrar las capacidades de Grok-3 en vivo, la presentación se sintió más como una Juego de ponerse al día con la innovación. El equipo mostró el modelo que resuelve los problemas de física y escribió el código de juego desde cero: hazañas impresionantes que Chatgpt, Claude y Gemini de Google dominaron hace un tiempo.

Nuevas herramientas, viejos trucos

También introdujeron DeepSearch, un agente de investigación que, al igual que herramientas similares de Operai y Google, recorre la web y genera informes extensos sobre temas dados. X Premium Plus Los suscriptores obtienen acceso inmediato a Grok-3, pero la versión más potente y las versiones actualizadas lo harán Por lo general, vive en una aplicación independiente dedicada o en Grok.com. Las interacciones de voz, similares al «modo de voz avanzado» de Openii, llegarán en las próximas semanas, con Musk enfatizando que esto no es simple texto a voz, sino un modelo genuino de voz de IA capaz de un habla natural y expresiva. Los desarrolladores obtendrán acceso a API en las próximas semanas, junto con las capacidades de transcripción de audio, lo que convierte a Grok-3 en una herramienta poderosa para aplicaciones de terceros con IA. Solo después de mostrar un ejemplo de un juego de Tetris generado por Grok, Xai también reveló planes para Un estudio de juegos de IA que permitirá a los desarrolladores construir juegos impulsados ​​por Grok-3. En este momento, el modelo se está implementando lentamente. Al momento de escribir, Decrypt aún no ha recibido acceso al modelo, pero algunos entusiastas lo han intentado y hasta ahora están satisfechos con los resultados. Computador Científico Lex Friedman, una de las voces más fuertes en el espacio de IA, elogió a Grok-3's capacidades.

Publicidad

Otros lo compararon con los principales rivales del mercado. «Grok 3 + Thinking se siente en algún lugar alrededor del territorio del estado del arte de los modelos más fuertes de OpenAi (O1-Pro, $ 200/mes), y un poco mejor que Deepseek-R1 y Gemini 2.0 Flash Thinking», ex antiguo «, antiguo», antiguo «, antiguo», antiguo «, antiguo», antiguo «, antiguo», antiguo «, antiguo», antiguo «, antiguo», antiguo «, antiguo», antiguo «, antiguo», antiguo «, antiguo»? El cofundador de Operai, Andrej Karpathy, escribió en una extensa publicación sobre X. «Por ahora, grandes felicitaciones al equipo de XAI, claramente tienen una gran velocidad e impulso»

X usuario Penny2X compartió un juego construido desde cero con Grok-3, un juego de plataformas 2D similar a Mario Bros., parecían impresionados por la capacidad de Grok para comprender las instrucciones y mejorar varias iteraciones. «Sigo pidiendo ajustes, y sigue escupiendo el juego en un solo archivo que puedo poner en mi escritorio y ejecutar». Escribió en una publicación sobre X. “Esto es increíble. Vivimos en el futuro. Todos son desarrolladores ahora ”. El juego está disponible para realizar pruebas en agradecimiento Dege. La compañía también confirmó los planes de código abierto Grok-2 una vez que Grok-3 está completamente maduro y se ejecuta correctamente, lo que se espera que ocurra en algún momento de los próximos meses . XAI previamente de origen abierto sus modelos después de Grok-2, continuando su tendencia de lanzar versiones más antiguas para estimular la innovación, aunque Grok-2 se retrasa detrás de los modelos de primer nivel. Por ahora, Grok-3 parece experto en hacer coincidir lo que los mejores modelos de IA pueden ya lo hago. La prueba real se producirá cuando XAI lance sus características de voz prometidas, herramientas de juego y acceso a API en las próximas semanas. Ahora, la pelota está en la cancha de Operai, que lanzará GPT-4.5 pronto. Editado por Sebastian Sinclair

Boletín generalmente inteligente

Un viaje semanal de IA narrado por Gen, un modelo de IA generativo.

Descargo de responsabilidad: Los puntos de vista y opiniones expresadas en este artículo pertenecen a su autor y no necesariamente reflejan aquellas de CriptoPasion. La opinión del autor es a título informativo y en ninguna circunstancia constituye una recomendación de inversión ni asesoría financiera.