Anthropic acaba de lanzar Claude 2.1, un modelo de lenguaje grande (LLM) que ofrece una ventana de contexto de 200.000 tokens, una característica que supera el contexto de 120K recientemente anunciado de GPT-4 Turbo de OpenAI. Este lanzamiento estratégico brinda destreza en el manejo de contexto que casi duplica la de su rival más cercano y es el fruto de una asociación ampliada con Google que hizo posible que la startup utilizara sus unidades de procesamiento tensoriales más avanzadas. “Nuestro nuevo modelo Claude 2.1 ofrece una ventana de contexto de token de 200K líder en la industria, una Disminución del doble en las tasas de alucinaciones, indicaciones del sistema, uso de herramientas y precios actualizados”, dijo Anthropic en un tweet hoy. La introducción de Claude 2.1 responde a la creciente demanda de IA que pueda procesar y analizar documentos de formato largo con precisión.
Nuestro nuevo modelo Claude 2.1 ofrece una ventana de contexto de 200.000 tokens líder en la industria, una disminución del doble en las tasas de alucinaciones, indicaciones del sistema, uso de herramientas y precios actualizados. Claude 2.1 está disponible a través de API en nuestra consola y está impulsando nuestra experiencia de chat https://t.co/uLbS2JNczH. pic.twitter.com/T1XdQreluH
– Antrópico (@AnthropicAI) 21 de noviembre de 2023
Esta nueva actualización significa que los usuarios de Claude ahora pueden interactuar con documentos tan extensos como bases de código completas o epopeyas literarias clásicas, desbloqueando el potencial en varias aplicaciones, desde análisis legal hasta crítica literaria. Esta expansión a una ventana de 200 000 tokens no es solo una actualización incremental: si la recuperación La tasa (la capacidad de captar con precisión información de indicaciones largas) entre Claude 2.1 y GPT-4 turbo es proporcional, Claude 2.1 podría manejar las indicaciones de GPT-4 Turbo con mayor precisión que el modelo de OpenAI. El investigador de IA Greg Kamradt rápidamente puso el Claude 2.1 modelo a prueba. «A partir de alrededor de 90.000 tokens, el rendimiento de la recuperación en la parte inferior del documento comenzó a empeorar cada vez más», concluyó. Su investigación encontró niveles de degradación similares para GPT -4 Turbo en alrededor de 65.000 tokens. «Soy un gran admirador de Anthropic: están ayudando a superar los límites del desempeño en LLM y creando herramientas poderosas para el mundo», publicó.
Claude 2.1 (200.000 tokens): prueba de presión para recordar un contexto prolongado A todos nos encanta aumentar la longitud del contexto, pero ¿cómo es el rendimiento? Anthropic se acercó con acceso temprano a Claude 2.1, así que repetí el análisis de «aguja en un pajar» que hice en GPT-4. Esto es lo que encontré:… pic.twitter.com/B36KnjtJmE
—Greg Kamradt (@GregKamradt) 21 de noviembre de 2023
El compromiso de Anthropic de reducir los errores de la IA es evidente en la precisión mejorada de Claude 2.1, que afirma una reducción del 50 % en las tasas de alucinaciones. Esto supone duplicar la veracidad en comparación con Claude 2.0. Estas mejoras se probaron rigurosamente frente a un conjunto sólido de preguntas fácticas complejas diseñadas para desafiar las limitaciones del modelo actual. Como informó anteriormente Decrypt, las alucinaciones eran una de las debilidades de Claude. Un aumento tan drástico en la precisión pondría al LLM en una competencia más cercana contra GPT-4. Con la introducción de una función de uso de herramientas API, Claude 2.1 también se integra más perfectamente en los flujos de trabajo de los usuarios avanzados, lo que demuestra su capacidad para orquestar varias funciones, búsqueda en la web y extraerlos de bases de datos privadas. Aunque aún está en versión beta, esta característica promete extender la utilidad de Claude a través de un espectro de operaciones, desde razonamiento numérico complejo hasta hacer recomendaciones de productos. Además, Claude 2.1 de Anthropic presenta «mensajes del sistema», diseñados para elevar la interacción entre el usuario y la IA. » Estas indicaciones permiten a los usuarios preparar el escenario para las tareas de Claude especificando roles, objetivos o estilos, mejorando así la capacidad de Claude para mantener el carácter en escenarios de juego de roles, cumplir con las reglas y personalizar las respuestas. Esto es comparable a las instrucciones personalizadas de OpenAI, pero más extenso en términos de contexto. Por ejemplo, un usuario podría indicarle a Claude que adopte el tono de un analista técnico al resumir un informe financiero, asegurando que el resultado se alinee con los estándares profesionales. Esta personalización a través de indicaciones del sistema puede aumentar la precisión, reducir las alucinaciones y mejorar la calidad general de una pieza al hacer que las interacciones sean más precisas y contextualmente relevantes. Sin embargo, todo el potencial de Claude 2.1, con su ventana de contexto de 200.000 tokens, está reservado para Claude Pro. usuarios, por lo que los usuarios gratuitos tendrán que ceñirse a Claude 2 con 100.000 tokens y una precisión clasificada entre GPT 3.5 y GPT-4. Los efectos dominó del lanzamiento de Claude 2.1 influirán en la dinámica dentro de la industria de la IA. A medida que las empresas y los usuarios evalúan sus opciones de IA, las capacidades mejoradas de Claude 2.1 presentan nuevas consideraciones para quienes buscan aprovechar la IA por su precisión y adaptabilidad. Editado por Ryan Ozawa.
















