La última actualización de ChatGPT potencia el rendimiento - ¡Obtén los detalles!

La última actualización de ChatGPT potencia el rendimiento – ¡Obtén los detalles!

Cada vez más, las empresas de IA prueban modelos nuevos y experimentales con nombres extraños en el Chatbot Arena de LMSYS y los implementan silenciosamente sin ninguna nota de lanzamiento. Un ejemplo de ello es que, desde la semana pasada, los usuarios de X han estado hablando sobre un rendimiento mejorado en ChatGPT, ya sea para tareas de codificación o creativas. Muchos creían que se trataba de un nuevo modelo de OpenAI, probablemente relacionado con Project Strawberry, un nuevo motor de razonamiento avanzado.

Finalmente, OpenAI dejó salir al genio de la botella y reveló que ChatGPT de hecho está ejecutando un nuevo modeloNo se trata de un nuevo modelo de clase fronteriza, sino de un modelo GPT-4o mejorado. Nota de lanzamiento dice que es un modelo GPT-4o actualizado y optimizado para chat, y su nombre es chatgpt-4o-latest. Basándose en los comentarios cualitativos y los resultados de los experimentos, OpenAI ha ajustado el Modelo GPT-4o para un mejor rendimiento.

Hay un nuevo modelo GPT-4o en ChatGPT desde la semana pasada. ¡Esperamos que lo disfruten y que lo prueben si aún no lo han hecho! Creemos que les gustará. — ChatGPT (@ChatGPTapp) 12 de agosto de 2024

OpenAI dice además que continúa eliminando datos incorrectos del conjunto de datos de entrenamiento y agregando datos buenos junto con «experimentando con nuevos métodos de investigación.”Aquí es donde comienza la intriga. Se supone que el proyecto Strawberry aportará un nuevo método de post-entrenamiento para mejorar el razonamiento. ¿El nuevo modelo ChatGPT ya está ejecutando el motor Strawberry?

Vaya, GPT-4o ahora utiliza razonamiento de varios pasos. Es impresionante ver esto en acción. Resulta que la actualización no era un nuevo modelo, sino un nuevo método. imagen.twitter.com/kVF0ndA21T— Ra (@misaligned_agi) 13 de agosto de 2024

No puedo decirlo con seguridad, pero muchos usuarios de X notaron que ChatGPT ahora usa un razonamiento de varios pasos para dar respuestas correctas. En este método, El modelo se mejora a sí mismo generando diversos razonamientos paso a paso y, finalmente, llegando a una conclusión correcta.

Por cierto, OpenAI también probó el nuevo modelo ChatGPT en LMSYS bajo el nombre de “anonymous-chatbot” y recibió más de 11.000 votos. El nuevo modelo “chatgpt-4o-latest” volvió a ocupar el primer puesto, superando a otros modelos de IA de Google, Anthropic y Meta. Se convirtió en el primer modelo en obtener 1314 puntos en LMSYS Arena.

¡Actualización emocionante de Chatbot Arena!

Lo último @AiOpen La API ChatGPT-4o (20240808) se ha probado bajo el nombre de “anonymous-chatbot” durante la última semana con más de 11 000 votos de la comunidad.

OpenAI ha recuperado con éxito la posición número 1, superando a Gemini-1.5-Pro-Exp de Google con un… https://t.co/9lJlASI9UW imagen.twitter.com/gxCDuBOi9N—lmsys.org (@lmsysorg) 14 de agosto de 2024

¿El nuevo modelo ChatGPT pasa la prueba Vibe?

Para probar el modelo ChatGPT actualizado, probé algunas preguntas de razonamiento y, bueno, no encontré mucha diferencia entre el modelo anterior y el más reciente. Le pedí que encontrara el número más grande entre 9,11 y 9,9 y me dio una respuesta correcta, como antes. También realicé otras preguntas de razonamiento de sentido común y estaban en línea con el modelo anterior.

Sin embargo, en algunas indicaciones, sigue sin obtener la respuesta correcta. Por ejemplo, en respuesta a la indicación siguiente, me dice que apile 9 huevos en la parte superior de la botella, lo cual es imposible.

Aquí tenemos un libro, 9 huevos, una computadora portátil, una botella y un clavo. Por favor, dígame cómo apilarlos uno sobre otro de manera estable.

En otra prueba, dice que solo hay dos “R” en la palabra fresa, lo cual nuevamente es incorrecto.

¿Cuántas Rs hay en fresa?

Probando una pregunta complicada en chatgpt

Es posible que el nuevo modelo ChatGPT no se haya implementado de forma generalizada. De cualquier manera, con el nuevo modelo de OpenAI, podemos esperar mejoras en otras áreas clave. Si tienes alguna pregunta, háznosla saber en los comentarios a continuación.

Apoya nuestro trabajo ❤️

Si te ha gustado este artículo, considera dejar una propina para ayudarnos a seguir publicando contenido de calidad.

Pago seguro en PayPal
Véase también:  El Estudio de IA de Sopas de Darren Aronofsky Obtiene Gran Financiación de Inversores
Moyens I/O Staff te ha motivado, brindándote asesoría en tecnología, desarrollo personal, estilo de vida y estrategias que te ayudarán.