La compañía asegura que esta versión es más propensa a marcar sus propias incertidumbres y evita hacer afirmaciones sin respaldo, mejorando la confiabilidad en tareas complejas.
Anthropic lanzó este jueves Claude Opus 4.8, una actualización de su modelo insignia que pone el foco en la honestidad. La empresa busca que la inteligencia artificial sea más transparente cuando no tiene suficiente información o cuando podría estar equivocada.
Según explicaron desde Anthropic, los modelos de IA suelen tener un problema común: a veces sacan conclusiones apresuradas y las presentan con demasiada confianza aunque las evidencias sean débiles. Con esta nueva versión, Opus 4.8 sería cuatro veces menos propenso que su antecesor a dejar pasar errores en código sin mencionarlos.
Los primeros testers destacaron que el modelo ahora es más propenso a señalar las incertidumbres sobre su propio trabajo y evita hacer afirmaciones que no puede respaldar del todo. Esto representa un avance en el entrenamiento para que las IAs sean más honestas.
Control sobre el esfuerzo de la IA
Otra novedad importante es que los usuarios ahora pueden indicarle al modelo cuánto esfuerzo quiere que ponga en cada tarea. Las respuestas de mayor esfuerzo consumen más tokens, lo que permite a los usuarios elegir opciones más livianas cuando no quieren gastar tan rápido sus límites de uso.Esta funcionalidad da mayor control y flexibilidad, especialmente para quienes usan la herramienta de forma intensiva en su día a día.
Además, Anthropic presentó en vista previa una característica llamada "dynamic workflows". Esta permite que Claude tome tareas mucho más grandes: el modelo puede planificar el trabajo, ejecutar cientos de subagentes en paralelo dentro de una misma sesión y verificar sus resultados antes de entregarlos al usuario.
Con Opus 4.8, estos agentes pueden funcionar durante más tiempo, lo que abre la puerta a proyectos más ambiciosos y complejos.
Desde la compañía remarcaron que entrenan a todos sus modelos para ser honestos, evitando que hagan afirmaciones que no pueden sostener. Este enfoque busca solucionar uno de los dolores de cabeza más grandes en el desarrollo de inteligencias artificiales actuales.
El lanzamiento se produce en un momento donde la industria busca equilibrar el poder de estas herramientas con mayor responsabilidad y transparencia en sus respuestas. Opus 4.8 parece dar un paso concreto en esa dirección al priorizar la claridad sobre la confianza excesiva.