Anthropic ha anunciado el lanzamiento de Claude Sonnet 4.5, su modelo más reciente orientado a tareas de programación, uso de herramientas y agentes autónomos.
En este artículo desgranamos qué aporta, sus mejoras técnicas y los retos que plantea.
Ir directo a lo que me interesa
Toggle¿Qué es Claude Sonnet 4.5?
Claude Sonnet 4.5 es una versión evolucionada de la familia Claude de Anthropic, especialmente optimizada para:
Generar código y trabajar directamente con entornos de software.
Actuar como agente autónomo, con capacidad de manejar múltiples pasos, usar herramientas y operar más tiempo sin “reinicios”.
Mantener comportamiento alineado ante riesgos como el engaño, adulación excesiva u otros efectos no deseados.
Anthropic lo describe como “el mejor modelo de codificación del mundo” (best coding model in the world)
Principales mejoras y novedades
Aquí están las características destacadas de Sonnet 4.5:
| Mejora / Característica | Qué significa | |
|---|---|---|
| Sesiones continuas de hasta 30 horas | En pruebas internas, el modelo ha mantenido foco en tareas complejas durante más de 30 horas sin “colapsar”. | |
| Mejora sustancial en benchmarks | En el benchmark OSWorld alcanza un 61,4 % frente al 42,2 % de Sonnet 4 en versiones anteriores. | |
| Nuevo soporte para agentes complejos | Mejor manejo de memoria, uso de herramientas múltiples y coordinación entre agentes. | |
| Checkpoints en Claude Code | Permite guardar puntos intermedios durante la generación de código y retroceder si es necesario. | |
| Disponibilidad en plataformas importantes | Ya accesible a través de la API Claude, Amazon Bedrock, Vertex AI y GitHub Copilot | |
| Mismo precio que versiones anteriores | La estructura de costeo para desarrolladores permanece igual: $3 por millón de tokens de entrada y $15 por millón de salida. | |
| Mejora en comportamiento (alineación y seguridad) | Reducción de conductas problemáticas como adulación, engaño y búsqueda de poder; filtro más fuerte frente a ataques de prompt injection. |
Casos de uso y aplicaciones prácticas
Algunas de las formas en que Claude Sonnet 4.5 se perfila como una herramienta clave:
Desarrollo de software autónomo: gracias a su capacidad de mantener operaciones prolongadas, puede gestionar proyectos más largos sin intervención manual frecuente.
Agentes orquestadores: puede coordinar múltiples subtareas, utilizar herramientas externas y administrar flujos complejos de trabajo.
Integración en plataformas de IA empresarial: al estar disponible en servicios como Amazon Bedrock y Vertex AI, puede incorporarse en ecosistemas ya establecidos.
Soporte en Copilot (GitHub): Sonnet 4.5 está siendo desplegado como modelo opcional en GitHub Copilot para usuarios Pro, Pro+, Business y Enterprise.
Límites, riesgos y desafíos
Aunque las mejoras son notables, Sonnet 4.5 no es infalible. Algunos aspectos a tener en cuenta:
Seguridad y alineación aún imperfectas: aunque Anthropic afirma haber mitigado conductas de riesgo, ya hay reportes de bypasses o vulnerabilidades frente a comandos maliciosos.
Dependencia de benchmarks internos: muchos de los avances se basan en pruebas internas o benchmarks seleccionados; el desempeño real en entornos variados aún debe evaluarse.
Costo y acceso: aunque el precio no cambia, el consumo de tokens en tareas largas puede encarecer proyectos intensivos.
Problemas de contexto extremo: en flujos ultra extensos o con muchas herramientas, gestionar el contexto sigue siendo un reto técnico.
Competencia feroz: otros modelos emergentes de OpenAI, Google y otros competidores seguirán empujando límites y podrían superarlo rápidamente.
¿Por qué esta versión es importante para los usuarios de IA en España (o en general)?
Mejores herramientas para desarrolladores: permite que equipos técnicos aceleren tareas de codificación, revisión y orquestación.
Impulso a agentes autónomos: con mayor confiabilidad para mantener tareas largas, se abren nuevas aplicaciones en automatización inteligente.
Puente entre investigación y producción: al estar integrado en plataformas como Bedrock o Copilot, facilita que lo nuevo llegue antes al mundo real.
Relevancia estratégica: en la carrera global por el liderazgo en IA, versiones como esta marcan quién lleva la delantera en capacidades críticas.
Conclusión
Claude Sonnet 4.5 representa un salto sustancial en la familia Claude de Anthropic, especialmente en lo que toca a tareas de programación, agentes autónomos y comportamiento más alineado. Las mejoras técnicas —como sesiones de hasta 30 horas, checkpoints, mejor contexto y mayor robustez— lo hacen una alternativa muy poderosa en el ecosistema de IA.
Sin embargo, no debemos caer en el “mito del modelo perfecto”: aún subsisten riesgos técnicos, de seguridad y de despliegue en entornos reales. La verdadera prueba estará en cómo se comporte en proyectos complejos y comerciales durante meses.
En Academia de IA, creemos que modelos como Sonnet 4.5 empujan los límites de lo posible. Y si eres desarrollador, emprendedor o responsable tecnológico, este lanzamiento merece tu atención.

Abogada especializada en Inteligencia Artificial. Profesora externa de IA en ENAE. Speaker. CEO Fundadora de academiadeia.es, legalprompt.es, fenixcomunicación.es, murciaunica.com y la revista digital para «Nostálgicos de mentes inquietas» generacionfenix.com.
