2026 en LLMs (hasta ahora)
· Fuente: Simon Willison
Simon Willison cerró el congreso WeAreDevelopers en San José con una charla que repasó los hitos más relevantes de los modelos de lenguaje grande (LLM) en 2026, aunque el año aún no ha terminado. Señaló que el punto de inflexión se produjo en noviembre de 2025, cuando se lanzaron Claude Opus 4.5 y GPT‑5.1. Ambas versiones introdujeron mejoras incrementales, pero lo más destacado fue la evolución de sus agentes de codificación, que pasaron de generar errores frecuentes a ser lo suficientemente fiables para usarse cotidianamente.
Willison utiliza su “benchmark” personal –pedir a los modelos que dibujen un pelícano montado en una bicicleta– para ilustrar que, pese a los avances, la calidad visual sigue siendo limitada; Claude aún no logra representar una bicicleta y GPT‑5.1 produce un marco bastante deficiente. Durante las vacaciones de diciembre, muchos desarrolladores experimentaron con estas combinaciones de modelo y agente, descubriendo nuevas capacidades que antes no existían.
El ponente también comentó su cambio de estrategia personal: en lugar de limitarse a proyectos existentes, decidió aprovechar los agentes de código para lanzar tantos proyectos nuevos como sea posible, con el objetivo de explorar los límites de la tecnología.
Esta noticia es relevante porque muestra cómo los LLM están consolidándose como herramientas de desarrollo confiables, lo que podría acelerar la creación de software y reducir la dependencia de programadores humanos en tareas rutinarias. Además, la creciente confianza en estos agentes abre la puerta a nuevas aplicaciones empresariales y a la necesidad de abordar desafíos como la sandboxing y la seguridad.
Leer artículo original en Simon Willison
Este resumen es una síntesis informativa elaborada por dataqbs.com. Todos los derechos sobre el contenido original pertenecen a su autor y al medio de comunicación citado. Nosotros solo actuamos como curadores de noticias tecnológicas, sin reclamar autoría alguna.