Explicador en lenguaje claro
Lo que los LLM no pueden hacer
¿Cuáles son los límites reales de los modelos de lenguaje?
La lista honesta: no pueden saber con fiabilidad lo que no saben, así que la seguridad y el acierto se separan. No tienen memoria más allá de la ventana de contexto salvo que un producto se la añada. La aritmética exacta y el conteo fallan sin una calculadora como herramienta. No pueden verificar hechos contra el mundo, solo contra patrones del texto de entrenamiento. Y no pueden actuar, navegar ni ejecutar código por sí solos; todo 'agent' es un arnés de herramientas y permisos alrededor del mismo predictor.
Revisado por última vez el
Leer es el camino lento. Empieza con una lección gratis que puedes operar ahora mismo.
Empieza gratis: Predice la siguiente palabra →Gratis, sin código, sin registro.
Y después ve más a fondo: El borde del mapa: lo que los LLM no pueden hacer Bloqueada
Lo que la gente entiende mal
- Los límites significan que fallan en todo. Con herramientas, recuperación y verificaciones, son confiables dentro de carriles bien definidos.
- La escala borrará todo esto. Algunos límites, como el autoconocimiento calibrado y el anclaje, son estructurales a la predicción y han sobrevivido a cada salto de escala hasta ahora.
- Una respuesta errónea demuestra que la tecnología es falsa. Mismo sistema, distinto ajuste de tarea. Saber qué tareas encajan es la verdadera habilidad.
Dónde lo ves en productos reales
- Los chatbots traen calculadoras e intérpretes de código porque la aritmética cruda es un punto débil conocido.
- Los productos de agents piden permiso antes de actuar: el arnés, no el modelo, es la capa de seguridad.
- El aviso de 'la IA puede cometer errores' bajo cada chat es esta página, en una línea.
Preguntas frecuentes
- ¿En qué son realmente malos los LLM?
- En aritmética y conteo fiables sin herramientas, en mantenerse consistentes en tareas muy largas, en saber lo que no saben, y en cualquier cosa que dependa de información que nadie escribió. Las herramientas parchean varias de estas. Ninguna se resuelve solo con un modelo más grande.
- ¿La escala va a arreglarlo?
- Algunas han mejorado de forma sostenida con la escala. Las que vienen de la forma del sistema, sin memoria persistente, sin manera de comprobar un dato, sin experiencia del mundo, no son el tipo de cosa que arreglen más parámetros. Los productos las cubren con herramientas y retrieval.
- ¿Qué no debería delegar nunca sin revisar?
- Todo aquello donde equivocarse con seguridad sale caro: detalles legales, médicos y financieros, números sobre los que vas a actuar, y cualquier cosa irreversible. Usa el modelo para redactar y explorar, y verifica las partes que tienen consecuencias.
Explicadores relacionados
Más en Construir encima, y confiar en ello
- ¿Qué es la generación aumentada por recuperación (RAG)?
- ¿Qué son los evals, y cómo saben los equipos que una función de IA funciona?
- ¿Qué es una base de datos vectorial y por qué todo stack de RAG tiene una?
- ¿Qué es usar un LLM como juez y funciona?
- ¿Uso RAG o fine-tuning?
- ¿Qué es un data flywheel y por qué dicen que es el foso de la IA?
Una idea a la vez, en tu correo
Lecciones y explicadores nuevos, escritos como están escritas estas páginas. De vez en cuando, no a diario, y nunca una secuencia de venta.
Primero te enviamos un enlace de confirmación. Puedes darte de baja con un clic, cuando quieras. Privacidad.
Parte de See How AI Works, un curso interactivo gratuito, donde aprendes cómo funciona la IA moderna operándola, no viendo videos.