Saltar al contenido
todas las lecciones
Operación y escalado4.10Bloqueada

El dial del pensamiento: cuándo de más perjudica

Si pensar ayuda, súbelo al máximo. ¿verdad?

La idea que hay dentro

Pensar más da rendimientos decrecientes y luego negativos, así que ajusta el presupuesto a la tarea.

Después de esta lección

Puedes razonar sobre los presupuestos de pensamiento: cuándo más razonamiento ayuda y cuándo malgasta tiempo y dinero.

Adónde lleva

Generar tokens es el cuello de botella. ¿podemos hacerlo más rápido?

Dentro de esta lección

Ese es el escenario real de la lección, en pausa. Reclama tu pase para operarlo.

Mira cómo funciona la IA de verdad, de principio a fin.

Esta lección es solo una parada del arco completo. Desbloquéalo todo y consérvalo de por vida.

Lo que obtienes

  • El camino principal de 34 lecciones, una ruta que sí se termina, de una palabra a los agentes
  • Rutas por objetivo para usar IA en el trabajo y construir funciones con IA
  • Labs de jefe que te hacen aplicar un acto entero, no solo reconocerlo
  • Repaso espaciado que trae cada idea de vuelta antes de que la olvides
  • Memoria del curso: cada término definido, con enlaces a donde aparece por primera vez
  • Una tarjeta de capacidades para compartir cuando termines el camino principal
  • Acceso de por vida en cualquier dispositivo, con todas las lecciones futuras incluidas

No son videos para mirar. Predices, operas la máquina y luego lo demuestras. Por eso se queda.

99 lecciones y retos interactivos. Sin videos, sin código.

Pase de lanzamiento gratis: acceso de por vida, sin tarjeta

¿Nuevo por aquí? Las primeras lecciones son gratis para probar. Empieza con la lección 0.1

Qué muestra esta lección

Pensar más da rendimientos decrecientes y luego negativos, así que ajusta el presupuesto a la tarea.

La pregunta con la que abre

Si pensar ayuda, súbelo al máximo. ¿verdad?

El recorrido, en palabras de la propia lección

  • Sube el dial de pensamiento en una tarea fácil. Mira subir el costo y la latencia, ¿y la calidad?
  • Pensar más tiempo hizo al modelo más inteligente la lección pasada. ¿Entonces solo sube el dial al máximo, siempre?
  • Ajusta el presupuesto a la tarea: mucho para problemas difíciles, un poco para los medios, casi nada para los fáciles.
  • Curvas inventadas. Pensar de más una tarea fácil es un efecto real, pero suele ser una caída leve, no este precipicio.
  • Cuántos tokens de razonamiento se le permiten al modelo antes de responder.
  • En una tarea fácil la calidad empieza alta y se mantiene, pero el costo y la latencia suben todo el tiempo. Arrastra más allá de la mitad y mira cómo cae la calidad. Luego prueba las otras tareas.
  • Esta tarea necesitaba pensar un poco y ya se aplanó: pasado su punto óptimo, el presupuesto extra compra casi nada.
  • Una tarea media sube rápido: un presupuesto pequeño compra casi toda la calidad. Fíjate dónde se aplana la curva.
  • Demasiado presupuesto en una tarea trivial: el modelo puede dudar de sí mismo hasta dar una respuesta rebuscada, mientras te cobra más y te hace esperar.
  • Un problema realmente difícil necesita espacio para razonar. Aquí el presupuesto extra compró calidad real: el costo y la latencia valieron la pena.
  • En una tarea difícil la calidad empieza baja. Sigue arrastrando a la derecha y sube: aquí es donde el presupuesto justifica su costo.
  • Pensar más compró más precisión la lección pasada, ¿entonces solo súbelo al máximo, siempre?
  • Pensar más es un dial, no un interruptor: ayuda en un problema difícil, pero en uno fácil el modelo puede convencerse a sí mismo de descartar la respuesta correcta. Cada tarea tiene su propio punto óptimo, el punto donde su curva se aplana, y queda en un lugar distinto cada vez.
  • Lección anterior: gastar más cómputo en el momento de responder, dejar que el modelo piense más tiempo, compraba más precisión. Lo obvio es subir ese dial al máximo, siempre. No es gratis, pero más inteligente vale la pena, ¿no?
  • An easy task is already at full quality with zero thinking, it needs no working-out, so more reasoning just burns
  • Pones un modelo de razonamiento en su nivel de pensamiento más alto para todo, y ahora una simple pregunta de sí/no vuelve más lenta y a veces mal. ¿Por qué?
  • El pensamiento es un dial, no un interruptor: pasado el punto justo, el modelo puede convencerse de descartar una respuesta ya correcta mientras pagas más costo y latencia. Ajusta el presupuesto a la tarea: mucho para problemas difíciles, casi nada para los fáciles.
  • El costo y la latencia suben todo el tiempo. ¿Y la calidad?

La idea clave

Puedes fijar el presupuesto de pensamiento a propósito, más para problemas difíciles, poco para los fáciles.

Qué puedes hacer después de esta lección

Puedes razonar sobre los presupuestos de pensamiento: cuándo más razonamiento ayuda y cuándo malgasta tiempo y dinero.

Ponte a prueba: ¿Pensar de más siempre es mejor?
  • No, suma costo/latencia y puede hacer que sobrepiense tareas simples(correcta)
  • Sí, súbelo siempre al máximo
  • Solo para tareas fáciles
  • Nunca cambia la respuesta

Pensar más cuesta tiempo y dinero y puede hacer que el modelo le dé demasiadas vueltas a lo fácil. Ajusta el presupuesto a lo difícil que es de verdad la pregunta.

Adónde lleva: Generar tokens es el cuello de botella. ¿podemos hacerlo más rápido?

Este es el resumen escrito. La lección en sí es interactiva: arriba predices, arrastras y operas el mecanismo, y la revelación te responde.