Saltar al contenido

Explicador en lenguaje claro

Las bases de datos vectoriales, explicadas

¿Qué es una base de datos vectorial y por qué todo stack de RAG tiene una?

Una base de datos vectorial guarda embeddings, las listas de números que codifican significado, y responde rápido una sola pregunta: ¿qué elementos guardados quedan más cerca de este vector nuevo? Eso es buscar por significado en vez de por palabra clave. Conviertes tus documentos en embeddings una vez, conviertes la pregunta del usuario al momento, traes los fragmentos más cercanos y los pegas en el context del modelo. Ese paso de traer es la recuperación de RAG, y los índices especializados existen porque comparar millones de vectores a lo bruto sería lentísimo.

Revisado por última vez el

No te quedes en leerlo. Opera tú mismo el mecanismo en una lección interactiva corta.

Míralo funcionar: RAG: la recuperación como retorno a la similitud

Gratis, sin código, sin registro.

Lo que la gente entiende mal

  • Es una base de datos de hechos que la IA sabe. Guarda tu contenido como vectores; el modelo queda congelado y aparte.
  • La búsqueda vectorial entiende los documentos. Solo ordena por cercanía geométrica. Un contenido mal troceado se recupera mal, da igual el modelo.
  • Siempre necesitas una. Un corpus pequeño cabe directo en la ventana de contexto; la base se gana el puesto a escala.

Dónde lo ves en productos reales

  • Todo producto de 'chatea con tus documentos' corre una por debajo.
  • Herramientas como Pinecone o la extensión pgvector son exactamente este componente.
  • La búsqueda semántica en apps de notas, encontrar la nota que describes pero nunca titulaste, es búsqueda vectorial.

Preguntas frecuentes

¿De verdad necesito una base de datos vectorial?
Para empezar, no. Hasta unas decenas de miles de fragmentos, un array en memoria o una extensión de Postgres alcanza y es mucho más simple de operar. Un almacén dedicado se gana su lugar cuando necesitas escala, filtrado por metadatos y actualizaciones en vivo a la vez.
¿En qué se diferencia de una búsqueda normal en base de datos?
Una búsqueda por palabras clave encuentra documentos que contienen tus palabras. Una búsqueda vectorial encuentra documentos cuyo significado está cerca de tu pregunta, así que cómo cancelo puede coincidir con una página sobre dar de baja una suscripción. Los buenos sistemas hacen las dos y combinan los resultados.
¿Qué es un índice de embeddings?
Una estructura que encuentra vecinos cercanos sin comparar tu consulta contra todos los vectores guardados. Cambia exactitud por velocidad, devolviendo casi siempre los vecinos correctos en una fracción del tiempo. Esa aproximación es la razón de que dos corridas puedan dar resultados algo distintos.

Explicadores relacionados

Más en Construir encima, y confiar en ello

Una idea a la vez, en tu correo

Lecciones y explicadores nuevos, escritos como están escritas estas páginas. De vez en cuando, no a diario, y nunca una secuencia de venta.

Primero te enviamos un enlace de confirmación. Puedes darte de baja con un clic, cuando quieras. Privacidad.

Parte de See How AI Works, un curso interactivo gratuito, donde aprendes cómo funciona la IA moderna operándola, no viendo videos.