Bases de datos vectoriales
Bases de datos vectoriales
Una introducción práctica
Aprende a construir con la tecnología que sostiene toda la IA generativa, embeddings, búsqueda semántica y sistemas RAG completos, usando el código abierto que ya tienes instalado y de la mano de un profesional con más de tres décadas en datos.
⚡ Libro completo (última edición)
⚡ Formatos EPUB y PDF
⚡ En español latinoamericano neutro
⚡ Envío instantáneo
⚡ Incluye audioresumen*
⚡ Incluye videoresumen*
⚡ Incluye recursos adicionales*
⚡ Actualizaciones [gratis]
*NotebookLM Pro
No se pudo cargar la disponibilidad de retiro
Su diferencia es la secuencia. La mayoría del material disponible te da piezas sueltas, un tutorial de embeddings por aquí, un demo de RAG por allá, siempre encadenado a un servicio en la nube que decide por ti. Este libro te da un camino con orden lógico, del porqué al qué y del qué al cómo, con una progresión deliberada, primero los conceptos, luego los embeddings, después la búsqueda por similitud, y recién entonces cuatro sistemas completos construidos desde cero. Es agnóstico de proveedor y radicalmente pragmático, se apoya en herramientas de código abierto que ya conoces y en modelos que corren en tu propia máquina. Y no se detiene en la teoría bonita, entra donde otros huyen, en las limitaciones, el ajuste de rendimiento, la gestión de recursos y las consideraciones para producción. Otros te muestran que funciona, pero este te enseña por qué funciona y qué hacer cuando deja de funcionar.
Libro electrónico - Última edición, de Nitin Borwankar (autor)
Compartir
La IA que todos presumen corre sobre algo que casi nadie sabe construir
Aprende a levantar búsqueda semántica y sistemas RAG con la base de datos que ya tienes abierta
Veinte pestañas de tutoriales. Cero aplicaciones terminadas. No es falta de talento: es exceso de información desordenada.
La teoría vive en artículos indigeribles y los tutoriales te amarran a un servicio en la nube que cambia cada trimestre. Pero nadie te explica lo que de verdad decide: qué métrica de distancia usar, cuándo conviene HNSW frente a IVF, cómo partir un PDF para que el modelo no alucine.
Entonces aparece Nitin Borwankar, más de tres décadas en datos, publicado por O'Reilly, y hace algo raro: te da una ruta. 🧭 Del porqué al qué, y del qué al cómo.
Empiezas por los embeddings —Word2Vec, Doc2Vec, transformers—, sigues con FAISS y sus índices, y terminas construyendo cuatro sistemas que corren. Búsqueda semántica sobre SQLite3. Un buscador de artículos científicos con PostgreSQL y pgvector, empaquetado en Docker. Un sistema RAG con Ollama y modelos locales. Un motor de búsqueda de conversaciones con API en FastAPI.
Todo con herramientas de código abierto. Todo en tu propia máquina. Sin GPU heroica, sin migrar la base de datos de la empresa, sin pedirle permiso a ningún proveedor extranjero. 🔓
No cambias de stack: extiendes el que ya dominas. Tu SQLite de siempre se vuelve motor semántico. Tus documentos muertos, conocimiento consultable.
Y el lunes siguiente dejas de ser quien escucha hablar de RAG en la junta y pasas a ser quien explica por qué eligieron HNSW. ⚡
América Latina no puede seguir alquilando la inteligencia que otros construyen. Los cimientos —métricas de distancia, el problema ANN, HNSW— sobreviven a las modas.
Llévate «Bases de datos vectoriales» en Libros de Alejandría 5.0 y escribe hoy tu primera línea. 🔥
INFO
INFO
La revolución de la IA ya está aquí y en su núcleo late una tecnología transformadora que la mayoría de los desarrolladores aún no ha explorado a fondo: las bases de datos vectoriales. Desde impulsar la búsqueda semántica hasta habilitar los modelos de lenguaje grandes (LLM) y la IA generativa, las bases de datos vectoriales están transformando la forma en que creamos aplicaciones con datos no estructurados como texto, imágenes y audio. Pero ¿cómo pasas de la curiosidad a la competencia con esta tecnología vital? Ahí es donde entra este libro.
En esta guía práctica, el autor Nitin Borwankar te lleva por el «por qué, qué y cómo» de las bases de datos vectoriales, empezando por la teoría básica detrás de los embeddings vectoriales y avanzando hacia la creación de aplicaciones con herramientas del mundo real. Aprenderás sobre Word2Vec, cómo convertir bases de datos SQL de código abierto como SQLite3 y PostgreSQL en bases de datos vectoriales, y cómo integrarlas en aplicaciones de generación aumentada por recuperación (RAG). Ya seas desarrollador de Python, ingeniero de datos o profesional de ML, este libro te da los fundamentos para aprovechar las bases de datos vectoriales con confianza en tus proyectos de IA.
- Comprende la conexión entre las bases de datos vectoriales, los embeddings y los LLM
- Aprende enfoques prácticos para transformar bases de datos SQL en bases de datos vectoriales
- Construye aplicaciones RAG para uso tanto personal como empresarial
- Aplica las bases de datos vectoriales para resolver desafíos de IA del mundo real
- Aprende a utilizar bases de datos vectoriales con LLM para crear aplicaciones
TRANSFORMACIÓN
TRANSFORMACIÓN
Pasar de la curiosidad a la competencia real con bases de datos vectoriales en cuestión de semanas, sin abandonar el stack que ya dominas. Esta guía práctica te lleva de la teoría de los embeddings al código que corre en tu propia máquina —Word2Vec, FAISS, SQLite3, PostgreSQL con pgvector, Ollama— y resuelve el problema que hoy frena a miles de desarrolladores, entender que toda la IA generativa se sostiene sobre la búsqueda semántica, pero no saber cómo construirla. Nitin Borwankar, con más de tres décadas en datos, te entrega el porqué, el qué y el cómo en una secuencia lógica. Entonces dejas de mirar la revolución de la IA desde la banca y empiezas a jugar dentro de ella.
¿PARA QUIÉN ES?
¿PARA QUIÉN ES?
Para el desarrollador de Python o backend que ve pasar la ola de la IA generativa desde la orilla. Para el ingeniero de datos que ya administra PostgreSQL o SQLite y quiere sumarles significado sin migrar nada. Y para quien sueña con abrir su terminal y que la máquina entienda.
Habilidades:
Embeddings, FAISS, pgvector, búsqueda semántica, RAG con Ollama
Nivel: Intermedio
Requisitos:
Python básico y una laptop común. Ni GPU, ni matemáticas avanzadas.
IMPORTANCIA ESTRATÉGICA
IMPORTANCIA ESTRATÉGICA
Su valor para la comunidad es soberanía. América Latina no puede permitirse ser solo consumidora de la inteligencia artificial que otros construyen, porque quien no sabe levantar sus propios sistemas alquila para siempre los ajenos. Este libro reparte precisamente ese poder, enseña a construir búsqueda semántica y sistemas RAG con herramientas de código abierto, sobre bases de datos que cualquiera puede instalar y con modelos que corren localmente, sin depender de la infraestructura ni de los permisos de una corporación extranjera. Cada desarrollador de la región que lo termina es una empresa que digitaliza su conocimiento, una universidad que hace consultable su archivo, un proyecto que resuelve un problema local con tecnología propia. En Libros de Alejandría 5.0 creemos en el poder transformador del conocimiento, y este es conocimiento que se convierte directamente en capacidad instalada para la región.
AUTORES
AUTORES
Nitin Borwankar es un científico de datos experimentado y profesional de bases de datos con experiencia en el desarrollo e implementación de soluciones de datos empresariales. Con una carrera que abarca más de tres décadas, Nitin es conocido por su trabajo en la educación sobre ciencia de datos, su defensa del uso de herramientas de código abierto para la ciencia de datos y sus contribuciones a los planes de estudio de aprendizaje automático de código abierto. Es un conferencista frecuente y aborda la IA y los LLM desde una perspectiva pragmática de aplicación de datos.
LO QUE APRENDERÁS
LO QUE APRENDERÁS
1. Introducción a las bases de datos vectoriales
- ¿Por qué necesitas bases de datos vectoriales? Un nuevo tipo de datos: vector, búsqueda por similitud y dónde se usan
- SQL frente a las bases de datos vectoriales: representación de vectores en un sistema relacional y la necesidad de capacidades específicas
- NoSQL frente a las bases de datos vectoriales: almacenamiento vectorial, limitaciones de sus extensiones y cuándo elegirlas
- Enfoques híbridos: combinación de datos estructurados y vectoriales, arquitectura, consulta de ejemplo y beneficios
2. Embeddings
- Comprender los embeddings vectoriales y por qué los necesitamos
- Word2Vec, el avance que lo cambió todo, y Doc2Vec: de las palabras a los documentos
- De los embeddings a los modelos de lenguaje modernos: la conexión Transformer (codificador, decodificador y codificador-decodificador)
- Modelos de embeddings: los generadores vectoriales especializados y su papel en las aplicaciones modernas de LLM
- Aplicaciones prácticas y casos de uso: pipeline RAG simple
- La biblioteca sentence-transformers y sus mejores prácticas
- La capa de embeddings: la puerta de entrada al aprendizaje zero-shot
- Aritmética vectorial con Word2Vec, paso a paso, hasta la clásica analogía de rey y reina
3. Búsqueda por similitud con FAISS
- Fundamentos: representaciones vectoriales, métricas de distancia y heurísticas de selección
- Índices de FAISS: planos (fuerza bruta), IVF, LSH, HNSW, especializados y compuestos
- Cómo elegir el índice correcto y cuándo aplicar cuantización (SQ y PQ)
- El problema ANN: evitar el costo computacional y técnicas clave en FAISS
- Comprender los índices HNSW: cómo funcionan, parámetros clave y características de rendimiento
- Arquitectura y componentes de FAISS, con un sistema de búsqueda por similitud de ejemplo
4. Búsqueda semántica con SQLite3
- La extensión de búsqueda por similitud de vectores de SQLite: capacidades, arquitectura y limitaciones
- Configuración del entorno de desarrollo y diseño del esquema de base de datos
- Conexión a Reddit con el Python Reddit API Wrapper, extracción y preprocesamiento de contenido
- Generación y almacenamiento de embeddings con procesamiento por lotes
- Creación del índice vectorial VSS e implementación del motor de búsqueda semántica
- Puesta en práctica de todo y extensión con indexación incremental
5. Construcción de un sistema de búsqueda de artículos de ArXiv con PostgreSQL y pgvector
- El reto de buscar en la literatura científica y la justificación de la pila tecnológica
- Arquitectura, componentes del sistema y flujo de datos
- Instalación de PostgreSQL y pgvector, entorno de Python y verificación
- Diseño de bases de datos para artículos científicos: esquemas, almacenamiento de vectores e indexación
- Integración con la API de ArXiv, descarga de PDF y partición de texto inteligente
- Búsqueda por similitud, aplicación interactiva y empaquetado en Docker para despliegue local
- Ajuste básico de rendimiento: configuración del índice, consultas y gestión de recursos
6. Construcción de un sistema de generación aumentada por recuperación con SQLite VSS y Ollama
- Arquitectura del sistema y cimientos de la base de datos con soporte vectorial
- Procesamiento de texto, gestión de modelos de embeddings y partición inteligente
- Implementación de búsqueda híbrida: componente semántico, por palabras clave y fusión de puntuaciones
- Integración del LLM con Ollama y el pipeline RAG completo de preguntas y respuestas
- Demostración, pruebas y consideraciones para producción con patrones avanzados de RAG
7. Construcción de un sistema RAG científico con PostgreSQL y pgvector
- Objetivos, capacidades y arquitectura del sistema
- Índices vectoriales de alto rendimiento y estrategia de generación de embeddings
- Descubrimiento de artículos, extracción inteligente de texto de PDF y partición avanzada
- Búsqueda semántica multinivel: a nivel de resumen y a nivel de sección
- LLM local con Ollama, recuperación de contexto inteligente e ingeniería de prompts científicos
- Nota técnica sobre HNSW y cómo evaluar tus resultados
8. Construcción de un sistema completo de búsqueda de conversaciones y RAG
- Diseño del esquema de conversaciones y arquitectura de tres tablas para un rendimiento óptimo
- Importación robusta de JSON, transacciones atómicas y recuperación de errores
- Generación eficiente de embeddings: patrón Singleton, procesamiento incremental y por lotes
- Búsqueda contextual con comprensión conversacional y uniones entre múltiples tablas
- Integración de RAG para el historial de conversaciones y ingeniería de prompts conversacionales
- API web completa con FastAPI: endpoints de búsqueda, preguntas y respuestas, estadísticas y monitoreo
- Demostración integral y un sistema completo de conocimiento personal
9. Lenguaje de consulta vectorial
- Conceptos centrales, modelo de datos y estructura de sintaxis básica
- Operaciones vectoriales: búsqueda por similitud, híbrida, por rango y en lote
- Funciones y agregaciones vectoriales
¿CÓMO FUNCIONA?
¿CÓMO FUNCIONA?
⚡ Dentro de nuestra plataforma encontrarás los enlaces de descarga, te avisaremos por correo electrónico de todas las futuras actualizaciones.
Descarga el ebook y disfrútalo en las mejores plataformas como Google Play Books, Apple Books o Kindle
El formato EPUB se puede leer sin internet con estas y más plataformas. Y por supuesto, siempre puedes leer el archivo PDF (LISTO PARA IMPRIMIR), donde y como quieras.

Los demos te enseñan que funciona; este libro, por qué funciona y qué hacer cuando deja de funcionar. En tu propia máquina.
Preguntas frecuentes del libro
Preguntas frecuentes del libro
¿Qué es exactamente una base de datos vectorial y en qué se diferencia del SQL que ya uso? Almacena significado, no texto exacto. El capítulo 1 enfrenta SQL, NoSQL y vectores, y dice cuándo gana cada uno.
¿Necesito matemáticas avanzadas para entender los embeddings? No. La aritmética vectorial va paso a paso, con la analogía de rey y reina y una herramienta interactiva.
¿Qué nivel de Python hace falta para seguir los ejemplos? Python de uso cotidiano. Si ya mueves consultas y scripts, tienes lo necesario para correr cada ejemplo.
¿El libro trae código real que pueda ejecutar tal cual? Sí. Cada capítulo cierra con código que corre en tu máquina, no con teoría bonita que nadie ejecuta.
¿Puedo convertir mi SQLite3 o mi PostgreSQL actual en base vectorial, o tengo que migrarlo todo? Los conviertes, no los migras. Vuelves vectoriales SQLite3 y PostgreSQL sin abandonar lo que ya dominas.
¿Se explica cómo construir un sistema RAG completo de principio a fin? De principio a fin, cuatro veces: con SQLite y Ollama, con pgvector, sobre artículos y sobre conversaciones.
¿Funciona con modelos locales o me obliga a depender de una API en la nube? Con modelos locales. Ollama corre en tu equipo, así que tu pipeline no depende de reglas ajenas.
¿Qué herramientas concretas se usan y por qué esas? Word2Vec, FAISS, SQLite3, PostgreSQL con pgvector, Ollama, FastAPI y Docker: abiertas y sin atarte a nadie.
¿Cómo elijo entre índices planos, IVF, LSH y HNSW sin equivocarme? El capítulo 3 lo resuelve: métricas de distancia, heurísticas de selección y cómo elegir el índice correcto.
¿Qué es la cuantización y cuándo me conviene aplicarla? Comprimir vectores para ganar velocidad y memoria. Verás SQ y PQ, y cuándo aplicarlas sin degradar todo.
¿Sirve también para datos no estructurados como imágenes y audio, o solo para texto? Las bases vectoriales manejan texto, imágenes y audio. Los proyectos que construyes aquí son de texto.
¿Está pensado para proyectos personales o aguanta un entorno empresarial? Ambos. Construyes RAG personal y empresarial, con ajuste de rendimiento y miras puestas en producción.
¿Necesito GPU o una máquina potente para practicar? No. Modelos locales, SQLite y un Docker Compose que levantas en minutos: una laptop común alcanza.
¿Cuánto tiempo me tomará ver mi primer sistema funcionando? Los capítulos son autocontenidos y cada uno termina en algo que corre. Tu primer sistema no espera meses.
¿El contenido está en español y se sigue con facilidad? Sí, edición en español neutro, cuidada y clara. Se lee de corrido, del concepto al código que funciona.
¿Quién es el autor y por qué debería confiar en su criterio? Nitin Borwankar: más de tres décadas en datos, defensor del código abierto y publicado por O'Reilly.
¿Esto seguirá vigente el año que viene o es otra moda que se apaga? Métricas de distancia, el problema ANN y HNSW son cimientos. Las modas se construyen encima; esto las sostiene.

¿Necesitas factura?
Una vez realizada tu compra, obtendrás los pasos para solicitarla.
Aprende sin riesgos con nuestra garantía de satisfacción total
En Libros de Alejandría 5.0 creemos en el poder de la educación para transformar vidas. Por esta razón, no solo ofrecemos conocimiento de alto nivel en tecnología, negocios y marketing, sino que también garantizamos que cada inversión en aprendizaje sea segura.
Estamos tan convencidos del impacto y la calidad de nuestros recursos que los respaldamos con la mejor garantía:
Si un producto no cumple con tus expectativas, te devolvemos el 100% de tu dinero, sin rodeos.
Sin trámites complicados ni condiciones ocultas. Con tan solo un mensaje de texto.
Cada recurso que vendemos está diseñado para aportar valor real. Si no lo logramos contigo, no pagas. Así de simple.
Aprende con confianza. ¡Tu satisfacción es nuestra prioridad y está garantizada!
Pago seguro
Nuestra tienda online ofrece un sistema de pagos altamente seguro, utilizando plataformas de encriptación avanzada para proteger tus datos en cada transacción.
Ofrecemos las opciones de pago más seguras: Apple Pay, Visa, Mastercard, American Express, entre otras.