{"product_id":"construye-un-modelo-de-razonamiento-desde-cero","title":"Construye un modelo de razonamiento (desde cero)","description":"\u003cblockquote\u003e\n    \u003cp\u003e«Una inmersión profunda excepcional en la \u003cstrong\u003epróxima frontera de la IA\u003c\/strong\u003e».\u003c\/p\u003e\n    \u003cp\u003e\u003ccite\u003e—Aman Chadha, Google\u003c\/cite\u003e\u003c\/p\u003e\n  \u003c\/blockquote\u003e\n\n  \u003cp\u003e\u003cstrong\u003eConstruye un modelo de razonamiento (desde cero)\u003c\/strong\u003e es una \u003cstrong\u003eguía práctica\u003c\/strong\u003e para entender cómo funcionan los \u003cstrong\u003eLLMs modernos orientados al razonamiento\u003c\/strong\u003e mediante la construcción paso a paso de sus métodos principales. El libro cuenta una \u003cstrong\u003ehistoria de ingeniería clara\u003c\/strong\u003e: comienza con un \u003cstrong\u003eLLM preentrenado\u003c\/strong\u003e convencional, aprende cómo funciona la \u003cstrong\u003egeneración de texto\u003c\/strong\u003e, construye \u003cstrong\u003eherramientas de evaluación confiables\u003c\/strong\u003e, mejora el razonamiento mediante \u003cstrong\u003emétodos en tiempo de inferencia\u003c\/strong\u003e, y luego pasa a enfoques basados en el entrenamiento, como el \u003cstrong\u003eaprendizaje por refuerzo\u003c\/strong\u003e y la \u003cstrong\u003edestilación\u003c\/strong\u003e.\u003c\/p\u003e\n\n  \u003cp\u003eLa progresión es deliberada. Los primeros capítulos establecen el \u003cstrong\u003emodelo base\u003c\/strong\u003e y explican la \u003cstrong\u003egeneración de texto\u003c\/strong\u003e, la \u003cstrong\u003ecaché KV\u003c\/strong\u003e y la \u003cstrong\u003eevaluación con verificadores matemáticos\u003c\/strong\u003e. Los capítulos intermedios muestran cómo puedes mejorar el razonamiento \u003cstrong\u003esin cambiar los pesos del modelo\u003c\/strong\u003e, utilizando \u003cstrong\u003eprompts de cadena de pensamiento\u003c\/strong\u003e (chain-of-thought prompting), \u003cstrong\u003emuestreo\u003c\/strong\u003e, \u003cstrong\u003eautoconsistencia\u003c\/strong\u003e, \u003cstrong\u003epuntuación de respuestas\u003c\/strong\u003e y \u003cstrong\u003eautorrefinamiento\u003c\/strong\u003e. Los capítulos posteriores pasan a modificar el propio modelo mediante el \u003cstrong\u003eaprendizaje por refuerzo con recompensas verificables\u003c\/strong\u003e, \u003cstrong\u003emejoras de GRPO\u003c\/strong\u003e, \u003cstrong\u003erecompensas de formato\u003c\/strong\u003e y, finalmente, la \u003cstrong\u003edestilación\u003c\/strong\u003e de modelos de razonamiento más potentes en otros más pequeños.\u003c\/p\u003e\n\n  \u003cp\u003eEl libro es especialmente útil porque \u003cstrong\u003eimplementa los métodos principales desde cero\u003c\/strong\u003e en lugar de tratarlos como llamadas a bibliotecas de caja negra. Ves cómo funcionan realmente la \u003cstrong\u003eautoconsistencia\u003c\/strong\u003e, el \u003cstrong\u003eautorrefinamiento\u003c\/strong\u003e, \u003cstrong\u003eBest-of-N\u003c\/strong\u003e y los métodos basados en el entrenamiento, incluidos sus \u003cstrong\u003ecompromisos de costo y latencia\u003c\/strong\u003e. También analiza los \u003cstrong\u003emodos de fallo comunes\u003c\/strong\u003e, incluidos los casos en los que el refinamiento puede empeorar las respuestas. Conceptos difíciles como \u003cstrong\u003esoftmax\u003c\/strong\u003e, la \u003cstrong\u003etemperatura\u003c\/strong\u003e y el \u003cstrong\u003emuestreo top-p\u003c\/strong\u003e se aclaran con explicaciones vinculadas a \u003cstrong\u003ecódigo y diagramas\u003c\/strong\u003e, y los \u003cstrong\u003eflujos de trabajo visuales\u003c\/strong\u003e facilitan el seguimiento de los pipelines y los métodos de puntuación.\u003c\/p\u003e\n\n  \u003cp\u003eLeer el libro se siente como seguir una \u003cstrong\u003econstrucción técnica guiada\u003c\/strong\u003e en lugar de una revisión superficial de temas de IA. Cada concepto se introduce porque el proyecto ahora lo necesita. Los \u003cstrong\u003ediagramas\u003c\/strong\u003e, las \u003cstrong\u003ehojas de ruta\u003c\/strong\u003e, los \u003cstrong\u003elistados de código\u003c\/strong\u003e, los \u003cstrong\u003eejercicios\u003c\/strong\u003e y los \u003cstrong\u003eresúmenes de flujos de trabajo\u003c\/strong\u003e repetidos te ayudan a mantenerte orientado a través del material avanzado. Esta estructura refleja la fortaleza profesional de \u003cstrong\u003eSebastian Raschka\u003c\/strong\u003e: explicar temas complejos de aprendizaje automático haciendo que cada detalle sea concreto y mostrando exactamente dónde encaja cada sección en la historia general. No trata mecanismos como la \u003cstrong\u003eevaluación\u003c\/strong\u003e, las \u003cstrong\u003elog-probabilidades\u003c\/strong\u003e, la \u003cstrong\u003eregularización KL\u003c\/strong\u003e o la \u003cstrong\u003edestilación\u003c\/strong\u003e como abstracciones aisladas; los conecta con el objetivo de hacer que los \u003cstrong\u003emodelos de razonamiento sean comprensibles e implementables\u003c\/strong\u003e.\u003c\/p\u003e\n\n  \u003cp\u003eFísica y organizativamente, el libro tiene \u003cstrong\u003eocho capítulos\u003c\/strong\u003e y \u003cstrong\u003esiete apéndices sustanciales\u003c\/strong\u003e. Ese diseño mantiene la narrativa principal enfocada mientras traslada el material de apoyo —referencias, soluciones de ejercicios, código fuente del modelo, modelos más grandes, procesamiento por lotes, alternativas de evaluación e interfaces de chat— a apéndices ordenados. El resultado es un libro de \u003cstrong\u003eflujo lógico\u003c\/strong\u003e que sigue siendo \u003cstrong\u003epráctico, navegable y técnicamente profundo\u003c\/strong\u003e sin interrumpir constantemente la construcción central.\u003c\/p\u003e\n\n  \u003ch2\u003eQué incluye\u003c\/h2\u003e\n  \u003cul\u003e\n    \u003cli\u003e\n\u003cstrong\u003eImplementaciones desde cero\u003c\/strong\u003e de las mejoras fundamentales de razonamiento en los LLMs\u003c\/li\u003e\n    \u003cli\u003e\u003cstrong\u003eMétodos de evaluación basados en verificadores\u003c\/strong\u003e\u003c\/li\u003e\n    \u003cli\u003e\n\u003cstrong\u003eAprendizaje por refuerzo con verificadores automáticos\u003c\/strong\u003e para tareas de matemáticas\u003c\/li\u003e\n  \u003c\/ul\u003e\n\n  \u003ch2\u003eAcerca del lector\u003c\/h2\u003e\n  \u003cp\u003ePara lectores que conocen \u003cstrong\u003ePython\u003c\/strong\u003e y tienen ciertos conocimientos de \u003cstrong\u003eaprendizaje automático\u003c\/strong\u003e.\u003c\/p\u003e\n\n  \u003ch2\u003eCitas\u003c\/h2\u003e\n  \u003cblockquote\u003e\n    \u003cp\u003eDestila las ideas profundas de la manera más clara y accesible.\u003c\/p\u003e\n    \u003cp\u003e\u003ccite\u003e—Byron Hsu, LMSYS\u003c\/cite\u003e\u003c\/p\u003e\n  \u003c\/blockquote\u003e\n  \u003cblockquote\u003e\n    \u003cp\u003eGenial. Una gran lectura y escritura entretenida.\u003c\/p\u003e\n    \u003cp\u003e\u003ccite\u003e—Chris Alexiuk, NVIDIA\u003c\/cite\u003e\u003c\/p\u003e\n  \u003c\/blockquote\u003e\n  \u003cblockquote\u003e\n    \u003cp\u003eEl \u003cstrong\u003eestándar de oro\u003c\/strong\u003e para los desarrolladores que quieren construir en la vanguardia de la IA.\u003c\/p\u003e\n    \u003cp\u003e\u003ccite\u003e—Omar Sanseviero, autor de \u003cem\u003eIA generativa práctica con Transformers y modelos de difusión\u003c\/em\u003e\u003c\/cite\u003e\u003c\/p\u003e\n  \u003c\/blockquote\u003e\n  \u003cblockquote\u003e\n    \u003cp\u003e¡Una introducción práctica y muy bien estructurada a los modelos de razonamiento!\u003c\/p\u003e\n    \u003cp\u003e\u003ccite\u003e—Vinija Jain, Google\u003c\/cite\u003e\u003c\/p\u003e\n  \u003c\/blockquote\u003e\n  \u003cblockquote\u003e\n    \u003cp\u003eUn punto de partida excelente, \u003cstrong\u003eaccesible\u003c\/strong\u003e incluso para lectores con poca o ninguna experiencia previa de trabajo con LLMs.\u003c\/p\u003e\n    \u003cp\u003e\u003ccite\u003e—Arun Prakash, AI4Bharat\u003c\/cite\u003e\u003c\/p\u003e\n  \u003c\/blockquote\u003e\n  \u003cblockquote\u003e\n    \u003cp\u003e\u003cstrong\u003eDesmitifica los modelos de razonamiento\u003c\/strong\u003e al proporcionar implementaciones prácticas de técnicas de vanguardia.\u003c\/p\u003e\n    \u003cp\u003e\u003ccite\u003e—Fabio Montagna, GraphAware\u003c\/cite\u003e\u003c\/p\u003e\n  \u003c\/blockquote\u003e\n  \u003cblockquote\u003e\n    \u003cp\u003eNo se queda en la teoría; te guía desde el muestreo hasta la puntuación y el refinamiento iterativo \u003cstrong\u003econ código real\u003c\/strong\u003e.\u003c\/p\u003e\n    \u003cp\u003e\u003ccite\u003e—Toni Ramchandani, MSCI Inc.\u003c\/cite\u003e\u003c\/p\u003e\n  \u003c\/blockquote\u003e\n\n  \u003cp\u003eTodos hablan de modelos de razonamiento, pero muy pocos saben qué ocurre por dentro. Entonces deja de usarlos como cajas negras y \u003cstrong\u003econstrúyelos con tus propias manos\u003c\/strong\u003e: \u003cstrong\u003eempieza hoy\u003c\/strong\u003e, capítulo a capítulo, del primer token generado hasta la destilación.\u003c\/p\u003e","brand":"Biblioteca de Alejandría","offers":[{"title":"Default Title","offer_id":44707095609386,"sku":null,"price":296.74,"currency_code":"MXN","in_stock":true}],"thumbnail_url":"\/\/cdn.shopify.com\/s\/files\/1\/0648\/3489\/5914\/files\/raschka-razonamiento-v4.png?v=1787268828","url":"https:\/\/alejandriav5.org\/products\/construye-un-modelo-de-razonamiento-desde-cero","provider":"Libros de Alejandría 5.0","version":"1.0","type":"link"}