Descripción
CONSTRUCCION DE GRANDES MODELOS DE LENGUAJE DESDE CERO
Resumen del libro
Este libro ofrece una guía práctica y detallada para construir un modelo de lenguaje de gran tamaño desde sus fundamentos, basándose en el principio de que solo se comprende realmente aquello que se es capaz de crear. Sebastian Raschka guía al lector a través de cada etapa del proceso, desde la planificación y codificación del modelo hasta su entrenamiento y ajuste fino, sin recurrir a bibliotecas de modelos de lenguaje existentes. El resultado es un modelo funcional, similar a GPT-2, ejecutable en un portátil moderno. El lector no solo obtendrá un sistema de clasificación de texto y un chatbot capaz de seguir instrucciones, sino una comprensión profunda de la inteligencia artificial generativa.
¿De qué trata?
El libro aborda la construcción completa de un modelo de lenguaje de gran tamaño (LLM) desde cero. Comienza con la planificación y codificación de un modelo similar a GPT-2, explicando la arquitectura y los componentes clave. A continuación, enseña a cargar y utilizar pesos preentrenados para acelerar el proceso. El lector aprenderá a diseñar un flujo completo de entrenamiento, ajustar el modelo para tareas de clasificación de texto y, finalmente, desarrollar un chatbot que pueda responder a instrucciones humanas en conversaciones naturales. Todo el proceso se realiza sin depender de bibliotecas de modelos de lenguaje preexistentes, lo que garantiza una comprensión profunda de cada componente.
Temas principales
- Arquitectura de modelos de lenguaje autorregresivos (similar a GPT-2).
- Planificación, codificación y entrenamiento de modelos desde cero.
- Carga y uso de pesos preentrenados para optimizar el rendimiento.
- Ajuste fino (fine-tuning) para clasificación de textos y seguimiento de instrucciones.
- Implementación práctica de un chatbot funcional con capacidad de diálogo.
¿Para quién está recomendado?
Está dirigido a lectores con conocimientos intermedios de Python y nociones básicas de machine learning o aprendizaje automático. Es ideal para desarrolladores, ingenieros de software, científicos de datos y estudiantes que deseen comprender en profundidad cómo funcionan los grandes modelos de lenguaje y adquirir la capacidad de construirlos y personalizarlos por sí mismos.
Qué aporta este libro
- Comprensión profunda de la arquitectura y el funcionamiento interno de los LLMs.
- Habilidad práctica para construir un modelo de lenguaje funcional desde cero.
- Capacidad para ajustar y personalizar modelos para tareas específicas como clasificación y chatbots.
- Experiencia práctica en el diseño y ejecución de flujos completos de entrenamiento.
- Conocimiento para ejecutar modelos de lenguaje de gran tamaño en hardware accesible, como un portátil moderno.
Ficha técnica
- Autor: Sebastian Raschka
- Editorial: ANAYA MULTIMEDIA
- Idioma: Español
- Tema: Algoritmos y estructuras de datos, Ingeniería del software, Captura y análisis de datos, Inteligencia artificial, Redes neuronales y sistemas difusos
- Colección: Títulos especiales
- Encuadernación: Bolsillo
- Fecha de edición: enero de 2026
- Número de páginas: 360
- Peso: 607 g
Valoración editorial
Esta obra destaca por su enfoque práctico y pedagógico, alejándose de la teoría abstracta para sumergir al lector en la construcción real de un modelo de lenguaje. La propuesta de crear un LLM funcional desde cero, sin depender de bibliotecas de alto nivel, resulta especialmente valiosa para quienes buscan un conocimiento sólido y transferible. El libro cubre un vacío formativo significativo, ofreciendo una ruta clara desde los fundamentos hasta la implementación de un chatbot, todo ello en un entorno accesible. Es un recurso riguroso y útil para profesionales y entusiastas que deseen dominar esta tecnología.

