Introducción a LLM
Esta página proporciona una guía sencilla sobre los modelos de lenguaje de gran escala (LLM), desde lo básico hasta las aplicaciones para los entusiastas de la IA.
Capítulo 14 — Benchmarking, testing y rendimiento
Decimocuarta y última entrega del recorrido de LLM Primer IV. El MCP-Universe Benchmark sobre servidores reales, los dos modos de fallo sistémico que expuso, la brecha de diez veces en throughput entre sesión por petición y pools de sesión compartidos, y el puente al Volumen V.
2026-04-12Capítulo 13 — Frameworks e integración con la nube
Decimotercera entrega del recorrido de LLM Primer IV. Strands con Bedrock, el patrón de capa de estado de AWS, el Microsoft Agent Framework, LangChain, Semantic Kernel — y las tres formas de integración de producción a las que los equipos llegan de forma independiente.
2026-04-11Capítulo 10 — Memoria de tareas de horizonte largo
Décima entrega del recorrido de LLM Primer IV. Memoria a corto plazo mediante ventanas y scratchpads ReAct, memoria a largo plazo mediante vectores episódicos y almacenes semánticos, y las técnicas de compactación que mantienen productivo a un agente a lo largo de horas y días.
2026-04-08Capítulo 9 — Administrando el presupuesto de atención
Novena entrega del recorrido de LLM Primer IV. Context rot, el acantilado de lost-in-the-middle, tool-loadout rot, y las tres respuestas arquitectónicas — MCP, RAG, fine-tuning — a la pregunta de dónde corresponde de verdad el conocimiento que le falta a un modelo.
2026-04-07Capítulo 8 — Distribuciones arquitectónicas de despliegue
Octava entrega del recorrido de LLM Primer IV. Las tres distribuciones de despliegue que han emergido en el ecosistema MCP — agente reutilizable, pureza estricta, híbrida — y las cuatro restricciones vinculantes que determinan cuál encaja con cada proyecto.
2026-04-06Capítulo 1 — La crisis de integración de la IA y el auge de la arquitectura agéntica
Primera entrega del recorrido de LLM Primer IV. Por qué los agentes monolíticos se deshilachan al crecer el system prompt, el problema de integración N por M que se esconde debajo, y el paso de la ingeniería de prompts a la ingeniería de contexto que MCP vino a habilitar.
2026-03-30LLM Primer IV — Introducción a la serie e índice
Apertura del recorrido capítulo a capítulo del Libro IV de la serie LLM Primer — Diseñando la cognición de la IA con MCP. Por qué los agentes necesitan una capa de protocolo para escalar más allá de la demo, para quién está escrito, y el calendario de los catorce posts que siguen, del 30 de marzo al 12 de abril.
2026-03-29Capítulo 11 — Actualizaciones continuas y optimización de la pipeline
Undécima y última entrega del recorrido de LLM Primer III. CDC e indexación incremental mantienen el corpus fresco, la caché semántica y la estratificación de modelos mantienen baja la latencia, y un bucle de feedback de cuatro etapas cierra la distancia entre lo que la producción le dice al equipo y lo que el equipo realmente cambia — más un puente al Volumen IV sobre Model Context Protocol.
2026-03-28Capítulo 2 — Parsing inteligente de documentos
Segunda entrega del recorrido de LLM Primer III. Por qué un PDF no es un fichero de texto, qué preserva en realidad un parser consciente del layout, el panorama actual de herramientas (LlamaParse, Docling, Unstructured, Marker-PDF, Firecrawl, DeepSeek-OCR) y la vía multimodal que recupera directamente sobre imágenes de página.
2026-03-19Capítulo 12 — Construyendo tu propio sistema LLM: de los conjuntos de datos a la producción
Capítulo 12 de la serie LLM Primer I. El capítulo final. Lo que realmente se requiere para construir un sistema impulsado por LLM de extremo a extremo — licenciamiento de conjuntos de datos, pipelines de entrenamiento, marcos de evaluación, la pila de aplicaciones integrada y los patrones de casos de estudio que distinguen a los despliegues exitosos de los pilotos fallidos.
2026-03-01Capítulo 11 — Investigación de vanguardia: MoE, modelos de razonamiento y el nuevo eje de escalado
Capítulo 11 de la serie LLM Primer I. Las fronteras de investigación que ahora son realidad de producción — mixture-of-experts, memoria con recuperación, tokenización multimodal nativa, aprendizaje continuo y el paradigma de escalado en tiempo de inferencia que produjo los modelos de razonamiento de hoy. La mayor adición de contenido de la edición de 2026.
2026-02-28Capítulo 10 — Seguridad, ética y confianza: más allá del marketing
Capítulo 10 de la serie LLM Primer I. La imagen honesta de la seguridad de los LLM — por qué las alucinaciones ocurren mecánicamente, dónde realmente vive el sesgo, cómo funcionan las barreras en capas y por qué la gobernanza es la capa institucional que los controles técnicos no pueden reemplazar. Para profesionales que necesitan desplegar de forma segura.
2026-02-27Capítulo 9 — Rendimiento, escalado y costos: los compromisos reales de ingeniería
Capítulo 9 de la serie LLM Primer I. Las realidades operativas de ejecutar LLM a escala — tamaño del modelo vs capacidad, el compromiso latencia–throughput, economía de costos, cuantización y despliegue en el borde. Por qué los modelos de frontera son a menudo la elección equivocada incluso cuando puedes permitírtelos.
2026-02-26Capítulo 7 — Más allá de la predicción del siguiente token: embeddings, recuperación y multimodalidad
Capítulo 7 de la serie LLM Primer I. Las capacidades que convierten a un predictor del siguiente token en algo mucho más — embeddings, búsqueda semántica, generación aumentada con recuperación y la transición a entradas multimodales. Cómo RAG realmente mantiene un LLM anclado en documentos reales en lugar de inventar.
2026-02-24Capítulo 5 — Entrenando modelos grandes: qué se necesita realmente para un modelo de frontera
Capítulo 5 de la serie LLM Primer I. Cómo se entrenan realmente los LLM de frontera — la tubería de datos, la función de pérdida, los meses de tiempo de GPU y por qué el "entrenamiento" es ahora un problema de ingeniería a escala industrial más que un problema de investigación. Desmitifica para qué están pagando esas corridas de cientos de millones de dólares.
2026-02-22Un recorrido capítulo por capítulo de LLM Primer I — Introducción a la serie e índice
Introducción e índice del recorrido en doce partes capítulo por capítulo de LLM Primer I: Cómo funciona la IA generativa. Una publicación por día, del 18 de febrero al 1 de marzo de 2026. Léelos en orden o elige el capítulo que más te importe. Los doce están listados y enlazados aquí.
2026-02-17La Serie LLM Primer — Una guía de campo de la IA generativa, construida volumen a volumen
La Serie LLM Primer — una guía de campo en siete volúmenes sobre IA generativa por Sho Shimoda. Cada volumen cubre una capa distinta del trabajo con modelos de lenguaje grandes, desde los fundamentos hasta el escalado y la seguridad. Esta es la página principal: una visión general de toda la serie, más el recorrido capítulo por capítulo en vivo de los primeros volúmenes.
2026-02-15