Tema

Modelos y elección de herramientas

Elige entre ChatGPT, Claude, Gemini, Copilot, modelos de razonamiento y inferencia alojada o local.

27 contenidos (12 artículos · 15 vídeos)

Comienza aquí

Una selección inicial antes de explorar todo el contenido.

Más sobre este tema

13 min de lectura
Artículo

El stack de LLM en 2026: modelos, inferencia, herramientas y decisiones

La perspectiva práctica de un arquitecto sobre el stack de LLM en 2026: gamas de modelos, proveedores de inferencia, capas de orquestación, herramientas de evaluación y las decisiones que realmente importan al implantar IA en producción. Todo lo que te habría gustado saber antes de empezar.

Avanzado
10 min de lectura
Artículo

Cadena de pensamiento, autocrítica y árbol de pensamientos: cuándo usar cada técnica

Tres técnicas de razonamiento que pueden mejorar los resultados de la IA en problemas complejos y el balance entre costes y beneficios de utilizarlas. Con prompts concretos, comparaciones directas y las particularidades de los modelos de razonamiento modernos.

Intermedio
12 min de lectura
Artículo

Optimización del coste de inferencia: caché de prompts, enrutamiento y control de salida

Los costes de inferencia de los LLM pueden reducirse en un 60-90% con las técnicas adecuadas: caché de prompts, enrutamiento de modelos, control de salida, procesamiento por lotes y otros patrones menos conocidos. Analizamos las cifras, los patrones y la disciplina de producción que separan una inferencia bien gestionada de una factura descontrolada.

Avanzado
13 min de lectura
Artículo

Fine-tuning en 2026: cuándo LoRA supera a RAG y cómo aplicarlo sin un clúster

El fine-tuning con LoRA ya es accesible: puedes realizar un ajuste real en un portátil o alquilar una GPU durante una hora. Esta guía explica qué patrones funcionan, cuándo supera a RAG y cómo ejecutar el proceso completo, desde la preparación de datos hasta el despliegue.

Avanzado
6 min de lectura
Artículo

Versión gratuita vs. de pago de ChatGPT: qué incluye realmente la actualización

Comparación sin jerga de la versión gratuita de ChatGPT, ChatGPT Plus y ChatGPT Pro — qué cambia al actualizar y cómo saber si realmente necesitas hacerlo.

Primeros pasos con IA
10 min de lectura
Artículo

IA local en tu Mac: Ollama, LM Studio y lo que pueden hacer realmente los modelos 7B

La ejecución local de IA ha madurado. Con Ollama o LM Studio y un Mac moderno, puedes utilizar modelos capaces sin conexión, sin coste y de forma privada. Conoce qué funciona, qué no y qué casos de uso se benefician realmente.

Intermedio
10 min de lectura
Artículo

Diseño de prompts para modelos de razonamiento (o3, R1 y Claude Extended Thinking)

Los modelos de razonamiento no son modelos rápidos con pasos adicionales. Responden mejor a otro estilo de prompting, ignoran algunos patrones convencionales y presentan sus propios riesgos. Una guía práctica para utilizarlos bien.

Intermedio
12 min de lectura
Artículo

Elegir entre prompting, RAG y fine-tuning (y cuándo combinarlos)

El prompting, RAG y el fine-tuning son las tres grandes palancas para adaptar los LLM a un problema. Cada una resulta adecuada en situaciones diferentes. Este marco ayuda a elegir, explica sus costes reales y muestra los patrones de producción en los que conviene combinarlas.

Avanzado
11 min de lectura
Artículo

Inferencia con alojamiento propio frente a gestionada: vLLM, TGI y cálculo del punto de equilibrio

¿A qué escala la inferencia con alojamiento propio supera a las llamadas a API? Analizamos los cálculos reales, las exigencias operativas y los patrones que distinguen a los equipos que deberían alojar sus modelos de aquellos que deberían seguir pagando por inferencia gestionada.

Avanzado
Vídeo

Análisis a fondo de los LLM como ChatGPT

Análisis a fondo de los LLM como ChatGPT

Avanzado
Vídeo

Andrej Karpathy: El software está cambiando (de nuevo)

Andrej Karpathy: El software está cambiando (de nuevo)

Avanzado
Vídeo

¿Es el fin del RAG? El nuevo almacenamiento en caché de prompts de Anthropic

¿Es el fin del RAG? El nuevo almacenamiento en caché de prompts de Anthropic

Avanzado
Vídeo

Build Hour: Almacenamiento en caché de prompts

Build Hour: Almacenamiento en caché de prompts

Avanzado
Vídeo

Fine-tuning de modelos LLM: curso de IA generativa

Fine-tuning de modelos LLM: curso de IA generativa

Avanzado
Vídeo

Desarrollo de un LLM: creación, entrenamiento y fine-tuning

Desarrollo de un LLM: creación, entrenamiento y fine-tuning

Avanzado
Vídeo

¿Merece la pena ChatGPT Plus? Mi análisis actualizado para 2025

¿Merece la pena ChatGPT Plus? Mi análisis actualizado para 2025

Primeros pasos con IA
Vídeo

Todos los modelos de IA, explicados

Todos los modelos de IA, explicados

Intermedio
Vídeo

RouteLLM alcanza el 90% de la calidad de GPT4o y cuesta un 80% menos

RouteLLM alcanza el 90% de la calidad de GPT4o y cuesta un 80% menos

Intermedio
Vídeo

RAG frente a ajuste fino

RAG frente a ajuste fino

Avanzado
Vídeo

RAG vs Fine-Tuning vs Prompt Engineering: Optimizando modelos de IA

RAG vs Fine-Tuning vs Prompt Engineering: Optimizando modelos de IA

Avanzado
Vídeo

Cómo utilizo los modelos de lenguaje de gran tamaño (LLM)

Cómo utilizo los modelos de lenguaje de gran tamaño (LLM)

Principiante
Vídeo

La nueva IA más inteligente: Claude 3 – probado frente a Gemini 1.5 + GPT-4

La nueva IA más inteligente: Claude 3 – probado frente a Gemini 1.5 + GPT-4

Principiante
Vídeo

Serving rápido de LLM con vLLM y PagedAttention

Serving rápido de LLM con vLLM y PagedAttention

Avanzado
Vídeo

Explicación de cada modelo de IA

Explicación de cada modelo de IA

Primeros pasos con IA