Modelos y elección de herramientas
Elige entre ChatGPT, Claude, Gemini, Copilot, modelos de razonamiento y inferencia alojada o local.
27 contenidos (12 artículos · 15 vídeos)
Comienza aquí
Una selección inicial antes de explorar todo el contenido.
6 min de lecturaChatGPT, Claude, Gemini, Copilot — ¿cuál debería elegir un principiante?
Cuatro asistentes de IA principales, explicados con claridad. Una guía no técnica para elegir tu primera IA según las herramientas que ya utilizas y lo que realmente necesitas.
Primeros pasos con IA
7 min de lecturaElegir el modelo adecuado para cada tarea: guía rápida para 2026
Qué modelo elegir según el tipo de tarea: GPT, Claude, Gemini, modelos de razonamiento y opciones con pesos abiertos, clasificados por aquello que realmente hacen mejor y acompañados de reglas sencillas para decidir.
Principiante
10 min de lecturaOrquestación multimodelo: enrutamiento por coste, latencia y calidad
Utilizar un único modelo para todo es un error de principiante. Los sistemas de IA en producción dirigen cada solicitud al modelo adecuado y pueden reducir los costes un 60-90%, además de mejorar la calidad. Conoce los patrones, la lógica de enrutamiento y las ventajas e inconvenientes.
IntermedioMás sobre este tema
13 min de lecturaEl stack de LLM en 2026: modelos, inferencia, herramientas y decisiones
La perspectiva práctica de un arquitecto sobre el stack de LLM en 2026: gamas de modelos, proveedores de inferencia, capas de orquestación, herramientas de evaluación y las decisiones que realmente importan al implantar IA en producción. Todo lo que te habría gustado saber antes de empezar.
Avanzado
10 min de lecturaCadena de pensamiento, autocrítica y árbol de pensamientos: cuándo usar cada técnica
Tres técnicas de razonamiento que pueden mejorar los resultados de la IA en problemas complejos y el balance entre costes y beneficios de utilizarlas. Con prompts concretos, comparaciones directas y las particularidades de los modelos de razonamiento modernos.
Intermedio
12 min de lecturaOptimización del coste de inferencia: caché de prompts, enrutamiento y control de salida
Los costes de inferencia de los LLM pueden reducirse en un 60-90% con las técnicas adecuadas: caché de prompts, enrutamiento de modelos, control de salida, procesamiento por lotes y otros patrones menos conocidos. Analizamos las cifras, los patrones y la disciplina de producción que separan una inferencia bien gestionada de una factura descontrolada.
Avanzado
13 min de lecturaFine-tuning en 2026: cuándo LoRA supera a RAG y cómo aplicarlo sin un clúster
El fine-tuning con LoRA ya es accesible: puedes realizar un ajuste real en un portátil o alquilar una GPU durante una hora. Esta guía explica qué patrones funcionan, cuándo supera a RAG y cómo ejecutar el proceso completo, desde la preparación de datos hasta el despliegue.
Avanzado
6 min de lecturaVersión gratuita vs. de pago de ChatGPT: qué incluye realmente la actualización
Comparación sin jerga de la versión gratuita de ChatGPT, ChatGPT Plus y ChatGPT Pro — qué cambia al actualizar y cómo saber si realmente necesitas hacerlo.
Primeros pasos con IA
10 min de lecturaIA local en tu Mac: Ollama, LM Studio y lo que pueden hacer realmente los modelos 7B
La ejecución local de IA ha madurado. Con Ollama o LM Studio y un Mac moderno, puedes utilizar modelos capaces sin conexión, sin coste y de forma privada. Conoce qué funciona, qué no y qué casos de uso se benefician realmente.
Intermedio
10 min de lecturaDiseño de prompts para modelos de razonamiento (o3, R1 y Claude Extended Thinking)
Los modelos de razonamiento no son modelos rápidos con pasos adicionales. Responden mejor a otro estilo de prompting, ignoran algunos patrones convencionales y presentan sus propios riesgos. Una guía práctica para utilizarlos bien.
Intermedio
12 min de lecturaElegir entre prompting, RAG y fine-tuning (y cuándo combinarlos)
El prompting, RAG y el fine-tuning son las tres grandes palancas para adaptar los LLM a un problema. Cada una resulta adecuada en situaciones diferentes. Este marco ayuda a elegir, explica sus costes reales y muestra los patrones de producción en los que conviene combinarlas.
Avanzado
11 min de lecturaInferencia con alojamiento propio frente a gestionada: vLLM, TGI y cálculo del punto de equilibrio
¿A qué escala la inferencia con alojamiento propio supera a las llamadas a API? Analizamos los cálculos reales, las exigencias operativas y los patrones que distinguen a los equipos que deberían alojar sus modelos de aquellos que deberían seguir pagando por inferencia gestionada.
Avanzado
Análisis a fondo de los LLM como ChatGPT
Análisis a fondo de los LLM como ChatGPT
Avanzado
Andrej Karpathy: El software está cambiando (de nuevo)
Andrej Karpathy: El software está cambiando (de nuevo)
Avanzado
¿Es el fin del RAG? El nuevo almacenamiento en caché de prompts de Anthropic
¿Es el fin del RAG? El nuevo almacenamiento en caché de prompts de Anthropic
Avanzado
Build Hour: Almacenamiento en caché de prompts
Build Hour: Almacenamiento en caché de prompts
Avanzado
Fine-tuning de modelos LLM: curso de IA generativa
Fine-tuning de modelos LLM: curso de IA generativa
Avanzado
Desarrollo de un LLM: creación, entrenamiento y fine-tuning
Desarrollo de un LLM: creación, entrenamiento y fine-tuning
Avanzado
¿Merece la pena ChatGPT Plus? Mi análisis actualizado para 2025
¿Merece la pena ChatGPT Plus? Mi análisis actualizado para 2025
Primeros pasos con IA
Todos los modelos de IA, explicados
Todos los modelos de IA, explicados
Intermedio
RouteLLM alcanza el 90% de la calidad de GPT4o y cuesta un 80% menos
RouteLLM alcanza el 90% de la calidad de GPT4o y cuesta un 80% menos
Intermedio
RAG frente a ajuste fino
RAG frente a ajuste fino
Avanzado
RAG vs Fine-Tuning vs Prompt Engineering: Optimizando modelos de IA
RAG vs Fine-Tuning vs Prompt Engineering: Optimizando modelos de IA
Avanzado
Cómo utilizo los modelos de lenguaje de gran tamaño (LLM)
Cómo utilizo los modelos de lenguaje de gran tamaño (LLM)
Principiante
La nueva IA más inteligente: Claude 3 – probado frente a Gemini 1.5 + GPT-4
La nueva IA más inteligente: Claude 3 – probado frente a Gemini 1.5 + GPT-4
Principiante
Serving rápido de LLM con vLLM y PagedAttention
Serving rápido de LLM con vLLM y PagedAttention
Avanzado
Explicación de cada modelo de IA
Explicación de cada modelo de IA
Primeros pasos con IA