Vídeos complementarios

Elegir el modelo adecuado para cada tarea: vídeos complementarios

El artículo es una guía rápida para decidir qué proveedor, qué nivel y qué opción de "thinking" convienen a cada tarea. La elección siguiente muestra a una persona alternando entre esos modelos en pantalla para que veas por qué un profesional escogería uno u otro en cada momento.

Selección principal

2:11:12
Cómo utilizo los modelos de lenguaje de gran tamaño (LLM)

Andrej Karpathy

Karpathy dedica capítulos específicos a "Be aware of the model you're using, pricing tiers" (ten en cuenta el modelo y el nivel de precios) y "Thinking models and when to use them" (modelos de razonamiento y cuándo utilizarlos). Después alterna continuamente entre ChatGPT, Claude, Gemini, Grok y Perplexity durante el resto del recorrido. Es lo más parecido a ver la guía del artículo aplicada en directo por alguien con criterios firmes sobre cuándo cada nivel justifica su coste.

Qué aprenderás: Aprenderás a distribuir el trabajo entre herramientas rápidas, económicas, de razonamiento profundo y respaldadas por fuentes, en lugar de utilizar un solo modelo para todo.

Qué ver o saber antes: Saber utilizar al menos un chatbot de uso general y comparar sus resultados en una misma tarea.

Nota de AI Expert: Los hábitos de selección son valiosos; los nombres exactos de los modelos, los precios, los límites de contexto y las clasificaciones no son estables. Repite la comparación con tus propias tareas antes de estandarizar una recomendación para el equipo.

Abrir página del vídeo

También merece la pena

16:50
La nueva IA más inteligente: Claude 3 – probado frente a Gemini 1.5 + GPT-4

AI Explained

Es anterior al artículo (marzo de 2024), pero lo útil es la metodología: un analista riguroso ejecuta las mismas tareas difíciles —OCR, teoría de la mente, seguimiento de instrucciones y matemáticas— en tres modelos de frontera, los compara directamente y muestra exactamente dónde falla cada uno. Los nombres de los modelos han quedado anticuados; el marco de comparación, no.

Qué aprenderás: Verás un método de comparación estructurado que puedes reutilizar para decidir qué modelo ofrece calidad suficiente para una tarea.

Qué ver o saber antes: Saber que Claude 3, Gemini 1.5 y GPT-4 ya no representan el nivel de referencia de los modelos de frontera.

Nota de AI Expert: Trátalo como un vídeo sobre metodología de pruebas, no como una clasificación actual. Los ganadores concretos son históricos; lo útil es ejecutar los mismos ejemplos, comprobar los modos de fallo y cuestionar las afirmaciones imprecisas sobre el "mejor modelo".

Abrir página del vídeo