Cover Image for Tribu iA/Papers. Sesión 8 - DeepSeek & Chain of Thought
Cover Image for Tribu iA/Papers. Sesión 8 - DeepSeek & Chain of Thought
Avatar for Eventos de Tribu IA
Hosted By
8 Went

Tribu iA/Papers. Sesión 8 - DeepSeek & Chain of Thought

YouTube
Registration
Past Event
Welcome! To join the event, please register below.
About Event

¿Te interesa entender cómo los grandes modelos de lenguaje aprenden a razonar y cómo los open-source están cerrando la brecha con modelos como GPT-4?

En esta sesión vamos a conversar sobre dos papers clave para entender como los LLMs aprenden: su capacidad de razonar y los avances en eficiencia extrema a gran escala.

📄 Paper 1: DeepSeek-V3: pushing the limits of open-source LLMs
Con 671 mil millones de parámetros y entrenado por solo $5.5M, DeepSeek-V3 es el modelo open-source más potente en tareas de código y matemáticas. Su secreto: una arquitectura Mixture-of-Experts altamente optimizada, atención latente, entrenamiento en FP8 y predicción multi-token. Un ejemplo real de ingeniería extrema al servicio de la IA escalable.
→ Escucha el resumen completo en nuestro podcast

📄 Paper 2: Chain-of-Thought Prompting
Este paper de Google Research marcó un antes y un después. Introduce una técnica simple pero poderosa: hacer que los modelos razonen paso a paso, como lo haría un humano. El resultado: un salto dramático en tareas de lógica, aritmética y sentido común. Y lo más interesante… esta capacidad solo emerge en modelos suficientemente grandes.
→ Escucha el resumen en nuestro podcast

🟣 Te invitamos a conectarte por YouTube Live y sumarte a la conversación.

📚 Puedes prepararte leyendo los papers o escuchando sus podcasts resumidos.

📝 Regístrate para recibir el link al Live y no perderte nada.

Agradecemos a nuestros patrocinadores Riscco y Softserve por hacer estos espacios posibles.

Al registrarte, aceptas nuestra Política de tratamiento de datos.

Avatar for Eventos de Tribu IA
Hosted By
8 Went