Lanzamiento de DeepSeek R1
Era: La Era de los LLM · años 2020–Presente
El laboratorio chino DeepSeek lanzó R1, un modelo de razonamiento de código abierto cuyo rendimiento rivalizaba con el o1 de OpenAI. El lanzamiento demostró que las capacidades de frontera podían lograrse fuera del establishment de IA de EE. UU. y desencadenó una reevaluación global de la competencia en IA.
DeepSeek
Fuentes y respaldo
DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning
DeepSeek / arXiv · Tipo de fuente: paper
DeepSeek-R1’s release, training approach, and reported evaluations.
Publicado: ·Consultado: