DeepSeek

DeepSeek-R

Sigue las próximas arquitecturas de razonamiento de DeepSeek y sus métodos de aprendizaje por refuerzo a gran escala.

Sitio oficial DeepSeek

Serie de razonamiento DeepSeek-R

La serie DeepSeek-R investiga el aprendizaje por refuerzo a gran escala para potenciar cadenas de pensamiento y resolución de problemas complejos.

Innovaciones algorítmicas

Al incentivar la auto-verificación y la exploración autónoma sin depender de datos supervisados masivos, DeepSeek-R redefine la eficiencia del razonamiento.

Pesos abiertos y seguimiento

Monitoreamos las próximas versiones de la serie R documentadas en publicaciones técnicas y repositorios de GitHub de DeepSeek.

En el horizonte · esta página

Retrasado

DeepSeek

DeepSeek-R2

Modelo de razonamiento por refuerzo puro de segunda generación aplazado para adaptación técnica en clústeres de hardware.

Fecha por anunciar✓ Con fuentes

Lanzamientos documentados

Cronología · esta página

  1. DeepSeek-R2 — Desarrollo de DeepSeek-R2 documentado tras el lanzamiento de R1 y los giros de arquitectura en V4.