2025-01-20 추론 모델 DeepSeek-R1 공개 강화학습 중심 추론 모델 DeepSeek-R1, 실험 모델 R1-Zero, 여섯 종의 경량 증류 모델 공개. 딥시크 DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning - arXiv DeepSeek-R1 Release - DeepSeek API Docs China’s cheap, open AI model DeepSeek thrills scientists - Nature 더보기