| 标题 |
DeepSeek-R1 incentivizes reasoning in LLMs through reinforcement learning |
| 网址 | |
| DOI | |
| 其它 |
期刊:Nature 作者:Daya Guo; Dejian Yang; Haowei Zhang; Junxiao Song; Peiyi Wang; et al 出版日期:2025-09-17 |
| 求助人 | |
| 下载 | 求助已完成,仅限求助人下载。 |
PDF的下载单位、IP信息已删除
(2025-6-4)