DeepSeek-R1 Kimi1.5及类强推理模型开发解读陈博远北京大学2022级“通班"主要研究方向:大语言模型对齐与可扩展监督https://cby-pku.github.io/https://pair-lab.com/ OutlineDeepSeck-R1开创RL加持下强推理慢思考范式新边界> DeepSeck-RIZero及R1技术剖