标签:多阶段训练

DeepSeek-R1:高性能AI推理模型的革命性突破

DeepSeek-R1 是一款由中国杭州深度求索公司开发的高性能AI推理模型,专注于数学、代码和自然语言推理任务。该模型通过强化学习和多阶段训练技术实现高效推理...