DeepSeek 与清华联合研究:创新奖励模型推理方法,提升可扩展性
2025 年 4 月 5 日
2026-07-20
中国信通院启动「AISHPerf 大模型训练与推理工程实践性能基准研究工作」2025-09-02
DeepSeek 公开模型原理与训练方法说明2025-07-21
黄仁勋力赞 DeepSeek 对中国创新能力充满信心2025-05-27
微软携手清华、北大推出奖励推理模型:根据 AI 任务复杂性动态分配计算资源2025-05-19
华为 + DeepSeek 推理性能创新高,技术报告公布2025-05-13
腾讯混元宣布开源首个多模态统一 CoT 奖励模型2025-04-05
DeepSeek 与清华联合研究:创新奖励模型推理方法,提升可扩展性2025-03-20
清华团队推出开源具身智能框架 UniAct2025-02-24
清华团队与合作者推出大语言模型 RealSafe-R1查看更多
体验专业版特色功能,拓展更丰富、更全面的相关内容。