DeepSeek 公布多模态模型技术报告后又删除
5 月 1 日
DeepSeek 在 GitHub 发布多模态大模型并公开配套技术报告,提出基于「视觉原语」的创新推理框架,以突破当前多模态大语言模型在空间参照任务中的核心瓶颈。报告指出主流链式思维推理范式局限于语言学领域,现有研究忽视「参照鸿沟」问题,自然语言模糊性会导致模型推理逻辑崩溃。为此,DeepSeek 提出「基于视觉原语的思考」框架,将空间标记提升为推理基本单元,使模型具备「指代」能力,实现对空间关系的精确推演。该框架模型架构高度优化,视觉标记效率高,在相关测试中能与前沿模型匹配,为多模态智能指明方向。不过,随后该论文被删除。
2026-08-31
DeepSeek-V4 首个实验性多模态视觉模型开源2026-08-20
DeepSeek Harness 首发新版本:多模态能力升级2026-08-13
DeepSeek Harness 开发者预览版开放测试2026-06-18
DeepSeek 识图模式正式上线 App 和网页端2026-05-01
DeepSeek 公布多模态模型技术报告后又删除2026-04-29
DeepSeek 灰测识图模式2026-02-28
消息称 DeepSeek 多模态大模型 V4 将于下周发布2026-02-11
DeepSeek 更新模型 可一次性处理超长文本查看更多
体验专业版特色功能,拓展更丰富、更全面的相关内容。