DeepSeek最新发布,首批“试用体验”出炉→

  5 月 28 日晚,DeepSeek 再次传来大消息。

  当天,DeepSeek 官方宣布 DeepSeek R1 模型已完成小版本试升级,欢迎前往官方网页、APP、小程序测试(打开深度思考),API 接口和使用方式保持不变。

  不过,DeepSeek 官方此次并没有公布版本更新的具体内容。今年 3 月,DeepSeek 曾对 V3 模型进行小版本升级,同样是通过官方交流群率先宣布,随后公布了具体更新内容。此前,也有许多关于 R2 大模型的传闻出现,比如“参数规模被曝达到惊人的 1.2 万亿,相比前代 R1 的 6710 亿参数几乎翻倍等”。但截至目前,并未获得官方证实。

  DeepSeek 的本次升级是在英伟达发布最新财报前数小时宣布的。作为全球领先的 AI 芯片制造商,英伟达的股价在 1 月因 R1 的发布而遭遇重挫。

  据中国基金报报道,据用户反馈,DeepSeek 升级后的模型,思维链 (CoT) 的行为似乎发生了显著变化。

  也有用户总结了更新后的几个亮点,其中包括:现在像 Google 模型一样进行深度推理;改进写作任务——更自然、格式更好;独特的推理风格——不仅快速,而且深思熟虑;长时间思考——每个任务最多 30~60 分钟。

  另外,据财联社援引 AIGC 开放社区的信息,已经有网友迫不及待的对新版 R1 进行测试,在著名代码测试平台 Live CodeBench 中显示,其性能可以媲美 OpenAI 最新的 o3 模型高版本。也有网友对新版 R1 的风格进行了测试,几乎和 OpenAI 的 o3 差不多。

  据券商中国报道,这是自 3 月底以来,DeepSeek 的一次最新动作。3 月 25 日晚,DeepSeek 公司在官方账号上正式宣布 V3 模型完成小版本升级的消息,并介绍了新版本 DeepSeek-V3-0324 模型的提升细节,包括推理、前端开发、中文写作、中文搜索几个方面的能力优化。彼时,据海外专业 AI 模型评测机构最新排名,新版 V3 模型是得分最高的非推理模型,超过 xAI 的 Grok3 和 OpenAI 的 GPT-4.5(preview)。

  然而,自那之后,DeepSeek 的热度就开始下降,使用率也有所回落,并且引发了一些质疑。当前,市场最关注的依然是其 R2 模型的发布。4 月底,有传闻称,其 R2 大模型的参数规模被曝达到惊人的 1.2 万亿,相比前代 R1 的 6710 亿参数几乎翻倍。这一数字接近国际顶尖模型如 GPT-4Turbo 和谷歌 Gemini2.0Pro 的水平。R2 的动态激活参数为 780 亿,实际消耗的计算量仅为总参数的 6.5%。这种设计让模型在保持高性能的同时,显著降低了运行成本。然而,种种迹象表明,这些似乎只是市场人士的臆测,截至目前也未获得官方证实,R2 模型亦未推出。反观 Open AI 的动作却相对较多,人工智能大模型的竞争依然在持续。

  编辑|何小桃  杜恒峰