5月28日晚,DeepSeek再次传来大消息。 当天,DeepSeek官方宣布DeepSeek R1模型已完成小版本试升级,接待前往官方网页、APP、小程序测试(翻开深度思考),API 接口和使用方法坚持稳定。 不过,DeepSeek官方此次并没有宣布版本更新的具体内容。今年3月,DeepSeek曾对V3模型进行小版本升级,同样是通过官方交流群率先宣布,随后宣布了具体更新内容。此前,也有许多关于R2大模型的听说泛起,好比“参数规模被曝抵达惊人的1.2万亿,相比前代R1的6710亿参数险些翻倍等”。但截至目前,并未获得官方证实。 DeepSeek的本次升级是在英伟达宣布最新财报前数小时宣布的。作为全球领先的AI芯片制造商,英伟达的股价在1月因R1的宣布而遭遇重挫。 据中国基金报报道,据用户反响,DeepSeek升级后的模型,思维链 (CoT) 的行为似乎爆发了显著变革。 也有用户总结了更新后的几个亮点,其中包括:现在像Google模型一样进行深度推理;革新写作任务——更自然、花样更好;奇特的推理作风——不但快速,并且深思熟虑;长时间思考——每个任务最多30~60分钟。 另外,据财联社援引AIGC开放社区的信息,已经有网友迫缺乏待的对新版R1进行测试,在著名代码测试平台Live CodeBench中显示,其性能可以媲美OpenAI最新的o3模型高版本。也有网友对新版R1的作风进行了测试,险些和OpenAI的o3差未几。 据券商中国报道,这是自3月底以来,DeepSeek的一次最新行动。3月25日晚,DeepSeek公司在官方账号上正式宣布V3模型完成小版本升级的消息,并介绍了新版本DeepSeek-V3-0324模型的提升细节,包括推理、前端开发、中文写作、中文搜索几个方面的能力优化。彼时,据外洋专业AI模型评测机构最新排名,新版V3模型是得分最高的非推理模型,凌驾xAI的Grok3和OpenAI的GPT-4.5(preview)。 然而,自那之后,DeepSeek的热度就开始下降,使用率也有所回落,并且引发了一些质疑。目今,市场最关注的依然是其R2模型的宣布。4月底,有听说称,其R2大模型的参数规模被曝抵达惊人的1.2万亿,相比前代R1的6710亿参数险些翻倍。这一数字接近国际顶尖模型如GPT-4Turbo和谷歌Gemini2.0Pro的水平。R2的动态激活参数为780亿,实际消耗的盘算量仅为总参数的6.5%。这种设计让模型在坚持高性能的同时,显著降低了运行本钱。然而,种种迹象标明,这些似乎只是市场人士的臆测,截至目前也未获得官方证实,R2模型亦未推出。反观Open AI的行动却相对较多,人工智能大模型的竞争依然在连续。 编辑|何小桃杜恒峰 校对|赵庆 封面图片来源:每经记者 兰素英 摄 每日经济新闻综合中国基金报、券商中国、财联社