深夜重磅!DeepSeek最新发布,首批“试用体验”出炉→
深夜重磅!DeepSeek最新发布,首批“试用体验”出炉→
深夜重磅!DeepSeek最新发布,首批“试用体验”出炉→5月28日晚,DeepSeek再次传来大消息(xiāoxī)。
当天,DeepSeek官方(guānfāng)宣布(xuānbù)DeepSeek R1模型已完成小版本试升级,欢迎前往官方网页、APP、小程序测试(打开深度思考),API 接口和使用方式保持不变(bùbiàn)。
不过,DeepSeek官方(guānfāng)此次并没有公布版本更新(gēngxīn)的(de)具体内容。今年3月,DeepSeek曾对V3模型进行小版本升级,同样是通过官方交流群率先宣布,随后公布了具体更新内容。此前,也有许多关于R2大(dà)模型的传闻出现,比如“参数规模被曝达到惊人的1.2万亿,相比前代R1的6710亿参数几乎翻倍(fānbèi)等”。但截至(jiézhì)目前,并未获得官方证实。
DeepSeek的本次升级(shēngjí)是在英伟达发布最新财报前数小时宣布的。作为全球领先(lǐngxiān)的AI芯片制造商(zhìzàoshāng),英伟达的股价在1月因R1的发布而遭遇重挫。
据中国基金报报道,据用户反馈,DeepSeek升级后的模型,思维链 (CoT) 的行为(xíngwéi)似乎发生(fāshēng)了显著变化。
也有用户总结了更新后的(de)几个亮点,其中包括:现在像Google模型一样进行深度(shēndù)推理;改进写作任务——更自然、格式更好;独特的推理风格——不仅快速(kuàisù),而且深思熟虑;长时间思考(sīkǎo)——每个任务最多30~60分钟。
另外,据财联社(liánshè)援引AIGC开放社区的信息,已经有网友迫不及待的对(duì)新版R1进行测试,在著名代码测试平台Live CodeBench中显示,其性能(xìngnéng)可以媲美OpenAI最新的o3模型高版本。也(yě)有网友对新版R1的风格进行了(le)测试,几乎和OpenAI的o3差不多。
据券商中国报道,这是(shì)自3月底(yuèdǐ)以来,DeepSeek的(de)(de)一次最新动作。3月25日晚,DeepSeek公司在官方账号上(shàng)正式宣布V3模型完成小版本升级的消息,并介绍(jièshào)了新版本DeepSeek-V3-0324模型的提升(tíshēng)细节,包括推理、前端开发、中文写作、中文搜索几个方面的能力优化。彼时,据海外专业AI模型评测机构最新排名,新版V3模型是得分最高的非推理模型,超过xAI的Grok3和OpenAI的GPT-4.5(preview)。
然而,自那(nà)之后,DeepSeek的(de)热度就开始下降,使用率也有所回落,并且引发了一些质疑。当前,市场最关注的依然是其R2模型(móxíng)的发布。4月底,有传闻称(chēng),其R2大模型的参数(cānshù)规模被曝达到惊人的1.2万亿,相比前代R1的6710亿参数几乎翻倍。这一数字接近国际顶尖模型如GPT-4Turbo和(hé)谷歌Gemini2.0Pro的水平。R2的动态激活参数为780亿,实际(shíjì)消耗的计算量仅为总参数的6.5%。这种设计让模型在保持高性能(gāoxìngnéng)的同时,显著(xiǎnzhù)降低了运行成本。然而,种种迹象表明,这些似乎只是市场人士的臆测,截至(jiézhì)目前也未(wèi)获得官方证实,R2模型亦未推出。反观Open AI的动作却相对较多,人工智能大模型的竞争依然在持续。
编辑|何小桃(héxiǎotáo) 杜恒峰
每日经济(jīngjì)新闻综合中国基金报、券商中国、财联社
更多精彩资讯请(qǐng)在应用市场下载“央广网”客户端。欢迎提供新闻线索,24小时报料热线400-800-0088;消费者(xiāofèizhě)也可(kě)通过央广网“啄木鸟消费者投诉(tóusù)平台”线上投诉。版权声明:本文章(wénzhāng)版权归属央广网所有,未经授权不得转载。转载请联系:cnrbanquan@cnr.cn,不尊重原创的行为我们将追究责任。
5月28日晚,DeepSeek再次传来大消息(xiāoxī)。
当天,DeepSeek官方(guānfāng)宣布(xuānbù)DeepSeek R1模型已完成小版本试升级,欢迎前往官方网页、APP、小程序测试(打开深度思考),API 接口和使用方式保持不变(bùbiàn)。
不过,DeepSeek官方(guānfāng)此次并没有公布版本更新(gēngxīn)的(de)具体内容。今年3月,DeepSeek曾对V3模型进行小版本升级,同样是通过官方交流群率先宣布,随后公布了具体更新内容。此前,也有许多关于R2大(dà)模型的传闻出现,比如“参数规模被曝达到惊人的1.2万亿,相比前代R1的6710亿参数几乎翻倍(fānbèi)等”。但截至(jiézhì)目前,并未获得官方证实。
DeepSeek的本次升级(shēngjí)是在英伟达发布最新财报前数小时宣布的。作为全球领先(lǐngxiān)的AI芯片制造商(zhìzàoshāng),英伟达的股价在1月因R1的发布而遭遇重挫。
据中国基金报报道,据用户反馈,DeepSeek升级后的模型,思维链 (CoT) 的行为(xíngwéi)似乎发生(fāshēng)了显著变化。
也有用户总结了更新后的(de)几个亮点,其中包括:现在像Google模型一样进行深度(shēndù)推理;改进写作任务——更自然、格式更好;独特的推理风格——不仅快速(kuàisù),而且深思熟虑;长时间思考(sīkǎo)——每个任务最多30~60分钟。
另外,据财联社(liánshè)援引AIGC开放社区的信息,已经有网友迫不及待的对(duì)新版R1进行测试,在著名代码测试平台Live CodeBench中显示,其性能(xìngnéng)可以媲美OpenAI最新的o3模型高版本。也(yě)有网友对新版R1的风格进行了(le)测试,几乎和OpenAI的o3差不多。
据券商中国报道,这是(shì)自3月底(yuèdǐ)以来,DeepSeek的(de)(de)一次最新动作。3月25日晚,DeepSeek公司在官方账号上(shàng)正式宣布V3模型完成小版本升级的消息,并介绍(jièshào)了新版本DeepSeek-V3-0324模型的提升(tíshēng)细节,包括推理、前端开发、中文写作、中文搜索几个方面的能力优化。彼时,据海外专业AI模型评测机构最新排名,新版V3模型是得分最高的非推理模型,超过xAI的Grok3和OpenAI的GPT-4.5(preview)。
然而,自那(nà)之后,DeepSeek的(de)热度就开始下降,使用率也有所回落,并且引发了一些质疑。当前,市场最关注的依然是其R2模型(móxíng)的发布。4月底,有传闻称(chēng),其R2大模型的参数(cānshù)规模被曝达到惊人的1.2万亿,相比前代R1的6710亿参数几乎翻倍。这一数字接近国际顶尖模型如GPT-4Turbo和(hé)谷歌Gemini2.0Pro的水平。R2的动态激活参数为780亿,实际(shíjì)消耗的计算量仅为总参数的6.5%。这种设计让模型在保持高性能(gāoxìngnéng)的同时,显著(xiǎnzhù)降低了运行成本。然而,种种迹象表明,这些似乎只是市场人士的臆测,截至(jiézhì)目前也未(wèi)获得官方证实,R2模型亦未推出。反观Open AI的动作却相对较多,人工智能大模型的竞争依然在持续。
编辑|何小桃(héxiǎotáo) 杜恒峰
每日经济(jīngjì)新闻综合中国基金报、券商中国、财联社
更多精彩资讯请(qǐng)在应用市场下载“央广网”客户端。欢迎提供新闻线索,24小时报料热线400-800-0088;消费者(xiāofèizhě)也可(kě)通过央广网“啄木鸟消费者投诉(tóusù)平台”线上投诉。版权声明:本文章(wénzhāng)版权归属央广网所有,未经授权不得转载。转载请联系:cnrbanquan@cnr.cn,不尊重原创的行为我们将追究责任。




相关推荐
评论列表
暂无评论,快抢沙发吧~
你 发表评论:
欢迎