媲美OpenAI o3,DeepSeek深夜开源新版R1模型|界面新闻 · 科技

AFtr9qmm 4 0

大模型明星企业DeepSeek深夜“上新”。据AIGC开放社区,5月29日凌晨,DeepSeek开源了R1最新0528版本。DeepSeek目前没有对该版本进行任何说明,又只是“悄悄”地开放了模型。估计很快会放出模型卡介绍更多功能。但已经有网友迫不及待的对新版R1进行测试,在著名代码测试平台Live CodeBench中显示,其性能可以媲美OpenAI最新的o3模型高版本。也有网友对新版R1的风格进行了测试,几乎和OpenAI的o3差不多。

此前,DeepSeek在官方交流群中发布通知:DeepSeek R1模型已完成小版本试升级,欢迎前往官方网页、App、小程序测试(打开深度思考),API接口和使用方式保持不变。DeepSeek曾在今年3月对V3模型进行小版本升级,同样是通过官方交流群率先宣布,随后公布了具体更新内容。

3月25日晚,DeepSeek在官方账号上正式宣布V3模型完成小版本升级的消息,并介绍了新版本DeepSeek-V3-0324模型的提升细节,包括推理、前端开发、中文写作等几个方面的能力优化。

彼时,据海外专业AI模型评测机构最新排名,新版V3模型是得分最高的非推理模型,超过xAI的Grok3和OpenAI的GPT-4.5(preview)。

关于此次最新升级的R1模型,据中国基金报报道,据用户反馈,DeepSeek升级后的模型,思维链 (CoT) 的行为似乎发生了显著变化。

也有用户总结了更新后的几个亮点,其中包括:现在像Google模型一样进行深度推理;改进写作任务——更自然、格式更好;独特的推理风格——不仅快速,而且深思熟虑;长时间思考——每个任务最多30~60分钟。

媲美OpenAI o3,DeepSeek深夜开源新版R1模型|界面新闻 · 科技-第1张图片-娱乐资讯头条生活新闻网

DeepSeek于今年1月正式发布高性能开源推理大语言模型R1,该模型在数学推理、编程、逻辑分析等领域表现亮眼,以极低成本实现对OpenAI o1等闭源模型的性能对标,迅速成为全球AI领域焦点,引发热议。

相比于此次小版本升级的R1大模型,外界更期待DeepSeek推出R2模型。此前,有许多关于R2大模型的传闻出现,比如“参数规模被曝达到惊人的1.2万亿,相比前代R1的6710亿参数几乎翻倍等”。但截至目前,并未获得官方证实。

  • 京东MALL北京首店试营业,线下零售再扩张|界面新闻 · 科技
  • 中银证券一员工违规炒股遭处罚,监管紧盯从业人员投资行为|界面新闻
  • 美黄石公园附近重大车祸致5名中国公民遇难,驻旧金山总领馆紧急提醒|界面新闻 · 天下
  • 退市首日两度临停,普利制药遭遇股债双杀|界面新闻 · 证券
  • Momenta累计合作量产车型超130款|界面新闻 · 快讯
  • 国泰海通证券:白酒行业周期寻底,配置价值凸显|界面新闻 · 快讯
  • 小数据 | 谁在打卡爆火的哈尔滨?|界面新闻
  • 上海官宣启动不动产信托登记,多个创新亮点值得关注|界面新闻
  • “陶天海时代”的金茂权力版图:任命3名副总裁、14名城市总|界面新闻 · 地产
  • 财说| 提前进入“高温模式”,旅游市场有哪些新趋势?|界面新闻 · 证券
  • 涉嫌信息披露违法违规,“客药第一股”嘉应制药被中国证监会立案|界面新闻 · 证券
  • 美伊第三轮核问题会谈在即,伊朗代表团抵达阿曼|界面新闻 · 快讯
  • 与美国关税谈判期限延长至7月9日,欧盟:面对勒索不会退缩|界面新闻 · 天下
  • 京东外卖又崩了,京东:午间高峰下单量暴增致系统故障|界面新闻
  • 力源海纳IPO抽中现场检查:产能利用率骤降,多个大客户去年业绩大降|界面新闻 · 证券
  • 抱歉,评论功能暂时关闭!