新版DeepSeek-R1正式开源！直逼o3编程强到离谱，一手实测来了

编辑：编辑部 YXZH

【新智元导读】新版DeepSeek-R1重磅开源，凌晨已放出权重！此次模型性能几乎与o4-mini（Medium）相当，编程实测超越Claude 4 Sonnet。网友纷纷惊叹：开源又一次胜利了。

临近端午假期，DeepSeek果然又开始搞事。

就在今天凌晨，新版DeepSeek-R1正式开源了！

DeepSeek-R1-0528模型权重已上传到HuggingFace，不过模型卡暂未更新。

项目地址：
https://huggingface.co/deepseek-ai/DeepSeek-R1-0528/tree/main

时隔4个月，DeepSeek-R1完成了超进化，编码能力强到离谱，而且思考时间更长了。

据称，新模型基于DeepSeek-V3-0324训练（参数为660B）。

经典物理模拟测试中，DeepSeek-R1新旧版本的对比

在LiveCodeBench基准上，DeepSeek-R1-0528性能几乎与o3-mini（High）和o4-mini（Medium)实力相当，一举超越了Gemini 2.5 Flash。

有网友称赞，DeepSeek-R1能够像o3一样纠正思维链，并且像Claude一样创造性进行世界构建。

可以说，这是属于开源模型的巨大胜利！

不用R2，直接对标SOTA

此次，DeepSeek-R1-0528更新核心亮点，网友做了一个浓缩版的总结：

能像谷歌模型一样深度推理
文本生成优化：更自然，格式更佳
独特的推理风格：不仅快，而且更缜密
支持长时思考：单任务处理时长可达30-60分钟

思考时间更长，成为了全网讨论最多的一点。有网友实测后，R1思考时长超过了25分钟。

另外，这似乎是唯一一个能持续正确做对「9.9 - 9.11是多少」的模型。

编程能力强到爆

网友实测显示，新版DeepSeek-R1在编程方面简直不可思议！

AI圈大佬「karminski-牙医」用同一个prompt测试了DeepSeek-R1-0528和Claude 4 Sonnet后发现。

不管是光线照射在墙上形成的漫反射，还是球在撞击后的运动方向，亦或是控制面板的美观程度，这一把R1稳赢。

网友Alex的测试也显示出，DeepSeek-R1在前端编码的能力上超越了Claude 4 Sonnet。

网友Haider.则是让模型构建一个单词评分系统。R1简要思考后，就立刻出了关于代码和工作测试的两个文件，第一次运行就完美无瑕。

此前，o3是唯一能完成这个任务的模型。而如今，R1堪称是完成这个任务的最佳模型。

注意，R1的表现之所以如此惊人，是因为它返回的两个文件在第一次都能运行良好，不用编辑，不用重试，这极其少见。

因为此前的大多数模型，要么会在边缘情况下终端，要么会做得太复杂，要么缺少适当的测试覆盖率。

展开阅读全文

更新时间：2025-12-05

标签：科技离谱新版正式程强模型网友测试权重能力强大佬此前性能编辑

1 2 3 4 5

苹果计划重命名操作系统

彭博科技记者马克·古尔曼发文称，苹果公司计划对其操作系统名称进行迄今为止最全面的调整，这是其所有设备软件改革的一部分。据悉，苹果的下一代操作系统将以年份而非版本号来命

直播预告｜小行星，“天问”来了！

新民周刊谈话直播栏目“周周嘎3胡” 第102期小行星，“天问”来了！ △ 天问二号“一箭双雕”的亮点△为什么要探测小行星？△小行星，“神秘而危险”？△中国载人登月已近在眼前？ 2025

699元，小米200Hz新机官宣：5月30日，正式开售

699元杀疯了！Redmi 200Hz电竞显示器炸场，玩家：这价格真实存在？小米旗下的 Redmi 又来“掀桌子”了！5月30日，一款让电竞玩家直呼“离谱”的新品——Redmi 显示器 G27 200Hz 版本正

苹果品牌新策略：iOS 26领衔，操作系统命名向年份看齐

IT之家 5 月 29 日消息，彭博社的马克・古尔曼（Mark Gurman）今天（5 月 29 日）发布博文，报道称苹果公司正重塑其六大系统，不再使用传统版本号，而是以年份为后缀命名。例如，苹果计划在 2

西昌卫星发射中心成功实施天问二号“零窗口”发射

5月29日凌晨1时31分，我国在西昌卫星发射中心用长征三号乙运载火箭，成功将行星探测工程天问二号探测器发射升空。新华社图“点火！”5月29日1时31分，搭载着天问二号探测器的长征

中航西飞举办高端科技人才引进与项目推进会暨“高端智航”论坛

为贯彻国家创新驱动发展战略，系统谋划公司未来发展，推动科技创新和人才队伍建设迈上新台阶，5月28日，中航西飞举办高端科技人才引进与项目推进会暨“高端智航”论坛。中航西飞总

天问二号出差近10年，这趟星际快递要带点啥？

来源：央视网 5月29日1时31分，我国在西昌卫星发射中心用长征三号乙Y110运载火箭，成功将行星探测工程天问二号探测器发射升空。去一颗小行星上“挖土”，再前排“围观”一颗主带彗

获超百家机构调研的机器人概念股出炉

人民财讯5月29日电，据证券时报·数据宝统计，今年一季度以来，A股机器人概念持续火热，概念指数最高上涨超30%，中大力德、金奥博、巨轮智能等19只概念股在一季度期间股价最大涨幅超

马兴瑞主持召开自治区党委全面深化改革委员会会议

马兴瑞主持召开自治区党委全面深化改革委员会会议增强改革动力加大改革力度以钉钉子精神推进战略性创造性引领性改革攻坚艾尔肯·吐尼亚孜祖木热提·吾布力努尔兰·阿不

美国国际贸易法院“叫停”特朗普政府关税措施生效

新华社纽约5月28日电（记者刘亚南）据多家美国媒体28日报道，位于纽约的美国国际贸易法院当天裁定暂停特朗普政府4月2日宣布的一揽子加征关税政策生效。

多家中小银行降存款利率！中信证券：港股和A股将迎牛市！

1，多家中小银行下调存款利率呈幅度大、跟进快特征5月28日，上海华瑞银行下调人民币存款挂牌利率。其中，活期、3年期整存整取存款挂牌利率均下调10个基点，分别至0.15%、2.4%；5年

墨西哥央行大幅下调2025年经济增长预期

当地时间5月28日，墨西哥央行发布的季度报告显示，该行大幅下调今明两年经济增长预期，归因于国内经济疲软和美国贸易政策带来的不确定性。墨西哥央行预计墨西哥今年国内生产总值

马斯克官宣即将离开特朗普政府

当地时间5月28日，美国政府效率部负责人埃隆·马斯克在其社交媒体平台X上发文表示，在他作为特别政府雇员的任期即将结束之际，他想感谢美国总统特朗普给予的减少政府浪费性支出的

山东墨龙股价下跌2.23% 董事会审议续聘审计机构议案

山东墨龙股价报3.95元，较前一交易日下跌0.09元。盘中最高触及4.06元，最低下探至3.95元，成交量为18.65万手，成交金额7400万元。山东墨龙主要从事石油机械专用设备制造业务，产品应

上滑加载更多 ↓

新版DeepSeek-R1正式开源！直逼o3编程强到离谱，一手实测来了

【新智元导读】新版DeepSeek-R1重磅开源，凌晨已放出权重！此次模型性能几乎与o4-mini（Medium）相当，编程实测超越Claude 4 Sonnet。网友纷纷惊叹：开源又一次胜利了。

苹果计划重命名操作系统

直播预告｜小行星，“天问”来了！

699元，小米200Hz新机官宣：5月30日，正式开售

最新爆料！苹果将推出 iOS 26，放弃 iOS 19 系统

苹果品牌新策略：iOS 26领衔，操作系统命名向年份看齐

西昌卫星发射中心成功实施天问二号“零窗口”发射

中航西飞举办高端科技人才引进与项目推进会暨“高端智航”论坛

天问二号出差近10年，这趟星际快递要带点啥？

获超百家机构调研的机器人概念股出炉

马兴瑞主持召开自治区党委全面深化改革委员会会议

美国国际贸易法院“叫停”特朗普政府关税措施生效

多家中小银行降存款利率！中信证券：港股和A股将迎牛市！

墨西哥央行大幅下调2025年经济增长预期

马斯克官宣即将离开特朗普政府

山东墨龙股价下跌2.23% 董事会审议续聘审计机构议案

699元，小米200Hz新机官宣：5月30日，正式开售

中航西飞举办高端科技人才引进与项目推进会暨“高端智

vivo S30系列正式发布：三大创新重塑中端市场格局

美股三大指数集体收跌，热门科技股多数下跌

中旗股份：氯虫苯甲酰胺项目尚未正式投产提醒投资者谨

当端午遇上“六一”，中国科技馆迎观众过“科学味”假期

驿城区开展科技活动周科普宣传活动

四川省科协为科技智库专家代表颁发聘书

奋达科技股价微跌0.44%，清华大学团队到访探讨机器人技

【AI早报】5月29日：A股缩量震荡收平，科技股调整后布局高