360联合北大震撼发布!5%参数量逼近Deepseek-R1满血性能

2025年2月24日——由360与北京大学联合研发的中等量级推理模型Tiny-R1-32B-Preview正式亮相,仅以5%参数,逼近Deepseek-R1-671B的性能。

360联合北大震撼发布!5%参数量逼近Deepseek-R1满血性能

核心突破:小模型,大能量

▪  数学领域:以78.1分(AIME 2024评测)逼近原版R1模型(79.8分),远超Deepseek-R1-Distill-Llama-70B(70.0分);

▪  综合性能:在编程(LiveCodeBench 61.6分)、科学(GPQA-Diamond 65.0分)领域全面领先最佳开源70B模型Deepseek-R1-Distill-Llama-70B;

▪  效率跃迁:仅需5%参数量,性能达原版R1的95%以上,推理成本大幅降低。

技术革新:领域专精+模型融合

研究团队使用「分治-融合」策略:

▪  基于DeepSeek-R1生成海量领域数据,分别训练数学、编程、科学三大垂直模型;

▪  通过Arcee团队Mergekit工具智能融合,突破单一模型性能上限,实现多任务均衡优化。

开源承诺:推动技术普惠

▪  模型仓库:https://huggingface.co/qihoo360/TinyR1-32B-Preview

▪  即将公开完整技术报告、训练代码及部分数据集;  

▪  践行开源精神,助力AI社区共筑高效推理新生态。

研发团队表示:「Tiny-R1-32B-Preview是蒸馏技术的里程碑,未来将持续探索更轻量、更强大的通用模型,推动AI技术普惠化进程。」

360 团队: Lin Sun, Guangxiang Zhao, Xiaoqi Jian, Weihong Lin, Yongfu Zhu, Change Jia, Linglin Zhang, Jinzhu Wu, Sai-er Hu, Xiangzheng Zhang

北大团队: Yuhan Wu, Zihan Jiang, Wenrui Liu, Junting Zhou, Bin Cui, Tong Yang

001.jpg

图片4.jpg

免责声明

               

本文转载自网络平台,发布此文仅为传递信息,本文观点不代表本站立场,版权归原作者所有;不代表赞同其观点,不对内容真实性负责,仅供用户参考之用,不构成任何投资、使用等行为的建议。请读者使用之前核实真实性,以及可能存在的风险,任何后果均由读者自行承担。

本网站提供的草稿箱预览链接仅用于内容创作者内部测试及协作沟通,不构成正式发布内容。预览链接包含的图文、数据等内容均为未定稿版本,可能存在错误、遗漏或临时性修改,用户不得将其作为决策依据或对外传播。

因预览链接内容不准确、失效或第三方不当使用导致的直接或间接损失(包括但不限于数据错误、商业风险、法律纠纷等),本网站不承担赔偿责任。用户通过预览链接访问第三方资源(如嵌入的图片、外链等),需自行承担相关风险,本网站不对其安全性、合法性负责。

禁止将预览链接用于商业推广、侵权传播或违反公序良俗的行为,违者需自行承担法律责任。如发现预览链接内容涉及侵权或违规,用户应立即停止使用并通过网站指定渠道提交删除请求。

本声明受中华人民共和国法律管辖,争议解决以本网站所在地法院为管辖法院。本网站保留修改免责声明的权利,修改后的声明将同步更新至预览链接页面,用户继续使用即视为接受新条款。

Previous 2025-02-21 上午11:53
Next 2025-03-06 下午4:11

相关推荐

  • 科技赋能好房子!博匠10款智能机器人亮相中国住博会,用实力圈粉全球

    2025年11月6日,北京首钢国际会展中心里人潮涌动,热闹得像开了场建筑圈的嘉年华,第二十二届中国住博会正式启幕啦!作为行业一年一度的重头戏,本届住博会喊出“科技赋能建好房 产业升级促发展”的口号,200多家国内外企业带着看家本领赶来,全是住房建设领域的新技术、好房子样板。 博匠机器人带着5大品类、10款智能装备一亮相就吸足目光,机器人现场秀操作,把智能建房…

    2025-11-20
    0
  • 从“被动筛查”到“主动拦截”:考拉悠然 Mini LED 模组 AOI 的范式革命

    本文转载自:行家说Display 步入2025年Q4,行家说白皮书团队进入一年一度的产业密集调研期,捕捉产品创新与产业走向。而在今年针对COB环节的专项调研中,我们关注到一个变化:Mini LED AOI检测设备出现新进展。 在调研某头部屏厂COB直显产线时,我们发现其检测方案取得突破:漏检率控制在0.01%以下,炉前修复效率提升40%,产线直通率达80%。…

    2025-11-19
    0
  • 从淘宝小店到国家级高新技术企业,简一科技八周年庆典推出限时特惠活动

    在中国制造业转型升级的大潮中,一批专注于细分领域的科技型企业正崭露头角。武汉简一科技有限公司,这家成立八年的功能性膜材料企业,用扎实的发展足迹印证了中国制造的韧性与活力。从一家淘宝小店起步,到如今产品远销海外市场,简一科技走出了一条独具特色的创新发展之路。 创新驱动,构建完整产业链壁垒 八年来,简一科技始终坚持以技术创新为核心驱动力,逐步构建起从研发、生产、…

    2025-10-25
    0
  • 百度商家智能体全新升级,以技术革新赋能商家转化经营新突破

    9月伊始,百度正式宣布旗下百度商家智能体完成全面升级。作为一款致力于为广大商家提供智能化、便捷获客的平台,百度商家智能体此次升级意义重大,不仅进一步提升了服务效能,更是在数字经济飞速发展的当下,为商家在激烈的市场竞争中开辟了新的增长路径,满足不同行业的商家需求,助力其实现低成本、高转化,百度商家智能体无疑为商家组建了一支“专属AI销售团队”。        …

    2025-09-19
    0
  • 北大团队提出2比特复数模型iFairy{±1, ±i},精度反超量化前,可手机部署

    version 8.14 摘要:为破解大模型部署与推理成本高昂的困境,北京大学杨仝老师团队首次提出名为iFairy的超低比特量化方案。该方案创新性地利用复数{±1, ±i}对模型权重进行2-bit量化,在实现1/8极致压缩与“无乘法”推理加速的同时,语言建模能力和下游任务表现甚至反超了其全精度的LLaMA基座模型。 当下,大语言模型(LLM)的研究热潮席卷全…

    2025-08-15
    0