360联合北大震撼发布!5%参数量逼近Deepseek-R1满血性能

2025年2月24日——由360与北京大学联合研发的中等量级推理模型Tiny-R1-32B-Preview正式亮相,仅以5%参数,逼近Deepseek-R1-671B的性能。

360联合北大震撼发布!5%参数量逼近Deepseek-R1满血性能

核心突破:小模型,大能量

▪  数学领域:以78.1分(AIME 2024评测)逼近原版R1模型(79.8分),远超Deepseek-R1-Distill-Llama-70B(70.0分);

▪  综合性能:在编程(LiveCodeBench 61.6分)、科学(GPQA-Diamond 65.0分)领域全面领先最佳开源70B模型Deepseek-R1-Distill-Llama-70B;

▪  效率跃迁:仅需5%参数量,性能达原版R1的95%以上,推理成本大幅降低。

技术革新:领域专精+模型融合

研究团队使用「分治-融合」策略:

▪  基于DeepSeek-R1生成海量领域数据,分别训练数学、编程、科学三大垂直模型;

▪  通过Arcee团队Mergekit工具智能融合,突破单一模型性能上限,实现多任务均衡优化。

开源承诺:推动技术普惠

▪  模型仓库:https://huggingface.co/qihoo360/TinyR1-32B-Preview

▪  即将公开完整技术报告、训练代码及部分数据集;  

▪  践行开源精神,助力AI社区共筑高效推理新生态。

研发团队表示:「Tiny-R1-32B-Preview是蒸馏技术的里程碑,未来将持续探索更轻量、更强大的通用模型,推动AI技术普惠化进程。」

360 团队: Lin Sun, Guangxiang Zhao, Xiaoqi Jian, Weihong Lin, Yongfu Zhu, Change Jia, Linglin Zhang, Jinzhu Wu, Sai-er Hu, Xiangzheng Zhang

北大团队: Yuhan Wu, Zihan Jiang, Wenrui Liu, Junting Zhou, Bin Cui, Tong Yang

001.jpg

图片4.jpg

【来源:经济界】凡本网注明“来源:经济界” 的所有作品,版权均属于经济界。如转载,须注明“来源:经济界”。违反上述声明者,本网将追究其相关法律责任。
Previous 2025-02-21 上午11:53
Next 2025-03-06 下午4:11

相关推荐

  • 百度商家智能体全新升级,以技术革新赋能商家转化经营新突破

    9月伊始,百度正式宣布旗下百度商家智能体完成全面升级。作为一款致力于为广大商家提供智能化、便捷获客的平台,百度商家智能体此次升级意义重大,不仅进一步提升了服务效能,更是在数字经济飞速发展的当下,为商家在激烈的市场竞争中开辟了新的增长路径,满足不同行业的商家需求,助力其实现低成本、高转化,百度商家智能体无疑为商家组建了一支“专属AI销售团队”。        …

    2025-09-19
    0
  • 10大AI制作微课工具推荐,2025最新榜单,课件帮领先!

    2025 年,AI 制作微课工具迎来了爆发式发展,为方便用户选择,最新榜单出炉,10 大工具各有特色,其中课件帮凭借全面的功能和出色的表现处于领先地位。     课件帮位居榜首,是当之无愧的领先者。它的三大创作模式为微课制作提供了极大便利,文档播讲模式可直接上传 PPT,自动生成口播稿、配置动画转场和字幕(可配置双语字幕),让静态 PPT…

    2025-09-01
    0
  • 北大团队提出2比特复数模型iFairy{±1, ±i},精度反超量化前,可手机部署

    version 8.14 摘要:为破解大模型部署与推理成本高昂的困境,北京大学杨仝老师团队首次提出名为iFairy的超低比特量化方案。该方案创新性地利用复数{±1, ±i}对模型权重进行2-bit量化,在实现1/8极致压缩与“无乘法”推理加速的同时,语言建模能力和下游任务表现甚至反超了其全精度的LLaMA基座模型。 当下,大语言模型(LLM)的研究热潮席卷全…

    2025-08-15
    0
  • 用友YonSuite医药解决方案合规提效,全链智变,重塑医药新生态!

    当前医药和医疗器械行业正面临政策与市场的双重变革: 国内外宏观政策的持续调整与市场环境的快速演变,对企业的管理水平提升和经营效率优化提出了更为迫切的要求。 与此同时,全球范围内的研发竞争日趋白热化,监管标准也在不断升级,这双重压力倒逼着企业必须借助数智化手段,实现质量管控的全面升级与运营效率的突破性提升。 在这样的背景下,数智化已不再是企业发展的可选项,而是…

    2025-07-21
    0
  • 全省标杆!天正上榜浙江管理现代化企业

    农业农村部发布的机收进度显示,截至6月18日,全国小麦收获进度已达到96%,总体进度高效,推进速度比常年快2到3天。三夏“快跑”的背后,离不开科技的强力支撑。央视、人民日报等央媒聚焦雷沃智慧农业整体解决方案,对潍柴雷沃引领三夏 “智变”的龙头作为进行系列深度报道。 央视频全景直播走进雷沃智慧农场 深度揭秘科学种田的“中国答案” 6月16日,央视频以“1小时4…

    2025-06-23
    0