360联合北大震撼发布!5%参数量逼近Deepseek-R1满血性能

2025年2月24日——由360与北京大学联合研发的中等量级推理模型Tiny-R1-32B-Preview正式亮相,仅以5%参数,逼近Deepseek-R1-671B的性能。

360联合北大震撼发布!5%参数量逼近Deepseek-R1满血性能

核心突破:小模型,大能量

▪  数学领域:以78.1分(AIME 2024评测)逼近原版R1模型(79.8分),远超Deepseek-R1-Distill-Llama-70B(70.0分);

▪  综合性能:在编程(LiveCodeBench 61.6分)、科学(GPQA-Diamond 65.0分)领域全面领先最佳开源70B模型Deepseek-R1-Distill-Llama-70B;

▪  效率跃迁:仅需5%参数量,性能达原版R1的95%以上,推理成本大幅降低。

技术革新:领域专精+模型融合

研究团队使用「分治-融合」策略:

▪  基于DeepSeek-R1生成海量领域数据,分别训练数学、编程、科学三大垂直模型;

▪  通过Arcee团队Mergekit工具智能融合,突破单一模型性能上限,实现多任务均衡优化。

开源承诺:推动技术普惠

▪  模型仓库:https://huggingface.co/qihoo360/TinyR1-32B-Preview

▪  即将公开完整技术报告、训练代码及部分数据集;  

▪  践行开源精神,助力AI社区共筑高效推理新生态。

研发团队表示:「Tiny-R1-32B-Preview是蒸馏技术的里程碑,未来将持续探索更轻量、更强大的通用模型,推动AI技术普惠化进程。」

360 团队: Lin Sun, Guangxiang Zhao, Xiaoqi Jian, Weihong Lin, Yongfu Zhu, Change Jia, Linglin Zhang, Jinzhu Wu, Sai-er Hu, Xiangzheng Zhang

北大团队: Yuhan Wu, Zihan Jiang, Wenrui Liu, Junting Zhou, Bin Cui, Tong Yang

001.jpg

图片4.jpg

【来源:经济界】凡本网注明“来源:经济界” 的所有作品,版权均属于经济界。如转载,须注明“来源:经济界”。违反上述声明者,本网将追究其相关法律责任。
Previous 2025-02-21 上午11:53
Next 2025-02-25 下午10:26

相关推荐

  • 全省标杆!天正上榜浙江管理现代化企业

    农业农村部发布的机收进度显示,截至6月18日,全国小麦收获进度已达到96%,总体进度高效,推进速度比常年快2到3天。三夏“快跑”的背后,离不开科技的强力支撑。央视、人民日报等央媒聚焦雷沃智慧农业整体解决方案,对潍柴雷沃引领三夏 “智变”的龙头作为进行系列深度报道。 央视频全景直播走进雷沃智慧农场 深度揭秘科学种田的“中国答案” 6月16日,央视频以“1小时4…

    12小时前
    0
  • 科技赋能未来 创新智领时代 2025全球人工智能技术创新大赛硬件挑战赛圆满落幕

    6月6日,为期两天的2025全球人工智能技术创新大赛-硬件挑战赛在杭州未来科技城国际会议中心圆满收官。本次大赛由中国人工智能学会主办,大赛吸引了来自全国40余所高校的200余支顶尖队伍报名参赛,引发了行业内外的广泛关注。 大赛围绕智慧交通、智慧生活机器人、智慧农业采收和药房机器人四大前沿赛道展开激烈角逐,聚焦机器人设计、传感器应用、机器视觉及物联网等核心技术…

    2025-06-09
    0
  • 2025全球人工智能技术创新大赛——硬件创新挑战赛即将开赛

    近日,备受瞩目的2025全球人工智能技术创新大赛——硬件创新挑战赛进入开赛倒计时,将于2025年6月5日至6日在杭州市余杭区未来科技城国际会议中心盛大举行。 本次大赛由中国人工智能学会主办,北京塔洛斯科技有限公司及北京心引力科技有限公司协办,旨在挖掘并培育人工智能硬件领域的创新力量,推动人工智能技术实现跨越式发展。 本次大赛比赛地点为杭州未来科技城国际会议中…

    2025-06-03
    0
  • 北大杨仝团队发布FairyR1模型:5%参数量数学和代码能力超越满血DeepSeek

    北京大学杨仝教授团队近期发布了其在高效大型语言模型研究方向的一项新成果——FairyR1-32B模型。该模型基于DeepSeek-R1-Distill-Qwen-32B基座,通过结合微调与模型合并技术构建。研究探索了在参数量大幅减少的情况下,模型在特定任务上实现与更大模型相当甚至更优性能的可能性。该研究得到了国家自然科学基金委项目(624B2005, 623…

    2025-05-26
    0
  • 凝心聚力 开拓新局|山东三聚20万吨/年生物柴油异构项目成功中交

    4月23日上午,北京海新能源科技股份有限公司(以下简称海新能科)旗下山东三聚生物能源有限公司(以下简称山东三聚)举行20万吨/年生物柴油异构项目中交仪式,标志着该项目由建设阶段正式转入试生产阶段,将成为海新能科厚积产业优势,打造生物能源板块高质量发展的新引擎。 在仪式现场,山东省日照市莒县人民政府党组副书记、县经济开发区党工委副书记、管委会主任尹进华,莒县国…

    2025-04-24
    0