<cite id="ffb66"></cite><cite id="ffb66"><track id="ffb66"></track></cite>
      <legend id="ffb66"><li id="ffb66"></li></legend>
      色婷婷久,激情色播,久久久无码专区,亚洲中文字幕av,国产成人A片,av无码免费,精品久久国产,99视频精品3
      網易首頁 > 網易號 > 正文 申請入駐

      業界首個!螞蟻開源萬億參數混合線性思考模型,IMO金牌水平

      0
      分享至


      智東西
      作者 程茜
      編輯 李水青

      智東西2月13日消息,今天,螞蟻集團開源全球首個基于混合線性架構的萬億參數思考模型Ring-2.5-1T。

      根據官方信息,相比螞蟻2025年10月發布的萬億級思考模型Ring-1T,Ring-2.5-1T在生成效率、推理深度和長時程任務執行能力三個關鍵維度上實現提升,且在長文本生成、數學推理與智能體任務執行上達到開源領先水平。

      在生成效率上,Ring-2.5-1T在32K以上長文本生成場景中,對比上代模型訪存規模降低至1/10,生成吞吐提升3倍以上。

      在深度思考能力方面,該模型在國際數學奧林匹克競賽(IMO 2025)和中國數學奧林匹克(CMO 2025)自測均達到金牌水平,IMO為35分、CMO為105分。


      目前,該模型已經適配Claude Code等智能體框架與OpenClaw個人AI助理,支持多步規劃與工具調用。

      Ring-2.5-1T的模型權重與推理代碼已在Hugging Face、ModelScope等主流開源平臺發布,官方平臺Chat體驗頁和API服務將在近期上線。

      Hugging Face:https://huggingface.co/inclusionAI/Ring-2.5-1T

      ModelScape:https://modelscope.cn/organization/inclusionAI

      一、拿下多項開源SOTA,達IMO金牌水平

      為了評估Ring-2.5-1T的深度思考與長時任務執行能力,螞蟻研究人員選擇了具有代表性的開源思考模型DeepSeek-v3.2-Thinking、Kimi-K2.5-Thinking和閉源API GPT-5.2-thinking-high、Gemini-3.0-Pro-preview-thinking-high、Claude-Opus-4.5-Extended-Thinking作為比較。

      螞蟻集團公布的多項權威基準測試結果顯示,Ring-2.5-1T在數學、編程和邏輯推理的IMOAnswerBench、AIME 26、HMMT 25、LiveCodeBench、ARC-AGI-V2等高難度推理任務以及Agent搜索、工具調用和軟件工程Gaia2-search、Tau2-bench和SWE-Bench Verified等長時任務執行方面均實現了最先進的開源性能。

      此外,螞蟻還對深度思考(Heavy Thinking)模式下的模型性能進行了額外測試,Ring-2.5-1T在IMOAnswerBench、HMMT-25等數學競賽推理基準和LiveCodeBench-v6代碼生成基準中超越所有對比模型。

      其中,在IMO 2025(滿分42分)中,Ring-2.5-1T獲得35分,達到金牌水平;在CMO 2025(滿分126分)中,該模型獲得105分,超過金牌分數線78分和國家隊集訓隊選拔線87分。

      研究人員比較了Ring-2.5-1T和Ring-1T的答案發現,前者在推理邏輯的嚴謹性、高級數學證明技術的應用以及答案表述的完整性方面均有提升。

      智能體搜索任務Gaia2-search中,Ring-2.5-1T在開源模型中取得了SOTA性能。Gaia2環境強調跨應用工具協作和復雜任務執行能力,Ring-2.5-1T在規劃生成和多步工具調用方面均展現出較高的效率和準確性。

      二、三大關鍵維度提升,能快速適配Claude Code、OpenClaw

      相比螞蟻2025年10月發布的萬億級思考模型Ring-1T,Ring-2.5-1T在生成效率、推理深度和長時程任務執行能力三個關鍵維度上有顯著改進。

      首先在生成效率方面,通過采用高比例線性注意力機制,Ring-2.5-1T將內存訪問開銷降低至1/10,并將超過32K token序列的生成吞吐量提高了3倍以上,適用于深度思考和長時程任務執行。

      其次在深度思考層面,該模型在RLVR(基于可驗證獎勵的強化學習)基礎上引入密集獎勵機制,為推理過程提供嚴格性反饋,使Ring-2.5-1T同時達到IMO 2025和CMO 2025(自測)的金獎水平。

      最后是長程任務執行,Ring-2.5-1T通過大規模完全異步智能體RL(強化學習)訓練,增強了解決復雜任務的長時程自主執行能力,使其能快速適配Claude Code等智能體編程框架和OpenClaw個人AI助手。

      三、引入混合線性注意力架構,可提升長程推理場景吞吐量

      Ring-2.5-1T基于Ling 2.5架構,通過優化注意力機制,可提升長文本推理的效率與穩定性。

      作為實現自主模型架構的關鍵進展,Ling 2.5架構在Ling 2.0架構的基礎上引入了一種混合線性注意力架構。通過增量訓練,研究人員將Ling 2.0架構中的GQA(分組查詢注意力)升級為MLA(多頭線性注意力)+Lightning Linear結構的1:7比例。

      具體來說,基于其先前發布的Ring-flash-linear-2.0技術路線圖,研究人員將部分GQA層轉換為Lightning Linear注意力,以提升長時程推理場景中的吞吐量。

      同時為了進一步壓縮KV緩存,研究人員將剩余的GQA層近似轉換為MLA,同時針對QK Norm(查詢-核歸一化)和Partial RoPE(部分旋轉位置編碼)等特征進行針對性改進,從而增強Ling 2.5架構的表達能力。


      在此基礎上,模型激活參數規模從前代的51B提升至63B,并且在混合線性注意力架構的支持下,其推理效率相比Ling 2.0仍實現大幅提升。

      與僅具備32B激活參數的Kimi K2架構相比,在1T總參數量下,Ling 2.5架構在長序列推理任務中的吞吐表現優勢顯著,且隨著生成長度增加,效率優勢持續擴大。


      ▲在一臺配備8塊H20-3e GPU的機器上,批處理大小=64,比較不同生成長度下的解碼吞吐量


      ▲在一臺配備8塊H200 GPU的機器上,批處理大小=64,比較不同生成長度下的解碼吞吐量

      結語:從短對話到復雜規劃,大模型需突破長文本瓶頸

      隨著AI大模型應用從短對話向長文檔處理、跨文件代碼理解、復雜任務規劃等場景擴展,Ring-2.5-1T可以緩解模型在長輸出場景下計算開銷高、推理速度慢的問題。

      此前,傳統架構在面對超長文本、多模態內容、復雜業務流程時,普遍面臨算力成本高、響應延遲大、部署難度高等問題,螞蟻百靈團隊此次通過底層架構創新,或為行業提供一條兼顧性能、成本與擴展性的技術路徑。


      特別聲明:以上內容(如有圖片或視頻亦包括在內)為自媒體平臺“網易號”用戶上傳并發布,本平臺僅提供信息存儲服務。

      Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

      相關推薦
      熱點推薦
      突然暴跌!北京降了!價格再下跌!

      突然暴跌!北京降了!價格再下跌!

      美麗大北京
      2026-02-13 16:41:07
      米蘭冬奧|今日早報:金博洋謝幕,馬里寧爆冷,花滑男單冠軍花落哈薩克斯坦

      米蘭冬奧|今日早報:金博洋謝幕,馬里寧爆冷,花滑男單冠軍花落哈薩克斯坦

      上觀新聞
      2026-02-14 06:59:04
      剛剛,整個日本開始了走向毀滅!

      剛剛,整個日本開始了走向毀滅!

      一個壞土豆
      2026-02-13 19:50:54
      蜜雪冰城墨西哥首店開業,民眾排隊數小時購買,當地華人:比其他奶茶便宜很多,檸檬水8元一杯,口感和國內一樣

      蜜雪冰城墨西哥首店開業,民眾排隊數小時購買,當地華人:比其他奶茶便宜很多,檸檬水8元一杯,口感和國內一樣

      極目新聞
      2026-02-13 17:51:18
      1-3!登貝萊破門,金球先生難挽敗局,大巴黎爆冷倒地,7連勝終結

      1-3!登貝萊破門,金球先生難挽敗局,大巴黎爆冷倒地,7連勝終結

      我的護球最獨特
      2026-02-14 03:54:15
      “功能性滅絕”儒艮尸體現廣東湛江海灘?專家:確認為印太江豚

      “功能性滅絕”儒艮尸體現廣東湛江海灘?專家:確認為印太江豚

      上觀新聞
      2026-02-14 06:39:08
      浙江“一人公司”興起!前大廠程序員靠AI月入200萬元:“完全不需要員工”

      浙江“一人公司”興起!前大廠程序員靠AI月入200萬元:“完全不需要員工”

      環球網資訊
      2026-02-13 20:27:07
      中德法舉行三方外長會晤

      中德法舉行三方外長會晤

      新華社
      2026-02-14 08:38:08
      網友胖東來買車厘子放一個月后全壞了,一番溝通后同意退款

      網友胖東來買車厘子放一個月后全壞了,一番溝通后同意退款

      映射生活的身影
      2026-02-13 14:36:46
      高市早苗拿俄立威后,不到24小時,普京反擊,一句話堵死日本后路

      高市早苗拿俄立威后,不到24小時,普京反擊,一句話堵死日本后路

      松林看世界
      2026-02-14 08:22:40
      13歲體操冠軍傅佳麗被虐待致跳樓,央媒跟進:2名涉事教練被立案

      13歲體操冠軍傅佳麗被虐待致跳樓,央媒跟進:2名涉事教練被立案

      奇思妙想草葉君
      2026-02-12 20:11:52
      德國總理慕安會上喊話美國:你能力不足以獨行!

      德國總理慕安會上喊話美國:你能力不足以獨行!

      看看新聞Knews
      2026-02-14 10:37:17
      韓國獎牌榜超越中國后,韓媒嘲諷:至今0金,連澳大利亞都不如!

      韓國獎牌榜超越中國后,韓媒嘲諷:至今0金,連澳大利亞都不如!

      十點街球體育
      2026-02-13 22:03:39
      馬競成第一神經刀!馬競5-2皇馬4-0巴薩 但西甲落后皇薩多達12分

      馬競成第一神經刀!馬競5-2皇馬4-0巴薩 但西甲落后皇薩多達12分

      智道足球
      2026-02-13 17:55:07
      外媒:魯比奧“最后一刻”決定缺席一場烏克蘭問題會議,被批“瘋了”

      外媒:魯比奧“最后一刻”決定缺席一場烏克蘭問題會議,被批“瘋了”

      環球網資訊
      2026-02-14 09:34:33
      無冕之王!40歲保羅被裁后宣布退役 長文深情告別21年NBA生涯

      無冕之王!40歲保羅被裁后宣布退役 長文深情告別21年NBA生涯

      醉臥浮生
      2026-02-14 02:17:59
      恭喜!克萊與安踏簽下終身合同 12年間售出簽名鞋超1000萬雙

      恭喜!克萊與安踏簽下終身合同 12年間售出簽名鞋超1000萬雙

      羅說NBA
      2026-02-14 06:58:33
      驚天轉向!托卡耶夫自削權力,哈薩克斯坦告別“一言堂”

      驚天轉向!托卡耶夫自削權力,哈薩克斯坦告別“一言堂”

      芳芳歷史燴
      2026-02-12 15:40:36
      中央批準,湖北省副省長跨省履新!多個省級黨委領導班子調整

      中央批準,湖北省副省長跨省履新!多個省級黨委領導班子調整

      上觀新聞
      2026-02-14 10:49:06
      在日本待了5年我才敢說:很多人眼里的日本,根本不是那么回事

      在日本待了5年我才敢說:很多人眼里的日本,根本不是那么回事

      夜深愛雜談
      2026-02-13 21:05:31
      2026-02-14 11:47:00
      智東西 incentive-icons
      智東西
      聚焦智能變革,服務產業升級。
      11230文章數 116972關注度
      往期回顧 全部

      科技要聞

      獨家探訪蔡磊:答不完的卷子 死磕最后一程

      頭條要聞

      牛彈琴:一覺醒來烏感謝中國了 希望與中國最高層接觸

      頭條要聞

      牛彈琴:一覺醒來烏感謝中國了 希望與中國最高層接觸

      體育要聞

      一年怒虧2個億,庫里和安德瑪的“孽緣”

      娛樂要聞

      吳克群變“吳克窮”助農,國臺辦點贊

      財經要聞

      春節搶黃金,誰賺到錢了?

      汽車要聞

      星光730新春促銷開啟 80天銷量破2.6萬臺

      態度原創

      教育
      數碼
      親子
      游戲
      公開課

      教育要聞

      3位諾貝爾文學獎得主親測有效的9個寫作習慣,新手也能立刻上手

      數碼要聞

      美光開始量產面向數據中心的固態硬盤

      親子要聞

      孩子吃飯時,有3個表現是典型的“聰明相”,占一個都很了不起

      天國拯救1次世代版發布!已有玩家可免費升級

      公開課

      李玫瑾:為什么性格比能力更重要?

      無障礙瀏覽 進入關懷版