国产98在线 | 传媒麻豆,久久―日本道色综合久久,久久久精品久久久久久久久久久,国产成人精品免费久久久久,五月综合色婷婷影院在线观看,久久久亚洲精品视频

  • 虎科技 - 領先的互聯網科技媒體

阿里通義千問Qwen2.5-1M模型開源,長上下文處理能力大幅提升!

   時間:2025-01-27 07:52 來源:ITBEAR作者:趙云飛

阿里通義千問于近日正式宣布,開源了其最新的Qwen2.5-1M模型及其配套的推理框架。這一舉措標志著通義千問在人工智能領域邁出了重要一步。

據悉,通義千問此次發布的開源模型包括Qwen2.5-7B-Instruct-1M和Qwen2.5-14B-Instruct-1M兩個版本。尤為引人注目的是,這兩個版本首次將Qwen模型的上下文長度擴展到了1M(即100萬標記),這在業界尚屬首次。

為了幫助開發者更好地部署和應用這些模型,Qwen團隊還開源了基于vLLM的推理框架。該框架集成了稀疏注意力方法,使得在處理長達1M標記的輸入時,推理速度有了顯著提升,達到了3倍至7倍的增長。

在長上下文任務方面,Qwen2.5-1M系列模型展現出了強大的能力。在一項名為“大海撈針”的任務中,這些模型能夠準確地從1M長度的文檔中檢索出隱藏信息。盡管7B版本的模型在極少數情況下出現了錯誤,但整體上,其表現仍然令人矚目。

為了全面評估Qwen2.5-1M系列模型在長上下文任務中的表現,研究團隊還選擇了RULER、LV-eval和LongbenchChat等多個測試集進行測試。測試結果顯示,這些模型在大多數任務中都顯著優于之前的128K版本,特別是在處理超過64K長度的任務時,其優勢更加明顯。

Qwen2.5-14B-Instruct-1M模型不僅在性能上擊敗了Qwen2.5-Turbo,還在多個數據集上穩定超越了GPT-4o-mini。這一結果無疑為長上下文任務提供了更多開源模型的選擇。

除了長上下文任務外,Qwen2.5-1M系列模型在短序列任務上的表現同樣出色。測試結果顯示,Qwen2.5-7B-Instruct-1M和Qwen2.5-14B-Instruct-1M在短文本任務上的表現與其128K版本相當,這意味著增加長序列處理能力并沒有犧牲其基本能力。

與GPT-4o-mini相比,Qwen2.5-14B-Instruct-1M和Qwen2.5-Turbo在短文本任務上實現了相近的性能,但它們的上下文長度卻是GPT-4o-mini的八倍。這一結果進一步證明了Qwen2.5-1M系列模型在短序列任務上的強大實力。

 
 
更多>同類內容
推薦圖文
推薦內容
點擊排行
 
智快科技微信賬號
ITBear微信賬號

微信掃一掃
加微信拉群
電動汽車群
科技數碼群

主站蜘蛛池模板: 男人天堂网址 | 久久成人免费视频 | 伊人国产视频 | 伊人情人| 婷婷综合影院 | 四虎影视最新网站在线播放 | 成年香蕉大黄美女美女 | 欧美亚洲一区二区三区 | 久草免费色站 | 久久精品国产这里是免费 | 全免费a级毛片免费看不卡 欧日韩一区二区三区 | 香蕉视频久久久 | 国产麻豆剧传媒精品网站 | 一区二区视频免费看 | 亚洲精品在线视频 | 欧美精彩狠狠色丁香婷婷 | 亚洲国产成人精品女人久久久 | 羞羞视频在线观看网站 | 一区二区三区欧美日韩 | 迪米电影网 | 色婷婷激情 | 日韩在线观看第一页 | 国产精品一二三 | 四虎成人免费影院网址 | 亚洲成人中文字幕 | 亚洲国产精品午夜电影 | 亚洲国产欧美精品一区二区三区 | 羞羞视频在线观看 | 伊人久久综合 | 亚洲第一免费网站 | 激情五月网站 | 亚洲国产一区在线观看 | 成人自拍视频网 | 男人的天堂导航 | 五月天婷婷丁香花 | 欧美 国产 日本 | 自拍偷拍欧美图片 | 国内自拍网| 亚洲精品在线免费观看视频 | 伊人婷婷在线 | 亚洲男人的天堂久久精品 |