阿里云官宣:通义千问GPT-4级主力模子价钱直降97%
5月21日,阿里云抛出重磅炸弹:通义千问GPT-4级主力模子Qwen-Long,API输入价钱从0.02元/千tokens降至0.0005元/千tokens,直降97%。
5月21日,阿里云抛出重磅炸弹:通义千问GPT-4级主力模子Qwen-Long,API输入价钱从0.02元/千tokens降至0.0005元/千tokens,直降97%。这意味着,1块钱不错买200万tokens,颠倒于5本《新华字典》的翰墨量。这款模子最高解救1千万tokens长文本输入,降价后约为GPT-4价钱的1/400,击穿全球底价。

Qwen-Long是通义千问的长文本增强版模子,性能对标GPT-4,坎坷文长度最高达1千万。除了输入价钱降至0.0005元/千tokens,Qwen-Long输出价钱也直降90%至0.002元/千tokens。比较之下,国表里厂商GPT-4、Gemini1.5 Pro、Claude 3 Sonnet及Ernie-4.0每千tokens输入价钱分辨为0.22元、0.025元、0.022元及0.12元,均远高于Qwen-long。

通义千问本次降价共掩饰9款买卖化及开源系列模子。不久前发布的通义千问旗舰款大模子Qwen-Max,API输入价钱降至0.04元/千tokens,降幅达67%。Qwen-Max是当今业界阐扬最佳的汉文大模子,在泰斗基准OpenCompass上性能追平GPT-4-Turbo,并在大模子竞技场Chatbot Arena中踏进全球前15。

不久前,OpenAI的Sam Altman转发了Chatbot Arena榜单来印证GPT-4o的智力,其中全球排行前20的模子中,仅有的三款中国模子王人是通义千问出品。

业界大王人以为,跟着大模子性能逐渐素质,AI诈欺立异正插足密集探索期,但推理本钱过高照旧是制约大模子领域化诈欺的重要身分。
在武汉AI智领者峰会现场,阿里云智能集团资深副总裁、众人云功绩部总裁刘伟光默示:“动作中国第一大云蓄意公司,阿里云此次大幅镌汰大模子推理价钱,就是但愿加速AI诈欺的爆发。咱们预测异日大模子API的调用量会有千千万万倍的增长。”
刘伟光以为,无论是开源模子照旧买卖化模子,众人云+API将成为企业使用大模子的主流情势,主要有三点原因:
一是众人云的时间红利和领域效应,带来雄伟的本钱和性能上风。阿里云不错从模子本人和AI基础表情两个层面赓续优化,追求极致的推理本钱和性能。阿里云基于自研的异构芯片互联、高性能鸠合HPN7.0、高性能存储CPFS、东谈主工智能平台PAI等中枢时间和家具,构建了极致弹性的AI算力退换系统,连系百真金不怕火漫步式推理加速引擎,大幅压缩了模子推理本钱,并加速模子推理速率。
即即是雷同的开源模子,在众人云上的调用价钱也远远低于特有化部署。以使用Qwen-72B开源模子、每月1亿tokens用量为例,在阿里云百真金不怕火上告成调用API每月仅需600元,特有化部署的本钱平均每月超1万元。
二是云上更方便进行多模子调用,并提供企业级的数据安全保险。阿里云不错为每个企业提供专属VPC环境,作念到蓄意断绝、存储断绝、鸠合断绝、数据加密,充分保险数据安全。当今,阿里云已主导或深度参与10多项大模子安全连系海异邦内时间圭臬的制定。
三是云厂商自然的盛开性,能为确立者提供最丰富的模子和器具链。阿里云百真金不怕火平台上蕴蓄通义、百川、ChatGLM、Llama系列等上百款国表里优质模子,内置大模子定制与诈欺确立器具链,确立者不错浅陋地测试比较不同模子,确立专属大模子,并平缓搭建RAG等诈欺。从选模子、调模子、搭诈欺到对外劳动,一站式赓续。
声明:新浪网独家稿件,未经授权辞谢转载。 -->
