3D视窗网
加入收藏 | 设为首页 | RSSrss
3D视窗网
 
您当前的位置:首页 > 消费

AI大模型的语言不平等:英语最便宜,其它语言要贵得多

2023-07-31 08:24:28  IT之家   阅读:5503次   阅读量:9665   

,用户所使用的语言对于大型语言模型的费用有很大的影响,可能造成英语使用者和其它语言使用者之间的人工智能鸿沟。最近的一项研究显示,由于 OpenAI 等服务所采用的的服务器成本衡量和计费的方式,英语输入和输出的费用要比其他语言低得多,其中简体中文的费用大约是英语的两倍,西班牙语是英语的 1.5 倍,而缅甸的掸语则是英语的 15 倍。

IT之家注意到,推特用户 Dylan Patel分享了一张照片,展示了牛津大学进行的一项研究,该研究发现,让一个 LLM 处理一句缅甸语句子需要 198 个词元(tokens),而同样的句子用英语写只需要 17 个词元。词元代表了通过 API(如 OpenAI 的 ChatGPT 或 Anthropic 的 Claude 2)访问 LLM 所需的计算力成本,这意味着缅甸语句子使用这种服务的成本比英语句子高出 11 倍。

词元化模型意味着,除了英语之外的其他语言使用和训练模型要贵得多。这是因为像中文这样的语言有着不同、更复杂的结构(无论是从语法还是字符数量上),导致它们需要更高的词元化率。例如,根据 OpenAI 的 GPT3 分词器 ,“你的爱意(your affection)”的词元,在英语中只需要两个词元,但在简体中文中需要八个词元。尽管简体中文文本只有 4 个字符(你的爱意),而英文有 14 个字符。

广告声明:文内含有的对外跳转链接,用于传递更多信息,节省甄选时间,结果仅供参考,IT之家所有文章均包含本声明。

声明:以上内容为本网站转自其它媒体,相关信息仅为传递更多企业信息之目的,不代表本网观点,亦不代表本网站赞同其观点或证实其内容的真实性。投资有风险,需谨慎。
   
推荐资讯
偿二代二期周年下的险企众生相:猛增资、调业务、优投资
偿二代二期周年下的
汇聚千万热爱,一汽丰田千万用户达成
汇聚千万热爱,一汽
税务部门持续开展“便民办税春风行动”去年121条措施全部落地
税务部门持续开展“
《收获日3》Steam页面上线,2023年发售
《收获日3》Ste
最新资讯
热门阅读
  1. 北京君正上半年净利润预降52.97%-60
  2. 集思广益凝心聚力继续推进“保交楼”进程
  3. 统信UOS智能终端版升级“有融视窗”,实现
  4. IDC发布二季度中国智能手机市场报告:OP
  5. 启动盘制作工具Rufus4.2稳定版发布,
  6. 天润乳业发行9.9亿元可转债遭问询:融资规
  7. 新材料产业高质量发展之路怎么走?这场讲堂给
  8. 国家发展改革委负责同志持续召开民营企业座谈
  9. 2023年立秋可以举行婚礼吗
  10. 陆金所控股上榜2023年《财富》中国500
Copyright © 2014- 3d.s-sound.net All Rights Reserved. [ 3D视窗网 ]版权所有
网站地图  备案号:豫ICP备2022007296号  邮箱:boss_11@teag.net