AI大模型的语言不平等:英语最便宜,其它语言要贵得多#抽屉IT

None

相关推荐

封面图片

AI 大模型的语言不平等:英语最便宜,其它语言要贵得多

AI大模型的语言不平等:英语最便宜,其它语言要贵得多用户所使用的语言对于大型语言模型(LLM)的费用有很大的影响,可能造成英语使用者和其它语言使用者之间的人工智能鸿沟。最近的一项研究显示,由于OpenAI等服务所采用的服务器成本衡量和计费的方式,英语输入和输出的费用要比其他语言低得多,其中简体中文的费用大约是英语的两倍,西班牙语是英语的1.5倍,而缅甸的掸语则是英语的15倍。推特用户DylanPatel分享了一张照片,展示了牛津大学进行的一项研究,该研究发现,让一个LLM处理一句缅甸语句子需要198个词元(tokens),而同样的句子用英语写只需要17个词元。词元代表了通过API(如OpenAI的ChatGPT或Anthropic的Claude2)访问LLM所需的计算力成本,这意味着缅甸语句子使用这种服务的成本比英语句子高出11倍。词元化模型(即人工智能公司将用户输入转换为计算成本的方式)意味着,除了英语之外的其他语言使用和训练模型要贵得多。这是因为像中文这样的语言有着不同、更复杂的结构(无论是从语法还是字符数量上),导致它们需要更高的词元化率。例如,根据OpenAI的GPT3分词器,“你的爱意(youraffection)”的词元,在英语中只需要两个词元,但在简体中文中需要八个词元。尽管简体中文文本只有4个字符(你的爱意),而英文有14个字符。——、

封面图片

AI大模型的语言不平等:英语最便宜,其它语言要贵得多https://www.ithome.com/0/709/207.htm========Tokenizer硬伤问题

封面图片

牛津大学研究显示,不同语言使用AI大模型的成本不同,英语最便宜,其它语言要贵得多#抽屉IT

封面图片

不平等待遇

封面图片

人生从来不平等

封面图片

不平等待遇

🔍 发送关键词来寻找群组、频道或视频。

启动SOSO机器人