中文比英文贵两倍,AI大模型处理不同语言体系,运算成本差距极大

2025-04-07 来源|AI图库吧

AI奇点网2023年7月31日报道丨用户所使用的语言对于大型语言模型(LLM)的费用有很大的影响,可能造成英语使用者和其它语言使用者之间的人工智能鸿沟。最近的一项研究显示,由于 OpenAI 等服务所采用的服务器成本衡量和计费的方式,英语输入和输出的费用要比其他语言低得多,其中简体中文的费用大约是英语的两倍,西班牙语是英语的 1.5 倍,而缅甸的掸语则是英语的 15 倍。

推特用户 Dylan Patel(@dlan522p)分享了一张照片,展示了牛津大学进行的一项研究,该研究发现,让一个 LLM 处理一句缅甸语句子需要 198 个词元(tokens),而同样的句子用英语写只需要 17 个词元。词元代表了通过 API(如 OpenAI 的 ChatGPT 或 Anthropic 的 Claude 2)访问 LLM 所需的计算力成本,这意味着缅甸语句子使用这种服务的成本比英语句子高出 11 倍。

词元化模型(即人工智能公司将用户输入转换为计算成本的方式)意味着,除了英语之外的其他语言使用和训练模型要贵得多。这是因为像中文这样的语言有着不同、更复杂的结构(无论是从语法还是字符数量上),导致它们需要更高的词元化率。例如,根据 OpenAI 的 GPT3 分词器 ,“你的爱意(your affection)”的词元,在英语中只需要两个词元,但在简体中文中需要八个词元。尽管简体中文文本只有 4 个字符(你的爱意),而英文有 14 个字符。

最新
更多

中文比英文贵两倍,AI大模型处理不同语言体系,运算成本差距极大

由于 OpenAI 等服务所采用的服务器成本衡量和计费的方式,英语输入和输出的费用要比其他语言低得多,其中简体中文的费用大约是英语的两倍,西班牙语是英语的 1 5 倍,而缅甸的掸语则是英语的 15 倍。

iPhone推出一键查询苹果浏览器过往历史:妥妥“人生搜索引擎”,黑镜预言成真

iPhone推出一键查询苹果浏览器过往历史的APP,APP名叫 Rewind,背靠 GPT-4,可以一键记录、搜索、回答用 Safari 浏览过的所有内容,网友表示简直黑镜预言成真 。

7月份月活5.4亿!推特更名“X”后创下月活访问新高,平台数据将用于AI训练

马斯克今天发布推文,宣布 X(此前为推特)月活跃用户数量在下滑之后已经回暖,从 531202332 人增加到 541562214 人,月活用户创新高。

AI编码神器GitHub Copilot重磅升级!官方预测80%代码将由AI生成

作为 Copilot 代码补全工具的升级,GitHub 刚刚宣布了 Copilot X 计划,正式接入 GPT-4,5 年内 80% 的代码将自动生成。

AI种地你敢想?农业AI对话机器人面世,帮助农民解决农业生产问题

最近,一亩田集团发布了一款基于大模型技术的农业AI对话机器人“小田”,以问答形式为用户提供针对农业领域的知识与信息。是目前国内发布的首款农业AI对话机器人。

谷歌发布首个视觉语言算法模型RT-2,家用机器人可自主学习做家务倒垃圾

7月28日,谷歌推出了一种新的人工智7月28日,谷歌推出了一种新的人工智能(AI)模型 Robotics Transformer2(RT-2),可以帮助训练机器人理解扔垃圾等任务。

网站地图