(相关资料图)
IT之家 7 月 31 日消息,用户所使用的语言对于大型语言模型(LLM)的费用有很大的影响,可能造成英语使用者和其它语言使用者之间的人工智能鸿沟。最近的一项研究显示,由于 OpenAI 等服务所采用的的服务器成本衡量和计费的方式,英语输入和输出的费用要比其他语言低得多,其中简体中文的费用大约是英语的两倍,西班牙语是英语的 1.5 倍,而缅甸的掸语则是英语的 15 倍。
IT之家注意到,推特用户 Dylan Patel(@dlan522p)分享了一张照片,展示了牛津大学进行的一项研究,该研究发现,让一个 LLM 处理一句缅甸语句子需要 198 个词元(tokens),而同样的句子用英语写只需要 17 个词元。词元代表了通过 API(如 OpenAI 的 ChatGPT 或 Anthropic 的 Claude 2)访问 LLM 所需的计算力成本,这意味着缅甸语句子使用这种服务的成本比英语句子高出 11 倍。
词元化模型(即人工智能公司将用户输入转换为计算成本的方式)意味着,除了英语之外的其他语言使用和训练模型要贵得多。这是因为像中文这样的语言有着不同、更复杂的结构(无论是从语法还是字符数量上),导致它们需要更高的词元化率。例如,根据 OpenAI 的 GPT3 分词器 ,“你的爱意(your affection)”的词元,在英语中只需要两个词元,但在简体中文中需要八个词元。尽管简体中文文本只有 4 个字符(你的爱意),而英文有 14 个字符。
标签:
IT之家7月31日消息,用户所使用的语言对于大型语言模型(LLM)的费用有
盛阅春强调保持定力坚定信心全力打好下半年工业经济攻坚战---湖北日报
,你们好,今天0471房产来聊聊一篇庙村,庙村简述的文章,网友们对这件
个股亮点:中国黄金集团旗下,专业化灭菌服务企业;公司主要从事辐照技
各位网友们好,我是编辑小夏,为大家解答莲子的功效与作用及食用方法,
近日召开的中央全面深化改革委员会第二次会议审议通过《关于进一步
民营经济作为我国国民经济的重要组成部分,是经济增长的主力军、创
在css中,可以使用“font-style”属性实现文本的斜体样式,语法为“fon
东方甄选最近在其自营app上开启直播带货,想将公域流量转化成私域流量
北京时间7月30日消息,2023WTT支线赛哈维若夫站资格赛继续进行。男子单
1、直接食用:开瓶后用勺取出直接食用,细腻润滑、醇香甜蜜。(就是前面
1、宓,拼音:mìfú。2、mì。3、①安静。4、②姓。5、2、fú。6、古
7月30日13时38分,贵阳市气象台发布雷电黄色预警信号,称未来6小时南明
铁人三项怎么玩? "铁人三项需要完成三场随机小游戏,最后根据排名领取
“龙贸通”中俄国际物贸综合服务平台7月30日正式上线试运行,目前已吸
7月29日,四川成都,大运村内,瑞典运动员拿起一只用核桃壳做成的小乌
“八一,如此洪亮的名字;八一,多么娇艳的红旗……”同学们稚嫩但坚定
文 长江证券首席经济学家伍戈先行经济的,是预期。在前期政策保持定力
征地啦!近日,市人民政府发布《瑞安市2023年度计划第七批次建设用地征
“感谢你们特地从德化来帮助我们。”“石狮德化一家亲,都是厝边,以后