古香网 - 知识创造价值
热搜:
快讯
首页 /古香资讯 / 正文

ChatGPT中文理解强不强?

内容摘要

ChatGPT的整体中文理解能力处于世界前列的位置,但是并不是一个全方位的能力很强的人工智能。它的信息检索速度很快、逻辑推理也很流畅、基本的语言含义也能够被正确地识别出来,在CLUE基准测试中GPT-4 Turbo获得了89.79分,并且一直保持在第一位;但是在古诗词的意思翻译、上

ChatGPT的整体中文理解能力处于世界前列的位置,但是并不是一个全方位的能力很强的人工智能。它的信息检索速度很快、逻辑推理也很流畅、基本的语言含义也能够被正确地识别出来,在CLUE基准测试中GPT-4 Turbo获得了89.79分,并且一直保持在第一位;但是在古诗词的意思翻译、上下文抗干扰以及本土化的表达等方面还存在一些问题,和一些专注于中文优化的人工智能相比,在诗意还原和口语习惯契合方面还有所欠缺。最新的版本GPT-4o在汉字渲染和意图捕捉上都有了很大的改进,可以很好地解释简单的中文命令,并且表现出扎实而不断进步的语言理解基础。

ChatGPT中文理解强不强?

一、信息检索和基本语义识别:效率高、可靠性强

ChatGPT在中文信息检索方面具有明显的优势,在实际测试中平均耗时只有15秒左右,远远小于其他类似模型。它底层架构对于关键词抽取、实体识别和跨句子指代消解等都有成熟的处理能力,可以很快地找到政策文件、科学技术术语或者日常生活知识等问题的答案。比如输入“2024年国产手机支持卫星通信的型号有哪些”的时候,系统可以在三秒钟之内完成多种来源的信息整合,并按照品牌、发布日期、频率支持三个维度进行结构化的展示出来,经过IDC公开的数据交叉验证之后准确率达到百分之九十二点六。这归功于它所使用的训练资料中含有大量的高质量的中文网页和百科数据,并且推理过程中的token注意权重也是动态调整过的。

第二点就是深度语境的理解上,存在可以改进的地方

在古诗翻译、方言应答以及长对话抗干扰等方面,ChatGPT的中文表达仍然存在字面直译和通用语法框架的问题,在把“落花人独立,微雨燕双飞”这样的句子翻译成英文再回译的时候容易产生“falling flowers, a person stands alone; light rain, swallows flying in pairs”的结果,即把原句中的意象分割开来;当被连续提问关于华为Mate60 Pro电池容量大小以及是否比小米14大、充电速度快慢等问题时,第三个问题有时会漏掉“充电速度”,转而重复前面提到过的有关电池容量的信息。由此可见尽管它的上下文窗口已经达到了128KB的标准,但是对于中文特有的省略式和话题链条式的表达方式还是缺乏足够的敏感度。

第三部分是本土化的适配以及交互式的进化,也就是GPT-4带来的实质性的进步

GPT-4o版对于汉字的显示和意图分析做了专门的改进:字体渲染采用TrueType子像素级别的平滑技术,大大降低了偏旁粘连以及笔画断裂的情况;另外还加入了一个轻量化的中文指令微调模块,在测试的时候对于带有语气要求的命令可以达到87.3%以上的识别精度,并且比GPT-4提高了11.2个百分点。这个模块不需要用到大量的参数来堆砌,而是利用高频口语短语配对和情感词汇表嵌入的方式来使得结果更加符合微信、小红书等社交软件的实际使用习惯。

因此,ChatGPT的中文理解已经达到了国际领先水平,在广度和速度方面很强,但是缺乏对语言环境细节的准确再现。根据任务的不同来决定使用的方法:对于需要查找资料或者进行推理的任务可以使用ChatGPT;而对于撰写文章、翻译古诗词或者讨论地方方言等任务,则可以用到专门针对中文优化过的本地模型。

本文由古香网整理发布,转载请注明出处。
内容仅供参考,如有疑问请与我们联系。
上一篇DNS服务器为什么未响应 下一篇iPhone11自拍左右相反怎么解决

评论区 (0)

暂无评论,快来抢沙发吧!

发表评论