ChatGPT和GPT-4不是同一级别的东西,一个是产品一个是模型的区别,ChatGPT是面向普通用户的对话式的AI应用,它的免费版用的是GPT-3.5这个模型,而GPT-4就是OpenAI公司推出的第四代的大规模语言模型,在逻辑推理、多步骤的任务分解以及对较长的文章进行理解方面的能力更强一些,并且还具有一定的跨模态的能力(比如可以识别图片),而且在权威的标准测试里表现得更好一些,在SAT阅读、AP生物这些考试中的成绩已经接近人类顶尖水平,在编写代码、做法律文件分析或者写一篇学术论文的时候出错的概率也小很多。对于一般的聊天、查询天气或者是写一条朋友圈的文字来说,GPT-3.5就足够了;但是如果是要写一个技术方案、调试复杂的Python脚本或者是整理一份上百页的PDF文档的话,则需要使用到GPT-4这样的高级别的模型才能保证输出的质量稳定并且没有大的错误。

第一部分是主要定位和技术代差
ChatGPT是由OpenAI开发的一个交互式的软件界面,它是前端应用的一种形式,它的表现好坏取决于底层模型的选择。现在免费用户的默认选择是GPT-3.5,但是开通了ChatGPT Plus之后就可以一直使用到GPT-4(包括Turbo版)。GPT-4并不是一个单独的应用程序,而是在经过更加严格的对齐训练、拥有更大的参数量(虽然没有公开具体的数字,但是业内普遍认为它的参数数量级远远大于GPT-3.5)以及更精确的任务微调之后得到的语言模型基础。在MMLU大规模多任务语言理解测试中得到了86.4分,在HumanEval编程评价中通过率提高了将近四成,这就表明它不只懂得语法知识,还能理解工程项目的工作环境和限制条件。
第二部分就是实际应用中能力的界限
在日常生活中的高频场景里,GPT-3.5的回答速度更快、语气也更加轻松愉快,更适合做即兴问答以及带有感情色彩的内容创作;而在三种类型的任务当中,GPT-4的优势是无法被取代的:第一种就是大篇幅的文字处理工作,在此情况下它可以接受上传PDF或者Word格式的文件,并且可以准确地找到其中某一段落的内容,比如对于一份上百页的财务报告进行关键字抽取和三年内数据变化趋势比较;第二种则是需要很强逻辑推理能力的任务,比如把自然语言描述转换成完整的SQL语句并且检查语法错误,或者是给嵌入式的系统编写包含中断处理功能的C语言程序模板;第三种就是跨学科的知识融合问题,在这种情形之下它能够根据医学指南、临床实验数据和个人病史资料来生成一个结构化的会诊建议摘要。这些功能的背后有强大的思维链引导机制和事实验证模块的支持。
第三部分是关于获得途径和使用成本之间的权衡
用户不需要单独安装GPT-4,只需要开通ChatGPT Plus会员(每月收费大约为20美元),然后在网页或者APP中选择模型切换选项就可以使用了。需要注意的是:虽然GPT-4 Turbo可以提供128KB以上的上下文并且对回答进行了改进,但是在图片识别等方面仍然需要特殊的入口(比如用手机拍摄并上传照片)。另外,免费版的ChatGPT没有给用户提供GPT-4的访问权限。此外,在高并发的时候可能会出现响应延迟的情况,在工作日早上上班高峰期时最好避免进行复杂的任务处理。对于简单的写作润色或者是学习问题的回答来说,GPT-3.5仍然具有很高的性价比。
所以并不是只有这一种情况,而是根据任务粒度和结果容错率来进行合理的匹配。






评论区 (0)
暂无评论,快来抢沙发吧!
发表评论