GPT-4 是 OpenAI 沿着 GPT、GPT-2 和 GPT-3 研究路径开发的深度学习语言模型,于 2023 年 3 月 14 日发布。它通过使用更多数据和更多计算,打造日益精密的语言模型,并将更安全、更符合使用规范作为重点。GPT-4 可生成回复,具备高级推理和指令跟踪能力,既可在 ChatGPT Plus 中使用,也可作为 API 供开发人员构建应用程序和服务。官网还展示了 Duolingo、Be My Eyes、Stripe 和摩根士丹利财富管理公司使用 GPT-4 的案例,覆盖对话交互、视觉无障碍、用户体验、欺诈防范和知识库组织等场景。
核心功能
生成回复
GPT-4 的核心用途是生成回复。官网将其描述为能够生成“更安全、更有用的回复”的系统,并将其定位为扩展深度学习研究的重要里程碑。正文没有进一步限定回复的具体格式或支持的文件类型,因此不能据此推断它具备文档转换、图片生成等功能。
高级推理
GPT-4 具备高级推理能力。OpenAI 将这项能力用于安全研究,并借助 GPT-4 创建模型微调所需的训练数据。官网没有公布具体的推理任务清单,因此这里只能确认其被用于安全相关的研究、训练和评估工作。
指令跟踪
GPT-4 具备指令跟踪能力,并被用于帮助 OpenAI 推进安全工作。该能力与人工反馈培训、训练过程和分类器迭代结合使用,用于改进模型行为。正文未说明其支持哪些具体指令格式,也没有给出独立的操作步骤。
安全性与对齐改进
OpenAI 花费 6 个月时间提升 GPT-4 的安全性和规范符合度,并纳入更多人工反馈,其中包括 ChatGPT 用户提交的反馈。OpenAI 还与 50 多位人工智能安全和保障领域专家合作,征求早期反馈,并在训练、评估和监控过程中迭代分类器。
面向实际应用的服务能力
GPT-4 已被用于多个实际应用案例。Duolingo 使用它带来更深度的对话交互体验,Be My Eyes 使用它改变视觉无障碍环境,Stripe 用它简化用户体验并打击欺诈行为,摩根士丹利财富管理公司则使用它组织庞大的知识库。这些案例体现了 GPT-4 可被整合到对话、无障碍、服务和知识管理等应用中。
使用方式
GPT-4 可在 ChatGPT Plus 上使用,也可作为 API 供开发人员构建应用程序和服务。开发者可以通过 API 将模型用于自己的应用和服务;官网正文没有说明具体调用方式、是否需要单独注册、是否需要自备模型 Key,也没有提供命令行、浏览器插件或客户端信息。正文同样未说明导入导出能力。
适用人群与场景
开发者可以通过 API 将 GPT-4 集成到应用程序和服务中。教育与语言学习产品可参考 Duolingo 的案例,将模型用于更深度的对话交互。无障碍服务可参考 Be My Eyes 的使用方式,探索视觉无障碍场景。企业团队则可参考 Stripe 和摩根士丹利财富管理公司的案例,将其用于用户体验、欺诈防范或庞大知识库的组织。
注意事项
GPT-4 仍存在已知局限,包括社会偏见、虚构内容和对抗性提示。OpenAI 表示正在努力解决这些问题,并强调透明度、用户教育和更广泛的人工智能素养;随着社会采用这些模型,OpenAI 也会继续推动人们参与模型塑造过程。