93.7%|MMLU-Pro 准确率
OpenAI 发布 GPT-5 多模态大模型,首次整合实时视觉推理能力
GPT-5 正式亮相
2026年6月19日,OpenAI 在旧金山总部举办特别发布活动,正式发布了备受期待的 GPT-5 大模型。这是全球首个实现文本、图像、音频和实时视频四模态端到端训练的基础模型,CEO Sam Altman 将其称为"向通用人工智能迈出的最坚实一步"。GPT-5 在 MMLU-Pro 基准上取得 93.7% 的准确率,较 GPT-4 提升约 11 个百分点。
核心能力突破
GPT-5 最引人注目的创新在于实时视觉推理能力。用户可以通过手机摄像头或屏幕共享,让模型实时理解视觉场景并做出推理——例如对着一张电路板照片,模型可以直接指出短路位置并给出维修建议。该模型还引入了"任务链"功能,可自主规划并执行跨应用的多步骤复杂任务,如从邮件中提取数据、填入表格、生成分析报告并发送给指定人员。
定价与开放策略
GPT-5 将首先面向 ChatGPT Pro 和 Enterprise 用户推出,个人版月费为 40 美元,API 价格约为 GPT-4o 的 1.5 倍。OpenAI 同时宣布向学术界免费开放 GPT-5 的轻量版本 GPT-5 Mini 用于研究用途。首批开放区域包括北美和欧洲,亚太地区预计在 7 月中旬上线。
← 返回资讯列表
AI8899 · 内容仅供学习参考