Appearance
OpenAI GPT-4.1
OpenAI GPT-4.1 于 2025 年 4 月 14 日通过 API 首发,是 GPT-4o 的升级版本。它以超长上下文窗口和显著改进的编码能力为主要卖点,定位为生产环境的高性能模型。
发展历程
| 时间 | 事件 |
|---|---|
| 2025.04.14 | 通过 API 正式发布 |
| 2025.04 | 后续集成至 ChatGPT |
核心能力
- 超长上下文: 支持高达 100 万 token 的上下文窗口
- 编码能力: 在 SWE-bench 等代码任务上显著提升
- 指令遵循: 对复杂系统提示词的理解和执行更精确
- 多步骤任务: 更好的工具使用和多阶段任务执行能力
技术亮点
长上下文优化
GPT-4.1 将上下文窗口从 GPT-4o 的 128K 扩展到 1M token,使得模型能够处理整个代码库、大型文档或多轮对话历史。这一能力与 长上下文技术 的发展密切相关。
编码专项优化
在软件工程任务上,GPT-4.1 通过针对性的后训练和数据增强,在 SWE-bench Verified 等真实代码任务基准上取得了显著进步。
Benchmarks 表现
| 基准测试 | 表现 | 说明 |
|---|---|---|
| SWE-bench Verified | 显著提升 | 真实 GitHub Issue 解决 |
| 长上下文检索 | 高准确率 | 1M token 中的细节检索 |
| 多语言 | 优化 | 非英语任务表现改进 |
定价与可用性
- API: 标准 API 层级即可使用
- 定价: 比 GPT-4o 更经济,具体费率参见官方 API 文档
- ChatGPT: 后续集成到 ChatGPT 各级别
与其他模型的关系
- vs GPT-4o: GPT-4.1 是 GPT-4o 的升级版,主要在长上下文和编码方面改进
- vs o3: GPT-4.1 定位为通用模型,o3 定位为推理专家
相关页面
- 长上下文技术 — 长上下文技术
- Code Generation / SWE-bench — 代码生成能力评估
- OpenAI — OpenAI 公司概览