OpenAI推出全新推理模型o1,强悍但API费用显著上涨

近日,OpenAI发布了备受期待的推理模型o1,标志着AI技术又一重要进展。新模型于9月13日凌晨正式上线,其中包括一个较小且经济实惠的版本——o1 mini。此次发布被称为“预览版”,说明o1依然处于初期测试阶段。OpenAI的API负责人表示:“如果您之前曾有过产品构想但受限于当时的模型智能水平,现在可以重新尝试。”

关于权限的管理,OpenAI采取了分阶段的发布策略。ChatGPT Plus和Team用户可立即访问o1-preview及o1-mini,而Enterprise和教育类用户则会在下周获得访问权。同时,API等级为5的开发者在满足特定消费条件后,也能使用这两种模型,不过使用时速率限制为每分钟20次。OpenAI还计划未来向所有ChatGPT的免费用户开放o1-mini的使用权限。

然而,对于开发者而言,借助API使用o1的费用较高,o1-preview定价为每百万输入token 15美元、每百万输出token 60美元,远远高于GPT-4o的价格(输入5美元/百万token,输出15美元/百万token)。

about image

OpenAI的员工在社交平台上的发帖中,纷纷对o1的能力表示赞赏,并提到了一些重要的功能升级。API负责人Michelle Pokrass强调,o1-preview和o1-mini是目前在推理表现上最佳的模型,未来会为API带来全新的应用场景。她鼓励那些曾因模型不足而搁置的创意再次尝试。

about image

OpenAI联合创始人Greg Brockman也对此表示自豪,指出o1是首个通过强化学习训练的模型,具备深入思考的能力。在定量和定性两个方面都有显著提升,思维链功能使得模型的推理过程更易被人理解。他解释了模型在进行系统I和系统II思考的过程中,如何通过强化学习来增强表现。

尽管o1技术还处于早期发展阶段,但在安全性方面已有积极探索,如提高可靠性、抵御幻觉和对抗攻击者的能力。研究团队发现,思维链的引入显著提升了模型的安全指标。此外,尽管其准确性仍有改进空间,但在某些编程比赛中,o1的表现已有突破,显示出其潜力。

about image

研究员Jason Wei强调了o1的重要更新,指出不能仅仅依赖提示来实现思维链,而要通过强化学习优化思维过程。他提到在深度学习历史上扩展训练的尝试,思维链的自适应计算在推理时同样可扩展。尽管找到能让o1优于GPT-4o的提示并不容易,但一旦找到,o1的表现便会让人惊喜。

总的来看,这一新模型在许多方面都展现出了人类一样的逻辑处理能力,诸如拆分复杂步骤、识别和纠正错误以及探索不同解决思路等功能,均让人感到耳目一新。

组织健身赛事和挑战活动,包括力量训练、健美比赛等,增加健身爱好者的竞技体验。...

组织健身赛事和挑战活动,包括力量训练、健美比赛等,增加健身爱好者的竞技体验。...