奥特曼率队深夜血战DeepSeek,o3-mini急上线!价格骨折免费用

行业资讯· 2025-02-01 08:40:25

眼看DeepSeek风头尽显,被逼急的OpenAI果然紧急发布了o3-mni。不光免费用户都能用,每百万输入和输出token价格更是疯狂跳水打骨折价!

o3-mini,真的来了。

刚刚,OpenAI官宣o3-mini和o3-mini-high两大版本正式在ChatGPT上线。


诚如奥特曼所言,免费用户直接打开「Reason」即可体验,Plus用户每天会有更多用量,具体来说:

- ChatGPT免费版:首次体验推理模型

- ChatGPT Plus和团队版:每天150次对话限制

- ChatGPT Pro:无限制访问

- ChatGPT Enterprise和ChatGPT Edu:将在一周内可用

- API:向3-5级开发者开放(初期暂不支持图像分析功能)

- 输入1.10美元/百万token、输出4.40美元/百万token

感谢DeepSeek,o3-mini的价格这次算是彻底给打下来了——比OpenAI o1-mini便宜63%,比满血版o1便宜93%。(但仍是GPT-4o mini的7倍左右)


订阅用户已经在第一时间「告别」了o1-mini,还没来得及说再见

OpenAI表示,o3-mini的发布是在追求高效能智能技术道路上的又一重要里程碑。

通过优化科学(Science)、技术(Technology)、工程(Engineering)和数学(Mathematics)领域的推理能力,同时保持较低的成本,让高质量AI技术变得更加平易近人。

值得一提的是,在ChatGPT中,o3-mini采用的是「中等推理强度」,在速度和准确性之间取得平衡。所有付费用户还可以在模型选择器中选择o3-mini-high——响应时间略长但智能水平更高的版本。


目前,由于太过火爆,ChatGPT的项目和自定义GPTs功能都已经被挤崩了。


集成搜索,两种版本可选

去年12月,。相较于上一代o1模型,o3在ARC-AGI等多项基准测试中刷新SOTA。

与o1-mini一样,o3-mini是最具性价比的推理模型,可谓是突破性能边界的「小巨人」。

在STEM领域,尤其是科学、数学和编程等方面,o3-mini性能表现卓越超越o1,并继承了上一代低成本和低延迟的优点。


对于开发者来说,o3-mini简直就是一份「大礼包」,它首次在小型推理模型中支持:包括函数调用、结构化输出和开发者消息、流式传输功能。

开发者可以根据需求选择低、中、高三种推理强度,让o3-mini在处理复杂问题时进行「深度思考」,灵活平衡速度和准确性。

遗憾地是,o3-mini暂不支持视觉功能。

如前所述,从今天起,o3-mini将通过Chat Completions API,Assistants API和Batch API向3-5级指定开发者开放。

同时,o3-mini还整合了搜索功能,能够提供带有相关网络来源链接最新响应。

一起来看看这款「小而美」的o3-mini有什么过人之处。

快速、强大、专为STEM领域推理优化

与其前身OpenAI o1类似,OpenAI o3-mini专门针对STEM推理进行了优化。

采用了中等推理强度的o3-mini,在数学、编程和科学领域的表现与o1不相上下,且响应速度更快。


报告地址:https://cdn.openai.com/o3-mini-system-card.pdf

专家测试评估显示,o3-mini相比o1-mini能够生成更准确、更清晰的答案,推理能力更强。

在测试中,o3-mini的响应结果获得了56%的偏好度,在处理复杂现实问题时的重大错误率更是降低了39%。

在中等推理强度设置下,o3-mini在最具挑战性的推理和智能评估项目(包括AIME和GPQA)中,均达到了与o1相当的水平。

数学竞赛(AIME 2024)

在低推理强度下,o3-mini达到了与o1-mini相当的水平;在中等推理强度下,其表现可与o1媲美;而在高推理强度下,o3-mini的表现更是超越了o1-mini和o1。


博士级科学问题(GPQA Diamond)



文章链接: http://www.huangxinwei.com/aizixun/7215.html Chat AI人工智能机器人在线使用

[免责声明]如需转载请注明原创来源;本站部分文章和图片来源网络编辑,如存在版权问题请发送邮件至398879136@qq.com,我们会在3个工作日内处理。非原创标注的文章,观点仅代表作者本人,不代表炎黄立场。