OpenAI o1預(yù)覽模型發(fā)布:推理能力更強(qiáng) 可達(dá)理科博士生水準(zhǔn)
快科技9月13日消息,今日凌晨,OpenAI正式推出了OpenAI o1預(yù)覽模型。
對(duì)于復(fù)雜推理任務(wù)而言,新模型代表著人工智能能力的嶄新水平,其特點(diǎn)就是會(huì)在回答之前花更多時(shí)間進(jìn)行思考,就像人類思考解決問(wèn)題的過(guò)程一樣。
OpenAI曾解釋過(guò),2023年發(fā)布的GPT-4類似于高中生的智能水平,而GPT-5則是完成AI從“高中生躍升至博士”的成長(zhǎng),o1模型就是其中關(guān)鍵的一步。
根據(jù)測(cè)試,o1模型在國(guó)際數(shù)學(xué)奧林匹克的資格考試中,能夠拿到83%的分?jǐn)?shù),而GPT-4o只能正確解決13%的問(wèn)題。
而在編程能力比賽Codeforces中,o1模型拿到89%百分位的成績(jī),而GPT-4o只有11%。
OpenAI表示,根據(jù)測(cè)試,在下一個(gè)更新的版本中,AI在物理、化學(xué)和生物學(xué)的挑戰(zhàn)性基準(zhǔn)測(cè)試中,表現(xiàn)能夠與博士生水平類似。
相較于GPT-4o等現(xiàn)有的大模型,OpenAI o1能夠解決更加困難的推理問(wèn)題,同時(shí)改善過(guò)往模型中存在的機(jī)制性缺陷。
比如在解答編程問(wèn)題時(shí)也會(huì)更有條理,在著手寫代碼前,把整個(gè)回答的流程全部思考完一遍,再動(dòng)手輸出代碼。
o1會(huì)花更多時(shí)間思考
在o1模型中,AI會(huì)不斷試錯(cuò)并打磨答案,從而顯著提高生成結(jié)果的準(zhǔn)確率和質(zhì)量。
OpenAI 宣布,ChatGPT訂閱用戶從9月12日起可以訪問(wèn)這兩個(gè)新模型,o1-preview每周消息數(shù)量限制為30條,o1-mini則為50條。
作者:建嘉來(lái)源:快科技
原文標(biāo)題 : OpenAI o1預(yù)覽模型發(fā)布:推理能力更強(qiáng) 可達(dá)理科博士生水準(zhǔn)

發(fā)表評(píng)論
請(qǐng)輸入評(píng)論內(nèi)容...
請(qǐng)輸入評(píng)論/評(píng)論長(zhǎng)度6~500個(gè)字
圖片新聞
-
機(jī)器人奧運(yùn)會(huì)戰(zhàn)報(bào):宇樹機(jī)器人摘下首金,天工Ultra搶走首位“百米飛人”
-
存儲(chǔ)圈掐架!江波龍起訴佰維,索賠121萬(wàn)
-
長(zhǎng)安汽車母公司突然更名:從“中國(guó)長(zhǎng)安”到“辰致科技”
-
豆包前負(fù)責(zé)人喬木出軌BP后續(xù):均被辭退
-
字節(jié)AI Lab負(fù)責(zé)人李航卸任后返聘,Seed進(jìn)入調(diào)整期
-
員工持股爆雷?廣汽埃安緊急回應(yīng)
-
中國(guó)“智造”背后的「關(guān)鍵力量」
-
小米汽車研發(fā)中心重磅落地,寶馬家門口“搶人”
最新活動(dòng)更多
-
10月23日火熱報(bào)名中>> 2025是德科技創(chuàng)新技術(shù)峰會(huì)
-
10月23日立即報(bào)名>> Works With 開發(fā)者大會(huì)深圳站
-
10月24日立即參評(píng)>> 【評(píng)選】維科杯·OFweek 2025(第十屆)物聯(lián)網(wǎng)行業(yè)年度評(píng)選
-
11月27日立即報(bào)名>> 【工程師系列】汽車電子技術(shù)在線大會(huì)
-
12月18日立即報(bào)名>> 【線下會(huì)議】OFweek 2025(第十屆)物聯(lián)網(wǎng)產(chǎn)業(yè)大會(huì)
-
精彩回顧立即查看>> 【限時(shí)福利】TE 2025國(guó)際物聯(lián)網(wǎng)展·深圳站
推薦專題