OpenAI o1預(yù)覽模型發(fā)布:推理能力更強(qiáng)
9月13日消息,今日凌晨,OpenAI正式推出了OpenAI o1預(yù)覽模型。
對(duì)于復(fù)雜推理任務(wù)而言,新模型代表著人工智能能力的嶄新水平,其特點(diǎn)就是會(huì)在回答之前花更多時(shí)間進(jìn)行思考,就像人類思考解決問(wèn)題的過(guò)程一樣。
OpenAI曾解釋過(guò),2023年發(fā)布的GPT-4類似于高中生的智能水平,而GPT-5則是完成AI從“高中生躍升至博士”的成長(zhǎng),o1模型就是其中關(guān)鍵的一步。
根據(jù)測(cè)試,o1模型在國(guó)際數(shù)學(xué)奧林匹克的資格考試中,能夠拿到83%的分?jǐn)?shù),而GPT-4o只能正確解決13%的問(wèn)題。
而在編程能力比賽Codeforces中,o1模型拿到89%百分位的成績(jī),而GPT-4o只有11%。
OpenAI表示,根據(jù)測(cè)試,在下一個(gè)更新的版本中,AI在物理、化學(xué)和生物學(xué)的挑戰(zhàn)性基準(zhǔn)測(cè)試中,表現(xiàn)能夠與博士生水平類似。
相較于GPT-4o等現(xiàn)有的大模型,OpenAI o1能夠解決更加困難的推理問(wèn)題,同時(shí)改善過(guò)往模型中存在的機(jī)制性缺陷。
比如在解答編程問(wèn)題時(shí)也會(huì)更有條理,在著手寫代碼前,把整個(gè)回答的流程全部思考完一遍,再動(dòng)手輸出代碼。
o1會(huì)花更多時(shí)間思考
在o1模型中,AI會(huì)不斷試錯(cuò)并打磨答案,從而顯著提高生成結(jié)果的準(zhǔn)確率和質(zhì)量。
OpenAI 宣布,ChatGPT訂閱用戶從9月12日起可以訪問(wèn)這兩個(gè)新模型,o1-preview每周消息數(shù)量限制為30條,o1-mini則為50條。