123,123,123

[導(dǎo)讀]9月13日消息，今日凌晨，OpenAI正式推出了OpenAI o1預(yù)覽模型。

9月13日消息，今日凌晨，OpenAI正式推出了OpenAI o1預(yù)覽模型。

對(duì)于復(fù)雜推理任務(wù)而言，新模型代表著人工智能能力的嶄新水平，其特點(diǎn)就是會(huì)在回答之前花更多時(shí)間進(jìn)行思考，就像人類(lèi)思考解決問(wèn)題的過(guò)程一樣。

OpenAI曾解釋過(guò)，2023年發(fā)布的GPT-4類(lèi)似于高中生的智能水平，而GPT-5則是完成AI從“高中生躍升至博士”的成長(zhǎng)，o1模型就是其中關(guān)鍵的一步。

根據(jù)測(cè)試，o1模型在國(guó)際數(shù)學(xué)奧林匹克的資格考試中，能夠拿到83%的分?jǐn)?shù)，而GPT-4o只能正確解決13%的問(wèn)題。

而在編程能力比賽Codeforces中，o1模型拿到89%百分位的成績(jī)，而GPT-4o只有11%。

OpenAI表示，根據(jù)測(cè)試，在下一個(gè)更新的版本中，AI在物理、化學(xué)和生物學(xué)的挑戰(zhàn)性基準(zhǔn)測(cè)試中，表現(xiàn)能夠與博士生水平類(lèi)似。

相較于GPT-4o等現(xiàn)有的大模型，OpenAI o1能夠解決更加困難的推理問(wèn)題，同時(shí)改善過(guò)往模型中存在的機(jī)制性缺陷。

比如在解答編程問(wèn)題時(shí)也會(huì)更有條理，在著手寫(xiě)代碼前，把整個(gè)回答的流程全部思考完一遍，再動(dòng)手輸出代碼。

o1會(huì)花更多時(shí)間思考

在o1模型中，AI會(huì)不斷試錯(cuò)并打磨答案，從而顯著提高生成結(jié)果的準(zhǔn)確率和質(zhì)量。

OpenAI 宣布，ChatGPT訂閱用戶(hù)從9月12日起可以訪問(wèn)這兩個(gè)新模型，o1-preview每周消息數(shù)量限制為30條，o1-mini則為50條。

OpenAI o1預(yù)覽模型發(fā)布：推理能力更強(qiáng)