国产91精品一区二区麻豆网站-国产91精品高跟丝袜在线-国产91精品不卡在线-国产91激情对白露脸全程-在线国产区-在线观着免费观看国产黄

首頁 > 汽車資訊 > 汽車資訊 > 復雜推理大模型OpenAI o1亮相,數學與代碼能力飛躍

復雜推理大模型OpenAI o1亮相,數學與代碼能力飛躍

發布時間:2024-09-16 16:25:38來源: 13041198719

平安證券近日發布AI動態跟蹤系列(三):復雜推理大模型OpenAI o1亮相,數學與代碼能力飛躍。

以下為研究報告摘要:

9月13日,OpenAI正式發布并上線o1系列模型o1-preview和o1-mini。

平安觀點:

OpenAI計數器重置回1,o1系列開啟復雜推理序幕。本次OpenAI發布的是o1-preview(預覽版)和o1-mini(擅長STEM、更快、更便宜)兩個版本,ChatGPT付費用戶和API用戶可以使用。根據OpenAI官網介紹,o1系列被定位為用于解決難題的推理模型。對于復雜的推理任務來說,OpenAI認為o1是一個重大進步,代表了AI能力的新水平,鑒于此,OpenAI將計數器重置回1并將此系列模型命名為OpenAI o1。OpenAI研究發現,隨著強化學習(訓練時計算)和思考時間(測試時計算)的增加,o1的性能會不斷提高。因此在體驗上,與此前模型不同點在于,OpenAIo1在作出反應之前,需要像人類一樣,花更多時間思考問題。

o1基準表現明顯優于GPT-4o,數學與編碼能力實現飛躍。OpenAI實驗結果表明,在絕大多數推理任務中,o1的表現明顯優于GPT-4o。尤其是在具有挑戰性的推理基準上,o1實現了能力飛躍,1)數學能力:在美國數學奧林匹克(AIME2024)預選賽題目中,GPT-4o平均只能解決12%的問題,o1正式版達到平均74%的準確率,在使用學習評分函數重新排名1000個樣本后準確率達到93%,相當于美國排名前500的學生水平。2)編碼能力:在競爭性編程問題(Codeforces)比賽中,o1-preview、o1分別超越了62%、89%的人類競爭者,而對比GPT-4o僅超過11%。3)特定專業領域能力:GPQA diamond測試(專門用于評估模型在化學、物理和生物學等領域的專業知識水平)中,o1不僅成功完成了測試,更是超越了人類專家的表現,成為首個在GPQA diamond基準上擊敗人類專家的AI模型。

o1引入思維鏈優化邏輯推理,助力模型性能與安全提升。o1優越能力的背后,核心突破在于運用思維鏈(chain of thought)方法來處理復雜任務,OpenAI介紹到,類似于人類在回答困難問題之前可能會思考很長時間,o1在嘗試解決問題時會使用思維鏈。通過強化學習,o1學會打磨其思維鏈并改進它所使用的策略。o1學會了識別和糾正錯誤,學會了將棘手的步驟分解為更簡單的步驟,學會了在當前方法不起作用時嘗試不同的方法,此過程顯著提高了模型的推理能力。在OpenAI的一個官方演示中展示了o1-preview解答復雜問題的邏輯推理過程,o1-preview在過程中逐步顯示思考、翻譯問題、定義變量、理解問題、構建方程、解方程等與人類推理相似的步驟,最終輸出結論。同時,OpenAI認為思維鏈推理也為大模型安全性的提升提供了新思路,o1-preview在關鍵越獄評估和用于評估模型安全拒絕邊界的最嚴格內部基準上取得了顯著的改進。

投資建議:OpenAI推出專攻難題的o1系列大模型,應對復雜推理任務,o1引入思維鏈(Chain of Thought)提升邏輯推理能力,絕大多數基準表現不僅明顯超越GPT-4o,而且在數學與編碼能力上實現了重要飛躍,在理化生等專業領域的知識水平也達到新高度。OpenAI的動向始終引領全球大模型的發展,我們認為o1的正式亮相有望開啟復雜推理大模型的序幕,一方面對算力提出了更大需求,同時也將賦能下游AI應用(如編程、教育)的快速迭代。我們堅定看好AI主題的投資機會:1)算力方面,推薦工業富聯、浪潮信息、中科曙光、紫光股份、神州數碼、海光信息、龍芯中科,建議關注寒武紀、景嘉微、軟通動力;2)算法方面,推薦科大訊飛;3)應用場景方面,強烈推薦中科創達、恒生電子、盛視科技,推薦金山辦公,建議關注萬興科技、福昕軟件、同花順、彩訊股份;4)網絡安全方面,強烈推薦啟明星辰。

汽車資訊更多>>

2024年舟山市定海區衛生健康系統招聘編外人員公告 2024年寧波鄞州區錢湖醫院招聘編外人員公告 2024年貴陽清鎮市第一人民醫院醫共體暗流分院招聘合同制專業技術人員簡章 2024 年南海區第七人民醫院招聘事業單位 聘用制(編制)工作人員公告(第二批)(16人) A+級市場變天,AION RT A+王者現身! 悅達起亞銷量飆升,1-7月累計達13.2萬輛,增長66.5% 帥出新高度!猛士917高地雄獅版與M800星際成都車展驚艷亮相! 直降至高2.3萬元!2025款起亞K5增配上市,13.98萬元起售! 上汽俞經民:講MG一定要講英語,MG5是A級轎跑課代表 16.58萬元起,2025款漢開啟全面進化,加速沖擊合資燃油車 13.98萬元起售,配置增加,2025款起亞K5還香嗎? 重磅新品齊發,華為在線上演“王者歸來” 2024年亳州譙城區大學生鄉村醫生專項計劃招聘公告 2024年亳州市蒙城縣大學生鄉村醫生專項計劃招聘公告 2024年馬鞍山花山區“鄉編村用”招聘事業編制人員公告 2024年馬鞍山和縣“鄉編村用”專項招聘事業單位人員公告 2024年馬鞍山博望區“鄉編村用”招聘鄉鎮事業編制人員公告 2024年合肥市志遠教育集團校園招聘公告 2024年蕪湖徽文中學2025屆校園招聘簡章 2024年皖西學院藝朝藝夕教育科技集團2025屆校園招聘公告 2024年亳州市風華高級中學有限公司招聘簡章 預售20.98萬起/比亞迪唐DM同級,星途瑤光 C-DM四驅版9月26日上市 售26.88萬,座椅2+2+2布局,2.0T+8AT+四驅,第五代勝達香不香? 800V快充+高階智駕,0息0首付,限時17.99萬元起,小鵬G6 售價19.99萬起,車長超5米,配2.0T+7DCT,這款中型車帶勁不? 車長超5米,220馬力+7DCT,惠后22.39萬,這款合資B級車帶勁不? 配雙層隔音玻璃,油耗6.41L,限時12.78萬元,這款中型車適合家用 252馬力+四驅,配L2級輔助駕駛,惠后20.48萬,家用看這款中型SUV 2.0T+8AT+適時四驅,惠后16.88萬,家用可以看這款中型SUV 10萬級側滑門SUV,軸距2820mm,配置豐富,續航500km,適合家用
主站蜘蛛池模板: 久久久高清国产999尤物 | 国产激情一区二区三区在线观看 | 国产丝袜美腿 | 亚洲香蕉伊在人在线观看9 亚洲香蕉一区二区三区在线观看 | 亚洲综合国产一区二区三区 | 国产91精品在线观看 | 特黄大片aaaaa毛片 | 久久亚洲热| 日本aⅴ永久免费网站www | 俄罗斯18videosex性欧美成人 | 亚洲a成人| 老司机在线免费观看视频 | 亚洲a级| 免费观看一级成人毛片软件 | 草久在线视频 | 亚洲一区二区精品视频 | 蜜桃日本一道无卡不码高清 | 国产成人精品一区二区三在线观看 | 麻豆精品在线视频 | 亚洲激情 欧美 | 2021国产精品系列一区二区 | 2020久久精品亚洲热综合 | 污秽视频在线观看 | 成人国产亚洲欧美成人综合网 | 亚洲欧洲日韩国产一区二区三区 | 广州一级毛片 | 日韩一区国产一级 | 在线免费观看污污视频 | 欧美亚洲欧美日韩中文二区 | 国产精品久久久久久久久久久搜索 | 成人影库| 欧美一区欧美二区 | 色妞网站 | 91精品综合久久久久久五月天 | 国产情侣自拍网 | 日本午夜www高清视频 | 91成人爽a毛片一区二区 | 亚洲欧美日韩高清 | baoyu113成人免费视频网页 | 91先生在线 | 91久久精品午夜一区二区 |