IT之家 7 月 24 日消息,據(jù)新浪科技今日報(bào)道,騰訊宣布混元多模態(tài)模型部門與大語言模型部門合并,成立基礎(chǔ)模型部,統(tǒng)一由騰訊首席 AI 科學(xué)家姚順雨管理,以進(jìn)一步提升模型研發(fā)和協(xié)同效率,探索全模態(tài)模型的智能上限。
以大語言模型為基礎(chǔ),騰訊混元構(gòu)建了圖像、視頻、語音、3D 生成模型等完整的模型矩陣。
據(jù)介紹,7 月正式上線的大語言模型 Hy3,展現(xiàn)出顯著強(qiáng)于同尺寸模型且比肩參數(shù)規(guī)模 2-5 倍的旗艦?zāi)P偷闹悄芩?,已?WorkBuddy / CodeBuddy、元寶、Marvis、ima 等多個業(yè)務(wù)接入,API 已在騰訊云 TokenHub 以及多個海外平臺上線。發(fā)布一周后,Hy3 總調(diào)用量較上一代模型(Hy2)增長超 68 倍,WorkBuddy 自選模型的用戶中,選擇 Hy3 的占比達(dá)到 60%。
混元多模態(tài)模型也在持續(xù)進(jìn)化。4 月發(fā)布并開源的混元 3D 世界模型 2.0(Hy World 2.0)能夠根據(jù)文字、圖片、視頻等不同類型輸入,自動生成、重建和模擬 3D 世界,同時支持多格式 3D 資產(chǎn)導(dǎo)出,能與現(xiàn)有的游戲(881275)工作流無縫對接,快速生成游戲(881275)地圖和關(guān)卡原型?;煸?3D 系列模型的社區(qū)下載量超過 300 萬?;煸獔D像模型 3.0 在 LMArena 榜單上居國內(nèi)開源模型第一。
IT之家注:姚順雨本科畢業(yè)于清華大學(xué)姚班,獲普林斯頓大學(xué)計(jì)算機(jī)科學(xué)博士學(xué)位,2024 年加入 OpenAI 并參與智能體產(chǎn)品 operator 與 deep research 開發(fā) 。其研究聚焦語言智能體與現(xiàn)實(shí)世界交互,提出 ReAct 方法首創(chuàng)“推理 — 行動”結(jié)合的智能體范式,被學(xué)術(shù)界與工業(yè)界廣泛采納。
2025 年 12 月,騰訊升級大模型研發(fā)架構(gòu),新成立 AI Infra 部、AI Data 部、數(shù)據(jù)計(jì)算平臺部,全面強(qiáng)化其大模型的研發(fā)體系與核心能力。姚順雨(Vinces Yao)出任“CEO / 總裁辦公室”首席 AI 科學(xué)家,向騰訊總裁劉熾平匯報(bào);同時兼任 AI Infra 部、大語言模型部負(fù)責(zé)人,向技術(shù)工程事業(yè)群總裁盧山匯報(bào)。
