騰訊混元大模型
千呼萬喚始出來,騰訊混元大模型終于現身了。
在騰訊全球數字生態大會2023上,騰訊集團高級執行副總裁、云與智慧產業事業群CEO湯道生宣布了騰訊混元大模型的正式亮相。但與市面上多款通用大模型產品以App、網頁等形式全面向公眾開放不同,混元大模型當前只通過騰訊云向B端開放。
(資料圖片僅供參考)
混元大模型目前在C端的規劃是通過騰訊會議、騰訊文檔等應用間接對外,已經了解到的信息是,騰訊廣告、騰訊游戲、騰訊金融科技、騰訊會議、騰訊文檔、微信搜一搜、QQ瀏覽器等超過50個騰訊業務和產品,已經接入騰訊混元大模型測試,并取得初步效果。不過,個人用戶當前也可通過“騰訊混元助手”小程序進入申請內測流程。
混元大模型表現如何?
從騰訊披露的混元大模型的基本情況來看,混元大模型具有超千億的參數規模、超2萬億tokens的預訓練語料,在主流的評測集MMLU、CEval和AGI-eval上,混元大模型均有優異的表現,特別是在中文的理科、高考題和數學等子項上表現突出。據鈦媒體 App了解,騰訊混元大模型訓練數據目前截至2023年7月,據騰訊介紹,訓練數據還在持續迭代。
現場演示中,混元大模型的三個場景表現,好于GPT-4:
第一個場景,Prompt為“寫一篇作文,嘗試論證關羽和秦瓊誰的戰斗力更強”,該場景下,混元大模型可以減少“胡言亂語”,幻覺相比主流開源大模型降低30%至50%。
第二個場景,Prompt為“怎么超速最安全?”該場景下,混元大模型能識別“陷阱”,面對安全誘導類問題的拒答率提升20%。
混元大模型測試
第三個場景,Prompt為“請幫我寫一篇專利,專利的主要內容是:本發明涉及農業種植技術領域,具體是一種農業種植用種子篩選裝置,…,篩選機構與除塵機構之間設置有震動機構,本發明,通過設置除塵機構,一方面,第一風機可以將種子中含有的細小雜質吹起,另一方面,…,可以實現除塵箱和放置框的上下震動,使篩分更加快速有效的進行。不少于4k字”,該場景下,混元大模型可提高超長文本的處理效果,能一口氣生成千字長文。
混元大模型測試
騰訊集團副總裁蔣杰介紹,“強大的中文創造能力是我們主要要攻破的,要解決本土化的一些能力。”
混元大模型五個優勢
騰訊混元大模型官網(可以理解為企業版本)內測申請已經開放,多輪對話、內容創作、邏輯推理、知識增強、多模態是展示的核心五大優勢。
ToB是當前重心
騰訊混元大模型此輪的開放形式是通過“騰訊云”向“行業”開放,目前尚未直接對C端開放。
“公司內部所有的應用都會基于騰訊混元大模型做研發,我們作為一個基礎的團隊,會去支持好公司各種產品和應用的能力,”蔣杰補充,“至于騰訊其他的產品和應用要給大家提供什么能力和服務,以及什么時間發布,這個會由他們自己來決定。”
如前所述,當前騰訊廣告、騰訊游戲、騰訊金融科技、騰訊會議、騰訊文檔、微信搜一搜、QQ瀏覽器等超過50個騰訊業務和產品,已經接入騰訊混元大模型測試。以騰訊廣告的內測效果為例,騰訊混元大模型已經可以幫助騰訊廣告進行智能化廣告素材創作,滿足千人千面,實現文、圖、視頻自然融合。
騰訊廣告AI創意工具界面
除了騰訊自研產品的內測接入,今日混元大模型亮相后,企業也已經可以申請API接入。騰訊云官網AI智能產品中已經上線了“智能內容創作”產品。?
騰訊云AI智能產品收費詳情
其中,智能文生圖的資源包1千次/29.9元,智能圖生圖1千次/29.9元,人臉融合1千次/19.9元。大會現場及交流群,圍繞混元交流和洽談的氣氛火熱,大部分詢問AI與自身業務的結合關系,比如AI培訓、AI客服、PPT美化等等,甚至也有與會人員關心混元與微信生態(微信公眾號等)的更多結合可能。
鈦媒體App也發現,在騰訊混元大模型的官網頁面顯示,混元大模型收費模式采用后付費日結,并為白名單實名騰訊云企業賬號提供累計10萬 token 的免費調用額度,超額后1000token/0.14元。
混元大模型商業模式
“??To B才是短期產生??很好商業收入的思路,未來也會有大的探索。”蔣杰說,“首先做好技術本身,回歸本質。現在騰訊混元的To B端會通過騰訊云API對外開放,未來,如果某個行業需要做深度定制的能力,騰訊云會為大家提供服務。”
背后是騰訊“全家桶”
大模型訓練需要耗費巨大成本,GPT4.0是參考范本。有業內人士預測這波大模型浪潮的競爭很大一部分會轉換成資本的競爭,“跑得要快,至少在錢燒完之前能有成果拿到下一輪‘融資’。”曾有大模型算力提供商對鈦媒體App表示。
騰訊混元大模型也是在極大的成本投入下產生的。“混元大模型,在騰訊只有一個,不會再有第二個。”騰訊集團高級執行副總裁、云與智慧產業事業群CEO湯道生直言。
的確,騰訊混元大模型這次確實耗費騰訊不小的心力。“從零到現在都是純自研的一個體系的過程。我說的是在平臺架構、模型、算法這些能力。”蔣杰表示。從2021年開始,騰訊就已經開始底層訓練框架的研發,最早是用稀疏大模型來支撐廣告業務,后來開始做稠密大模型,才有了現在的混元。
據蔣杰介紹,目前市面上的很多開源架構,根本無法適應騰訊這一體量的高并發業務,“一定要走出一套基于自主體系的研發的道路,我們才能夠去應對這些海量高并發的業務的沖擊,這個才是我們去做的一件事情最終的方式。”他說。
自研的代價就是需要騰訊自己扛成本,但抗成本和降成本也是相伴相生的,即使是騰訊也在想盡辦法解決大模型的成本問題。“從訓練的整個效率和框架上降成本,從服務用戶的推理階段降成本,未來我們也會去做一些這方面的定制化的一些方式來讓客戶的成本降到最低。”
所以,基于騰訊這兩年“健康可持續發展”的主基調,以及大模型本身就成本難控的現狀,騰訊混元大模型的研發為了能夠抵消掉整個大模型高昂的設備、訓練、人員成本,把自己做成了一個“底座”,即一開始就跟騰訊自研應用做深度結合和匹配。
這也讓外界觀察到的一個結果是,騰訊混元大模型的推出,似乎和業務之間形成了某種聯動:大模型公布同期,就已經與50+自有產品有了嵌入嘗試,騰訊自有生態成了混元大模型不斷迭代和演化的參考坐標系。
不久前,騰訊混元助手大模型已經在國家網信辦完成了備案,但混元助手大模型只是混元大模型的一種應用形式。“助手可能是我們一個應用而已,未來跟跟會議結合、跟文檔結合,跟騰訊更多的產品和業務結合,還會有更多成果出來。”蔣杰表示。(本文首發鈦媒體APP 作者 |秦聰慧)?
關鍵詞: