字節跳動的AI布局,是「慢思考、快執行」的勝利

2025-02-05 10:38:19 來源:中華網财經
        【每日科技網】

  作者 |王延鶴

  臨界點在加速到來。

  特朗普重返白宮第二天,就宣布「星際之門」項目Stargate Project:

  OpenAI、甲骨文和軟銀将成立合資公司,未來四年投資5000億美元(約3.6萬億人民币)用于AI基礎設施。包括Arm、微軟、英偉達、甲骨文和OpenAI等科技公司,都是初始技術合作夥伴。這似乎就是美國在AI時代的「曼哈頓計劃」,向AGI時代無限加速。

  趕在春節前夕,中國的頭部大模型企業,密集進行了一輪推理模型更新。目前,DeepSeek的R1、Kimi的k1.5、智譜的GLM-Zero、階躍星辰的Step-1o系列等,都在對标OpenAI的o1模型。

  集體的智能湧現,意味着:中國廠商經過兩年沖刺,通過跟随式創新縮小差距,甚至走出一條用更少資源、性能比肩的不同道路。如今,也到了原創式創新、大規模商用化的臨界點。

  1月22日,字節跳動正式發布了豆包大模型1.5系列。Doubao-1.5-pro模型在知識、代碼、推理等權威測評得分全面超越GPT-4o 和 Claude 3.5 Sonnet,達到全球水平,并同步上線火山方舟對外提供服務,價格“加量不加價”。

字節跳動的AI布局,是「慢思考、快執行」的勝利

  過去一年,字節跳動是大模型增長最快的廠商。在2024年年初,字節跳動還被擔憂入局大模型時間太晚。經過一整年全力投入的高頻作戰,字節取得的戰果是:

  據QuestMobile數據,截至2024年12月,豆包APP的月活用戶約7523萬;

  截至12月中旬,豆包大模型日均Tokens使用量超4萬億,「豆包+火山引擎」大模型和雲服務的組合,突破了B端企業市場和雲計算的原有格局。

  這堪稱一次字節式「慢思考、快執行」的經典戰役。

  換句話說,每一次豆包大模型更新,都在以更低門檻、更低成本,将人工智能技術傳遞給上億用戶、開發者和企業。在事實上,豆包大模型已成為國内AI普惠的「布道者」

字節跳動的AI布局,是「慢思考、快執行」的勝利

  此次,字節跳動發布的豆包大模型1.5系列,包括了:

  Doubao-1.5-pro:滿血性能,支持256k長文本,多項測試得分優于 GPT-4o、Claude 3.5 Sonnet 等業界模型;

  Doubao-1.5-lite:輕量級成本,旗艦級性能,響應速度,測評指标持平或超越 GPT-4o mini、Claude 3.5 Haiku;

  Doubao-1.5-vision-pro:視覺理解模型,在視覺推理、文字文檔識别、細粒度信息理解、指令遵循方面的能力全面升級;

  Doubao-1.5-realtime-voice-pro:真正實現端到端語音對話,在豆包APP全量上線,即将開放API服務。

  目前,Doubao-1.5-pro已經在火山方舟全面上線,我們也上手進行了幾波測試。

字節跳動的AI布局,是「慢思考、快執行」的勝利

  最為核心的,就是豆包通用模型 1.5 Pro。

  目前,Doubao-1.5-pro 在知識、代碼、推理、中文等多個權威測評基準上都獲得了成績。

字節跳動的AI布局,是「慢思考、快執行」的勝利

  這意味着,企業無論是需要處理中文文本,搜索專業知識,做編程開發,還是進行的複雜邏輯推理任務,都能全面勝任。

  當然,到底能不能打,我們也上手實測體驗了一波。

  首先,我們測了兩個邏輯推理題:

  1. 繞暈很多人的「算賬問題」

  三個人去餐館吃飯,總共消費了30元,每人付了10元;

  後來老闆說今天打折,隻收25元,讓服務員退回5元;

  服務員私吞了2元,把剩下3元分給了三個人,每人退回1元;

  這樣,每個人實際上付了9元,三個人總共付了27元;

  加上服務員私藏的2元,總共是29元。

  那麼,還有1元去哪裡了?

  Doubao-1.5-pro用0.46s秒答了:

字節跳動的AI布局,是「慢思考、快執行」的勝利

  2. 非常經典的「動物過河」問題:

  農夫需要把狼、羊和白菜都帶過河,每次隻能帶一樣物品

  狼和羊不能單獨相處,羊和白菜也不能單獨相處

  請問農夫一共要過幾次河

  Doubao-1.5-pro用0.61s秒答了:

字節跳動的AI布局,是「慢思考、快執行」的勝利

  整體思路很清晰,根本難不倒它。

  随後,我們也測試了故事創作能力:

  請以“一場暴雨導緻城市停電”為開頭

  創作一個至少包含三次反轉的懸疑短篇小說

  結局需要出人意料

  豆包不到10秒給了我這樣一個小短篇,大家可以評判一下:

字節跳動的AI布局,是「慢思考、快執行」的勝利

  輕量級的Doubao-1.5-lite,在性能上其實和去年9月的豆包Pro版本媲美。相當于說,企業客戶隻需花更少的成本,就能獲得更出色的性能,AI的“智價比”更高了。

  同時,此次多模态能力的全面提升,讓豆包在交互和能力上,都更懂人,也更像人。

  視覺理解能能力上,Doubao-1.5-vision-pro在多模态數據合成、動态分辨率、多模态對齊、混合訓練上進行了全面升級,提升模型視覺推理、文字文檔識别、細粒度信息理解、指令遵循方面的能力。

  在升級之後,Doubao-1.5-vision-pro可以讀懂任意分辨率、任意比例的圖片,不管是随手拍的圖片、裁切後的模糊小圖,豆包都能理解。

  比如,能夠完全識别手寫的試卷,并進行判分:

字節跳動的AI布局,是「慢思考、快執行」的勝利

字節跳動的AI布局,是「慢思考、快執行」的勝利

  同時,豆包APP已全量上線實時語音功能。

  支持和真人一樣的聊天互動,豆包可以模仿不同語氣、情緒,能夠在對話中處理打斷和插嘴,也可做到唱歌、說悄悄話等有趣的互動方式。

  比如我們讓豆包模仿唱了一段已經解凍的《恭喜發财》:

字節跳動的AI布局,是「慢思考、快執行」的勝利

  距離豆包基礎模型上次更新,才過了一個月。

  我們從豆包大模型1.5 Pro的變化,也能看出字節在技術上的思路轉變:

  1.采用系數MoE(混合專家系統)架構,用激活參數僅為稠密模型參數量 1/7 的 MoE 模型,超過了稠密模型的性能,将性能杠杆提升至 7 倍,業界普遍為3倍。

  2.字節跳動對硬軟件進行了深度定制。自研服務器、網卡和網絡協議,提升了算力集群的通訊效率;算子層計算和通信的高效交疊,保障多機分布式推理的穩定和高效;精細量化和 PD 分離等方案,靈活使用算力和多任務混合調度,實現更高效算力利用。

  3.不使用任何其他模型數據,豆包構建了完全自主的數據生産體系,優化數據質量的同時,确保數據來源的獨立性和可靠性。

  不直接追求更大量級的模型規模,不走蒸餾模型的“捷徑”。

  豆包是在探索「模型效果、運行效率、成本控制」,三者之間的平衡點——用更低的成本,提供更強的能力。

字節跳動的AI布局,是「慢思考、快執行」的勝利

  字節跳動在匹配應有的段位。如果2024年大模型行業是3倍速發展,字節跳動就是10倍速的躍遷。

  去年年初,字節提高AI的戰略定位,積極招攬人才,大量資源壓強投入。「慢思考、快執行」的風格,貫徹了字節的作戰思路:

  1. 從C端破局,大規模、多領域、全覆蓋推出AI應用。這是字節跳動最擅長的産品驅動+流量打法的「大力出奇迹」模式

  2. 在B端飽和猛攻,通過優化的模型推理成本攻入企業市場。同時,在大模型加持下的火山引擎,也擡升了在雲服務市場的地位。

  先看C端産品,2023年8月,Grace改名“豆包”,作為AI智能助手正式上線;據QuestMobile數據,截至2024年12月,豆包APP的月活用戶數約為7523萬。

  多個渠道統計,豆包的用戶量在國内AI産品遙遙,千萬級的DAU是第二名的3倍(300萬);在全球,豆包的月活用戶數也僅次于ChatGPT(2.8億)。

  豆包APP完成階段性使命,為字節獲得初具規模的用戶基礎。目前,字節跳動已推出近20款AI應用,覆蓋聊天、視頻、編程、社交、教育等賽道。例如,AI視頻生成的即夢,AI聊天社交的貓箱,AI教育的豆包愛學,AI音樂的海綿音樂。

  再看B端,2024年5月,字節統一将大模型更名“豆包”,推出9款豆包大模型。當月,豆包大模型也通過字節跳動旗下的雲與AI服務平台“火山引擎”,正式提供服務。

  目前,字節跳動已推出了包括視頻生成、實時語音、視覺理解、文生圖、同聲傳譯等超10款大模型。

  字節跳動在B端的策略,是「更強模型、更低成本、更易落地」。通過豆包大模型和火山引擎這一對「大模型+雲服務」組合抱團破局。

  2024年5月推出時,豆包主力模型的定價僅為0.0008元/千Tokens,比當時行業價格便宜99.3%,帶動了阿裡雲、百度等大模型降價,B端大模型價格進入“厘”時代;

  12月火山引擎Foce冬季大會上,豆包視覺理解模型的定價,為0.003元/千Tokens,比行業價格低85%;

  2025年1月,豆包大模型1.5全系産品,也提質不加價,在火山引擎上售賣API的Doubao-1.5-pro,随着推理成本持續優化,毛利率提升到50%;

  從時間上看,火山引擎在2021年12月才正式加入雲計算競争,相比阿裡、騰訊、華為、百度這四朵雲,入場時間晚了一輪周期。坦白來說,雲計算是一個對後來者非常不友好的賽道,哪怕是字節跳動。

  火山引擎也是抓住了這一輪「大模型+雲廠商」的熱浪,終于取得了較大突破。2023年6月,火山引擎正式推出“火山方舟”平台,提供大模型的部署、精調、推理等服務。

  在那個時間點,國内對算力的需求,重心還在大模型的訓練側。當時中國7成做大模型的公司,包括月之暗面、智譜AI等明星公司,都跑在火山引擎上。這個時期主要客戶,也仍然是做大模型的少數幾家企業。

  随着大模型開始落地,大量企業客戶開始參與到AI應用開發中,行業對算力和雲服務的需求轉向推理側。火山引擎也将重心轉向AI Infra能力,以及打造開發平台、工具鍊等各層次的生态補全。

  2024年2月,火山引擎推出AI應用開發平台扣子,提供主流大模型的API,開發者和企業能低代碼構建AI Bot;

  5月,推出HiAgent平台,被稱為企業開發應用的“SDK”,企業能快速開發大模型應用和智能體,成為火山引擎增長最快的産品之一。

  12月,火山引擎升級以GPU為中心的AI Infra分布式業務體系,通過 vRDMA 網絡支持大規模并行計算及 P/D 分離推理架構,提升訓練和推理效率,降低企業使用成本;EIC 彈性極速緩存解決方案,實現 GPU 直連,使大模型推理時延降低至五十分之一,成本降低 20%。

  這一套「模型能力+低成本+生态搭建」的組合拳,讓火山引擎迅速在2024年取得了數量級的突破,核心在于為企業落地大模型、打造AI應用提供全周期的支撐。

  根據火山引擎披露數據,截至2024年12月中旬,豆包大模型的日均Token使用量已超過4萬億,相比5月上線時的數據(1200億)增長了33倍。

  目前,豆包大模型已在金融、消費、電商、教育、汽車等30多個行業完成落地,與企業深度開發AI應用樣闆間。截至12月,豆包大模型已經與八成主流汽車品牌合作,并接入到多家手機、PC等智能終端,覆蓋終端設備約3億台。

  例如,火山引擎在去年5月,與一汽紅旗、東風、吉利、長城等24家車企成立了“汽車大模型生态聯盟”;8月,火山引擎與多點DMALL成立“零售大模型生态聯盟”。

  小米的“小愛同學”,OPPO的Find X8新機,都使用豆包大模型提升用戶體驗;浙江大學與火山引擎搭建了“浙大先生”智能體應用開發平台;扣子專業版和HiAgent等工具生态,金融行業的招商銀行、華泰證券、國信證券等十餘家客戶。

  火山引擎總裁譚待表示,豆包大模型目前的定價,依然是有合理毛利的。這個價格是靠模型技術能力、工程能力、軟硬件結合能力做到的,而不是隻靠燒錢的卷低價。

  這個思路的潛在意思是說:AI的To B業務還處于初期階段,隻有讓更多企業和開發者用得起,一起持續降本、優化效率、做大蛋糕,商業模式才能長期成立。

字節跳動的AI布局,是「慢思考、快執行」的勝利

  到2024年的第四季度,大模型廠商的分化就已經塵埃落定。即便是「AI六小虎」,也已經有廠商在後撤,退出超大模型研發,轉向垂直領域、行業模型和AI應用的層面。

  目前市場上的廠商裡:1.有能力繼續疊代基礎模型,2.有希望實現商業化盈利。能符合這兩個要求的廠商可能隻有十家,2025年還會進一步縮圈。

  模型能力始終是第一位的。

  Scaling Law仍發揮作用,下一代基礎模型的參數和算力規模仍會有量級增加。據分析,GPT-4估計是1.8萬億參數,每輪訓練成本6000萬美金;GPT-5參數到十幾萬億,每輪訓練耗時幾個月,算力成本5億美金。

  量級增加的成本,高頻的研發周期,就會出清絕大部分非大廠的AI企業。而MoE、推理模型、多模态、Agent等衆多的新技術方向,頭部廠商也全部都要跟進。因為競争,無法再容忍因錯過趨勢,而導緻落後出局。

  與此同時,AI需要的龐大資金投入,與相比之下極少的盈利回報,也日益成為大模型發展的主要矛盾。

  同樣以OpenAI為例,ChatGPT活躍用戶近3億,去年底推出了每月200美元的ChatGPT Pro,而Sam Altman仍吐槽:Pro版訂閱服務實際在虧損。據報道,OpenAI在2024年的收入約37億美元,而虧損達50億美元。創造規模化、成熟的盈利模式,是行業的共同難題。

  對字節跳動來說,豆包大模型1.5 Pro跻身,C端産品積累龐大用戶基礎,火山引擎的B端業務厚積薄發,接下來更多要「直面天命」,找到在AI時代不可被替代的位置。

  在2024年的大模型招标中标名單裡,火山引擎的名字開始更多出現。在大模型的長期盈利模式尚不明朗的情況下,我們也要看到亞馬遜AWS、微軟Azure和谷歌雲,都以驚人的增速在創造财務新高。2025年,火山引擎除了全生态的布局,在「更強模型、更低成本、更易落地」戰術上還将猛攻。

  在國内To B市場,火山引擎抓住了明晰的主線:

  1.未來算力需求會進一步轉向推理,直到超過模型訓練算力;

  2.當前絕大部分企業,仍無法上手大模型和AI應用;

  3.混合雲和私有化等定制需求,仍然持續高漲。隻有把蛋糕做大,商業模式才有希望跑通。

  據報道,字節跳動在1月下旬成立Seed Edge項目,核心是做比預訓練和大模型疊代更長期、更基礎的AGI前沿研究。這是字節在慢下來,用更長研發周期,探索更底層、更多元、更有想象力的技術變革。

  從追随式的自我證明,到進入「無人之境」創造不可能。

免責聲明:本文僅代表作者個人觀點,與每日科技網無關。其原創性以及文中陳述文字和内容未經本站證實,對本文以及其中全部或者部分内容、文字的真實性、完整性、及時性本站不作任何保證或承諾,請讀者僅作參考,并請自行核實相關内容。
    本網站有部分内容均轉載自其它媒體,轉載目的在于傳遞更多信息,并不代表本網贊同其觀點和對其真實性負責,若因作品内容、知識産權、版權和其他問題,請及時提供相關證明等材料并與我們聯系,本網站将在規定時間内給予删除等相關處理.

猜你喜歡

海能達發布全新專業防爆PDT對講機CH690Ex

随着我國應急管理體系持續完善,消防救援任務正在從傳統火災處置,向化工園區事故、危險品洩漏、地下空間救援、大型綜合災害等多風險、多場景方向發展。在這些複雜環境中,救援現場往往面臨爆炸性氣體、可燃性粉塵、

2周前

海能達CCW 2026載譽收官:AI與融合通信引領專用通信新未來

6月16日至18日,2026年全球關鍵通信展(CCW2026)在英國倫敦舉行。展會期間,海能達集中展示了從終端到系統、從感知到決策的全鍊路創新版圖,AI與融合通信産品及解決方案貫穿三天展期,持續獲得高

4周前

登陸歐洲 Intersolar!遠景AI電力系統支撐全球 AI 算力發展

慕尼黑,2026年6月23日——在IntersolarEurope2026上,遠景科技集團發布面向AI數據中心的下一代電力基礎設施——融合風光儲一體化方案、固态變壓器(SST)、800V直流供電、儲能

1個月前

海能達六度問鼎ICCAs,PDC650與西安機場方案摘得雙獎

6月17日,2026年國際關鍵通信獎(InternationalCriticalCommunicationsAwards,ICCAs)在英國倫敦舉行的全球關鍵通信展(CCW2026)期間正式揭曉。海能

1個月前

海能達即将亮相2026年CCW全球關鍵通信展: 攜AI與融合通信解決方案登陸倫敦

6月16日至18日,2026年CCW全球關鍵通信展将在英國倫敦啟幕。作為全球領先的專用通信解決方案提供商,海能達将以全場景關鍵通信産品矩陣亮相F25展位,集中展示面向公共安全、應急救援、城市治理等領域

1個月前

海能達再獲第十一屆廣東專利獎:持續自主創新,構築專用通信知識産權高地

近日,廣東省市場監督管理局正式公示第十一屆廣東專利獎評選結果。海能達通信股份有限公司申報的“一種集群通信系統的組派接方法、通信系統及存儲介質”(專利号:ZL201811296617.7)榮獲廣東專利優

1個月前