多模態應用持續升溫 改寫企業AI算力帳單
多模態內容創作佔比上升,影片生成的算力消耗遠高於文字任務,應用重心的移動,意味著企業的算力帳單也在改寫 頭豹研究院 多模態內容創作正從大模型應用中的小眾場景走向前列。頭豹研究顯示,這類應用在九類核心業務場景中的佔比,半年間由0.6%升至11.9%,成為增長最快的方向。變化不止於報表:生成10秒1080p影片約消耗35萬Token,是文字任務的數百倍。這件事關係到內容平台、營銷部門,以及每一位規劃算力採購的決策者。 排序在半年內改寫 報告統計了約700個大模型應用樣本。2025年上半年,文字內容創作以23.7%的佔比位居第一,問答助手、數據處理分析緊隨其後。多模態內容創作只佔0.6%,排在九類場景的末位。 半年後,排序開始變化。多模態內容創作升至11.9%,智能客服從5%升至9.4%,AI搜索從3.1%升至4.7%。報告將這三個方向列為增長前三,多模態是其中最大的增量。 基礎盤並未被動搖。下半年,文字內容創作仍以19.5%居首,問答助手與數據處理保持較高佔比。多模態拿走的是增量,並未取代文字場景。 增長為何出現在多模態?報告的解釋是,多模態技術能力在2025年持續提升,帶動內容生產、資訊獲取和客戶互動三類需求加速釋放。率先放量的是內容密集型場景:Steam平台使用生成式AI的遊戲,從2024年的1,000多款增至2025年的7,818款以上,報告標註增長681%。 影片生成服務的收入也在增長。快手(1024.HK)公布,旗下可靈AI於2026年第二季度錄得逾8.5億元人民幣收入,按年增長逾200%;同季,平台上AI生成短影片營銷素材的投放消耗按年增長逾70%。從影片製作到廣告投放,多模態應用正進入更多商業場景。 帳單的計量單位變了 場景佔比的移動,改變的是算力消耗的計量單位。報告測算,生成10秒1080p影片約消耗35萬Token,數百倍於文字任務。應用從寫文案轉向做影片,單個任務的算力消耗不在同一量級。 消耗還被使用方式繼續放大。報告觀察到,應用價值正由單次生成轉向持續推理與任務閉環:搜索、營銷、客服、辦公等高頻業務流程嵌入模型,調用量、互動頻率和推理負載同步上升。 全國Token調用量也在增長。國家數據局公布,中國日均Token調用量於2026年3月超過140萬億;國家統計局其後表示,日均調用量已達「數百萬億」,但未公布更精確的數字。這項統計涵蓋各類AI應用,反映整體模型調用規模擴大。 這些數字合起來,改變的是算力預算的算法。過去按「模型能不能用」評估投入,現在要按「調用量乘以單位任務消耗」測算成本。任務從文字轉向影片、從單次轉向持續,成本增速可能快於用戶量增速。 誰先付這筆帳 壓力不會平均分攤。多模態放量集中在遊戲等內容密集型場景,互聯網內容平台與AI原生企業最先承擔成本。報告對這類客戶的判斷是:需求本質是高並發、彈性擴展與低成本調用,適合模型即服務(MaaS)與雲端推理服務,商業模式以按調用量付費為主。 上述場景佔比基於約700個樣本,反映的是場景結構變化,不等於行業收入分布。多模態能否持續放量,還取決於影片生成成本下降的速度。報告將供給側價格與成熟度,列為影響算力需求的核心變數之一。 對企業而言,影響落在三件事上:把多模態內容製作成本納入年度預算;在採購合同中明確調用計費方式;逐項評估哪些環節值得從文字生成升級到影片生成。規劃AI預算時,先算清業務中有多少任務會從文字轉向影片、從單次生成轉向持續推理。 多模態不是多了一個功能選項,而是把單任務算力消耗放大數百倍的變量。規劃AI預算時,與其盯模型榜單,不如先算清楚:業務里有多少任務會從文本轉向視頻、從單次生成轉向持續推理。前者決定體驗,後者決定成本。 頭豹研究院中國是行企研究原創內容平台和創新的數字化研究服務提供商,擁有近百名資深分析師,聯繫方式:CS@leadleo.com 本文內容純屬作者個人意見,不代表咏竹坊立場 欲訂閱咏竹坊每周免費通訊,請點擊這裏