輸入一段故事梗概,智慧體開始拆解劇本、設計角色、生成分鏡;上傳一張商品圖,系統自動完成腳本、配音和剪輯;給出一張靜態照片,一個能聽、能説、能實時回應用戶需求的數字人便出現在屏幕上……在2026世界人工智慧大會上,短視頻與網絡視聽不再只是生成式人工智慧的“演示窗口”,而正在成為檢驗技術能否進入真實生産的重要現場。

7月17日至20日,以“智慧夥伴 共創未來”為主題的2026世界人工智慧大會暨人工智慧全球治理高級別會議在上海舉行。閉幕數據顯示,大會共有1117家企業參展,展品4486項,351款産品全球首發、198款首秀。透過密集亮相的模型、智慧體和應用,一個個趨勢愈發清晰:人工智慧正在從單點功能走向全鏈路工作流,從生成素材走向交付作品,並進一步改變內容生産的組織方式、互動方式和全球傳播路徑。
一、從單點工具到“數字劇組”:創作流程由線性走向協同
過去幾年,AI視頻常被創作者形容為“開盲盒”:一個工具寫文案,一個工具生成圖片,一個工具製作視頻,最後再回到剪輯軟體拼接。不同環節彼此割裂,角色不一致、鏡頭不連貫、修改不可控,決定了不少作品只能停留在幾秒鐘的視覺奇觀,難以滿足微短劇、品牌短片和重大主題報道等複雜內容的生産需求。
本屆大會上,“智慧體”“工作流”“系統級交付”成為視頻創作技術産品的高頻詞。7月18日,商湯在大會論壇正式發佈日日新SenseNova U1 Pro,並集中展示全新的Seko 3.0。前者可在視頻創作前端完成世界觀搭建、角色設定、鏡頭規劃和分鏡統一;後者以“Agent框架+超創Skill生態”為底座,貫通意圖理解、任務拆解、模型匹配和工作流組裝,將前期策劃、素材生成與成片製作連接起來。

現場演示的《沙影之刃》提供了一個更直觀的樣本:系統先生成完整的世界觀設定和22個連續分鏡,再由Seko完成視頻生成,儘量保持人物、動作與劇情的前後連貫。如果説過去的生成式AI更像一名擅長承擔單項任務的“臨時工”,那麼新一代産品正在嘗試為用戶組建一支“數字劇組”——策劃智慧體梳理故事,視覺智慧體統一角色和場景,導演智慧體規劃鏡頭,生成系統完成畫面製作,人類創作者則負責目標設定、審美判斷和最終把關。
由此産生的變化,不只是生産效率大幅度提升。更重要的是,創意可以被結構化沉澱,角色、場景、運鏡和模板能夠作為數字資産復用;團隊之間的協作也從“文件傳遞”轉向“過程共創”。對於需要持續更新的短視頻賬號和多集微短劇而言,這種創作能力有助於保持作品風格穩定,降低規模化生産中的質量波動。但“數字劇組”並不意味着無需專業,而是把人的工作重心進一步推向選題、敘事、審美和質量控制。
二、從“鏡頭奇觀”到“連續敘事”,AI開始學習導演語言
短視頻雖“短”,不等於敘事能力可以簡化。無論是微短劇、系列科普,還是品牌故事、城市形象片,都需要統一連貫的人物、場景、情緒與節奏。早期視頻模型最難跨越的,恰恰是鏡頭之間的邏輯關係:人物鏡頭可能無故“換臉”,空間結構隨鏡頭的變化會發生錯亂,表演、台詞與畫面脫節、劇情連貫性及情緒轉換流暢度難以保障。
從本屆大會呈現出的行業變化看,AI視頻能力正在由“會生成畫面”向“理解視聽表達”升級。鏡頭為什麼從全景切到特寫,人物應當站在哪,台詞、動作和音樂如何協同烘托情緒,這些過去主要依賴導演和專業製作團隊完成的工作,正在被逐步嵌入智慧體工作流。

大會期間,智象未來發佈多模態創作智慧體vivago R1。據企業介紹,該産品通過多智慧體協作進行長鏈路敘事規劃,可生成連續長視頻,並統一畫面風格、人物設定和敘事邏輯。無論“任意連續時長”等能力在實際商用中表現如何,這一發佈至少釋放出一個明確的行業信號:行業評價AI視頻的標準正在迭代,從“單個鏡頭是否驚艷”,轉向“多個鏡頭串聯能否完整講好一個故事”。
當AI開始參與人物站位、鏡頭調度、台詞節奏和表演情緒,創作者的角色也隨之變化。人不必再把大量時間耗在重復執行上,而要更清楚地回答:為什麼要講這個故事?情緒從哪進入?人物為什麼值得相信?技術可以擴展敘事容量,卻不能替代生活經驗和導演判斷。
未來真正拉開AI短劇質量差距的,不會局限於畫面清晰度、特效精細度等表層指標,而是人物塑造能否立體、衝突能否合理、情緒能否演進。AI能不能“記住”人物是誰、故事講到了哪,將成為其由素材工具進入專業內容生産的重要門檻。
三、從“人人創作”到“一人成軍”,OPC重構創作者生態
本屆大會首次設立OPC專屬展示區,180家企業擂台。OPC通常指One Person Company,即“一人公司”;在當下的智慧經濟語境中,它更強調“個人+AI”的深度協同的生産模式——一個創作者借助多個智慧體,完成過去需要産品、研發、運營、營銷等不同團隊分工完成的全流程任務。

放到短視頻和網絡視聽行業,OPC更接近“一個創作者+一支AI劇組”:編劇、分鏡、美術、配音、翻譯、剪輯、運營等任務,可以由不同AI工具協同完成,由一個人負責選題、審美、決策和最終把關。“從個人剪輯走向AI劇組”,成為本屆大會折射出的一種新型內容生産組織模式。
這讓“一個創作者+一支AI劇組”從概念走向可操作的工作模式。它有望降低專業視聽創作的組織成本,讓獨立創作者、小型短劇工作室、地方融媒體和中小商家獲得過去只有大型團隊才具備的完整生産能力。尤其是知識類短視頻、垂直行業內容、地方文化傳播等細分領域,那些熟悉行業、擁有專業積累的個體創作者,借助AI可以實現更完整的視聽內容表達。
但“一個人”並不意味着“一個人包辦一切”,更不意味着專業價值消失。當工具越普及,同質化也越容易;執行成本越低,創意、審美、行業知識和社會洞察反而越稀缺。
OPC真正釋放的産業價值,不是批量製造內容的權利,而是讓有專業積累、有獨特表達的創作者,能夠依託更為輕量化的組織完成更高複雜度的作品。對於主流媒體而言,這也提供了一種“開門辦網”的新思路:通過開放創作工具、共享選題資源、搭建協作平台,聯動各行業專業領域的“超級個體”,打造更加多元、鮮活、貼近生活的內容供給生態。
四、從“翻譯搬運”到“原生適配”,AI重塑短劇出海路徑
“內容出海”是本屆WAIC短視頻和AI影視議題中的一個高頻詞。萬興劇廠在大會上展示了多項出海升級功能,包括雙語內容拆解、海外題材與藝術風格適配,以及中文劇本多國本土化轉繪;Virbo AI則把跨境營銷視頻製作簡化為“一張商品圖+一句話+一條參考視頻”,並支持多語言內容生成。
7月20日舉行的大會AI影視專場上,萬興科技推出“萬劇出海創投計劃”,擬投入數億元資金與資源,目標投資孵化萬部以上AI影視作品;同時聯合生數科技等産業夥伴發起“萬劇出海共創聯盟”,計劃打通技術研發、內容創作、全球發行和商業運營全産業鏈。由此來看,短劇出海賽道的競爭已不只是多語種生成工具之爭,而是開始延伸到算力配套、項目孵化、全球發行和商業變現等全鏈路環節。

AI技術的介入,正在降低配音、字幕、口型匹配、版本改編和視覺轉繪等跨語言生産成本。但內容出海絕非簡單的“翻譯+換臉”。不同國家和地區的受眾,在敘事節奏、人物關係、價值取向、審美偏好、內容監管和商業規範上存在很大差異,真正的本土化創作,需要從劇本策劃階段就貼合當地用戶需求,而不是等成片後再簡單替換語言版本。
這意味着,中國短劇和短視頻的全球傳播正在從“國內內容的海外版本”,進入“面向不同市場的原生創作+本土化適配”的新階段。AI解決的是生産效率,創作者負責的是文化理解;技術打開航道,故事、人物和情感共鳴,這樣才能決定內容能夠走多遠、走多久。
從長遠産業視角來看,短視頻、微短劇、AI漫劇自身的輕量化、類型化、易傳播特性,使其成為國際傳播的全新載體。但講好中國故事不能僅在海外熱門劇情模板中堆砌表層中國文化符號,而是要挖掘不同文化受眾均可共情的情感切入點,依託普通人日常生活、人物命運變遷、時代發展脈絡建立真實、細膩的情感連接。
五、從“播給你看”到“和你共創”,短視頻與直播邊界進一步消融
7月18日,虎牙在大會論壇首發實時多模態數字人VAM 1.0。據介紹,該模型可由一張靜態照片生成能夠實時説話、聆聽和反應的虛擬人,並支持彈幕、語音驅動以及唱跳、換裝等互動場景。與預先生成一段數字人視頻不同,它強調每一幀都是在線生成,以及對用戶行為的即時反饋。

這預示着AI視頻正在由固定成片走向可交互的“動態活內容”。一條彈幕可以觸發角色迅速反應,一次提問可以改變講解路徑,一個用戶選擇可以推動互動短劇進入不同情節。短視頻、直播、游戲和數字人服務之間的邊界將進一步模糊,內容也從創作者單向交付的“作品”,轉變為創作者、智慧體和用戶共同參與的“過程”。
在這一過程中,“用戶看了什麼”可能逐步變成“用戶參與生成了什麼”。知識類數字人可以根據提問調整講解內容,虛擬主播可以針對不同用戶進行回應,互動短劇也可以根據選擇生成不同劇情。這為新聞問答、文化導覽、在線教育、娛樂直播和品牌服務打開了新的想象空間。
不過,實時在線不等於持續有價值。數字人越逼真,越需要清晰的人設、可信的知識庫、經過授權的形象與聲音素材,以及有節制的合理的互動設計。沒有內容積累與價值篩選,24小時運轉也只會帶來重復或無效的內容輸出。
六、從效率競賽到可信發展,技術越強越要守住內容底線
隨着視頻生成、數字人復刻和批量投放門檻不斷降低,AI視頻行業面臨的風險也從版權爭議,擴展到虛假影像、聲音倣冒、身份冒用、商業誤導和低質內容氾濫。如何讓AI內容可識別、可核驗、可追溯,正成為行業發展的重要命題。

在2026世界人工智慧大會上,合合信息展示了AI跨模態鑒偽技術,通過分析視頻時序、運動規律和單幀畫面特徵,識別AI生成或編輯內容;“掃描全能王AI鑒偽小程序”則將相關能力延伸至短視頻分享、電商交易和社交場景。同期亮相的“Trust Hub”可信內容樞紐以及大會上發佈的《浦江宣言》,均圍繞可信信息傳播、AI內容版權保護和行業協同治理展開深度探索。
這些案例表明,短視頻治理正在從發佈後的人工審核,轉向覆蓋素材授權、內容生成、傳播檢測和爭議追溯的全流程治理。未來,評價AI視頻工具,不能只看生成速度、畫面質量和成本,還要看內容能否清晰標識、過程是否留痕、侵權與虛假信息能否及時被識別。
技術持續擴大産能的同時,行業配套的辨偽、溯源和治理能力也必須同步跟進。短視頻行業的下一輪核心競爭,將不只是效率競爭,很可能表現在可信內容管控能力競爭層面。
結語:技術降低門檻,不能降低標準
縱觀本屆WAIC展出的各類AI短視頻産品,行業正在完成全産業鏈體系重構,變革覆蓋生産流程、敘事能力、創作者生態、跨境傳播、交互形態、可信治理六大維度。

這場變化正在重塑創作者、內容機構、平台、技術企業和品牌商家的協作關係。AI降低了專業生産的成本,也放大了規模化創作、商業轉化和內容出海的可能。但工具越普及,對創意、審美、用戶洞察、版權意識和文化理解越顯稀缺。
未來真正具有競爭力的,不是最會批量生成內容的一方,而是能夠把模型能力變成穩定工作流,把OPC的輕量化變成專業完成度,把流量觸達變成用戶信任,把全球化生産變成跨文化共情的一方。技術降低的是操作門檻,不能降低內容標準;AI擴展的是産業空間,最終決定行業走向的,仍是人的原創能力、專業判斷與社會責任。
撰稿:柳春陽 清博AI元宇宙研究室主任
正在閱讀:從“一鍵成片”到“一人劇組” ——從2026世界人工智慧大會看短視頻發展的新趨勢