2026年QCon全球软件开发大会上海站定在10月22日到24日,主题围绕AI时代的工程实践。生数科技解决方案负责人郑重会在“AIGC内容工业化”专题上做演讲,重点拆解Vidu多模态大模型怎么把AIGC视频内容的生产力往上拉,同时也会聊视频生成目前卡在哪、下一步怎么走。
一场聚焦AI时代工程实践的技术大会
2026年的QCon上海站,跟往年不太一样。AI发展到这一步,单点模型再强,落不了地、形成不了稳定流程,价值就有限。这一届把主题定为“AI时代的工程实践”,其实就是想正面回应这件事。
大会设置了20个专题论坛,请了超过100位专家来讲,方向包括循环工程、智能体创新实践、Agent自主进化、AI原生架构等。AI Native架构、Agent Runtime、AI Infra、数据系统、安全与可观测这些议题也会散落在多个论坛里。对开发者来说,这里不光是了解趋势,更重要的是听一线团队讲他们踩过的坑、总结出来的办法。
Vidu大模型的“内容工业化”宣言
生数科技的解决方案负责人郑重,会在“AIGC内容工业化”专题上开讲,主题是Vidu多模态大模型怎么驱动AIGC内容生产力变革。他在AI大模型领域待了16年,之前做过字节跳动和百度的相关高级管理岗,也给英特尔、可口可乐、耐克这类公司做过AI服务。技术和商业两头都熟,讲“工业化”这个话题,站得住脚。
视频生成模型的关键瓶颈在哪
视频生成要比文本和图片难不少,行业里公认的难点主要集中在这些方向:
- 多主体一致性——多个对象在连续画面中保持身份和外观稳定
- 长时序稳定性——视频拉长后画面不崩坏、语义不漂移
- 动作控制——运动符合物理规律和用户意图
- 镜头语言——构图、景别、运镜具备叙事表达力
- 实时响应——生成速度从“等几分钟”压缩到“边编边出”
这些瓶颈卡住了AIGC视频的规模化应用。谁能先把它们啃下来,谁就握住了内容工业化的钥匙。
从参考驱动到流式交互,技术路线逐渐清晰
顺着这些瓶颈往下看,郑重会在演讲里给出几条技术路径。参考驱动生成解决的是“怎么让画面跟着设定走”,镜头与叙事控制解决的是“怎么把画面变成语言”,流式视频生成模型Vidu S1则把节奏从离线渲染带到了实时交互。
演讲大纲分六块:关键挑战拆解、一致性从随机生成到参考驱动、可控性从画面到镜头叙事、实时性从离线到流式交互、从世界生成到世界行动,以及视频AIGC整体技术演进路径。连起来看,就是一张视频生成从被动到主动、从生成到理解的地图。
下一站:世界模型与具身智能
视频生成模型的天花板,可能不在“视频”本身。当模型能够持续生成稳定、可信的动态画面,它就一步步接近物理世界的模拟器——这也就是世界模型。世界模型再跟具身智能结合起来,AI就不只是在屏幕里生成世界,还可能到真实世界里行动。郑重会在演讲里展开讲这个远期方向,关注AGI趋势的开发者应该会感兴趣。
算力与云资源:AIGC落地绕不开的现实
技术方案再漂亮,落地还是得跟算力较劲。视频AIGC尤其费资源,训练和推理都离不开GPU集群。中小团队自建机房不现实,上云更务实。不少AI团队会通过易枫顺 - 阿里云官方旗舰级代理商拿云服务器ECS资源,性能和预算两头兼顾,上云门槛也低一些。再碰巧赶上阿里云优惠活动,领一张阿里云代金券,探索AIGC前沿模型前期的投入又能省一块。
FAQ
Q: 2026年QCon上海站的具体时间和地点是什么?
A: 定在2026年10月22日至24日,地点是上海。具体场馆和参会方式可以留意QCon官方渠道,一般来说提前两个月左右开放报名。
Q: Vidu大模型和普通视频生成工具有什么区别?
A: Vidu是生数科技的多模态大模型,支持参考驱动生成、镜头级叙事控制,还有Vidu S1的流式实时交互。跟“输入文字等出片”的传统模式比,Vidu更像是能边聊边改的创作伙伴,同时也在世界模型和具身智能上做了布局。
Q: 这次演讲对非AI从业者有什么参考价值?
A: 视频AIGC正在影响影视、广告、游戏、电商、教育这些行业的内容生产方式。就算不做底层模型开发,产品经理、内容运营、创业者也能从演讲里判断技术走到哪一步了,想想自己的业务在什么节点接生成式视频最合适。
Q: 个人开发者尝试视频AIGC,算力成本高吗?
A: 确实不低,不过合理用云计算能压住成本。个人开发者一般从云服务器ECS或按量付费GPU实例起步,配合阿里云优惠活动或代金券,前期试错的压力能小不少。
关于易枫顺
深圳市易枫顺网络科技有限公司是阿里云官方旗舰级代理商。提供云服务器ECS、云数据库RDS、对象存储OSS等阿里云全系产品官方特惠折扣与代金券申请,以及多云成本优化、企业上云一站式服务。客服热线:19520841949 - 易枫顺
来源:InfoQ