新京报客户端

好新闻 无止境

立即打开
可灵AI进入2.0时代 快手带来“多模态视觉语言”
新京报 记者 罗亦丹 编辑 陈莉
2025-04-15 17:01

新京报贝壳财经讯(记者罗亦丹)“相信我,这是你能用到的最强大的视觉生成模型。”4月15日,快手高级副总裁、社区科学线负责人盖坤在可灵2.0模型发布会上说。


这是在可灵1.0发布10个月后,快手方面对可灵全系模型的一次重要升级,包括文生图视频“可图大模型2.0”,以及视频生成大模型“可灵大模型2.0”。盖坤介绍,可灵2.0模型在动态质量、语义响应、画面美学等维度,保持全球领先;可图2.0模型在指令遵循、电影质感及艺术风格表现等方面显著提升。


贝壳财经记者注意到,可灵2.0还上线了一种可以将文字、图片、短视频甚至MMW等不同格式文件结合起来一起编辑的新交互模式“MVL(Multi-modal Visual Language直译为多模态视觉语言)”。


据了解,当前视频生成主要分文生视频和图生视频两种,快手副总裁、可灵AI负责人张迪就披露,85%的视频创作通过图生视频完成。有AI创作者告诉记者,当前业界主流的视频制作方式是首先通过文字生成图片,再通过图片生成视频。


而在盖坤的演示中,通过MVL方式,用户能够结合图像参考、视频片段等多模态信息,将脑海中的多维度复杂创意传达给AI,而不仅仅是文字的提示语句。如下图所示,用户使用AI生成视频时,在提示词中也可以夹带图片或视频。


快手高级副总裁、社区科学线负责人盖坤演示多模态交互方式。新京报贝壳财经记者罗亦丹/摄


“我们的理念是致力于研发很强大的基础模型,同时致力于定义一个人和AI更完备的沟通方式,而这背后,我们的愿景是让每个人都能用AI讲出好故事,希望这个愿望早日成真。”盖坤说。


编辑 陈莉 校对 柳宝庆

来阅读我的更多文章吧
罗亦丹
新京报记者
记者主页
相关推荐
商汤「日日新6.5」全新升级,让AI完成从“工具”到“人”的跃迁
企业资讯
看“技术如何改变生活”,世界人工智能大会8项“镇馆之宝”亮相
财经
WAIC:轻松健康集团轻松健康AI赋能医疗健康,树立数字健康新标杆
企业资讯
视频翻译全新升级:33门语种开启“零时差”出海
企业资讯
金山办公发布原生Office智能体WPS灵犀,以AI智能体引领中国办公迈入助理时代
企业资讯
AI大模型、具身智能机器人…黄奇帆李萌王鹤等论道“智能”未来
科技
快手上线AI单元剧,AIGC内容如何商业化落地
科技
2025上海书展,有哪些新书和活动值得回顾?
文化
银河通用王鹤最新演讲:要善于运用合成数据,加速推动人形机器人新质生产力的大规模应用
科技
气象因“预见”而不同:墨迹天气焕新升级,定义“预见型气象服务”标准
企业资讯

新京报报料邮箱:67106710@bjnews.com.cn