对话AI Agent 直达视频名场面:当虹科技在WAIC重塑人与视频交互新方式
“我想看哪吒、敖丙共渡天劫的片段。”体验者话音刚落,眼前的屏幕画面,便开始乌云翻涌,毁灭性的雷霆如巨龙咆哮,直击陈塘关。
这一幕,发生在7月17日开幕的2026世界人工智能大会(WAIC)现场。当虹科技的视频AI Agent交互展项前,不少观众排队体验这一全新的视频交互方式。
与传统的视频搜索不同,体验者无需输入片名或关键词,也不用反复拖动进度条。哪怕只记得一个演员、一句台词,或某个经典画面,只要观众用自然语言描述出来,视频AI Agent便能迅速理解用户意图,准确定位到对应视频片段及具体时间点。
例如,“我想看《狂飙》最后一集”“帮我找张艺谋的最新电影”等指令,都能快速响应。观看过程中,用户还可以围绕画面内容随时提问,真正实现“边看边聊”。
“与以文本为主的语言模型相比,这项技术的难点在于,视频包含的信息更加复杂。”当虹科技工作人员介绍,除了画面本身,视频还包含人物、场景、动作、音乐、字幕等丰富的多模态信息。如何让AI真正理解这些内容,并准确定位用户想要的片段,是视频AI交互最核心的挑战。
为此,当虹科技展示的视频AI Agent融合了多维内容理解与多轮语义交互能力,能够深度解析人物、场景、事件及其上下文关系,将传统的“用文本搜索视频”升级为“直接和视频对话”。同时,依托当虹科技在视听传媒领域的多年沉淀,与内容生产平台建立了丰富的生态合作,模型能够持续优化理解与检索能力,为更加精准、自然的视频交互提供支撑。
“我们的视频AI Agent看似是改变了视频搜索的方式,实际上改变的是人与视频之间的交互逻辑。”当虹科技工作人员表示。
长期以来,视频更多是一种被动播放的内容载体,用户只能依赖关键词搜索、菜单选择或手动定位来获取想要的内容。而随着多模态大模型的发展,视频正从扁平的内容载体演变为可理解、可检索、可调用的信息空间。
借助视频AI Agent,视频中的人物、场景、事件等内容都成为了可理解、可检索的信息单元,用户面对的不再只是播放器,而是一个能够理解内容、持续对话的智能交互入口,从而实现与视频内容更深度的互动。
不少观众体验后表示:“太方便了,非常适合我这种总记不住片名、却记得剧情的人。”“以后不知道看什么的时候,直接让Agent根据我的心情推荐就行了。”相比过去依赖关键词搜索、反复拖动进度条寻找片段,如今一句话就能找到想看的内容,这种交互方式更加自然,也更符合日常使用习惯。
据了解,目前当虹科技已将该视频AI Agent引入智能座舱,让车主在车内通过语音即可获取想要的视频片段,充分利用停车、驻车等碎片化时间享受娱乐体验。
《对话AI Agent 直达视频名场面:当虹科技在WAIC重塑人与视频交互新方式》转载自互联网,如有侵权,联系我们删除,QQ:369-8522。
相关图文
-
男子旅游为省5千机票钱花3千买八手面包车:结果车坏半路拖车8千 巨亏2万4
快科技7月19日消息,近日湖北宜昌一网友发布的“省钱旅游”视频引起热议。据悉,这位网友为省下约5000元机票钱,花3000元买了一辆八手的面包车,打算带着一家人自驾从内蒙古回宜昌,... -
中国大模型首次登顶!Kimi K3拿下全球代码榜第一:或引发资本市场重新洗牌
快科技7月19日消息,日前,中国AI企业月之暗面正式发布新一代大模型Kimi K3,参数规模达到2.8万亿,是目前全球参数最大的开源模型。据央视财经报道,Kimi K3发布后仅数小时,便登顶业内备受关... -
我宣布 打工人终于等到了自己的天选AI
都 2026 年了,大家多多少少都用过点 AI 来应付手头的工作了吧。 我就问一个问题,你让 AI 做出来的 PPT,真敢原封不动发给老板吗?不出意外,基本没人心这么大。因为大多数 AI 生... -
美国人开始反思:美国为何留不住Kimi创始人杨植麟这种AI人才
快科技7月19日消息,这几天Kimi K3的热度不减,开源大模型的能力不仅追上了美国最顶级的AI,甚至还有超出的地方,美国的AI叙事天塌了。在众多讨论中,也有美国人开始反思了,Kimi创始人杨植麟... -
中国机器人头掉了还能坚持格斗!马斯克深夜转发称:看乐了
快科技7月19日消息,近日,众擎URKL全球首场机器人格斗赛·揭幕之夜在深圳开幕。原本仅出现在影视作品里的机甲对战走进了现实,32支全球顶尖战队携重型机甲上演硬核比武对决。擂台之上...








