发布时间:2024-03-18
点击次数: 编辑 | 言征
出品 | 51CTO技术栈(微信号:blog51cto)
3月15日,腾讯混元和清华大学、香港科技大学联合推出全新图生视频模型“Follow-Your-Click“,基于输入模型的图片,只需点击对应区域,加上少量提示词,就可以让图片中原本静态的区域动起来,一键转换成视频。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜
当前的图生视频大模型中,一般的生成方法不仅需要用户在提示词中描述运动区域,还需要提供运动指令的详细描述,过程较为复杂。另外,从生成的效果来看,现有图像生成视频技术在移动图像的指定部分上缺乏控制,生成的视频往往需要移动整个场景,而不是图像上的某一个区域,精准度和灵活性上有所欠缺。
为了解决这些问题,腾讯混元大模型团队、清华和港科大的联合项目组提出了更实用和可控的图像到视频生成模型Follow-Your-Click,带来更加便捷的交互,也让图片“一键点,万物动”成为现实。

图像到视频生成的技术在电影内容制作、增强现实、游戏制作以及广告等多个行业的AIGC应用上有着广泛前景,是2025年最热门的AI技术之一。
据了解,本联合项目组中的腾讯混元大模型团队,正在持续研究和探索多模态技术,拥有行业领先的视频生成能力。此前,腾讯混元大模型作为技术合作伙伴,支持《人民日报》打造原创视频《江山如此多娇》,生成中国大美河山的精
美视频片段,展示出了较强的内容理解、逻辑推理和画面生成能力。
论文链接:https://arxiv.org/abs/2403.08268
Github:https://follow-your-click.github.io/
以上就是一键点、万物动! 腾讯混元联合清华、港科大推出图生视频大模型“Follow Your Click”的详细内容,更多请关注其它相关文章!
# 开源
# 机械网站推广公司有哪些
# 富阳律师网站推广
# 虎林律师网站推广
# 大邑网站优化推广
# 巢湖营销推广选哪家好
# 开封外贸网站海外推广
# 杭州白帽seo技术
# 高碑店网站包年推广电话
# 设备网站建设价格标准
# 医疗seo怎么做
# 人民日报
# 模型
# 中国
# 上海
# 丰田
# 中国科学院
# 科大
# 一键
# follow
# 腾讯混元
# 清华
# 腾讯
相关栏目:
【
行业新闻62819 】
【
科技资讯67470 】
相关推荐:
成都大运会闭幕式引入人形机器人展示表演
特斯拉机器人面世 未来将大幅提振磁材需求,引领人工智能时代
海南省公安机关警用无人机培训班结业并举行警航比武演练
再也不怕「视频会议」尬住了!谷歌CHI顶会发布新神器Visual Captions:让图片做你的字幕助手
陈根教授:离人形机器人时代还有10年吗?
严打“黑飞”,无人机检测反制设备护航大运会净空安全
张朝阳与陆川谈AI:ChatGPT是鹦鹉学舌思维,不可能取代人类 | 把脉AI大模型
遵义市首次引入手术机器人,成功实施全膝关节置换术
航拍无人机怎么选?大疆无人机盘点推荐
意大利警察拟用AI预测犯罪 该算法被指种族歧视严重
国产工业机器人领域“暗潮涌动”,即将迎来新一轮复苏
智能电网技术:提高能源效率和可靠性
马斯克回应“人工智能让一切变得更好”:我们已经是半机器人了
华为盘古AI模型实现秒级全球气象预报时间缩短
国内阅读行业首款对话式AI应用“阅爱聊”封闭内测
AI数字人业务频频获点赞,谦寻积极引领示范作用
谷歌在人工智能领域没有“护城河”?
马斯克发推讽刺人工智能,机器学习本质是统计?
华为余承东表示:鸿蒙可能拥有强大的人工智能大模型能力
CharacterAI - 也许会成为会话人工智能的未来
联想创投携手12家被投企业MWC展示元宇宙、机器人等技术
组建团队,字节跳动要造机器人?
腾讯企点客服接待与营销分析能力升级!企业操作更高效、人机交互更智能
消息称 Meta Quest 将推 VR 游戏订阅:每月 7.99 美元,任选两款
机智云AI离线语音识别模组,让家电变得更加智能便捷
OpenAI 为开发者推出 GPT 聊天机器人 API 大更新,同时降低价格
东软成立魔形科技研究院,积极布局大语言模型系统工程战略,迎接AI时代
此「错」并非真的错:从四篇经典论文入手,理解Transformer架构图「错」在何处
《上古卷轴5》AI高清材质包优化游戏中所有怪物
Snap宣布研发出新技术 可大幅提升AI生成图像速度
轻量级的深度学习框架Tinygrad
尼康尼克尔 Z 180-600mm f/5.6-6.3 VR 镜头发布,12499 元
社区里,孩子们体验“机器人竞技”
世界人工智能大会(WAIC 2025)点燃魔都,博尔捷数字科技携前沿技术产品亮相
《自然》杂志拒绝刊登人工智能生成的图片和视频
彭博社:苹果Vision Pro曾测试VR手柄追踪方案
田渊栋新作:打开1层Transformer黑盒,注意力机制没那么神秘
网易加速行业AI大模型应用,将覆盖100多个应用场景
2025VR&AR显示技术峰会视频解析: 歌尔光学展示最新一代VR/AR光学模组
华为发布两款AI存储新品
图灵奖得主Hinton:我已经老了,如何控制比人类更聪明的AI交给你们了
“世界上最像人的机器人”接入 Stable Diffusion ,现场完成作画
AI无法对传统文化符号进行解构和创新
有远见!华为四年前注册商标Vision Pro:苹果AR国内要改名
世界人工智能大会高合发表演讲,HiPhi Y即将全球上市
OpenOOD更新v1.5:全面、精确的分布外检测代码库及测试平台,支持在线排行榜、一键测试
鹅厂机器狗抢起真狗「饭碗」!会撒欢儿做游戏,遛人也贼6
朱民:普通人炒股炒不过机器人是很正常的 AI已经能理解市场情绪
7大探索区域打造沉浸式玩乐“元宇宙” 昆明京东MALL未来科技探索官全城招募中
陈根:ChatGPT和人类合作开发机器人