400 128 6709

行业新闻

稳定AI发布稳定视频扩散模型,根据图像生成视频

发布时间:2023-11-22点击次数:

it之家 11 月 22 日消息,专注于开发人工智能(ai)产品的初创公司 stability ai 发布了其最新的 ai 模型 ——stable video diffusion。这款模型能够通过现有图片生成视频,是基于之前发布的 stable diffusion 文本转图片模型的延伸,也是目前为止市面上少有的能够生成视频的 ai 模型之一。

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜

稳定AI发布稳定视频扩散模型,根据图像生成视频

不过,这款模型目前并不是对所有人开放的。Stable Video Diffusion 目前处于 Stability AI 所谓的“研究预览”阶段。想要使用这款模型的人必须同意一些使用条款,其中规定了 Stable Video Diffusion 的预期应用场景(例如“教育或创意工具”、“设计和其他艺术过程”等)和非预期的场景(例如“对人或事件的事实或真实的表达”)。

稳定视频扩散实际上由两个模型组成——SVD和SVD-XT。SVD可以将静态图片转化为14帧的576×1024像素视频。SVD-XT采用相同的结构,但帧数提高到24。两者都能以每秒3到30帧的速度生成视频

根据 Stability AI 随 Stable Video Diffusion 一起发布的一篇白皮书,SVD 和 SVD-XT 最初是在一个包含数百万视频的数据集上进行训练的,然后在一个规模较小的数据集上进行了“微调”,这个数据集只有几十万到一百万左右的视频片段。这些视频的来源并不十分清楚,白皮书暗示许多是来自公开的研究数据集,所以无法判断是否有任何版权问题。

SVD和SVD-XT均能够生成高质量的四秒视频,从Stability AI博客上精心挑选的样本来看,其质量可以与Meta最新的视频生成模型、谷歌、AI初创公司Runway和Pika Labs的AI生成视频相媲美

魔术橡皮擦 魔术橡皮擦

智能擦除、填补背景内容

魔术橡皮擦 80 查看详情 魔术橡皮擦

稳定AI发布稳定视频扩散模型,根据图像生成视频

IT之家注意到,稳定视频扩散也有限制。Stability AI对此也非常坦诚,他们称这些模型不能生成没有运动或缓慢摄像机平移的视频,也不能通过文本进行控制,也不能渲染文字(至少不能清晰地渲染),也不能一致地“正确地”生|成人|脸和人物

尽管处于早期阶段,Stability AI指出这些模型具有很高的扩展性,可以适应生成物体的360度视图等各种用例

Stability AI 最终的目标似乎是将其商业化,称 Stable Video Diffusion 在“广告、教育、娱乐等领域”都有潜在的应用。

以上就是稳定AI发布稳定视频扩散模型,根据图像生成视频的详细内容,更多请关注其它相关文章!


# 都有  # 金昌蜂巢seo  # 龙江门窗网站建设  # 珠海网站优化哪家快  # 重庆江北区品牌网站建设  # 纸张推广的网站  # 网站建设主要营销内客  # 栅栏行业网站推广方式  # 跨境网站建设和推广方案  # 黄冈网站制作建设  # 正规seo推广企业排名  # 也有  # runway  # 是在  # 输入文字  # 的人  # 制作工具  # 如何用  # 也能  # 之家  # 这款  # stable diffusion  # pika  # stable video 


相关栏目: 【 行业新闻62819 】 【 科技资讯67470


相关推荐: 如布AI口袋学习机S12 将亮相综艺节目《好样的!国货》  陈根:AI冥想教练为用户提供个性化指导  郭帆谈ChatGPT:电影行业需要创新,否则人工智能将让电影变得平庸  苹果AR头显商标与华为撞车,在中国或改名  比尔盖茨:AI确实存在风险,但可控  开创全新虚拟现实体验的Pimax Crystal VR头显  将上下文长度扩展到256k,无限上下文版本的LongLLaMA来了?  WHEE安装教程  人工智能框架生态峰会即将召开,聚焦AI大模型技术与科学智能探索!  焊接协作机器人或将成为26届埃森展最大看点  大疆 DJI Mini 4 Pro 无人机曝光:流线设计,有望迎来功能性提升  国内阅读行业首款对话式AI应用“阅爱聊”封闭内测  找对了风口想不火都难,乐天派机器人,安卓机器人的最终形态?  构建人机交互创新模式,微美全息研究AIGC智能交互界面生成技术  推动综合能源服务高质量发展  乐天派桌面机器人加入小米米家生态系统,实现与其他智能设备的互联  华为HarmonyOS 4将集|成人|工智能大型模型  AIGC浪潮下,联想集团再加码计算与人工智能  AI大模型,将为智慧城市带来哪些新变化?  ​日媒:AI高效解析纳斯卡地画  人才智能平台转型中的人工智能的关键角色  鸿蒙智能座舱的AI大模型革新,引领智能座舱领域的变革吗?  AI大模型产品集体奔赴高考考场,教育赛道的讯飞星火能赢吗?  英媒:硅谷有些人太鼓吹AI,宣扬“学习无用”  Meta推出VR订阅服务Quest +:每月免费玩两款游戏,7.99美元/月  时隔 4 年:谷歌更新安卓机器人 LOGO,形象更立体  微软 Azure AI 文本转语音服务升级:新增男性声音和扩展语言支持  沐曦首款AI推理GPU亮相:INT8算力达160TOPS!  Intel酷睿Ultra发布会官宣!迈向全新的AI时代  DreamAvatar数字人使用教程  利用AI探索抗体“钥匙”、加速药物研发——访百图生科团队  2025VR&AR显示技术峰会视频解析: 歌尔光学展示最新一代VR/AR光学模组  Zoom远程会议应用:AI培训需经用户授权  构建AI绘画网站的方法:使用API接口和调用步骤  「社交达人」GPT-4!解读表情、揣测心理全都会  贫穷让我预训练  马斯克发推讽刺人工智能:机器学习的本质就是统计  掌阅科技入选北京市通用人工智能产业创新伙伴计划第二批成员名单  网易云音乐内测上线“私人DJ” 打造AI推荐音乐助手  好莱坞面临全面停摆 好莱坞大罢工抵制“AI入侵”  上海发布大模型政策 打造AI“模”都  世界上第一个完全由人工智能驱动的图像编辑器!  洞穴探险神器?可自主导航的单旋翼自旋无人机,效率更高!  参考封面|人工智能“淘金热”  PS AI修图免费平替来了!Stability AI又放大招,核弹级更新一键扩图  猿编程参加人工智能高峰论坛,推动人工智能教育解决方案在千所学校推行  你们的开机第一屏画面要变了!安卓机器人首次3D化  2025VR&AR显示技术峰会展示歌尔光学最新一代光学模组  中美陷入囚徒困境,人工智能变得不可控?可参考核不扩散条约规范  为什么很多人对纽约《人工智能招聘法》感到生气? 

400 128 6709
E-mail

contact@tlftec.cn

扫一扫,添加微信

©  云南淘乐房科技有限公司 版权所有  滇ICP备2025071560号  

云南淘乐房科技有限公司 云南淘乐房科技有限公司 云南淘乐房科技有限公司 云南淘乐房科技有限公司 云南淘乐房科技有限公司 云南淘乐房科技有限公司 云南淘乐房科技有限公司 云南淘乐房科技有限公司 云南淘乐房科技有限公司 云南淘乐房科技有限公司