来源:AICG工具箱 责编:网络 时间:2025-05-16 14:22:04
9月7日报道丨小编从阿里旗下的摩搭社区了解到,阿里巴巴达摩院新晋上线推出了一款全新视频生成大模型I2VGen-XL,并在魔搭社区开放体验。用户上传一张图片后2分钟左右即可生成一段1280x720的高分辨率视频,该模型研发负责人表示,未来将进一步实现2K超清效果,可应用于短视频内容生产、电影制作等场景。
和当前比较火爆的AI绘画创作大模型不同,视频生成大模型的技术门槛更高,其需要克服文本和视频内容匹配度、视频画面质量、画面连续性等诸多技术挑战。
针对该问题,阿里云进一步提出创新思路,I2VGen-XL模型设计了两个阶段,首先在低分辨率条件下保证生成结果和给定图像语义的匹配度,随后通过视频扩散模型(VLDM)来提高视频分辨率,并同时提升时间和空间上的一致性,保证最终视频内容的清晰度和连贯性,最终实现1280x720高分辨率的突破,并且在画面细节的展现上大幅领先现有模型。
据介绍,该模型的训练还使用了多种不同风格的视频类型数据,因此可生成科技感、电影色、卡通风格和素描等不同风格的丰富视频。
目前,I2VGen-XL的模型和代码均已开源,国内外社交媒体显示,该模型已吸引国内外用户和开发者的广泛体验和二次开发,涌现了大量创意AI视频生成内容,例如在城堡上展翅的恐龙、宇航员在飞船中行走的科幻电影画面等等。
感兴趣的朋友,不妨到阿里摩搭社区体验一番。模型体验地址链接直达:https://modelscope.cn/models/damo/Image-to-Video/summary
3月28日,2024黑马AI培训战略发布会启动仪式上邀请了两位重量级嘉宾,以“老人”的姿态,为今天的创业者指点迷津。
春节将至年味渐浓,阿里云通义千问APP上线多项免费新应用,涵盖全家福、拜新年、万物成龙等图像生成的新玩法。
【AI奇点网2024年8月27日早报】本站每日播报AI业界最新资讯,触摸时代脉搏,掌握未来科技动向。事不宜迟,点击查看今日AI资讯早餐。
1月17日,上海人工智能实验室发布的新一代大语言模型“书⽣·浦语”2 0(InternLM2)正式发布并开源。共计6个模型,全部免费可商用。
iPhone 16新品将在9月10日发布丨云知声推出「山海」多模态模型丨商汤科技推出「元萝卜」国际象棋AI下棋机器人
pika使用技巧_pika十大技巧怎么用
PikaAI怎么用_PIkaAI怎样生成视频_AI视频生成器Pika怎么用_AI视频生成工具Pika教程
ControlNet是什么_ ControlNet 有什么用
使用 ChatGPT编程的常见示例
华军软件园发布9月AI产品榜丨零一万物发布新版大模型Yi-Lightning丨李开复:中美顶尖大模型性能差距只有五个月
2024诺贝尔化学奖授予谷歌DeepMind CEO丨联发科发布天玑9400旗舰AI芯片丨Sora负责人被谷歌挖墙脚
ChatGPT计划在年底将订阅费涨到22美元/月丨Llama 3.2发布:手机端侧可运行丨百度世界大会将于11月12日举行
阿里通义Qwen2、GPT-4o等大厂模型开展2024高考全科测评:来看看“AI状元”花落谁家?
ChatGPT Edu教育版详解:支持最新GPT-4o、自定义GPTs、数据分析等,欧美高校抢先体验