AI工具
Diffutoon – 阿里推出的AI将视频转卡通风格的框架
Diffutoon是由阿里巴巴和华东师大的研究人员推出的一个将视频转换为卡通动漫风格的AI框架,基于扩散模型的可编辑卡通着色技术,能够将真实感视频转换成动漫风...
琴乐大模型 – 腾讯推出的AI音乐创作大模型
琴乐大模型是由腾讯AI Lab与腾讯TME天琴实验室共同研发的人工智能音乐创作大模型,该模型通过输入中英文关键词、描述性语句或音频,能够直接生成立体声音频或...
Unique3D – 清华大学团队开源的图像到3D生成模型
Unique3D是由清华大学团队开源的一个单张图像到3D模型转换的框架,通过结合多视图扩散模型和法线扩散模型,以及一种高效的多级上采样策略,能够从单张图片中...
谷歌DeepMind推出V2A技术,可为无声视频添加逼真音效
谷歌旗下的DeepMind公司再次取得突破性进展,推出了一款名为V2A(Video-to-Audio,视频到音频)的AI模型。该项技术能够将视频像素与文本提示相结合,为无声视...
Gen-3 Alpha – Runway公司最新推出的AI视频生成模型
Gen-3 Alpha是由AI视频初创公司Runway最新发布的新一代AI视频生成模型,通过大规模多模态训练基础设施,显著提升了视频的保真度、一致性和动态表现。该模型能...
Hallo – 复旦百度等开源的AI对口型肖像视频生成框架
Hallo是由复旦大学、百度公司、苏黎世联邦理工学院和南京大学的研究人员共同提出的一个AI对口型肖像图像动画技术,可基于语音音频输入来驱动生成逼真且动态的...
阶跃星辰推出移动端AI智能问答助手跃问APP
人工智能初创公司阶跃星辰宣布上线其AI智能问答助手跃问的移动端APP,可在苹果App Store和各大安卓应用商店进行下载使用。跃问已支持拍照识图、语音输入,pdf...
MimicBrush – 阿里等开源的AI图像编辑融合框架
MimicBrush是由阿里巴巴、香港大学和蚂蚁集团的研究人员推出的AI图像编辑融合框架,允许用户通过简单的操作,在源图像上指定需要编辑的区域,并提供一个包含...
Stability AI开源Stable Diffusion 3 Medium文生图模型
人工智能初创公司Stability AI宣布正式开源发布其最新的文本到图像生成模型——Stable Diffusion 3 Medium(SD3 Medium)。Stable Diffusion 3 Medium 包含 20 ...
国家网信办发布第六批深度合成服务算法备案信息,腾讯混元等492个算法在列
6月12日消息,国家网信办今日发布公告,根据《互联网信息服务深度合成管理规定》,现公开发布第六批境内深度合成服务算法备案信息。AI工具集从《境内深度合成...