AI工具

Veo – 谷歌推出的可生成1分钟1080P的视频模型

Veo是由Google DeepMind开发的一款视频生成模型,用户可以通过文本、图像或视频提示来指导其生成所需的视频内容,能够生成时长超过一分钟1080P分辨率的高质量...

混元DiT – 腾讯混元开源的文生图扩散模型Hunyuan-DiT

混元DiT(Hunyuan-DiT)是由腾讯混元团队开发的一款高性能的文本到图像的扩散Transformer模型,具备细粒度的中英文理解能力,能够根据文本提示生成多分辨率的...

GPT-4o – OpenAI最新发布的多模态AI大模型

GPT-4o是OpenAI最新推出的一款先进的人工智能模型,具备强大的多模态推理能力,能够处理语音、文本和视觉信息。该模型能够实时响应用户输入,并且在音频交互...

AniTalker – 上海交大开源的对口型说话视频生成框架

AniTalker是由来自上海交大X-LANCE实验室和思必驰AISpeech的研究人员推出的一个对口型说话视频生成框架,能够将单张静态人像和输入的音频转换成栩栩如生的动...

IC-Light – ControlNet作者开源的AI图片打光工具

IC-Light是一款由ControlNet作者张吕敏开发的AI图像打光处理工具,可以对图片进行光源操纵和光影重构,实现与不同背景的完美融合。用户只需上传图片,选择光...

PuLID – 字节跳动开源的个性化文本到图像生成框架

PuLID是字节跳动的团队开源的一种个性化文本到图像生成技术,通过对比对齐和快速采样方法,实现了无需调整模型的高效ID定制,轻松实现图像换脸效果。

Stable Artisan – Stability AI推出的Discord机器人服务,可生成图像和视频

Stable Artisan是Stability AI推出的一款基于Discord平台的机器人服务,利用其强大的AI技术和模型,如 Stable Diffusion 3 (SD3) 图像生成和 Stable Video Di...

15个免费的AI搜索引擎,无广告直达搜索结果

随着人工智能技术的发展,一些免费的AI搜索引擎应运而生,借助大模型和先进的算法为用户提供更加精准、高效的搜索结果。本文将介绍15个好用的AI搜索引擎,不...

Vidu – 生数科技发布的视频大模型,可生成16秒1080P的视频

Vidu是中国首个长时长、高一致性、高动态性的视频大模型,由生数科技与清华大学联合开发。该AI视频生成模型采用原创的U-ViT架构,结合Diffusion与Transformer...

VideoGigaGAN – Adobe推出的AI视频分辨率提升模型

VideoGigaGAN是由Adobe和马里兰大学的研究人员提出的一种新型的生成式视频超分辨率(VSR)模型,最高可将视频分辨率提升8倍,将模糊的视频放大为具有丰富细节...
1 8 9 10 11 12 24