当前标签:扩散模型

谷歌开源26B文本扩散MoE,劈柴:生成速度像赛马一样快

谷歌开源26B文本扩散MoE,劈柴:生成速度像赛马一样快

谷歌开源26B参数文本扩散MoE模型DiffusionGemma,推理速度最高提升4倍,采用Apache 2.0许可,专为本地低延迟场景设计。

英伟达发布 PiD 图像生成技术:13GB 显存跑通,最快 210ms 生成 2048×2048 图像

英伟达发布 PiD 图像生成技术:13GB 显存跑通,最快 210ms 生成 2048×2048 图像

13GB显存即可在RTX 5090上1秒内将512×512潜变量解码为2048×2048像素图像,速度较级联超分基线快近6倍,PiD技术重新定义了扩散模型的解码环节。

GPT Image 2

GPT Image 2

GPT Image 2是一款专业级AI图像生成与编辑平台,提供工作室品质的文本到图像创作工具。

Fashion Diffusion AI

Fashion Diffusion AI

Fashion Diffusion AI 是一站式AI时装设计与虚拟试穿平台。

Seedance 2 Cloud

Seedance 2 Cloud

Seedance 2 Cloud 是一款专注生成电影级短视频的AI视频生成工具,支持真实人脸和多模态控制。

Show-1

Show-1

文本生成视频平台Show-1结合像素与潜在扩散模型,提供高效且高质量的文本到视频转换服务。

Masked Diffusion Transformer (MDT)

Masked Diffusion Transformer (MDT)

图像合成领域最新突破技术,ICCV 2023 SOTA成果。

StoryDiffusion

StoryDiffusion

一个由南开大学HVision团队打造的AI图像视频故事生成工具。

Zero123

Zero123

Zero123 是一款基于单张图像生成3D一致多视图图像的扩散模型,专注于高质量三维图像生成任务。

Z-Image

Z-Image

Z-Image是一款基于单流扩散Transformer架构的高效免费AI图像生成模型,提供高质量、快速的图像创作体验。

Z-Image

Z-Image

Z-Image 是一款基于大型Transformer架构的图像生成工具,支持快速推理和高质量图像输出。

Gempix 2

Gempix 2

Gempix 2是一个基于扩散AI技术的图像生成与编辑平台,提供文本生成图像和智能编辑服务。

Seedance 2.0

Seedance 2.0

Seedance 2.0 是一个基于扩散模型的 AI 视频生成与增强平台,提供电影级视频内容创作服务。

Video Diffusion 开心版els

Video Diffusion 开心版els

扩散模型视频生成技术,利用创新梯度条件与自回归扩展生成高连贯性视频样本。

Stable Audio

Stable Audio

Stable Audio 是一款由 Stability AI 推出的免费 AI 音乐生成工具,专注于通过文本提示创建短小精悍的音频片段,特别适合制作背景音乐、音效和乐器独奏。

Harmonai

Harmonai

Harmonai 是一个社区驱动的开源项目,致力于发布生成式音频工具,让音乐创作变得轻松有趣。

Riffusion

Riffusion

Riffusion是一个利用人工智能从文本描述实时生成音乐的创新工具。

Sora

Sora

Sora是OpenAI开发的先进AI视频生成模型,能够根据文本指令创作高质量、高保真度的视频,开创了文本到视频生成的新纪元。

Imagen【推荐试用】

Imagen【推荐试用】

Imagen是Google推出的文本到图像生成模型,以其出色的写实效果和深刻的语言理解能力著称。