探索我们的 AI 模型合集
擅长创作绘画或漫画风格插画的风格化扩散模型。
顶级的照片级真实感和业界领先的清晰文本渲染。
专注于简洁写实风格和排版设计的尖端 Flux 构建版本。
可靠的写实模型,具有强大的内置文本支持。
第二代开发版本,具有更快的默认设置和可调节的分辨率,适用于迭代工作。
升级版 Flux Pro,拥有更高的默认分辨率、多图像支持以及更强的安全控制。
Black Forest Labs 最高保真度的 FLUX.2 模型,具有更强的提示词遵循能力、编辑一致性以及对多张参考图像的支持。
最先进的文本驱动图像编辑功能,能够精准遵循提示词,并生成效果一致的图像。
高保真通用模型,可快速生成清晰、自然的图像。
高级套餐,可最大程度遵循提示词并呈现照片级清晰度。
快速、低成本的生成器,具备协作式提示词优化工作流。
专为设计而生,擅长处理精确文本和清晰细节。
矢量输出模式,可无限缩放徽标和图标。
用于复杂、迭代式图像创作与编辑的多模态 Transformer。
OpenAI 的最先进图像模型,可实现高保真生成、精确编辑和强大的文本渲染。
双语模型,可生成整洁、高质量的图像和简短文本。
Seedream 多参考功能升级,支持更大的 4K 渲染和更高的提示词保真度。
Seedream 最新版本,相较于 Seedream 4,具有更强的编辑一致性、更出色的肖像和微小文本细节表现,以及更优的多图合成效果。
字节跳动旗舰图像模型,可输出 2K 超清画质,支持精准局部编辑,并可借助多达 10 张参考图,实现角色与风格的高度一致。
支持参考图的私人图像模型。生成内容不会公开,并于 24 小时后自动删除。
基于 Seedream 5 Pro 构建的高级私密图像模型,支持参考图。作品不会出现在公开动态中,并会在 24 小时后自动删除。
Seedream 已进行优化,以支持原生 4K 输出,同时保留了多图像参考功能。
支持参考图的轻量级图像编辑与生成。
最新的快速 Gemini 3.1 Flash 图像模型,支持 4K 输出、多图像 grounding 和扩展的纵横比。
Gemini 3 Pro 图像预览模型,具有更高的保真度并支持参考图像。
电影级文生视频,支持丝滑运镜和图片输入。
先进的视频模型,增加了多机位剪辑和生成式音频功能。
最新 Veo 版本,提升了保真度、动态效果和提示词控制能力。
1080p 多机位视频生成器,具有基准领先的真实感。
生成具有电影级动态质感和更强情感表现力的高保真音视频
具有更优运动、物理效果和首/末帧控制的多模态音视频生成。
字节跳动旗舰视频模型,支持原生音画同步,单次可生成长达 30 秒的视频片段,且指令遵循能力更强。
私密视频模型,支持起始/结束图像。作品不会出现在公开动态中,并会在 24 小时后失效。
经济实惠的电影感视频模型,可生成风格大胆、富有电影感的镜头。
通过文本提示或图像生成带有同步音频的电影级视频。
低成本、快速的 text-to-video,用于快速创意实验。