功能
撰写与编排
创作与设计
排期与发布
营销活动
分析与互动
团队与代理商
使用自有密钥
开源
集成
概览
渠道
大模型
媒体
存储
短链接
VPN
定价
文档
中文
English
Русский
中文
Français
Español
Português
Deutsch
Italiano
日本語
한국어
العربية
Türkçe
Tiếng Việt
登录
开始使用
媒体工作室
每种素材,都有对应的生成工作室。
图像、视频、音频与数字人生成 — 每个工作室都用你自己的提供商密钥、按其原价运行,就在你发帖所用的同一个媒体库里。
36 个个工作室 — 能力数据来自线上应用
Postmill — Settings · AI Media
图像
视频
音频
数字人
36 个工作室
Amazon Bedrock
Beta
AWS 面向生成式 AI 应用与智能体的全托管服务,提供各主流厂商的基础模型 —— 包括通过 Amazon Nova、Titan 和 Stability AI 进行图像生成。
图像
Azure OpenAI
Beta
微软 Azure 对 OpenAI 模型的托管访问,含 gpt-image 图像生成 —— 背后是 Azure 的企业级安全、区域化部署与合规控制。
图像
Black Forest Labs
FLUX 模型家族的缔造者 —— 一家前沿图像实验室,以顶尖的照片级真实感、精确的提示词控制,以及可用于生产的角色与风格一致性著称。
图像
D-ID
Beta
D-ID 的 Creative Reality Studio 可用一张图片生成照片级的说话人视频,并部署实时对话数字人 —— 把静态照片变成拟真的说话视频。
视频
数字人
Deepgram
语音 AI 平台 —— 快速、准确的语音转文字与字幕(同时支持文字转语音)。
音频
DeepInfra
Beta
对开发者友好的推理平台,通过简洁的 API 提供 100+ 个文本、图像、视频与语音模型 —— 在其自建的成本优化美国基础设施上按量付费。
图像
视频
音频
ElevenLabs
领先的 AI 音频平台,提供超写实文字转语音、声音克隆和覆盖 70+ 语言的多语种配音 —— 以最自然的 AI 人声著称。
音频
Fireworks AI
Beta
高性能推理平台,以开源级的成本提供前沿开放模型 —— 包括 FLUX 图像生成 —— 每日处理超过 30 万亿 token。
图像
Genviral
Beta
Genviral Studio AI 根据提示词生成短视频,并自动路由到顶尖视频模型(Sora、Seedance 等)。配置 Genviral 合作伙伴 API 密钥,即可直接生成到你的素材库。
视频
Google AI Studio
Beta
Google 用于媒体生成的 Gemini Developer API —— 涵盖 Nano Banana 与 Imagen 图像模型以及 Veo 视频,全部由一把 Gemini API 密钥驱动。
图像
视频
Google Vertex
Beta
Google Cloud 用于构建和扩展生成式应用的统一 AI 平台 —— 提供用于照片级图像的 Imagen 和高质量文生视频的 Veo,并内置治理能力。
图像
视频
Groq
Beta
Groq 在其自研 LPU 芯片上运行 AI 推理,追求极低延迟。语音方面提供 Whisper ASR 与 Orpheus/PlayAI TTS —— 实时转写与语音生成。
音频
Hedra
Beta
基于自研 Character-3 模型的多模态创作平台,可生成富有表现力的角色视频、图像与音频 —— 以从一个关键帧还原出栩栩如生的表演著称。
视频
数字人
HeyGen
推荐
AI 视频平台,可依据脚本生成逼真的数字人和「会说话的照片」视频。
视频
数字人
Higgsfield
Beta
AI 原生创作套件,可从文本或参考素材生成图像、视频与语音 —— Soul 负责图像,DoP 负责电影感的图生视频,Speak 负责说话视频。
图像
视频
Ideogram
Beta
以业界领先的图内文字渲染著称的 AI 图像生成器 —— 字形清晰、拼写正确,非常适合海报、广告与社交设计。
图像
Kling
Beta
快手推出的领先视频生成器,以长镜头、电影感以及出色的真实感与物理表现著称。新近模型可在一次生成中直接加入音频、旁白与音效。
图像
视频
音频
Leonardo.ai
Beta
由自研基础模型 Phoenix 驱动的创作平台 —— 以高分辨率输出、连贯的文字,以及能把草图瞬间变成精致成品的 Real-Time Canvas 著称。
图像
LTX Studio
Beta
Lightricks 的 LTX Studio 是端到端的 AI 视频制作平台。基于开源的 LTX-2 模型,带你从剧本到分镜再到成片。
视频
Luma
Luma AI 的 Dream Machine 能把文字和图像变成流畅逼真的视频。其 Ray 系列以自然的运动、扎实的物理表现和快速多产的创意迭代著称。
视频
MiniMax
MiniMax 的 AI 视频生成器 Hailuo,以出色的电影感运镜和对提示词的高度还原著称,可从文本或单张图片生成 —— 并附带舞蹈、特效与角色动画模板。
图像
视频
音频
OpenAI
OpenAI 通过 gpt-image-1 提供图像生成 —— 这是 ChatGPT 背后的原生多模态模型 —— 风格多样、世界知识扎实、文字准确,并支持按提示词编辑。
图像
视频
音频
OpenRouter
Beta
通过单一 OpenAI 兼容 API 统一接入 70+ 家厂商的 400+ 个模型 —— 其中包含覆盖 30+ 个模型的专用图像 API —— 并具备自动故障转移。
图像
Qwen
Beta
阿里巴巴的通义千问系列,经由 DashScope / 百炼提供服务 —— Qwen-Image 可从长提示词生成原生 2K 图像,Wan 则支持文生视频与图生视频。
图像
视频
Recraft
Beta
以设计为核心的 AI 图像平台,最为人知的是既能生成可编辑的矢量/SVG 图形,也能生成照片级图像,并支持无需训练、可复用的自定义品牌风格。
图像
Reel.Farm
Beta
Reel.Farm 把一条提示词变成成品的 TikTok 风格幻灯片视频 —— 幻灯片文案、排版和节奏都由它生成。专为批量、自动化的短内容而生。
视频
Replicate
推荐
通过一个 API 运行和微调开源的图像、视频与音频模型 —— 从 FLUX、Stable Diffusion 到视频超分与音乐生成器。
图像
视频
音频
数字人
Runway
开创性的生成式 AI 平台,其 Gen-4 系列可从文本和图像生成电影级的高保真视频 —— 以角色与场景的一致性和导演级运镜控制见长。
图像
视频
SiliconFlow
Beta
极速推理平台,通过单一 OpenAI 兼容 API 提供 200+ 个开放与商业模型 —— 涵盖大语言模型以及图像、视频和音频 —— 价格可预期。
图像
视频
音频
Stability AI
Stable Diffusion 与 Stable Image 系列模型背后的公司,提供开放、企业级的生成式媒体能力,用于图像创作与编辑,并保留完整的创作控制权。
图像
视频
音频
Suno
Beta
Suno 是领先的生成式 AI 音乐模型,能把一条提示词 —— 或你自己的歌词、风格与标题 —— 变成完整的、录音室水准的歌曲,可带人声也可纯器乐。本工作室使用 sunoapi.org 网关。
音频
Tavus
Beta
Tavus 打造面对面 AI 的基础模型 —— 实时视频分身与会看、会听、带情绪回应的对话式智能体,通过其 Phoenix 渲染与 CVI API 提供。
视频
数字人
Together AI
Beta
全栈推理云,通过一个 API 提供 200+ 个开源模型 —— 对话、图像、音频与视频 —— 并以优化内核在规模化场景下更快更省地生成。
图像
视频
音频
Vercel AI
Beta
Vercel AI Gateway 通过单一 API 把请求路由到众多厂商的数百个模型 —— 文本、图像与视频 —— 具备自动故障转移,且平台不加价。
图像
视频
Wan
Beta
阿里巴巴的 Wan 创作平台(百炼)以 Wan2.x 模型家族降低内容创作门槛 —— 涵盖文生视频、图生视频与文生图。
图像
视频
xAI Grok
xAI 打造了 Grok,这是马斯克旗下 xAI 的 AI 助手,具备对世界的实时认知。其图像模型(Aurora)可用与 Grok 对话模型相同的 API 密钥,直接生成照片级且忠于提示词的图像。
图像