媒体工作室

每种素材,都有对应的生成工作室。

图像、视频、音频与数字人生成 — 每个工作室都用你自己的提供商密钥、按其原价运行,就在你发帖所用的同一个媒体库里。

36 个个工作室 — 能力数据来自线上应用
Postmill — Settings · AI Media
Postmill AI 媒体提供商设置 — 图像、视频与音频工作室
36 个工作室
Amazon BedrockBeta
AWS 面向生成式 AI 应用与智能体的全托管服务,提供各主流厂商的基础模型 —— 包括通过 Amazon Nova、Titan 和 Stability AI 进行图像生成。
图像
Azure OpenAIBeta
微软 Azure 对 OpenAI 模型的托管访问,含 gpt-image 图像生成 —— 背后是 Azure 的企业级安全、区域化部署与合规控制。
图像
Black Forest Labs
FLUX 模型家族的缔造者 —— 一家前沿图像实验室,以顶尖的照片级真实感、精确的提示词控制,以及可用于生产的角色与风格一致性著称。
图像
D-IDBeta
D-ID 的 Creative Reality Studio 可用一张图片生成照片级的说话人视频,并部署实时对话数字人 —— 把静态照片变成拟真的说话视频。
视频数字人
Deepgram
语音 AI 平台 —— 快速、准确的语音转文字与字幕(同时支持文字转语音)。
音频
DeepInfraBeta
对开发者友好的推理平台,通过简洁的 API 提供 100+ 个文本、图像、视频与语音模型 —— 在其自建的成本优化美国基础设施上按量付费。
图像视频音频
ElevenLabs
领先的 AI 音频平台,提供超写实文字转语音、声音克隆和覆盖 70+ 语言的多语种配音 —— 以最自然的 AI 人声著称。
音频
Fireworks AIBeta
高性能推理平台,以开源级的成本提供前沿开放模型 —— 包括 FLUX 图像生成 —— 每日处理超过 30 万亿 token。
图像
GenviralBeta
Genviral Studio AI 根据提示词生成短视频,并自动路由到顶尖视频模型(Sora、Seedance 等)。配置 Genviral 合作伙伴 API 密钥,即可直接生成到你的素材库。
视频
Google AI StudioBeta
Google 用于媒体生成的 Gemini Developer API —— 涵盖 Nano Banana 与 Imagen 图像模型以及 Veo 视频,全部由一把 Gemini API 密钥驱动。
图像视频
Google VertexBeta
Google Cloud 用于构建和扩展生成式应用的统一 AI 平台 —— 提供用于照片级图像的 Imagen 和高质量文生视频的 Veo,并内置治理能力。
图像视频
GroqBeta
Groq 在其自研 LPU 芯片上运行 AI 推理,追求极低延迟。语音方面提供 Whisper ASR 与 Orpheus/PlayAI TTS —— 实时转写与语音生成。
音频
HedraBeta
基于自研 Character-3 模型的多模态创作平台,可生成富有表现力的角色视频、图像与音频 —— 以从一个关键帧还原出栩栩如生的表演著称。
视频数字人
HeyGen 推荐
AI 视频平台,可依据脚本生成逼真的数字人和「会说话的照片」视频。
视频数字人
HiggsfieldBeta
AI 原生创作套件,可从文本或参考素材生成图像、视频与语音 —— Soul 负责图像,DoP 负责电影感的图生视频,Speak 负责说话视频。
图像视频
IdeogramBeta
以业界领先的图内文字渲染著称的 AI 图像生成器 —— 字形清晰、拼写正确,非常适合海报、广告与社交设计。
图像
KlingBeta
快手推出的领先视频生成器,以长镜头、电影感以及出色的真实感与物理表现著称。新近模型可在一次生成中直接加入音频、旁白与音效。
图像视频音频
Leonardo.aiBeta
由自研基础模型 Phoenix 驱动的创作平台 —— 以高分辨率输出、连贯的文字,以及能把草图瞬间变成精致成品的 Real-Time Canvas 著称。
图像
LTX StudioBeta
Lightricks 的 LTX Studio 是端到端的 AI 视频制作平台。基于开源的 LTX-2 模型,带你从剧本到分镜再到成片。
视频
Luma
Luma AI 的 Dream Machine 能把文字和图像变成流畅逼真的视频。其 Ray 系列以自然的运动、扎实的物理表现和快速多产的创意迭代著称。
视频
MiniMax
MiniMax 的 AI 视频生成器 Hailuo,以出色的电影感运镜和对提示词的高度还原著称,可从文本或单张图片生成 —— 并附带舞蹈、特效与角色动画模板。
图像视频音频
OpenAI
OpenAI 通过 gpt-image-1 提供图像生成 —— 这是 ChatGPT 背后的原生多模态模型 —— 风格多样、世界知识扎实、文字准确,并支持按提示词编辑。
图像视频音频
OpenRouterBeta
通过单一 OpenAI 兼容 API 统一接入 70+ 家厂商的 400+ 个模型 —— 其中包含覆盖 30+ 个模型的专用图像 API —— 并具备自动故障转移。
图像
QwenBeta
阿里巴巴的通义千问系列,经由 DashScope / 百炼提供服务 —— Qwen-Image 可从长提示词生成原生 2K 图像,Wan 则支持文生视频与图生视频。
图像视频
RecraftBeta
以设计为核心的 AI 图像平台,最为人知的是既能生成可编辑的矢量/SVG 图形,也能生成照片级图像,并支持无需训练、可复用的自定义品牌风格。
图像
Reel.FarmBeta
Reel.Farm 把一条提示词变成成品的 TikTok 风格幻灯片视频 —— 幻灯片文案、排版和节奏都由它生成。专为批量、自动化的短内容而生。
视频
Replicate 推荐
通过一个 API 运行和微调开源的图像、视频与音频模型 —— 从 FLUX、Stable Diffusion 到视频超分与音乐生成器。
图像视频音频数字人
Runway
开创性的生成式 AI 平台,其 Gen-4 系列可从文本和图像生成电影级的高保真视频 —— 以角色与场景的一致性和导演级运镜控制见长。
图像视频
SiliconFlowBeta
极速推理平台,通过单一 OpenAI 兼容 API 提供 200+ 个开放与商业模型 —— 涵盖大语言模型以及图像、视频和音频 —— 价格可预期。
图像视频音频
Stability AI
Stable Diffusion 与 Stable Image 系列模型背后的公司,提供开放、企业级的生成式媒体能力,用于图像创作与编辑,并保留完整的创作控制权。
图像视频音频
SunoBeta
Suno 是领先的生成式 AI 音乐模型,能把一条提示词 —— 或你自己的歌词、风格与标题 —— 变成完整的、录音室水准的歌曲,可带人声也可纯器乐。本工作室使用 sunoapi.org 网关。
音频
TavusBeta
Tavus 打造面对面 AI 的基础模型 —— 实时视频分身与会看、会听、带情绪回应的对话式智能体,通过其 Phoenix 渲染与 CVI API 提供。
视频数字人
Together AIBeta
全栈推理云,通过一个 API 提供 200+ 个开源模型 —— 对话、图像、音频与视频 —— 并以优化内核在规模化场景下更快更省地生成。
图像视频音频
Vercel AIBeta
Vercel AI Gateway 通过单一 API 把请求路由到众多厂商的数百个模型 —— 文本、图像与视频 —— 具备自动故障转移,且平台不加价。
图像视频
WanBeta
阿里巴巴的 Wan 创作平台(百炼)以 Wan2.x 模型家族降低内容创作门槛 —— 涵盖文生视频、图生视频与文生图。
图像视频
xAI Grok
xAI 打造了 Grok,这是马斯克旗下 xAI 的 AI 助手,具备对世界的实时认知。其图像模型(Aurora)可用与 Grok 对话模型相同的 API 密钥,直接生成照片级且忠于提示词的图像。
图像