メディアスタジオ

どの素材にも、専用の生成スタジオを。

画像、動画、音声、アバターの生成。どのスタジオも自分のプロバイダーキーでその価格のまま動き、投稿に使うメディアライブラリの中で完結します。

36 スタジオ — 稼働中のアプリから取得した対応機能
Postmill — Settings · AI Media
PostmillのAIメディアプロバイダー設定 — 画像・動画・音声のスタジオ
36 スタジオ
Amazon BedrockBeta
生成AIアプリとエージェントのためのAWSのフルマネージドサービス。主要各社の基盤モデルを利用でき、Amazon Nova、Titan、Stability AIによる画像生成にも対応します。
画像
Azure OpenAIBeta
Microsoft Azureが提供するOpenAIモデルへのマネージドアクセス。gpt-imageによる画像生成を含み、Azureのエンタープライズ級セキュリティ、リージョン展開、コンプライアンス統制に支えられています。
画像
Black Forest Labs
FLUXモデルファミリーの開発元。最先端の写実性、精密なプロンプト制御、そして制作現場に耐えるキャラクターとスタイルの一貫性で知られる画像ラボです。
画像
D-IDBeta
D-IDのCreative Reality Studioは、1枚の画像から写実的なトーキングヘッド動画を作り、リアルタイムの会話アバターも展開します。静止画が人のように話す映像に変わります。
動画アバター
Deepgram
音声AIプラットフォーム。高速かつ高精度な音声認識と字幕生成に加え、音声合成にも対応します。
音声
DeepInfraBeta
開発者にやさしい推論ハブ。テキスト、画像、動画、音声にわたる100以上のモデルをシンプルなAPIで提供し、自社のコスト最適化された米国インフラ上で従量課金で利用できます。
画像動画音声
ElevenLabs
超写実的な音声合成、ボイスクローン、70以上の言語での多言語吹き替えを提供する主要AIオーディオプラットフォーム。現在最も自然に聞こえるAI音声として知られています。
音声
Fireworks AIBeta
高性能な推論プラットフォーム。FLUXの画像生成を含む最先端のオープンモデルをオープンソース水準のコストで提供し、1日あたり30兆トークン以上を処理しています。
画像
GenviralBeta
Genviral Studio AIは、プロンプトからショート動画を生成し、Sora、Seedanceなどの主要な動画モデルへ自動的に振り分けます。Genviralのパートナー用APIキーを設定すれば、メディアライブラリへ直接生成できます。
動画
Google AI StudioBeta
メディア生成のためのGoogleのGemini Developer API。画像モデルのNano BananaとImagen、動画のVeoまでを、1つのGemini APIキーで扱えます。
画像動画
Google VertexBeta
生成AIアプリの構築とスケールのためのGoogle Cloud統合AIプラットフォーム。写実的な画像のImagenと高品質なテキスト動画生成のVeoを備え、ガバナンス機能も組み込まれています。
画像動画
GroqBeta
Groqは超低レイテンシのために自社設計のLPUチップ上でAI推論を実行します。音声ではWhisper ASRとOrpheus/PlayAIのTTSを提供し、リアルタイムの文字起こしと音声生成に対応します。
音声
HedraBeta
自社モデルCharacter-3を基盤とするマルチモーダル制作プラットフォーム。表情豊かなキャラクター動画、画像、音声を生成し、1枚のキーフレームから生き生きとした演技を作り出すことで知られています。
動画アバター
HeyGen 注目
台本から、リアルなアバター動画や「話す写真」動画を生成するAI動画プラットフォーム。
動画アバター
HiggsfieldBeta
テキストやリファレンスから画像・動画・音声を生成するAIネイティブの制作スイート。画像はSoul、映画的な画像動画生成はDoP、トーキング動画はSpeakが担当します。
画像動画
IdeogramBeta
画像内の文字表現で業界随一と評されるAI画像生成ツール。くっきりと正しく綴られたタイポグラフィは、ポスター、広告、SNS向けデザインに最適です。
画像
KlingBeta
Kuaishouによる主要な動画生成モデル。長尺で映画的なクリップと、高い写実性・物理表現で知られます。最近のモデルは、ネイティブ音声・ナレーション・効果音を一度の生成で付加できます。
画像動画音声
Leonardo.aiBeta
自社の基盤モデルPhoenixを核とする制作プラットフォーム。高解像度な出力、破綻の少ない文字表現、そしてラフを即座に仕上がりへ変えるReal-Time Canvasで知られています。
画像
LTX StudioBeta
LightricksのLTX Studioは、エンドツーエンドのAI動画制作プラットフォームです。オープンソースのLTX-2モデルを基盤に、脚本からストーリーボード、完成動画までを一貫して支援します。
動画
Luma
Luma AIのDream Machineは、テキストと画像をリアルで滑らかな動画に変えます。Rayモデルは自然な動き、説得力ある物理表現、そして素早く数多く試せる制作サイクルで知られています。
動画
MiniMax
MiniMaxのAI動画生成ツールHailuoは、印象的な映画的モーションと、テキストや1枚の画像からの高いプロンプト再現性で知られています。ダンス、エフェクト、キャラクターアニメーションのテンプレートも用意されています。
画像動画音声
OpenAI
OpenAIのgpt-image-1による画像生成。ChatGPTを支えるネイティブマルチモーダルモデルで、多彩なスタイル、豊富な世界知識、正確な文字表現、プロンプトによる編集を実現します。
画像動画音声
OpenRouterBeta
70社以上の400を超えるモデルへ、OpenAI互換の単一APIでアクセスできる統合ゲートウェイ。30以上のモデルをカバーする専用の画像APIを備え、自動フェイルオーバーにも対応します。
画像
QwenBeta
AlibabaのQwenファミリー。DashScope/Model Studio経由で提供され、Qwen-Imageは長いプロンプトからネイティブ2K画像を生成し、Wanはテキスト動画生成と画像動画生成に対応します。
画像動画
RecraftBeta
デザイン志向のAI画像プラットフォーム。写実的な画像に加えて編集可能なベクター/SVGを生成できることで知られ、学習不要で再利用できる独自のブランドスタイルにも対応します。
画像
Reel.FarmBeta
Reel.Farmは、1つのプロンプトからTikTok風のスライドショー動画を完成形で作ります。スライドの文言、レイアウト、テンポまで自動生成。大量かつ自動化されたショート動画制作のために作られています。
動画
Replicate 注目
オープンソースの画像・動画・音声モデルを1つのAPIで実行・ファインチューニングできます。FLUXやStable Diffusionから、動画アップスケーラーや音楽生成モデルまで対応します。
画像動画音声アバター
Runway
生成AIの先駆的プラットフォーム。Gen-4ファミリーはテキストと画像から映画的で高精細な動画を生成し、キャラクターとシーンの一貫性、監督水準のモーション制御で高く評価されています。
画像動画
SiliconFlowBeta
極めて高速な推論プラットフォーム。LLMに加えて画像・動画・音声まで、200以上のオープンおよび商用モデルを、OpenAI互換の単一APIと分かりやすい価格で提供します。
画像動画音声
Stability AI
Stable DiffusionおよびStable Imageモデルを手がける企業。画像の生成と編集のために、完全な創作コントロールを保ったオープンでエンタープライズ品質の生成メディアを提供します。
画像動画音声
SunoBeta
Sunoは主要な生成AI音楽モデルです。テキストプロンプト、あるいは自分の歌詞・スタイル・タイトルから、ボーカル入りまたはインストの完成度の高いスタジオ品質の楽曲を作ります。本スタジオはsunoapi.orgのゲートウェイを利用します。
音声
TavusBeta
Tavusは対面型AIのための基盤モデルを開発しています。リアルタイムの映像レプリカと、見て、聞いて、感情を込めて応答する会話エージェントを、PhoenixレンダリングとCVI APIで提供します。
動画アバター
Together AIBeta
フルスタックの推論クラウド。200以上のオープンソースモデルを1つのAPIで提供し、チャット、画像、音声、動画に対応。最適化カーネルにより大規模でも高速かつ低コストに生成できます。
画像動画音声
Vercel AIBeta
Vercel AI Gatewayは、単一のAPIで多数のプロバイダーの数百のモデルへリクエストを振り分けます。テキスト、画像、動画に対応し、自動フェイルオーバー付きでプラットフォーム側の上乗せはありません。
画像動画
WanBeta
AlibabaのWan制作プラットフォーム(Model Studio)は、Wan2.xモデルファミリーでコンテンツ制作の敷居を下げます。テキスト動画生成、画像動画生成、テキスト画像生成に対応します。
画像動画
xAI Grok
xAIは、イーロン・マスク氏のxAIによるAIアシスタントGrokを開発しています。画像モデル(Aurora)は、Grokのチャットモデルと同じAPIキーで、写実的かつプロンプトに忠実な画像を直接生成します。
画像