Z-Image-Base

完全なCFGサポートを備えた60億パラメータのテキストから画像生成モデル。ネガティブプロンプトとオプションの参照画像ガイダンスをサポートし、画像生成を最大限にコントロール。スタイル転送と構図ガイダンスでフォトリアリスティックな画像を生成。

コスト:4 クレジット

入力

お試し:

Describe the image you want to generate. Be specific about style, lighting, and composition for best results.

Describe what you want to avoid in the generated image. Helps refine output quality.

Upload a reference image to guide generation

Optional reference image to influence composition, style, or subject. Use the strength slider to control its influence.

The size of the generated image in pixels (width*height). Supports various aspect ratios including 1:1, 4:3, 3:4, 3:2, 2:3, 16:9, 9:16.

Controls how much the reference image influences the output (0-1). Lower values follow the reference more closely; higher values give the prompt more freedom. Only applies when a reference image is provided.

Set a specific seed for reproducible results. Use -1 for random generation.

出力

生成結果はここに表示されます

サンプル結果

A cinematic photo of an astronaut riding a horse on Mars, dramatic lighting, highly detailed

テキストから画像:

A cinematic photo of an astronaut riding a horse on Mars, dramatic lighting, highly detailed

A mystical forest with glowing mushrooms, ethereal lighting, fantasy art style

テキストから画像:

A mystical forest with glowing mushrooms, ethereal lighting, fantasy art style

よくある質問

Z-Image-Baseとは?
Z-Image-Baseは、Tongyi-MAIの60億パラメータのテキストから画像生成モデルで、オプションの参照画像ガイダンスでフォトリアリスティックな画像を生成します。完全なCFG(Classifier-Free Guidance)をサポートし、画像生成を最大限にコントロールできます。
参照画像ガイダンスはどのように機能しますか?
オプションで参照画像をアップロードして、生成出力の構図、スタイル、または主題に影響を与えることができます。強度スライダーを使用して、参照が結果に与える影響度を制御します:低い値(0.2-0.4)は参照に忠実に従い、高い値(0.8-1.0)はプロンプトが支配的になります。
ネガティブプロンプトは何のためですか?
ネガティブプロンプトでは、生成画像で避けたい要素を指定できます。一般的な用途には、全体的な画像品質を向上させるための「ぼやけ、歪み、低品質、アーティファクト」や、表示したくない特定の要素などがあります。
どのサイズがサポートされていますか?
Z-Image-Baseは256×256から1536×1536ピクセルまでのサイズをサポートしています。正方形または長方形の画像を選択できます。デフォルトは品質と速度のバランスが良い1024×1024です。
強度パラメータはどのように機能しますか?
強度パラメータ(0-1)は参照画像の影響を制御します。低い値(0.2-0.4)は参照に忠実な出力を生成します。中程度の値(0.5-0.7)は参照とプロンプトを均等にブレンドします。高い値(0.8-1.0)はプロンプトが支配的になり、参照は緩いインスピレーションとして機能します。
Z-Image-Baseの最適な用途は?
Z-Image-Baseは以下に優れています:迅速なプロトタイピングとコンセプト探索、一貫した美学のためのスタイルガイド生成、ソーシャルメディアやマーケティング向けコンテンツ作成、様々なプロンプトと設定での創造的な実験、カタログや製品ビジュアルのバッチ生成。
最良の結果を得るには?
最良の結果を得るために:プロンプトでスタイル、照明、構図を具体的に指定する;一般的な問題を避けるためにネガティブプロンプトを使用する;参照画像を使用する場合は、約0.6の強度から始めて結果に基づいて調整する;プロンプトを調整しながら構図を反復するために同じシードを維持する。
参照画像なしで使用できますか?
はい!Z-Image-Baseは純粋なテキストから画像モデルとして完全に機能します。参照画像は完全にオプションです。画像が提供されない場合、モデルはテキストプロンプトのみに基づいて生成します。
シードパラメータはどのように機能しますか?
シードを-1に設定するとランダムな結果が得られ、固定の整数を使用すると出力が再現可能になります。同じプロンプト+シードの組み合わせは類似の画像を生成し、デザインの反復やバリエーション間の一貫性の維持に役立ちます。
Z-Image-BaseとZ-Image-Turboの違いは?
Z-Image-Baseは、ネガティブプロンプトと参照画像ガイダンスを含む完全なCFGサポートを提供し、最大の創造的コントロールを実現します。Z-Image-Turboはより少ないステップで速度に最適化されています。出力を細かく制御したい場合はBaseを、速度が優先の場合はTurboを選択してください。