広告なしの体験をご希望ですか?プランをアップグレードしてください。
Z-Imageは次世代の先進的な画像生成基盤モデルです。革新的なSingle-Stream Diffusion Transformer(S3-DiT)アーキテクチャを採用し、極めて高速で高品質、かつ高度に制御可能な画像合成を実現します。Z-Imageはテキスト、セマンティックトークン、VAE画像トークンを一つの統一シーケンスに統合し、パラメータ効率と生成速度を大幅に向上させています。
60億パラメータを備え、Z-Imageはオープンソースエコシステムで新基準を確立することを目指し、より高速な推論を維持しながら、より大規模なプロプライエタリモデルに匹敵またはそれを超えるパフォーマンスを提供します。
Z-Imageを効率的な生成AIのリーダーにする技術革新
Z-Image-Turboは画像生成に僅か8回のNFEで済みます。従来の拡散モデルに比べて大幅な改善です。エンタープライズGPUではサブ秒生成、コンシューマーハードウェアではリアルタイムパフォーマンス。
中国語と英語の優れたテキストレンダリング。ポスター、広告、製品パッケージ、ソーシャルメディアグラフィックを正確なタイポグラフィで両言語で生成。
Prompt Enhancerがセマンティックとコンテキストの解釈を実現。オブジェクト関係のより良い理解、複雑な多段階指示への正確な準拠、一貫した構図。
自然言語駆動の画像間変換。オブジェクトの追加・削除、スタイルや照明の変更、背景の変更——すべて柔軟でクリエイティブなコントロールで実現。
AIモデリングのスイートスポット。深い理解に十分な大きさ、16GBコンシューマーGPUで十分な小ささ。Single-Stream DiTがテキストと画像トークンを同時に処理。
商用利用、研究、コミュニティ改変に完全に開放。ロイヤリティなし。独自データセットでファインチューニングしてカスタムスタイルを実現。
高速生成と高度なクリエイティブ編集のための柔軟なエコシステム
フォトリアリスティックな結果に僅か8回のNFE。エンタープライズGPUではサブ秒、16GBコンシューマーハードウェアではリアルタイム。インタラクティブアプリや迅速なプロトタイピングに最適。
研究者とパワーユーザー向けの完全な非蒸留モデル。カスタムドメイン適応と特定データセットでのファインチューニングに完全な柔軟性。
自然言語駆動の画像編集。オブジェクトの追加/削除、スタイル変更、照明調整——クリエイティブな変換を適用しながら構造の整合性を維持。
開発者とアーティストのためのシンプルなワークフロー
速度ならZ-Image-Turbo、カスタマイズならZ-Image-Base、後処理ならZ-Image-Editを選択。すべてのバリアントはオープンソースでデプロイ可能。
事前学習済みウェイトをダウンロードしてローカルで実行。Z-Imageは16GB VRAM GPUでスムーズに動作。ComfyUIはモジュール式ノードベースインターフェースで無限のカスタマイズを提供。
Z-Imageは英語と中国語をネイティブ理解・レンダリング。詳細な説明や詩的なフレーズを入力——Z-Imageは高精度でセマンティック意図を解釈。
Z-Image-Turboのサブ秒レイテンシで、数十のコンセプトを迅速に反復。Z-Image-Editで自然言語コマンドで細部を完璧に。
今の作業に合わせた次のステップをおすすめします。