テキストと画像の入力
文章のブリーフ、入力画像、またはその両方を組み合わせて生成できます。
ByteDanceのSeedream 4.0とSeedream 4.5は、文章による説明やユーザーが提供する画像から生成を行い、1枚の元画像をプロジェクトに必要なだけ多様な方向へ展開します。
作成を始めるには、デスクトップのブラウザでこのページを開いてください。
Seedream 4はByteDanceの画像ラインであり、日常的な使用においてそれを際立たせているのは、空白のプロンプトからではなく入力画像を起点に作業することの扱いやすさです。
テキストから画像を生成するモードは、誰もがデモで見せるものです。画像から画像を生成するモードこそ、実際の作業の多くが行われる場です。つまり、別の設定が必要な商品写真、イラスト化する必要がある写真、6つのバリエーションが必要なレイアウトなどです。Seedream 4は、それをジェネレーターに後付けされた機能ではなく、主要な流れとして扱います。
すでに何かが存在する場合にSeedream 4を使用してください。商品写真の変換、既存画像のスタイル変更、1つのソースからのバリエーションセット生成、カタログ見開きの作成、そしてコマースやコンテンツのパイプラインが実際に消費する、ほぼ同一のアセットを大量に制作できます。

Seedream 4.0は、ByteDanceが開発したAI画像生成モデルです。文章による説明から画像を生成し、プロンプトとともに入力画像も受け付けるため、新しい画像を生成するだけでなく、写真の編集、スタイル変更、変換が可能です。
このモデルは、3つの大きな強みを中心に構築されています。
Virseでは、このラインを2つのエントリーとして提供しており、4.5は後発の改訂版です。どちらもAPI経由で提供されるクローズドモデルであり、公開されたウェイトはありません。そのため、ダウンロード可能なバージョンを検索しても何も見つかりません。一方に合わせて書いたプロンプトは、もう一方でもそのまま実行できます。

文章のブリーフ、入力画像、またはその両方を組み合わせて生成できます。
両方の改訂版は、モデル一覧に別々の項目として表示されます。
一方の改訂版のために書いた指示は、そのままもう一方にも転用できます。
重み、括弧、強調マーカーを使わない、平易な説明文です。
写真をイラストに変換したり、イラストを別の表現に変換したりできます。
API経由で提供され、ダウンロードやセルフホスト用の公開済みウェイトはありません。
ソース画像を提供することは、このモデルを高度なオプションとしてではなく、通常の使い方です。構図、被写体、フレーミングは指定した画像から引き継がれ、プロンプトで差分を説明します。
同じ入力画像を複数の異なる指示で順番に処理し、一貫性のある出力群を得られます。すべてが同じ画像から始まっているためです。
写真を線画に、レンダリングを絵画に、またはフラットなイラストを質感のあるものに変換しながら、元の配置は変化後も維持されます。
このモデルは、通常の説明文に反応します。覚えるべき重み付け構文も、入力するネガティブプロンプト欄もありません。
どちらも同じモデルリストにあり、同じ指示文を受け付けるため、自分の作業にどちらが合うかのテストは移行作業ではなくワンクリックで済みます。
指示文は各エントリー間で変更せずに移せるため、新しいリビジョンが登場したときに過去のプロンプトを低コストで再実行できます。
画像から画像への作業は、本質的に反復的です。1枚の元画像が4つの処理案になり、そのうち3つが別の何かの入力になり、有用なバージョンは2段階前のものだった、ということもよくあります。 Virseは、そのツリー全体を1つのキャンバス上に保持します。元画像、中間パス、完成した出力が互いに並んで配置されるため、一連の変換が、似た名前のファイルが詰まったフォルダーに埋もれるのではなく、読み取りやすいまま保たれます。
元画像をすべての派生物の横に置いておけば、記憶に頼るのではなく、実際に何が変わったのかを確認できます。
同じソースを複数の指示で並行して実行し、試行のたびに次の結果で置き換えるのではなく、すべての結果を保持できます。
キャンバスを離れたり指示文を書き直したりせずに、Seedream 4 と 30+ 種類の他の画像・動画モデルの間を移動できます。
1つのプロンプトを両方のリビジョンで並べて実行し、バージョン番号を読むのではなく、見て選べます。
既存の商品写真を、新しい設定、季節、または配色に移し替えます。
共通のソース処理から、一貫した一連の商品画像を生成します。
写真を線画、フラットなベクター表現、または絵画風レンダリングに変換します。
既存の被写体を撮り直すことなく、別の環境に配置します。
クライアントが選べるように、1つのコンセプトに対して複数のビジュアル表現を生成します。
共通のソースを使うことで、見た目に統一感のある関連投稿のシリーズを作成します。
作業の元にしたい写真、レンダー、または以前の生成結果をアップロードします。
何を変えるべきかを明記します。言及しないものは、そのまま引き継がれるものと見なされます。
同じソースに3つか4つの異なる指示をかけ、結果を並べて比較します。
うまくいった指示を採用し、確定する前にもう一方の入力でも試します。
有用なSeedream 4.5プロンプトには、通常4つの要素が含まれます。
こう書く代わりに
この写真をより良く、よりプロフェッショナルに見えるようにし、背景をよりきれいにしてください。
こう書く
被写体の背後にある散らかったデスクを、無地のミディアムグレーの壁に置き換えてください。被写体のポーズ、表情、服装、顔に当たる光の方向はそのまま正確に保ってください。自然な肌の質感を残した写真らしい仕上げにしてください。元のトリミングとフレーム内での被写体の位置を維持してください。
提供された写真を使い、シーンをペンとインクの線画に変換します。 構図、すべてのオブジェクトの位置、遠近感は元のまま正確に維持します。 影にはクロスハッチング、輪郭線はすっきりと、色なし、グレーの塗りつぶしなし。 元の空がある部分は白い紙にします。
提供されたセラミックマグの商品写真を使用し、白いスタジオ背景から、窓のそばにある風合いのあるオーク材のテーブル上へ移動してください。 マグの形状、釉薬の色、ハンドルの角度、スケールはそのまま正確に保ってください。 左からの柔らかな朝の光、右へ落ちる長い影を1本、マグの背後は浅い被写界深度にしてください。 元画像と同じカメラの高さとフレーミングにしてください。
提供された折りたたまれたウールスカーフの画像を使用し、同じショットを別のカラーバリエーションで生成してください。 折り目のパターン、ライティング、影の形、背景、トリミングは同一に保ってください。 糸の色だけを深いラストカラーに変更し、目に見える織りの質感は維持してください。 全体に均一で影のないスタジオ照明、正方形フォーマット。
| 比較項目 | Seedream 4 | Seedream 4.5 |
|---|---|---|
| 系列内での位置づけ | 以前のリリース | 同じ系列の後続改訂版 |
| 入力モード | テキストと画像 | テキストと画像 |
| プロンプト構文 | 平易な説明文 | 平易な説明文 |
| ブリーフの互換性 | 4.5でも変更なしで実行可能 | 4でも変更なしで実行可能 |
| 選び方 | 自分のブリーフで比較 | 自分のブリーフで比較 |
| 適した用途 | 既存のセットはこれを基に構築 | 現行改訂版での新規制作 |
画像から画像への作業では、保持条件は指示と同じくらい重要です。何を残すかを列挙することで、モデルがひそかに作り直してしまうのを防げます。
1枚の画像に複数の処理をかける場合は、毎回元の画像に戻ってください。編集を連鎖させると、処理のたびに少しずつずれていきます。
何を入れないかを列挙するのではなく、何があるべきかを伝えてください。望まないオブジェクトの名前を出すと、かえって呼び出してしまうことがあります。
一連の出力を作る場合は、すべてを一定に保ち、1つの属性だけを変えます。そうすることで、セットとして認識されるようになります。