NovelAI Journal
Back to NovelAI

ジャーナル記事

NovelAI 画像生成、正式公開しました!

ついにこの時が来ました。NovelAI の画像生成サービスが正式に公開されました。

公開日

ついにこの時が来ました。NovelAI の画像生成が 公開されました

さっそく本題へ

NovelAI Diffusion Anime による画像生成体験は、 思い描いたものを制限なく形にするための創作ツール として作られた、他にはないものです。想像の中の物語を、そのまま絵にしてください。

タグを使ってキャラクターや構図の見た目を指定できます (もちろん、普通の文章として書いて AI に解釈させることもできます)。

NovelAI Diffusion Anime の (Curated) と (Full) は、それぞれ独立したモデルとして公開することにしました。

NovelAI Diffusion Anime (Curated)
安定した基本品質と、予測しやすい題材が持ち味です。

NovelAI Diffusion Anime (Full)
学習データを広げてあり、より幅広い生成に対応します。

NovelAI Diffusion Anime の各モデルに加えて、 NovelAI Diffusion Furry (Beta) も同時に提供します。

NovelAI Diffusion Furry (Beta) では、 ケモノや擬人化された動物をテーマにした作品 を生成できます。
このモデルはまだ完成形ではなく、開発の進行に合わせて拡張していきます。

NovelAI Diffusion ならではの魅力

タグ付け:
チームは、既存の画像生成モデルに欠けていた知識を埋める好機と捉え、AI にタグを教え込みました。

画像生成のプロンプトを入力すると、タグの候補が表示されます。

Let the AI help you focus your prompt!

AI の助けを借りて、プロンプトの狙いを絞り込みましょう

ファインチューニングを施した NovelAI Diffusion モデルでは、何を生成してほしいのかを AI にずっと明確に伝えられます。入力内容に応じて AI がタグを提案し、そのタグをどれだけ深く知っているかを丸いマーカーの大きさで示します。特定のタグで学習しているため、ラベル付けされた定義をはるかに正確に認識でき、生成結果の一貫性も高まります。

The AI knows a lot about trees, much less woodland camouflage, though!

AI は木についてはよく知っていますが、森林迷彩についてはあまり詳しくないようです

タグの使用は必須ではありませんが、狙った方向へ AI を導くうえで大きな役割を果たします。タグと通常の文章を混ぜて使うことを強くおすすめします。自分だけの「キャラクター」を作るために使えば、どの生成結果にも同じキャラクターが登場しているかのような一貫性を演出できます。

Euterpe's visual tags are hard at work!

Euterpe の外見タグがしっかり働いています

Euterpe のタグ: auburn brown hair, very long hair, hair between eyes, hair flowers, flowers, updo, flower hair pins, extra long hair, green eyes, updo hair, golden neck, skinny, tall, thin

料金と機能

Opus をご利用の方へ: 640 x 640 ピクセルまで の基本的な生成を、 追加費用なしで無制限に ご利用いただけます。

これは画像解像度の「Normal」と「Small」のカテゴリーに含まれるものすべてが対象です。

The Image Resolutions Dropdown section applicable to Opus subscribers' coverage.

Opus をご利用の方が対象となる、画像解像度のドロップダウン部分

Normal に含まれるもの: Portrait(512 x 768 ピクセル)、Landscape(768 x 512 ピクセル)、Square(640 x 640 ピクセル)。
Small に含まれるもの: Portrait(384 x 640 ピクセル)、Landscape(640 x 384 ピクセル)、Square(512 x 512 ピクセル)。

Opus プランでは決められた設定の範囲で無制限に生成でき、それ以外のプランは、NovelAI の画像生成が自分に合っているかどうかを試すのにぴったりです。

料金は、解像度の大きさ、拡散のステップ数、そして一度の生成で作る画像の枚数に大きく左右されます。

急速に変化していくこの分野で、ぜひ NovelAI Diffusion を試してみてください。機能も技術もまだまだ進化の途中であり、開発を続けながら皆さんの声に耳を傾けていきます。

新しい通貨について

ステップは、モジュールの学習用という位置づけだったころには十分に役目を果たしてきました。しかし、画像生成のステップが、既存の通貨としてのステップ(当時はテキストモデル向けのカスタム AI モジュール学習のためだけに用意されていたもの)と紛らわしくなるという問題に直面しました。混乱を避けるため、通貨は一つに絞るべきだと判断しました。そこでこの機会に、社名である Anlatan から着想を得て、これからを見据えた名前へと通貨を刷新することにしました。

どこでも使える単一の通貨、Anlas の登場です。

通貨が統一されたことで、すべてのプランで Anlas を使って画像生成とその機能を利用できるようになります。

あわせて、 Scroll と Tablet の月あたりの標準 Anlas 付与量を 1000 に引き上げましたカスタム AI モジュールの学習に加えて 、画像生成にも使えるようにするためです。

なお、Anlas の購入には有効なサブスクリプションが 必須 です。

ここからは画像生成の各機能をご紹介します

CLIP のトークンコンテキストを3倍に拡張し、77 トークンから 231 トークンへ増やしました。これまで以上にプロンプトを練り込む余地があります。モデルは切り抜きなしで学習しているため、任意のアスペクト比の画像を生成できます。さらに、CLIP モデルの言語理解も大きく向上させました。

NovelAI Image Generation Settings at a glance

NovelAI の画像生成設定の一覧

すべてのプランで image-to-image(img2img)の機能をご利用いただけます。画像に手を加えたり、修正したり、一から描き起こしたりして、それを土台にモデルへ生成させることができます。

Upload Image はその名のとおり、任意の画像ファイルをエディターに読み込み、AI の生成を方向づける機能です。読み込んだ画像とテキストプロンプトを組み合わせれば、見た目を調整したり、配色や構図の下敷きとして使ったりできます。

Paint New Image を選ぶと NovelAI のキャンバスが開き、下描きやコンセプト、あるいは AI に伝えたい配色を描けます。仕上がりのイメージをテキストプロンプトで説明して、生成してみてください。

From sketch & prompt to generation & a quick switch to open eyes!

下描きとプロンプトから生成へ、そして目を開いた表情への差し替えまで

Edit Image では、過去の生成結果や読み込んだ画像を編集できます。気になる部分の修正や、最終的な構図に足したい要素の追加に使えます。

Enhance Image は、選んだ生成結果をテキストプロンプトとあわせてもう一度モデルに通し、さらに作り込む機能です。

Generate Variations は、AI が生み出したコンセプトや大枠のアイデアをもっと掘り下げたいときに、特定の生成結果からバリエーションを増やせる機能です。

除外したい要素 は、生成に出てきてほしくない要素を追い払うための機能です。たとえば女の子ばかり出てくるのに飽きたなら、あらゆる呼び方をこの欄に入れてみてください。1girl, woman, female と書いておけば、すぐに登場頻度が下がってくるはずです。

強調と弱化のベクトル を使うと、生成中に AI が細部のどこへ重きを置くかを制御できます。強めたいテキストは { } で、弱めたいテキストは [ ] で囲んでください。 これは プロンプト欄 でも 除外したい要素の欄 でも機能します。

詳しくはドキュメントページをご覧ください。

延期の件はどうなったのか

延期のお知らせに寄せられた ご意見 は、 しっかりと受け止めました

利用者の皆さんは、前例のないほど自由で制限のない体験を求めています。それは私たちも同じです。

そこで私たちは、 自社独自のモデルのみを提供し素の Stable Diffusion モデルは見送る という判断に至りました。素のモデルは他の多くの場所ですでに提供されていますし、バージョンごとにどんな内容を生成し得るのかを細かく見張る必要も生じるからです。独自の体験だけを提供することで、制限のないビジュアルな物語作りのための道具をお届けできます。

NovelAI は物語を紡ぐためのものであり、画像生成によって あらゆる物語を描けるようになる と信じています。この機能の可能性は、まだ広げ始めたばかりです。 そのため現時点では、素の標準的な Stable Diffusion モデルを提供する予定はありません。

NovelAI Diffusion のモデルがご自身の用途に合うかどうか、ぜひ試してみてください。

なお、NovelAI Diffusion のモデルは、同じプロンプトと同じシードを使っても、標準の Stable Diffusion モデルと同じ結果にはなりません。

著作権と利用について

NovelAI 上でアップロード・生成された画像は、当社のサーバーには保存されません。画像とプロンプトは こまめにバックアップして保存 してください。
当社は画像を共有するためのプラットフォームではありません。生成した画像を共有する際は、他のサービスをご利用ください。

NovelAI はいかなるファイルについても著作権や所有権を主張しません。 画像は利用規約 1.4 節で定義される「コンテンツ」として扱われます。 生成した画像を NovelAI の外で利用したい場合は、ご自身で調査を行ってください。

気に入った生成画像とプロンプトは必ず保存してください。
プロンプト、生成画像、キャンバスでの編集、アップロードした画像は保存されず、セッションの終了とともに失われます。

責任を持って生成してください。言葉づかいにもご注意を。画像生成は新しい技術であり、予期しない結果を生むことがあります。

Twitter などの SNS では、ぜひ私たちをタグ付けしてください。作品に #NovelAI#NAIDiffusion を付けていただければ、皆さんの創作の歩みを追いかけられます。

チーム一同、#NovelAIDiffusion を思いきり楽しんでいただけることを願っています。

何か問題がありましたら、遠慮なく support@novelai.net までご連絡ください。

告知の全文はこちら:https://novelai.net/updates