この記事はAI新メディアQuantum Bit(公開アカウントID:QbitAI)より許可を得て転載しています。転載の際は出典元にご連絡ください。 AIはすでに油絵の描き方を教えることができます。 任意の画像を入力すると、数秒以内にストロークのシーケンスが表示されます。 たとえば、世界的に有名な絵画「モナ・リザ」。 あるいはリアルな鳥。 雰囲気を盛り上げる川灯籠もあります。 つまり、どんなスタイルでもコントロールできるのです。 このテクニックは、21 時間以内に Reddit で 600 件以上のいいねを獲得しました。 どうやって作られたのですか? フィードフォワードネットワークによるストロークの予測ニューラル ペインティングは、与えられた画像に対して一連のストロークを生成し、ニューラル ネットワークを使用して絵画のような方法でリアルな再現プロセスを実行するプロセスです。 研究チームは、フィードフォワード ネットワークを使用してストロークのパラメーターを予測する、Paint Transformer と呼ばれるトランスフォーマー ベースのフレームワークを提案しました。 現在、Paint Transformer をトレーニングするためのデータセットがないため、研究者はオブジェクト検出にヒントを得た自己トレーニング パイプラインを設計しました。 モデル全体は、ストローク予測モジュールとストローク レンダラーの 2 つのモジュールで構成されています。 ストローク予測子は、ターゲット イメージと中間キャンバス イメージが指定されると、現在のストローク セットを決定するための一連のパラメーターを生成します。 予測子は、特徴埋め込み用の 2 つの CNN ネットワークと、パラメータ予測用のトランスフォーマーで構成されます。 次に、ストローク レンダラーはストローク セット内の各ストロークのストローク イメージを生成し、キャンバスに描画して、サイズが512 x 512の結果イメージを生成します。 DETR (Object Detection with Transformer) に基づいて、ストロークを保持する必要があるかどうかを予測するためのバイナリ ニューロンが追加されます。 これにより、既存のデータセットがなくてもトレーニングが可能になり、優れた一般化機能を実現できます。 実験では、このアプローチは、トレーニングと推論のコストが低く、従来の方法よりも優れたペイント パフォーマンスを実現することが示されています。 Baidu NDUチームによって作成この技術は、百度、南京大学、ラトガース大学が共同で開発した。 コードはオープンソース化され、Yike フォトアルバム アプリに適用されました。 論文の宛先: |
>>: 人工知能が高齢者の日常生活に影響を与えないようにする
今日は二十四節気の一つ、白露節気です。白露節気の季節には、我が国のほとんどの地域が秋の収穫期に入り、...
最近、一部メディアは、アント・ファイナンシャルの元副社長兼主任データサイエンティストである斉元氏が復...
導入畳み込みはニューラル ネットワークのコア計算の 1 つです。コンピューター ビジョンにおける畳み...
この夏、人工知能起業家サム・ホーガンが書いた記事がシリコンバレー中で話題になった。現在、AI と大規...
Cybernews によると、ますます多くの企業が、検出がますます困難になっている悪意のあるボッ...
[51CTO.com からのオリジナル記事] 喜び、悲しみ、恐怖、平静、怒り、驚き、軽蔑、嫌悪など...
[[399636]] 【51CTO.com クイック翻訳】自然言語処理 (NLP) の定義自然言語...
モデル| https://huggingface.co/ByteDance/SDXL-Lightni...
ロボット工学は考えられるあらゆる分野に応用できます。教育、旅行、防衛など、あらゆる分野でロボット工学...
多項式回帰は線形回帰の改良版です。線形回帰を知っていれば、簡単に理解できるでしょう。そうでない場合は...
顔認証機能の利用にあたり、利用者の同意を得ていない企業が半数近くあるというデータもある。ビッグデータ...
ご存知のとおり、大規模なモデルのトレーニングにはコストがかかりますが、事前トレーニング済みのモデルを...
自動運転技術の開発は加速しており、商業的な検討も日々増加しています。現段階では、業界では貨物輸送と旅...
GPT-4 のリリースは AI の歴史に残る大きな出来事であることは間違いありません。しかし、時が経...