AIが油絵の描き方を教えます。どんなスタイルでも習得でき、ストロークのシーケンスも数秒で表示されます。

[[417713]]

この記事はAI新メディアQuantum Bit（公開アカウントID：QbitAI）より許可を得て転載しています。転載の際は出典元にご連絡ください。

AIはすでに油絵の描き方を教えることができます。

任意の画像を入力すると、数秒以内にストロークのシーケンスが表示されます。

たとえば、世界的に有名な絵画「モナ・リザ」。

あるいはリアルな鳥。

雰囲気を盛り上げる川灯籠もあります。

つまり、どんなスタイルでもコントロールできるのです。

このテクニックは、21 時間以内に Reddit で 600 件以上のいいねを獲得しました。

どうやって作られたのですか?

フィードフォワードネットワークによるストロークの予測

ニューラルペインティングは、与えられた画像に対して一連のストロークを生成し、ニューラルネットワークを使用して絵画のような方法でリアルな再現プロセスを実行するプロセスです。

研究チームは、フィードフォワードネットワークを使用してストロークのパラメーターを予測する、Paint Transformer と呼ばれるトランスフォーマーベースのフレームワークを提案しました。

現在、Paint Transformer をトレーニングするためのデータセットがないため、研究者はオブジェクト検出にヒントを得た自己トレーニングパイプラインを設計しました。

モデル全体は、ストローク予測モジュールとストロークレンダラーの 2 つのモジュールで構成されています。

ストローク予測子は、ターゲットイメージと中間キャンバスイメージが指定されると、現在のストロークセットを決定するための一連のパラメーターを生成します。

予測子は、特徴埋め込み用の 2 つの CNN ネットワークと、パラメータ予測用のトランスフォーマーで構成されます。

次に、ストロークレンダラーはストロークセット内の各ストロークのストロークイメージを生成し、キャンバスに描画して、サイズが512 x 512の結果イメージを生成します。

DETR (Object Detection with Transformer) に基づいて、ストロークを保持する必要があるかどうかを予測するためのバイナリニューロンが追加されます。

これにより、既存のデータセットがなくてもトレーニングが可能になり、優れた一般化機能を実現できます。

実験では、このアプローチは、トレーニングと推論のコストが低く、従来の方法よりも優れたペイントパフォーマンスを実現することが示されています。

Baidu NDUチームによって作成

この技術は、百度、南京大学、ラトガース大学が共同で開発した。

コードはオープンソース化され、Yike フォトアルバムアプリに適用されました。

論文の宛先:
https://arxiv.org/abs/2108.03798
GitHubのURL:
https://github.com/wzmsltw/PaintTransformer

<<: 人工知能によって破壊される可能性のある7つの業界

>>: 人工知能が高齢者の日常生活に影響を与えないようにする

2023 年の AI セキュリティに関するトップ 10 の話題

ブログ

IoT、分析、AI – デジタル化の勝利のトリオ

ブログ

ChatGPT が処理できない 5 つのプログラミングタスク

ブログ

人工知能、AI、ロボットは雇用に影響を与えるでしょうか?劉強東さんの答えに人々は拍手喝采しました！

ブログ

顔認識技術のまとめ：従来の方法からディープラーニングまで

ブログ

試験形式がAIベースになったとき、「AI+教育」の関係をどうバランスさせるのか？

ブログ

100日学習プラン | データサイエンスの詳細ガイド

ブログ

AIが油絵の描き方を教えます。どんなスタイルでも習得でき、ストロークのシーケンスも数秒で表示されます。

フィードフォワードネットワークによるストロークの予測

Baidu NDUチームによって作成

2023 年の AI セキュリティに関するトップ 10 の話題

IoT、分析、AI – デジタル化の勝利のトリオ

ChatGPT が処理できない 5 つのプログラミングタスク

人工知能、AI、ロボットは雇用に影響を与えるでしょうか?劉強東さんの答えに人々は拍手喝采しました！

顔認識技術のまとめ：従来の方法からディープラーニングまで

試験形式がAIベースになったとき、「AI+教育」の関係をどうバランスさせるのか？

100日学習プラン | データサイエンスの詳細ガイド

推薦する

「スマートストア」のAIカメラは何ができるのか？

AIアーキテクトとはどのような人達でしょうか？

IoTセキュリティ戦略における機械学習の重要性

MITは、大規模な問題を解決するにはアルゴリズムがハードウェアよりも有用であることを証明した。

Meta はヘッドマウントディスプレイを使用して全身のモーショントラッキングを実現します。脚の情報なしで正確な姿勢推定

自分の写真がディープフェイクに使われるのではないかと心配ですか?ボストン大学の新しい研究を試してみてください

暗号化アルゴリズムの将来と現状の簡単な分析

LLaMAが使用するオープンソースデータセットは棚から削除されました。これには約20万冊の本が含まれており、OpenAIデータセットに匹敵します。

AIはソフトウェアテスターの仕事を「奪う」のでしょうか?

人工知能が社会にもっと役立つように

「初の顔認証事件」の最終判決がこちら