オタクなおじさんが独学でAIを学んでマスターレベルを作成し、Twitterで人気になった

オタクなおじさんが独学でAIを学んでマスターレベルを作成し、Twitterで人気になった

この記事はAI新メディアQuantum Bit(公開アカウントID:QbitAI)より許可を得て転載しています。転載の際は出典元にご連絡ください。

最近、佐藤さんという日本のオタクおじさんが、AIで似顔絵を生成する「AI画伯」というウェブサイトを開設した。10日間でユーザー訪問数が0から100万に増加し、Twitterで大騒ぎとなった。

使い方はシンプルで簡単です。顔写真をアップロードするだけで、マスターレベルの肖像画を生成できます。

技術以上にすごいのは佐藤さん自身です。自分でAIを学んで作り出したのですから。オタクの創造力には感心するしかありません。

佐藤さんはアスペルガー症候群を患っています。アスペルガー症候群は一般に「社会恐怖症」とも呼ばれ、まさに天才病です。一般的に、このような患者は特定の分野で特別な才能を発揮しますが、普通の人々の生活に適応することができません。

もちろん佐藤のスキルポイントはAIに集中しています。

pix2pix、TensorFlow に組み込まれた cGAN モデル

今回有名になったAI技術は、かの有名なGANの変種です。

今回の顔写真生成技術は、TensorFlow に組み込まれている cGAN (条件付き敵対的生成ネットワーク) 内のpix2pixモデルをベースにおじさんが改良したものです。

GAN の技術的な汎用性とは異なり、cGAN は特定のシナリオでのパフォーマンスを重視しています。たとえば、AI Gahaku は人間の顔のみをターゲットにできます。ユーザーが猫の顔をアップロードした場合、結果を生成することはできません。

GAN の特徴は、損失関数の自己計算と自動更新であり、GAN 自体が転移学習と組み合わせられる可能性を秘めています。近年の開発の軌跡から判断すると、GAN は転移学習によって提案された目標を達成するための手段としてより多く使用されています。転移学習は、GAN の応用に具体的な方向性を提供します。

TensorFlow に組み込まれている pix2pix は、cGAN に基づいた画像間変換モデルです。モデル自体は成熟しており、直接呼び出して白黒画像の色付けや画像スタイルの変更などのシナリオに適用できます。

叔父の pix2pix モデルの使用について具体的に言えば、彼は実際にモデルをマスター ポートレートの生成に限定しており、これはモデル自体の強力なスケーラビリティも反映しています。

どのように使うかはあなた次第です。

佐藤さんの他の作品「PixelMe」でもpix2pix技術が使われていますが、8ビットのピクセルスタイルのアバターが生成され、1つのモデルで複数の用途に使用できます。

もちろん、実際の結果は人によって異なります。結局のところ、厳密に言えば、既存のモデルの二次開発を行っています。元のアルゴリズムとデータ構造は変更されていないため、パフォーマンスと効果は元のモデルによって制限されます。

オタクのAI進化の旅

叔父の人生経験は複雑だと言える。大学を中退した後、パン屋で働き、看護学校の養成コースに参加したが、どれも自分には向いていないと感じ、自分の才能を生かしてAIの道に進むことを決意した。

[[338339]]

それでは、TensorFlow の学習を始めましょう。

Google Colab のコンピューティング リソースの助けを借りて、おじさんは TensorFlow チュートリアルに従ってゼロから始めました。しかし、おじさんは AI には向いていますが、ケーキを蒸すのには向いていません。

学習の過程で、佐藤さんは自分に合った方向性を見つけました。転移学習とGANは、画像再生をよりうまく実現できます。さまざまな画像トレーニングデータセットを使用して、特定のシナリオを学習および生成できます。

GAN は典型的な教師なし学習法です。その基本原理は、2 つのニューラル ネットワークを「互いに競争」させ、パラメータを継続的に最適化することで最良の結果を得て、自己ゲームを実現することです。

この技術は主にコンピュータービジョンの分野で使用されており、佐藤氏がGANを選んだ主な理由でもあります。

Google の寛大さのおかげで、叔父が使用するウェブサイトのサーバーとコンピューティング リソースは、1 日あたり約 20 ドルと比較的安価です。叔父は、許容できる容量の範囲内であれば、短期的には商用化を求めないと述べました。

みんなのためのAI!

有名になってからも、叔父は浮かれることはなかった。

彼はそれを金銭的利益のためではなく、自分が興味のあることとして捉えている。

テクノロジーに対する情熱から佐藤氏は独自の AI の旅を始め、2 年後にはオンラインでアプリケーションを立ち上げることができました。

夢に向かってあきらめずに努力するこの精神こそが、本当に学ぶ価値のあるものです。

結局のところ、誰もが AI を独学する勇気を持っているわけではありません。

<<:  AIoT分野におけるセキュリティリスクを知っておく必要があります!

>>:  クラウドコンピューティング機械学習プラットフォームの選び方

ブログ    
ブログ    

推薦する

Google、かわいい動物動画生成に優れたAI動画ジェネレータ「Lumiere」をリリース

海外メディアの報道によると、1月26日、GoogleはLumiereと呼ばれる人工知能ビデオジェネレ...

スタンフォードNLPコースXCS224Uのビデオが公開されました。実用的な情報が満載です。ぜひ聞いてください。

会話エージェントから検索クエリまで、自然言語理解 (NLP) は今日の最もエキサイティングなテクノロ...

...

AIはイスラエルとパレスチナの紛争の偽画像を生成し、それが非常にリアルであるためメディアで引用されている

イスラエルとパレスチナの紛争が続く中、関連ニュースが次々と報道され、中には虚偽の内容も混じり始め、真...

調査と市場:2025年までに世界のヘルスケア人工知能市場は272億ドルに達する

市場調査会社リサーチ・アンド・マーケッツが最近発表したレポートによると、人工知能の世界のヘルスケア市...

人工知能がブルーカラーの仕事に取って代わると、どのような影響があるでしょうか?

AI と ML をより多くのタスクに統合すると、短期的には多くのメリットが得られますが、長期的には...

Keras 機能 API によるディープラーニング

[[380280]] Keras Python ライブラリを使用すると、ディープラーニング モデルを...

会員数3億人、商品数4億点、大規模電子商取引の商品推奨にディープラーニングを応用!

電子商取引業界では、ユーザーに対する商品の推奨は常に非常にホットで重要なトピックです。比較的成熟した...

百度AIシティが上海と契約を締結、インテリジェントイノベーションで上海に新たな伝説を刻む

11月27日、百度は上海市政府と戦略的協力枠組み協定を締結した。上海市党委員会書記の李強氏と市党委員...

AI によって自動化された、誰でも使えるオンライン写真編集!北京大学の卒業生がアルゴリズムを新たな高みへ

この記事はAI新メディアQuantum Bit(公開アカウントID:QbitAI)より許可を得て転載...

従来のグラフエンジンから GNN へ: 計算グラフと機械学習の進化

この記事は公開アカウント「Reading Core Technique」(ID: AI_Discov...

医療機器製造における3つの大きなトレンド

医療製造にロボット工学と自動化を導入したダヴィンチ ロボット手術システムが発売されてから 20 年が...

資金調達、新製品、アプリケーションは引き続き成長中:8月のドローン業界の最新動向の概要

[[420938]]現在、人工知能や5Gなどの技術の助けを借りて、我が国のドローン開発は急速な成長の...

専門家の洞察: AI を活用して配送をスピードアップする方法

毎分250人の赤ちゃんが生まれ、世界では4回の地震が発生し、シンガポール港では1,000トンを超える...