空中でスクリーンに文字を書くのは魔法のようです。指をつまむだけで実現します。

空中でスクリーンに文字を書くのは魔法のようです。指をつまむだけで実現します。

この記事はAI新メディアQuantum Bit(公開アカウントID:QbitAI)より許可を得て転載しています。転載の際は出典元にご連絡ください。

空中にお守りを描くという第 2 レベルのスキルを欲しくない人がいるでしょうか?

魔法のブラシとして機能する汎用 AI を作成したほうがよいでしょう。

これは、書いたり描いたりするためのハンド トラッキング プログラムです。開発者はこれをYoHa ( Your Hand Tracking) と名付けました。

このプログラムは、遅延や遅れのないTensorFlow.jsに基づいたリアルタイム認識を実装します。

指をつまむと絵筆になり、拳を握るだけで簡単にキャンバスをきれいにすることができます。

YoHa を使って自分自身に特殊効果を描く効果は非常に優れているため、555 個の星を獲得できるのも不思議ではありません。

このAIをどうやってプレイするのですか?

このジェスチャー認識プログラムはオープンソース化されており、開発者の Benjamin は、この「魔法」を使用する機会をすべての人に惜しみなく提供しています。

自分のパソコンにインストールして遊ぶことができ、1行のコードで簡単に実装できます。

npm インストール @handtracking.io/yoha

また、Web ページから直接モデルをダウンロードして、書き込みや描画を行い、オンラインで試すこともできます。

YoHa は現時点では指をつまむ動作と拳を握る動作にしか反応できませんが、TensorFlow.js のサポートにより、そのパフォーマンスは決して低くありません。

21個の手関節の位置決め、左右の手の方向検出、手の姿勢検出などをすべてリアルタイムで実現できます。

「バイヤーショー」も同様に優れているかどうか見てみましょう。

ルーン文字の絵が醜すぎるというだけで魔法使いにはなれないことが判明

このような興味深い AI の原理は何でしょうか?

YoHa モデルは、TensorFlow.js ディープラーニング フレームワークを使用して、最初からトレーニングを行います。開発プロセスには、トレーニングと推論の 2 つの部分が含まれます。

モデルのトレーニング フェーズでは、カスタム データセットをトレーニング データとして使用するカスタム ニューラル ネットワークが使用され、オンラインのリアルタイム推論では TensorFlow.js 推論フレームワークが使用されます。

ただし、TensorFlow.js のサイズ制限により、YoHa はコンピューターよりもモバイル デバイスでのパフォーマンスが低下します。

さらに、YoHaのローカル実行速度はオンライントライアルよりもはるかに高速です。AIを飼いならすには、まず家に連れて帰って育てる必要があることがわかりました。

ジェスチャー認識は何に役立ちますか?

YoHa の開発者であるベンジャミン氏は、このプロジェクトは当初、ネットワークの双方向性を高めるために作成されたと述べています。

「既存のソリューションには私が求めていたものがなかったので、自分で新しいソリューションを作りました」

彼は本当に実践的な人です。欲しいものがない場合は、自分で作ります。

ジェスチャー認識は非常に人気があるので、VR/AR をもっと楽しくするために、より多くの遊び方を開発し、より豊富な機能を追加してみてはいかがでしょうか。

前述の YoHa のパフォーマンス欠陥に対応して、Benjamin はプレイヤーに高性能な代替手段である汎用ジェスチャ認識モデル MediaPipe も提供しました。

ハイエンドのプレーヤーがより高いパフォーマンスを要求する場合、このクラシックモデルをベースに機能を拡張することができます。

例えば、最近MediaPipeをベースに開発された「air-drawing 」という類似プロジェクトは、ゲームプレイの点でYoHaとは少し異なります。

興味があれば、AI を飼い慣らして文章を書いたり描いたりしてみましょう。

GitHub アドレス:
https://github.com/handtracking-io/yoha
トライアルアドレス:
https://handtracking.io/draw_demo/
https://loicmagne.github.io/air-drawing/

<<:  人工知能 (AI) は、研究室から実際のアプリケーションまでどのように異なるのでしょうか?

>>:  ライフル銃で動くロボット犬の発明者が恐怖を巻き起こす:プログラミング制御は恐れる必要はない

ブログ    
ブログ    

推薦する

第一AI教会は閉館しました!トランプ大統領に恩赦を受けた元グーグルエンジニアはかつてAIを神としていた

Googleの自動運転部門の創設者であり、かつてはAIの神とまで言われた、元Googleエンジニアの...

市場情報調査 | モノのインターネット市場における人工知能

現在、機械学習とディープラーニング技術は、IoT 向け人工知能の世界市場で 5.7% の CAGR ...

音声分析:自動運転車の鍵となる技術

サプライチェーン管理、製造業務、モビリティサービス、画像およびビデオ分析、音声分析の進歩により、次世...

...

天才少年が自動運転の「自転車」を製作、ネットユーザー「テスラも見たら泣くだろう」

自転車が「自力で歩ける」ようになるのはいつでしょうか? [[404743]]自転車は劣駆動システムで...

米国は中国のハイテク製品を全面的に禁止する「2021年戦略競争法」を提案した。

米国の民主党と共和党は常に深刻な対立関係にあるが、両党は中国との対決という一つの問題において稀な一致...

...

MetaはTransformerアーキテクチャにアクションを起こします。新しい注目メカニズムは推論をよりよく理解します。

大規模言語モデル (LLM) が強力であることは議論の余地のない事実ですが、それでも単純な間違いを犯...

百度の自動運転タクシーが長沙で運行開始!乗客は百度地図を通じて電話をかけ、無料の試乗を受けることができる。

4月20日の最新ニュースは、百度がApollp Robotaxi自動運転タクシーサービスの全面オー...

マイクロソフト、仕事の効率化に役立つ 7 つの新しい AI 製品を発表

Zhidongxi は 11 月 1 日に北京から、この日 (寒くて風が強い)、2017 Micro...

AI を使って「手を洗ってください」を 500 の言語に翻訳する方法

[[322940]]人間による翻訳と機械による翻訳の両方を使用することで、健康に関する重要なフレーズ...

【ビッグネームが勢揃い、第1話】新小売時代のスマートミドルプラットフォーム

小売業界は急速に進化しています。フロントエンドの入り口とバックエンドのテクノロジーは、変革のたびに絶...

AIをやりたいなら高校でデータサイエンスを勉強するな:ウルトラマンとマスクがついに合意

AIの発展には基礎教育を強化しなければ手遅れになります。大規模モデル技術が急速に発展し、企業間の競争...

中国のAIチップ「覚醒」の5年

10 種類以上のチップが発売され、多くの合併や買収が行われています。これは、過去 500 日間の中国...

海外メディア:人工知能はすでに自身のミスを警告できる

[[354534]]海外メディアは、人工知能は急速に発展しており、この分野における最新の技術的成果が...