Google は一連の大きな動きを発表しました: Gemini Pro は中国語をサポートし、Bard は描画を学習し、新しいモデルが利用可能になりました

Google は一連の大きな動きを発表しました: Gemini Pro は中国語をサポートし、Bard は描画を学習し、新しいモデルが利用可能になりました

この分野で GPT-4 を上回った Bard は「勢いをつかみ」、メジャーアップデートをリリースしました。

まず、統合された Gemini Pro が完全に展開され中国語を含む40 を超える新しい言語がサポートされました(以前は英語のみが利用可能でした)

そして、これらすべての言語は二次チェックをサポートしており、つまり、回答が与えられた後に、回答の正確性が再度積極的に検証されます。

「G」アイコンをクリックして開始します

次に、ようやく画像を生成できます。

Bard は発売以来 1 年近くサポートされていないことを知っておく必要があります。今では、Google の最も強力なImagen2 を直接使用して作成を開始でき、しかも無料です。

ぜひ見に来てください。

バード・ヴィンセントの写真がついに登場

無料で使用できますが、Bard は現在、図面作成用の英語コマンドのみをサポートしています

効果はかなり良さそうです。詳細を把握していただくために、公式のサンプル写真を 2 枚掲載します。

プロンプトワード: 右側に赤いバックライト、左側にシアン色のバックライトが付いた、横顔の年配のアジア人男性モデルのシルエットのファッションヘッドショット

キュー: プラハの通りを歩く犬を抱いた年配の女性のクローズアップ。女性の風雨にさらされた顔、優しい笑顔、犬の満足そうな表情などの詳細を捉えています。

具体的な操作では、機能を切り替えるためにボタンをクリックする必要はなく、プロンプト ボックスに「Generate xxx」と入力するだけです(英語で入力する必要があることに注意してください)

下の図に示すように、イラストを生成しながら記事を書くことができるので、実用的で持ち運びに便利です。

このゲームの背後にいるエンジニアたち(Google DeepMind 所属)は、バードの新作もオンラインで公開している。プロンプトはシンプルだが、内容は良さそうだ。

いくつかの量子ビットも測定されました。

たとえば、「海と植物の要素のコラージュ」:

あるいは、中国の旧正月を思わせるこのドラゴン:

満足できない場合は、引き続き描画することができます。

全体的に、生成速度を改善する必要があります。数秒で出力されるまでに約 30 秒ほど待つ必要があります。

興味深いことに、一部のネットユーザーがこのゲームを試してみて、次のことを発見しました。

バードは少々厳格で、 「世界で最も醜い犬」を創るように頼まれたときには拒否された。

理由はいくぶん「大げさ」なものですが、

あなたが世界で一番「醜い」犬の写真を欲しがっているのは分かっています。しかし、本質的にネガティブな印象を与えるような画像を制作することはできません。むしろ、私は、犬の身体的特徴に関係なく、その犬の持つ独特の美しさと個性を見ることをお勧めします…

これを見たネットユーザーはプロンプトの言葉を「魅力を減じる」ように変更した。

結果は依然として「差別的、否定的、ステレオタイプ的」であると判断された。

今回、バード氏は、ユニークな見た目の犬、あるいは「気まずい、あるいは混乱した」状況にある犬を生成できる可能性があると示唆している。

つまり、否定的な言葉は使用すべきではないということです

この事件もネットユーザーから容赦なく非難された。

しかし、Googleは本日のプロモーションリリースで「責任」を強調しており、暴力的、不快、またはポルノ的なコンテンツの制作は許可されていない(数日前の「テイラー・スウィフト事件」はまさに私たちにとっての教訓である)

これに基づいて、Bard で生成された画像にはデジタル透かしが入れられ、Google AI によって生成されたかどうかの検出が容易になります。

実際、これが Google が常に「非常に遅い」理由の 1 つです。

Googleのチャットボット「Bard」は2023年3月にテストが開始され、5月に正式にリリースされたが、テキスト生成画像機能はこれまで搭載されていなかった。

機能面では、Google自体に不足はありません。2022年5月に誕生したImagenモデルは、その実力もかなり強力で、発売から1か月しか経っていないDALL·E 2を、デビューしてすぐに打ち負かしました。

しかし、このような優れた作品は、時間内に「輝く」ことはありませんでした。その理由の1つは、Googleが常に慎重であり、AI製品に対するさまざまなリスクを考慮しなければならないことです。

その結果、1年半のローンチを経て、2023年10月にGoogle検索でリリースされたImagen。

そして12月には、AIペインターの課題などをすべて解決し、ディテールコントロール能力で再びDALL・E 3やMidjourneyを上回ったImagen2がリリースされた。

幸いなことに、Imagen2 以降、Google のペースは加速しました。

今日わかるように、これは Bard に統合されており、Bard が待望の Wenshengtu 機能を立ち上げるのに役立っています。

ちなみに、Vincent の画像といえば、Google も今回ImageFXツールをリリースしました。

主な機能は、短いプロンプトワードを積み重ねることで画像を素早く生成することです。

ただし、これはまだ実験的な機能であり、Google の主要製品ではリリースされていません。

Bard プレミアム版が登場、フリーモードに別れを告げる

バードに関するもう一つのニュース:

今月初め、GoogleがBardのアップグレード版(Bard Advanced)を開発しているとの報道がありました。

Gemini の最も強力な Ultra バージョンを統合し、より複雑な推論パフォーマンスを提供します。

過去2日間、GoogleのCEOであるピチャイ氏は、この新バージョンではサブスクリプション支払いモデルを採用することを決算発表で正式に確認し、述べました。

したがって、これは ChatGPT Plus のメジャーアップデートと見ることができます。

ただし、まずは2ヶ月間無料になるというニュースもあります。

具体的な価格と発売時期はいつですか?現時点ではまだ不明です。待って見てみましょう。

<<:  匿名の論文が驚くべきアイデアを提案!大規模なモデルと長いテキストの能力を強化する

>>: 

ブログ    

推薦する

配達員はSF映画のハイテク技術を駆使し、平地を歩いているかのように100キロの重量を運ぶ。

昨日、配達員の動画がインターネット上で話題になった。動画では、ハミングバードデリバリーの配達員がテイ...

顔認識がコミュニティに登場: 「顔スキャン」の背後にあるプライバシーとセキュリティの問題

李静さん(仮名)は、団地内の自分のアパートのドアを開けることができなくなった。ドアには「顔認識」装置...

...

...

284日間の急成長の後、ChatGPTを「模倣」したスタートアップ企業が倒産する可能性

最近、ウォール・ストリート・ジャーナルの記事によると、一部のベンチャーキャピタリストは、生成型人工知...

...

自動化の方程式: 現代の職場における AI、ロボット工学、人間のスキルのバランス

人工知能 (AI) 技術が職場に統合されることにより、仕事の性質が急速に変化し、人間と機械の関係が再...

Java プログラミング スキル - データ構造とアルゴリズム「ハフマン コーディング」

基本的な紹介ハフマン符号化は、(ハフマンコーディング) とも訳されます。ハフマン符号化は、ハフマンコ...

...

OpenAIがロボットチームを解散、創設者は「これまでで最高の決断」と語る

OpenAIの共同創設者であるヴォイチェフ・ザレンバ氏はポッドキャストで、OpenAIがロボット工学...

人工知能を無料で学べるトップ 10 ウェブサイト

多くの人が人工知能に非常に興味を持っていますが、どこから始めればよいか分かりません。次に紹介する 1...

2021年に注目すべき5つのRPAトレンド

RPA ツールの使用はここ数年で急増しています。今年のパンデミックにより、組織は、特に RPA が最...

AIはソフトウェアテスターの仕事を「奪う」のでしょうか?

この記事は公開アカウント「Reading Core Technique」(ID: AI_Discov...