Gemini 1.5 ハンズオンレビュー: Sora は偽物に見えるが、もっと素晴らしい機能がある

Gemini 1.5 ハンズオンレビュー: Sora は偽物に見えるが、もっと素晴らしい機能がある

Googleの「反撃」が来た!

ジェミニはソラに脚光を奪われましたが、今は再び脚光を浴びているようです。

最新のテストでは、Gemini 1.5 は、Sora ビデオが AI によって生成されたかどうかを分析できます。

重要な要素を直接的に伝えるタイプです。

たとえば、この古典的な猫のビデオでは、ジェミニ 1.5 は次のように言っています。

その目も毛も本物には見えませんでした。

この生成されたビデオでは、ジェミニ1.5が詐欺の詳細をすべて伝えています〜

魔法は魔法に勝つと言われますが、ソラがリリースされてからわずか数日後、ジェミニ 1.5 にすぐに「追いつかれ」ました。

ジェミニ 1.5 の第一波のテスト結果について、ネットユーザーは「これは恐ろしく良い」と述べ、これを「ゲームチェンジャー」と呼んだ。


ジェミニ1.5テストの第一波が到来

突然リリースされたGeminiバージョン1.5ですが、反対側のSoraに隠れてしまいました。

しかし、それでも、モデルのパフォーマンスの大幅な向上、特に100万トークンのコンテキストウィンドウのサポートは、ネットユーザーに依然として感銘を与えました。

現在、一部のブロガーが徐々にアクセス資格を取得し、実際のテストの第一波を開始しています。

生成されたビデオが本物か偽物かを識別できることに加えて、次のような優れた機能もあります。

1. 長い動画を分解して理解する

たとえば、14 分間の NBA ダンク ビデオでは、Gemini 1.5 はどのダンクのスコアが最も高いかを判断し、そのダンクの詳細を提供できます。

応答プロセス全体にかかる時間はわずか約 55 秒です。

2. 長い文章の内容を理解し、比較分析を行う

ブロガーは、合計で約10万トークン相当の映画「インターステラー」と「アド・アストラ」の2本の完全な脚本を提出し、ジェミニ1.5にそれらを分析して比較し、どちらの映画を見るか決めるよう依頼した。

わずか 30 秒強で、完全かつ詳細な分析レポートが提供されます。

この観点から見ると、プロットやセリフを分析するのは子供の遊びのように思えます。

(映画の中で最も感動的な名言を3つ分析してください)

3. 少数言語に翻訳する

英語をサトラン語に翻訳するなど、約2,000人しか話さない言語でも扱うことができます。

さらに、論文内の表を分析して理解するといった詳細もあります。

ネットユーザーはこの一連の実際のテストに驚嘆し、これは大きな改善であり、GPT-5 がこれに対抗するまで待たなければならないかもしれないと考えている。


特に、100 万トークンのコンテキストを処理できるため、GenAI スタートアップにとって非常に便利です。

一部のネットユーザーは、Google がコンテキスト ウィンドウのサイズ問題をどのように解決するのかについても興味を持っています。

何か新しいことが発見されたり達成されたりしたに違いありません。


ネットユーザー:偶然ではないだろう

しかし、OpenAI側からはまだGoogleの「反撃」に反応した者はいない。以前、Sora がリリースされたとき、Google からコメントを寄せる人はほとんどいませんでした。

しかし、両社は同じ日に発表をしており、ネットユーザーたちは長い間、次のような想像を膨らませてきた。

それは偶然である可能性は低いです

アルトマン氏は、Google を宣伝する絶好の機会を逃したくなかった。

一部のネットユーザーは、ソラの発表は明らかにマーケティング上の動きであり、まだ準備ができていないと考えている。それに比べると、Gemini 1.5 はまさに画期的な製品です。

しかし、ソラこそが本当のサプライズだと考える人もいます。

Gemini 1.5 はかなり良いですが、驚くほどではありません。

OpenAI も内部に 100 万を超えるモデルを持っていると確信しています。 (Sora はサイドプロジェクトです)。

そして、GPT-5 が登場すれば、すべての競合製品を打ち負かすだろうと考えられています。

これら2つの操作についてどう思いますか?

もう一つ

両社は激しい戦いを繰り広げており、痛手を負うのはAdobeのような注目を浴びていない企業だ。

ここ2日間、株価は何度も下落しています...

以前から注目を集めているビデオ生成会社Runwayの共同創設者は、次のように答えた。 「ゲームが始まった」

今回の国内の反応はChatGPTのそれとは少し異なる点が特筆に値します。

ソラが出てきた後は、反対する人も減って、前よりも静かになりました…

<<:  OpenAIの従業員が996の勤務スケジュールを公開、ネットユーザー「本当の競争は強制する必要はない」

>>:  20 分で回路基板の組み立て方を学びましょう!オープンソースのSERLフレームワークは、精密制御において100%の成功率を誇り、人間の3倍の速さです。

ブログ    
ブログ    
ブログ    
ブログ    

推薦する

ビッグデータはスマートな警察活動の基盤であり、AIは包括的な分析と判断の原動力である

都市化と経済発展の加速に伴い、我が国の社会保障を構成する要素が拡大し、公安機関の警察活動に大きな圧力...

人工知能の雇用に関するレポートによると、GenAI は米国のほぼすべての仕事に影響を与えるだろう

世界有数の求人サイトおよび採用プラットフォームである Indeed は、Indeed AI 求人レポ...

興味深いアルゴリズムを知っていますか?

[[428794]]この記事はWeChatの公開アカウント「WeDoctor Front-end ...

...

...

...

AIセキュリティリスクの予防と管理を強化するには、技術統合と法的規制に重点を置く必要がある

人工知能は、新たな科学技術革命と産業変革をリードする戦略的技術として、世界の主要国が科学技術の飛躍的...

ナレッジグラフ|データの価値を活かすのは「グラフ」

ナレッジグラフ|データの価値を活かすのは「グラフ」​​ナレッジグラフは、応用数学、グラフィックス、情...

AIがセキュリティの自動化、分析、対応にどのように役立つか

人工知能 (AI) は、チャットボットから自動運転車まで、あらゆるものを説明するために使用できる幅広...

ワンクリックで細い毛を切り取る。これはAdobeの最新のAI切り抜きアルゴリズムで、近日公開予定

この記事はAI新メディアQuantum Bit(公開アカウントID:QbitAI)より許可を得て転載...

人工知能の急速な発展により、小売業界は第5の変革期を迎えている。

[[252330]]人工知能の急速な発展は、新しい小売業者に力を与え、小売業界の「人、商品、場所」...

AIとITの自動化の6つのレベル

IT サービスの自動化の時代に入りつつあります。しかし、IT 業界では、自動車業界が評価されるのと同...

自動運転は飛躍的な進歩を遂げており、マスク氏は年内にL5レベルの自動運転が実現すると発言した。

自動運転技術は、世界中の大手自動車メーカーの主要な研究開発方向となっています。現在、多くの自動車メー...

データ拡張: データが限られている場合にディープラーニングをどのように使用するか? (下)

私たちは皆、そこに行ったことがあります。機械学習の概念に精通しており、それを機械学習モデルに適用でき...