GPT-4 が怠惰になる問題の解決に新たな進歩があります。 今朝、ウルトラマンが、新年には GPT-4 の問題が大幅に改善されるはずだとツイートしました。 写真 GPT-4 が怠惰になることについての苦情は数え切れないほどありますが、そのほとんどはコード関連のタスクに関するものです。 完成度が高くないだけでなく、細かく分割されてしまうため、使用時に一つずつコピーする必要があります。 最新バージョンについては、あるブロガーが体験して、小学1年生の子供のためにちょっとした学習ゲームを作ってみたところ、なかなかの効果が得られたと語っていました。 写真 しかし、反対する人もいます。たとえば、このネットユーザーは、ChatGPT の返信の長さは増えているものの、その多くは繰り返しになっており、作業がまだ十分に行われていないことに気づきました。 彼は ChatGPT にテキストを 17 の言語に翻訳するように依頼しましたが、意味不明な内容が大量に表示されただけで、翻訳されませんでした。 写真 個人差を排除するために、一部のネットユーザーがデータセットを使用して新しい ChatGPT をテストしたところ、結果は... 新しいバージョンはさらに怠惰ですか?このネットユーザーは、GitHubでオープンソースの「怠惰なベンチマーク」セットを使用して、0125(1月24日の最新バージョン)と1106(11月23日の前バージョン)のGPT-4モデルをテストし、新しいバージョンが以前よりもさらに悪く、より怠惰になっていることを発見しました。 写真 このテストデータセットにはコード関連のタスクが含まれており、正しい完了率は間接的に「怠惰」の度合いを反映します。完了率が高いほど、「怠惰」が少なくなります。 その結果、コード比較(Unified diff)タスクでは、旧バージョンでは半分以上の 57% を完了できましたが、新バージョンの完了率はわずか 44% で、ほぼ 4 分の 1 減少しました。 写真 直感的に、ChatGPT の「怠惰さ」が悪化していると感じた人もいました。 以前は、たとえ怠け者であっても、少なくとも試してみて、ユーザーが自分で埋められるような大まかな枠組みを提供していました。しかし、今では、彼らはただ諦めて、できないと言います。 写真 ネットユーザーのこの発見に対して、一部の人々は辛辣なコメントを寄せた。
写真 今回、ウルトラマンは、GPT-4 がなぜ遅延するようになったのか、どのような最適化戦略が採用されたのかについて、さらに詳しく説明しませんでした。 「自家製の方法」は怠惰を減らすことができるしかし、以前の研究では、GPT-4の怠惰さは時間と関係している可能性があることが示されており、この結論は、GPT-4が年末の12月に「怠惰」になったという事実と一致しています。 写真 この理論によれば、モデルのパフォーマンスは確かに新年の初めには向上するはずですが、パフォーマンスが向上せずに低下した理由は説明されていないようです。 しかし、ネットユーザーたちは、ChatGPTの慣性をある程度まで軽減できる「家庭療法」もいくつかまとめています。 たとえば、「指がない」と伝えると、断片的なコードではなく、比較的完全なコードを取得できます。 写真 あるいは、ChatGPT に「チップをあげる」と伝えることでも、動作を促すことができます。 「チップ」の金額について調査を行ったところ、10ドルが最も費用対効果が高いことが判明した人もいます。 写真 それで、ChatGPT は良くなったと思いますか、それとも怠惰になったと思いますか? 参考リンク: [2] https://aider.chat/docs/benchmarks-0125.html |
<<: 口を使ってiPhoneで10秒写真編集! UCSB Appleの中国人チームがマルチモーダルMGIEをリリース、オープンソースで誰でもプレイできることを公式発表
友人の輪の中で小さなボスがチキンスープを作っているのをよく見かけます。「すべての労働者の皆さん、仕事...
OpenAIは2022年11月30日にChatGPTをリリースしました。大規模言語モデル GPT3...
私たちが知っている食品の消費とレストラン体験の変革は、1921 年にカンザス州ウィチタでアメリカ初の...
先月、投資会社a16zがAIスタートアップが直面する困難を分析した記事を発表しました。AIスタートア...
[[251873]] 2019 年に AI を推進するものは何でしょうか? Forrester R...
古典的な「樽理論」によれば、樽にどれだけの水が入るかは、一番低い木材によって決まります。 [[397...
[[251560]] Nvidia は、従来のモデリングやグラフィック レンダリング エンジンではな...
翻訳者 |ブガッティレビュー | Chonglouセキュリティの専門家は長い間、オンラインアカウント...
否定できない現実として、私たちは自動化の時代に入り、それに伴い人工知能 (AI)、機械学習 (ML)...
この記事は、Heart of Autonomous Driving の公開アカウントから許可を得て転...
[[443053]] 2021年は人工知能が飛躍的に進歩し続ける年です。最近、Github で誰かが...