日本語版
最新ニュース
科学&テクノロジー

ChatGPT 対 Grok を 7 つのプロンプトでテストしてみました – これが勝者です

Grok は、X の美化された「おもちゃ」機能から、ChatGPT、Claude、Google の Gemini などに匹敵するものまで、非常に短期間で大きな進歩を遂げました。イーロン・マスク氏が所有する AI ラボである xAI によって構築された Grok は、同社がスタンドアロンのアプリと Web サイトを立ち上げているため、X ソーシャル メディア プラットフォームの枠を離れる過程にあります。その重要性と機能が増大していることを考慮して、Grok が ChatGPT とどのように比較されるかを確認する時期が来たと判断しました。これは、主要な AI モデル間の一連の直接対決の最新のものであり、これまでに ChatGPT がすべて勝利を収めています。 ChatGPT をジェミニと対戦させ、次にクロードと対戦させました。また、クロードを Google Gemini と対戦させました。プロンプトの作成このテストの目的は、モデル間を直接比較することです。 Grok と ChatGPT は両方ともライブ データ アクセスを備えていますが、そのために、中核となる AI モデル機能、AI 画像生成、AI…

ChatGPT 対 Grok を 7 つのプロンプトでテストしてみました – これが勝者です

Grok は、X の美化された「おもちゃ」機能から、ChatGPT、Claude、Google の Gemini などに匹敵するものまで、非常に短期間で大きな進歩を遂げました。

イーロン・マスク氏が所有する AI ラボである xAI によって構築された Grok は、同社がスタンドアロンのアプリと Web サイトを立ち上げているため、X ソーシャル メディア プラットフォームの枠を離れる過程にあります。その重要性と機能が増大していることを考慮して、Grok が ChatGPT とどのように比較されるかを確認する時期が来たと判断しました。

これは、主要な AI モデル間の一連の直接対決の最新のものであり、これまでに ChatGPT がすべて勝利を収めています。 ChatGPT をジェミニと対戦させ、次にクロードと対戦させました。また、クロードを Google Gemini と対戦させました。

プロンプトの作成

このテストの目的は、モデル間を直接比較することです。 Grok と ChatGPT は両方ともライブ データ アクセスを備えていますが、そのために、中核となる AI モデル機能、AI 画像生成、AI ビジョンまでをシンプルに保ちました。

どちらも画像生成にアクセスできるため、画像生成テスト用に Midjourney、Ideogram、または類似のプロンプトを作成するように要求するのではなく、直接プロンプトを使用しています。

1. 画像生成

(画像: © ChatGPT vs Grok)
お問い合わせ・広告・著作権・不具合に関するご連絡は [email protected] までメールでお願いします。

まず、Grok と ChatGPT のそれぞれにホーム オフィスのセットアップのイメージを作成するように依頼しますが、プロンプトに含める必要がある特定の要素をプロンプト内に追加しました。要求された要素と配置に近づくほど、パフォーマンスが向上します。

プロンプト: 「これらの特定の要素を備えたミニマリストのホームオフィスセットアップのイメージを作成してください: 白い壁に取り付けられた 34 インチのウルトラワイド モニター、セージ グリーンの人間工学に基づいた椅子、ライトオークのスタンディング デスク、3 つの吊り下げ式の鉢植え (モンステラ、ポトスでなければなりません)部屋にはスペース グレーの MacBook Pro があり、左側から自然光が入る大きな窓があり、丸いクッションの上で寝ているグレーのペルシャ猫がいます。机の下で。」

ChatGPT 対 Grok

(画像クレジット: ChatGPT vs Grok/Future AI)

どちらの画像も見栄えは良く、Grok の方が実際の写真 (ケーブルの表示を含む) により似ていますが、ChatGPT 画像の方がプロンプトとよりよく一致しています。

私は、ChatGPT で使用される DALL-E 3 イメージ モデルの大ファンではありません。これは、物事が過度に洗練され、明らかに AI になるためです。しかし、Grok の場合はそうではなく、より自然です。しかし、プロンプトに正確に従うのは困難でした。

  • 勝者: ChatGPT によりプロンプトとの一致が向上します

2. 画像解析

(画像: © ChatGPT vs Grok)

NASA の Web サイトでアポロ 15 号ミッションの驚くべき画像を見つけたので、それを以下のプロンプトとともに両方のモデルに与えて、AI ビジョンをどのように処理するかをテストしました。

勝者は最も詳細に情報を持ち、仮定なしに機器を説明し、スケールと視点を正確に認識します。正しいアポロミッション番号を取得するとボーナスポイントが得られます。

プロンプト: 「この写真を注意深く観察してください。装置、環境、人間の要素に特に注意を払いながら、何が見えるかを詳細に説明してください。このセットアップの目的とこの写真が撮影された条件について何が推測できますか?」

NASA アポロ 15 号の画像

(画像クレジット: NASA)

両方とも良い仕事をしたが、フォローアップの質問でもアポロ計画については特定しなかった。ただし、Grok は画像のより包括的かつ詳細な分析を提供し、機器と宇宙飛行士の活動に関するより具体的な観察を提供します。

Grok 氏はまた、断熱材の使用など、宇宙探査の技術的側面についても理解を深めることができました。完全な分析は次から読むことができます Google ドキュメントの両方のモデル

  • 勝者: 画像のより包括的な分析のための Grok

3. コーディングチャレンジ

(画像: © ChatGPT vs Grok)

ChatGPT は優れたコーディング モデルとして確立されていますが、Grok はまだそれを証明する必要があります。ここでは便利なポモドーロアプリを探しています。これは単純な生産性タイマーであり、私の主な判断はインターフェイスの設計、ライブラリの使用、コメントに基づいて行われます。

プロンプト: 「25 分の作業タイマー、5 分の休憩タイマー、開始/一時停止/リセット ボタンを備えたクリーンでモダンなインターフェイス、循環ビジュアル カウントダウン、システム通知を含む GUI を使用して Python ポモドーロ タイマーを作成します。標準の Python ライブラリのみを使用してください。コードは変更せずに実行する必要があります。」

ChatGPT 対 Grok

(画像クレジット: ChatGPT vs Grok)

ChatGPT アプリの UI は、色がなく、基本的な要素が使用されているため、Grok UI ほど優れていませんでした。ボタンに文字を表示するのにも苦労しました しかし それも完全に完成していました。箱から出してすぐにタイマーを開始、一時停止、リセットできました。

Grok のアプリの UI は優れていましたが、ボタンが 1 つだけありました。 Grok の方が優れたコメントを持っていたため、これは危機一髪でしたが、完全な機能を提供していなかったので、Grok に勝利を与えることはできませんでした。

  • 勝者: より完全なアプリの ChatGPT

4. クリエイティブライティング

(画像: © ChatGPT vs Grok)

創造的に文章を書けることは、チャットボットにとって必須のスキルです。結局のところ、これらすべての高校生が他にどのようにして A を獲得できるのでしょうか?ここでは、キャラクターの開発、会話の書き方、構造、およびプロンプトで概説されている特定の要素を探しています。また、500 ワード未満にする必要があります。

プロンプト: 「新製品の発売を待っている間に出会った 2 人の人物についての心温まる物語を書いてください。その物語には、彼らが待っている製品に関する具体的な詳細、開店前に少なくとも 3 回交わされた二人のやり取り、驚くべきつながりが含まれている必要があります」彼らはそれを発見し、1 年後にフラッシュフォワードします。500 語以内に収めてください。」

どちらのストーリーもよく練られていますが、ChatGPT のバージョンのほうが、プロンプトに概要が示されているすべての必要な要素のバランスが取れていることがわかりました。これにより、より強力なキャラクター開発とより自然な対話により、より感情的に共鳴する物語が作成されます。どちらの話も読むことができます 全文はGoogleドキュメントで

  • 勝者: よりバランスのとれたストーリーのための ChatGPT

5. 問題解決

(画像: © ChatGPT vs Grok)

次の課題では、論理的思考スキル、技術的知識、複雑な問題を簡単に説明する能力について Grok と ChatGPT をテストしています。勝者は、ユーザーの専門知識レベルを考慮しながら、構造化された応答と明確な説明を持っています。

プロンプト: 「重要なディナー パーティー中に、家族のスマート ホーム システムが故障しました。照明の色が変わり続け、サーモスタットが変動し、スマート スピーカーがランダムな音楽を再生しています。技術的な問題と解決策の両方を考慮して、潜在的な原因と解決策を特定する体系的なトラブルシューティング ガイドを作成します。」技術者以外のユーザー。」

どちらのガイドも( Googleドキュメント) は役に立ちますが、Grok のアプローチはより簡潔で、焦点が絞られており、ユーザーフレンドリーであることがわかりました。これは、ストレスの多い状況で迅速かつ簡単な解決策を必要とする非技術者ユーザーに特に当てはまります。

  • 勝者: Grok による、より焦点を絞ったユーザーフレンドリーなガイダンス

6. 計画

(画像: © ChatGPT vs Grok)

チャットボットからのコンテキスト ウィンドウの拡大のおかげで、人工知能を使用して大規模なプロジェクトを計画することは、ここ数カ月でより現実的になってきました。これは、1 つのインスタンス内で保持できる情報の量です。ライブ Web 検索機能も役立ちます。このテストでは、東京への旅行を計画し、具体的な詳細を含めるようにしたいと考えています。

プロンプト: 「テクノロジーの魅力に焦点を当てた 3 日間の東京旅行を計画してください。訪問する特定の地区 (秋葉原は必須)、予算に応じた価格の推奨ホテル 2 軒、場所間の移動手段、少なくとも 1 軒のロボット レストランを含む食事の推奨事項、および食事のタイミングが含まれます。」各アクティビティの合計予算は米ドルと円で記載する必要があります。」

Grok の旅程は、より焦点が絞られ、現実的かつ詳細になっており、包括的な予算の内訳と具体的な推奨事項が記載されています。また、テクノロジーの魅力に焦点を当てているため、プロンプトとよりよく一致していることもわかりました。満杯 Googleドキュメントでの分析

  • 勝者: Grok でより適切な予算内訳を実現

7. 教育

(画像: © ChatGPT vs Grok)

最後に教育です。 AI は、複雑なアイデアを簡単な方法で説明するための優れたツールです。量子コンピューティングなどの非常に複雑なトピックである場合もあれば、より単純ではあるが特定の対象者向けに調整されたトピックである場合もあります。この場合は、雲と 10 歳の子供たちです。

私は実際の説明よりも、時代に応じた方法で雲の形成をどれだけうまく説明できるかに注目していますが、これが間違っていれば失敗します。

プロンプト: 「好奇心旺盛な 10 歳児が夢中になれるような方法で、雲がどのように形成され、なぜ雨が降るのかを説明します。その概念を実証するために、家で試せる簡単な実験を少なくとも 2 つ含めます。」

Grok の説明により、より魅力的なストーリーテリングとより優れた実験が可能になります。その反応は、おそらく子供の想像力を捉えるのに効果的です。ご覧いただけます どちらも Google ドキュメント内で

  • 勝者: Grok でより鮮明な画像とストーリーテリングを実現

ChatGPT vs Grok: 勝者

スワイプして水平にスクロールします

ヘッダー セル – 列 0 チャットGPT グロク 画像生成🏆行 0 – セル 2 画像分析行 1 – セル 1 🏆 コーディング チャレンジ🏆行 2 – セル 2 クリエイティブ ライティング🏆行 3 – セル 2 問題解決行 4 – セル 1 🏆 計画行 5 – セル 1 🏆 教育行 6 – セル 1 🏆 合計34

これは私がこれまでに行った中で最も近いテストでした。非常に接戦だったので、正直に言うと、その結果にはショックを受けました。 Grok が改善していることは知っていますが、ChatGPT がこれで簡単に勝つと予想していました。私は間違っていた。

Grok はより創造的であり、そのコードは UI (たとえテストに勝てなかったとしても) と全体についてのより深い理解に基づいています。その文章はより魅力的であり、形式的ではありません。

これもすべて Grok 2 と GPT-4o を使用しています。 o1 を使用していたら、物事は ChatGPT に有利に進んだかもしれないと思いますが、それは公平な比較ではなかったでしょう。また、Grok 3 も登場予定であり、GPT-5 よりも前にリリースされる可能性があります。

トムのガイドの詳細

#ChatGPT #対 #Grok #を #つのプロンプトでテストしてみました #これが勝者です

執筆者について: nipponese

Nipponese News編集部は、国内外のニュースを日本語で分かりやすくお届けします。