HN 日本語サマリー

← 一覧へ戻る
AI・機械学習

学生はAIエッセイ作成において、ブラインドテストでChatGPTやClaudeよりもGeminiを好む

Students prefer Gemini over ChatGPT and Claude for AI essays in blind tests (studyarena.com)

5 pointsby pasharayan3 コメント

要約

StudyArenaの分析によると、大学の学生はAIによるエッセイ作成において、モデル名を伏せたブラインドテストでGeminiを最も好む結果となりました。Geminiは39.6%の選択率で、Claude(31.8%)、ChatGPT(29.2%)を上回りました。記事では、Geminiはライティングフィードバックに、Claudeは課題計画に、ChatGPTはリサーチにそれぞれ強みがあるとし、最終的な執筆は自身で行うことを推奨しています。

全文翻訳

主なポイント Geminiは、39.6%のブラインドライティング選択率で、Claudeの31.8%、ChatGPTまたはOpenAIの29.2%を抑え、StudyArenaの現在の大学エッセイ作成における選択肢となっています。 Ghostwriter(代筆者)としてではなく、エディターとしてGeminiを使用してください。一般的な文章、欠けている詳細、弱い決定を見つけさせ、最終的な文章は自分で書くようにしましょう。 大学の学生が最もよく使用する3つのAIモデルは、ChatGPT、Gemini、Claudeです。2026年8月時点のStudyArenaのデータによると、学生はGeminiを好んでいます。 StudyArenaは6,851件の有効なブラインド学生投票を分析しました。学生は、ブラインドテストアリーナでモデル名を見る前に回答を見て、好みの応答を選択しました。ライティングおよびエッセイタスクにおいて、Geminiは39.6%の選択率で1位となりました。Claudeは31.8%、ChatGPTおよびその他のOpenAIモデルは29.2%でした。 Geminiが勝利する理由 AIファミリー ブラインドライティング選択率 Gemini 39.6% Claude 31.8% ChatGPT / OpenAI 29.2% Geminiのリードは重要です。なぜなら、判断の瞬間にモデル名は隠されていたからです。誰も、Geminiにすでに支払ったから、Googleが好きだから、あるいはClaudeの方がよく書くと聞いたからという理由で選ぶことはできませんでした。回答は、ページ上で勝たなければなりませんでした。 バランスが重要であるように思われます。大学のライティングは、単一の極端なものを報酬として与えることはめったにありません。最良の応答は、形を失うことなく完全であり、機械的に聞こえることなく構造化され、ライターの声を削り取ることなく明確でなければなりません。Geminiは、それらのトレードオフが実際のライティングタスクで満たされたときに、学生が最も頻繁に選択したプロバイダーファミリーでした。 StudyArenaのライティングリーダーボードでライブ結果を確認できます。学生が新しいブラインド投票を行うにつれて、それは変化し続けます。今日の私たちの編集上の判断は複雑ではありません。Geminiから始めてください。 より良い回答は通常長かった 学生は長い応答を好む傾向がありました。選択された回答は、代替案よりも平均して37%長かったです。最も長い回答は、決定的なライティング比較の47.7%を獲得しました。最も短い回答でも25.0%を獲得しました。 より多くの推論はライティングを良くしなかった 現在のモデルファミリーは、異なる推論または努力設定を提供しています。StudyArenaのライティングデータにおける主要なプロバイダーファミリーの中で、より高い努力レベルのラベルは、より高い選択率を獲得しませんでした。 推論設定 ブラインドライティング選択率 低 40.7% 中 33.3% デフォルト 30.8% 高 29.5% このパターンは逆の方向に行きました。より多くの推論は、より多くのポイント、より多くの資格、より多くの繰り返しを行う余地を生み出します。それは証明や研究計画に役立つかもしれません。それはしばしば散文を損ないます。 エッセイ作業の場合、通常のまたは低い努力設定から始めてください。難しい部分が文章を書くことではなく、証拠を通して推論することである場合にのみ、より高く設定してください。最終的な編集は、アイデアの数を減らし、最良のアイデアを強化する必要があります。 現在のラベルはここで重要です。アリーナには、多くの比較でまだ名前が挙げられている古い世代ではなく、GPT-5.6 Sol、Claude Opus 5、およびGemini 3.1 Proが含まれています。 1 2 3プロバイダーディレクトリで完全なAIモデルディレクトリを閲覧したり、それらの背後にあるラボを見たりできます。 Geminiは最初の最良の選択肢であり、唯一有用なツールではありません Geminiは全体的な大学ライティングの推奨事項をリードしています。サポートデータはまた、各プロバイダーが有用な専門分野を持っていることを示しています。 GoogleのGeminiファミリーは、41.7%でライティングフィードバックをリードしました。これは、すでにドラフトを持っており、それがどこで焦点、具体性、または力強さを失っているかを知りたい場合に、Geminiを開始するのに最適な場所となります。 AnthropicのClaudeファミリーは、43.2%で課題計画をリードしました。Claudeは、ドラフトの前、競合する構造を求めており、それらの間のトレードオフを見たい場合に役立ちます。 OpenAIのGPTファミリーは、39.3%でリサーチワークをリードしました。ChatGPTは、議論マップ、検証すべき主張のリスト、またはあなたの論文に対する最も強力な反論が必要な場合に役立ちます。 これは矛盾ではありません。「大学のエッセイを書く」は、いくつかの異なるジョブを隠しています。 ステージ 最初の最良のツール 最良のリクエスト 議論を見つける ChatGPT / OpenAI 主張、反論、検証すべき事実をマッピングする ドラフトを計画する Claude 異なる構造を提案し、それぞれのコストを説明する ライティングを改善する Gemini 曖昧な、一般的な、または焦点の定まっていない段落を診断する 最終決定を下す あなた 真実であり、具体的であり、あなたのものであるものだけを残す 単一のサブスクリプションまたはタブが必要な場合は、Geminiを選択してください。エッセイが重要であれば、モデルを小さな編集デスクとして使用し、あなた自身を編集長として保ってください。 大学のエッセイにGeminiを使用する方法 最良のプロンプトは、エッセイの種類によって異なります。 個人的なステートメントの場合、「私のエッセイを書いてください」から始めないでください。Geminiにドラフトを与え、次のように言います: > これを書き直さないでください。どの応募者でも書けた可能性のある箇所を特定してください。読者がまだ私について知らないことを教えてください。そして、より具体的な詳細を明らかにする質問をしてください。 論証的なエッセイの場合: > 私の最も弱い前提、最も強力な真剣な反論、および一次情報源を必要とするすべての事実の主張を特定してください。証拠を追加したり、ドラフトを書き直したりしないでください。 文学分析の場合: > 解釈とプロットの要約を分離してください。段落がテキストから獲得せずに主張を行っている箇所を示してください。置き換えの文章ではなく、質問を提案してください。 短い応答の場合: > カットできるセットアップ、保持すべき詳細、プロンプトに最もよく答える文章をマークしてください。応答は私の声で続けてください。 これらのプロンプトは、モデルにその判断を明らかにさせます。その判断が良いかどうかはあなたが決定します。 より良い大学エッセイワークフロー 推奨されるワークフローは次のとおりです。 自分で生の素材を書いてください。真実でなければならない事実、シーン、引用、主張を書き留めてください。 Geminiに診断を求めてください。ピースを書き直すことなく、最も弱い決定を特定させます。 ClaudeとChatGPTにも同じリクエストを実行してください。モデル名を見る前にAIの回答をブラインドで比較するためにStudyArenaを使用してください。 最も有用な批判を選択してください。すべての提案を組み合わせないでください。それは委員会のような文章を生み出します。 あなた自身のドキュメントで書き直してください。モデルは問題を見つけることができます。あなたは文章の所有者であるべきです。 すべての事実の主張をチェックしてください。チャットボットによって発明または要約された引用ではなく、元のソースに従ってください。 再度カットしてください。モデルは追加が得意です。ライターは削除することでその価値を証明します。 このワークフローは、評判によってモデルを選択するという微妙な問題も解決します。一度ClaudeがライターであるとかChatGPTが賢いと信じると、あなたはロゴを採点し始めます。ブラインド比較は、批判がそのメリットで競争することを可能にします。 実際のプロンプトまたは作業中のドラフトで、今すぐ無料比較を実行できます。それは一般的なランキングよりも有用な回答となるでしょう。なぜなら、それはあなたの目の前の作業をテストするからです。 よくある質問 2026年に大学のエッセイに最適なAIはどれですか? Geminiです。StudyArenaのライティングおよびエッセイタスクで39.6%のブラインド選択率を獲得し、Claudeの31.8%、ChatGPTまたはOpenAIの29.2%を上回りました。これは、開始するのに最適な場所としてStudyArenaが現在推奨しているものです。 GeminiはライティングにおいてClaudeより優れていますか? はい、StudyArenaの現在のライティングデータではそうです。Claudeは計画と代替構造において特に有用ですが、学生はGeminiファミリーのライティング回答をより頻繁に好みました。 GeminiはエッセイにおいてChatGPTより優れていますか? はい、全体的なエッセイの選択肢としてです。ChatGPTとOpenAIモデルは、リサーチのフレームワークと反論において依然として強力です。Geminiは、完成したピースを改善するための最初の選択肢として優れています。 Geminiに私の個人的なステートメントを書かせるべきですか? いいえ。一般的な箇所、欠けている詳細、弱い構造を特定させます。その後、自分で文章を書いてください。個人的なステートメントのポイントは、その人自身です。 ChatGPT、Claude、Geminiを公平に比較するにはどうすればよいですか? 同じプロンプトとソース資料をそれらに与えてください。読む前に「最良」が何を意味するかを決定してください。回答を判断した後までモデル名を隠してください。StudyArenaの比較フローはこれを自動的に行います。 どのように評決に至ったか 2026年8月の非識別化されたStudyArenaの集計プロダクションデータを使用しました。内部および管理者のアクティビティは除外され、公開リーダーボードの対象とならない投票も除外されました。プロバイダーファミリーごとに現在のモデルバリアントをグループ化しました。選択率とは、決定的なライティングまたはエッセイの投票に登場したときに、プロバイダーの回答が選択されたことを意味します。 これがStudyArenaが推奨を行う方法です。実際の学生の選択を使用し、比較を維持します。