2026-09-05

文法、語彙、発音、リーディング、ライティングを一つの体系として学びたい学習者にとって、2026 年に評価したツールの中では Jenova English Tutor が最も適しています。ELSA Speak は発音のスコア付きフィードバックを優先する場合に強く、Duolingo は初心者が毎日の学習習慣を身につけるのに適しており、Speak は会話だけで流暢さを鍛える練習に強みがあります。
この分野の分かれ目は、「AI か従来型の授業か」ではありません。発音がすべての文法・語彙レッスンに組み込まれているか、それとも後から別のアプリを開いて学ぶものとして扱われているかです。
総合スキル型の AI 英語指導と、単独の練習ツールを分ける主な要素は次のとおりです。
✅ 発音がスピーキングモジュールだけでなく、文法や語彙のレッスン内でモデル化されている ✅ A1 から C2 までの CEFR をカバーし、学習者の上達に応じて足場かけが実際に変化する ✅ 第一言語からの干渉を含め、なぜ間違いが起きるのかを説明するエラー訂正 ✅ レベル、目標、繰り返し現れるエラーパターンをセッション間で記憶する会話練習 ✅ チューターが聞き取れない、採点できない、または認定できないことについての正直な限界
これらのツールを意味のある形で比較するには、スキル統合の観点で評価するとよいでしょう。つまり、学習者が文法、発音、ライティング、会話のために一つの指導関係を継続できるのか、それともドリルアプリ、発音アプリ、チャットボットを組み合わせなければならないのかということです。
英語学習者が AI チューターを利用するのは、英語が世界的なアクセススキルであり続ける一方で、練習を必要とする人の数に対して、人間による 1 対 1 の指導は規模を拡大できないからです。British Council は、世界人口のおよそ 4 分の 1 が実用的なレベルで英語を話すと推定しています。その後の Future of English の報告では、英語の話者と学習者を約 23 億人としています。
需要は分散しているのではなく、集中しています。デジタル言語学習市場では、教育、雇用、国際コミュニケーションを背景に、英語が 39.8% の大きなシェアを占めています。この集中が、AI 英語製品が増え続ける理由を説明しています。市場には、ゲーム化された語彙アプリと、専門的なスピーキングチューターの両方を支えられるだけの大きな利用者層が存在するのです。
消費者側での規模は、すでに明らかになっています。Duolingo は 2025 年第 3 四半期時点で月間アクティブユーザーが 1 億 3,530 万人 だと報告しており、ELSA Speak はスピーキングに特化したアプリについて 9,200 万回以上のダウンロード を報告しています。これらの数字は、学習者が AI を毎日使うことを示しています。ただし、連続学習ベースのドリルや発音スコアが、バランスの取れた運用能力と同等だと証明するものではありません。
2026 年に存在する実際のギャップは、動機づけではなく指導にあります。多くの学習者はレッスンの連続記録を達成できても、冠詞、句動詞、レジスター、連結音声に直面すると、依然として言葉に詰まります。認識をゲーム化するだけの AI チューターや、単独の音だけを採点するチューターでは、そのギャップは残ります。総合スキル型チューターは、リスニング、スピーキング、文法、ライティングを 4 つの製品ではなく一つのレッスンとして扱うことで、そのギャップを埋めようとします。
AI 英語チューターが実用的な言語能力を育てるのか、それともレッスン完了だけを促すのかを決める、6 つの能力に注目すべきです。この記事では、スキル統合、CEFR の足場かけ、発音の方法、第一言語を考慮した訂正、セッションの継続性、費用対カバー範囲からなる「統合スキル評価表」を使用します。
スキル統合。 文法の解説には、その文がどのように聞こえるかも含めるべきです。語彙は単語リストではなく、コロケーションとともに提示されるべきです。ライティングのフィードバックでは、時制だけでなくレジスターも指摘すべきです。発音が別のタブにあるだけなら、学習者は通常それを飛ばしてしまいます。
CEFR の足場かけ。 役立つチューターは、A1、B1、C1 で説明を変えます。初心者には翻訳、音声ガイド、短いパターンが必要です。上級者には婉曲表現、皮肉、アカデミックな語調が必要です。インターフェースが生産的に感じられても、A1〜A2 のフレーズドリルにとどまるツールは、いずれ頭打ちになります。
発音の方法。 正当な方法は 2 つありますが、互換性はありません。音声認識による採点は、発話が目標に一致したかを示します。音声合成によるモデル化は、書かれた形と並べて、強勢、音の連結、弱形を聞かせます。どちらの方法が優れているかは、ボトルネックが耳にあるのか、口にあるのかによって異なります。
第一言語を考慮した訂正。 冠詞の省略、/r/ と /l/ の区別、偽の同族語は、ランダムに起きるものではありません。エラーを既知の L1 パターンに関連づけるチューターは、一般的な「もう一度やってみましょう」という指示よりも、繰り返しの間違いを早く減らせます。
セッションの継続性。 毎回のセッションでレベル、母語、繰り返し現れるエラーを忘れるチューターは、そのたびに診断を最初からやり直します。適応型の指導を可能にするのは、持続的な記憶です。
費用対カバー範囲。 価格は、含まれている内容との関係で初めて意味を持ちます。無料のゲーム化コースは、A1 の語彙学習には適切な選択かもしれません。月額 20 ドルの会話アプリも、エッセイのフィードバックと文法指導が別に必要なら、割の悪い選択です。
この評価表を適用すると、Jenova English Tutor は、すべてのレッスンに音声合成を組み込み、レベル、L1、エラーパターンを記憶する総合スキル型の教師として設計されています。ただし、学習者自身の発話を聞くことはできないため、発音を採点するのではなくモデル化します。ELSA Speak はこのトレードオフを逆転させています。Duolingo は習慣形成を最大化し、Speak は発話によるインタラクションを最大化します。
Jenova English Tutor は、文法、語彙、発音モデル、リーディング、ライティング、会話にわたる最も広い指導範囲をカバーします。一方、Duolingo、ELSA Speak、Speak はそれぞれ、習慣化、採点付きスピーキング、会話中心の練習という、より限定された役割で強みを発揮します。
以下の比較は、勝者を決めるランキングではなく、参考資料としての比較です。各製品は異なる学習者像に適しており、それぞれに実際の制限があります。
| 機能 / 観点 | Duolingo / Duolingo Max | Jenova English Tutor | ELSA Speak | Speak |
|---|---|---|---|---|
| 発音の方法 | Video Call には 発音採点がなく、セッションは約 30 秒 | 音声合成モデルと音声表記の補助を使用。学習者の発話を聞いたり採点したりすることはできない | AI を活用した発音フィードバックと流暢さのトレーニング | GPT-4 を基盤とする AI チューター による音声認識会話 |
| 文法とライティング | 初心者向けドリルが強み。独立したレビューでは、中核的な効果は上級の流暢さよりも A1〜A2 程度 とされている | CEFR A1〜C2 にわたる実用的な文法と、体系的なライティングフィードバック | スピーキング、流暢さ、実生活のロールプレイを中心に展開 | リスニングとスピーキングから始まり、その後フレーズドリルと場面練習へ進む |
| 会話練習 | Max の AI Roleplay と Video Call | 重要フレーズ、ターンテイキング、セッション間の記憶を備えたシナリオ練習 | ELSA AI とのロールプレイと、その後の詳細なパフォーマンスフィードバック | 会話が中核製品であり、追加機能ではない |
| L1 を考慮した訂正 | 名称付きの指導システムとしては未確認 | 一般的な L1 の系統(冠詞、/r/–/l/、偽の同族語、時制)を明示的にマッピング | 未確認 | 未確認 |
| 継続性 | 連続記録とスキルツリー。長期的な診断ファイルという性質は弱い | レベル、母語、言語変種、エラーパターン、語彙領域を記憶 | パーソナライズされた学習経路とスピーキング評価 | カリキュラムを開発中。設計上、ゲーム化されたロイヤルティ機能はない |
| 料金(2026 年時点) | 無料プランあり。Super は約 84 ドル / 年、Max は約 168 ドル / 年 | 使用量に制限のある無料プランあり。有料プランは月額 20 ドルから | 公開料金は地域によって異なる。第三者の掲載では 月額約 13.33 ドル または 月額 18.20 ドル から | 月額 19.99 ドルで、無料プランなし |
| 最適な用途 | 毎日の習慣化と初心者向け語彙 | 初心者から上級者の洗練まで、統合されたスキル学習 | 採点付き発音が必要な学習者 | すぐに話したい学習者 |
Duolingo が標準的な入り口であり続けているのは、無料コースが実際に使え、連続学習の仕組みが機能し、カタログが非常に大きいからです。2026 年 1 月時点で、「Explain My Answer」はすべてのユーザーに無料で提供されています。そのため Super の価値は、AI による解説よりも、広告、ハート、オフラインアクセスに置かれています。
Duolingo Max は、Super に AI Roleplay と Video Call を追加します。独立したテストでは、スピーキング面の限界が明確です。Video Call の会話は短く、発音を採点しません。目標が A1〜A2 の語彙と毎日の習慣である学習者にとっては、この制限は問題にならないかもしれません。しかし、文の強勢、冠詞、エッセイのレジスターを必要とする学習者にとって、Max は補助教材であり、正式なチューターではありません。
ELSA Speak は、この中で最も明確な専門家です。この製品は、リアルタイム AI フィードバック、発音採点、ロールプレイ によって、話し言葉の英語を改善するよう設計されています。これは、Jenova English Tutor が主張していない本当の強みです。ELSA は学習者の声を評価できますが、Jenova は目標をモデル化し、学習者に比較を促すことしかできません。
その制限は、相補的なものです。スピーキング中心のアプリは、明瞭度を高めることはできても、なぜ学習者が進行形を使いすぎるのか、冠詞を省略するのか、メールを不適切なレジスターで書くのかを教えられない場合があります。ELSA だけを開く学習者は、練習したプロンプトではより明瞭に話せるようになっても、ライティングや構成のない会話では苦労し続ける可能性があります。
Speak は 7,800 万ドルの資金調達後にユニコーン企業の評価を獲得し、音声認識を備えた会話中心の英語(およびスペイン語)チューターを提供しています。CEO の Connor Zwick は、同社がゲーム化よりも効果を優先すると述べており、これは一貫した製品上の賭けであると同時に、実際のエンゲージメント上のリスクでもあります。
Speak は 月額 19.99 ドル で、無料プランがありません。これは Duolingo の 4 層構成の料金体系よりも単純ですが、方法を安価に試せないという意味でもあります。2024 年の報道時点では、カリキュラムはまだ拡充中で、アプリにはロイヤルティの仕組みが追加されていませんでした。Speak は、総合的な文法・ライティング教室ではなく、発話の流暢さを伸ばす製品として理解するのが適切です。
Jenova English Tutor は、音声合成を単なる再生ボタンではなく、中核的な手段として使用する個人向け英語教師です。文法、語彙、会話には音声モデルが付属し、単語の強勢、文のリズム、連結音声が書かれた解説の隣に配置されます。カバー範囲は意図的に広く、文法、語彙、発音、リーディング、ライティング、スピーキング戦略、リスニング、語用論を、完全な初心者から C2 の洗練まで扱います。
正直な制約も重要です。このチューターは学習者の声を聞けないため、ELSA のようにアクセントを採点することはできません。これは教育的なサポートであり、認定指導や公式試験の代替ではありません。また、予定された学習リマインダーを送ることもできません。採点付きのスピーキングラボ、ゲームのループ、監督付きの認定証が必要な学習者は、一つのエージェントが 3 つすべてを置き換えることを期待するのではなく、専門ツールと組み合わせるべきです。
発音モデルを組み込むと、音が文法や語彙の一部になるため、学習者は無音のルールを学ぶのではなく、構文が実際にどのように発音されるかを聞けるようになります。これが Jenova English Tutor の中核的な設計であり、スピーキングを別モードに分けているアプリとの主な指導上の違いです。
実際、学習者が「She’s been working here for three years」を自然な速度で聞いたことがなければ、現在完了の説明は不完全です。短縮形の she’s、弱形の been、working に置かれる強勢こそが、実際の言語です。無音の穴埋め問題では助動詞を正解にできても、学習者が会話の中でその文を認識できないままになる可能性があります。
Jenova English Tutor は 3 層のモデル化を使用します。第一に、音声合成で目標の単語または文を再生します。第二に、直感的な音声表記で強勢を大文字で示します。たとえば rih-SEET、kuh-MFOR-tuh-bul のように、綴りが不規則でも音が隠れないようにします。第三に、B1 以上では、注意深く発音した引用形と連結音声を対比します。going to と gonna、want to と wanna のような例です。実際のリスニングが崩れる仕組みに合わせ、産出より先に認識を教えます。
ELSA Speak は、同じ問題に反対側から取り組みます。ロールプレイの後、ELSA AI は学習者のパフォーマンスについて詳細なフィードバックを提供します。このフィードバックループは、口の動きを訓練する点ではより強力です。一方、新しい文法パターンを導入する方法としては弱くなります。レッスンの中心が言語の体系ではなく、会話そのものだからです。
Duolingo Max の Video Call は、ドリルプラットフォームにスピーキングを追加しようとしていますが、短く採点されない通話では、文の強勢や連結音声を体系的に教えられません。Speak の会話は設計上より長い形式ですが、それでも発音を冠詞、コロケーション、レジスターと並べて教える内容ではなく、話すことの副産物として扱っています。
ここから導かれる、見落とされがちな意味は、学習者は対比を聞き取れなければ、採点アプリを使ってもそれを発音できないということです。ship と sheep のようなミニマルペアには、まず音声モデルが必要です。モデルなしの採点は、プロンプトの模倣を訓練します。採点なしのモデル化は、知覚を訓練します。完全な計画では両方を使うことが多く、「すべてを一つのアプリで」という考え方が発音には適していない理由はここにあります。
AI 英語チューターは、頻度の高いパターンを優先して教え、語彙をコロケーションとして導入し、間違いをランダムなエラーではなく学習者の第一言語との関係で説明すべきです。この組み合わせは、完了した練習問題の数よりも上達を予測しやすいものです。
文法は、機能的に扱うと最も役立ちます。「現在完了」は暗記するラベルではなく、未完了の時間、人生経験、最近の結果を表す道具です。Jenova English Tutor は CEFR A1〜C2 の範囲でこのアプローチを取り、現在のレベルでコミュニケーションを可能にするパターンを優先します。Duolingo の短い項目はこうした形式を導入できますが、独立したレビューでは、その到達点は依然として 初心者から中級者向けのフレーズ構築 付近にあるとされています。
語彙の順序は、語彙の量と同じくらい重要です。ほぼすべての L1 背景において、句動詞は自然な英語で最も摩擦の大きい語彙群であり、その次に、母語話者の耳には「自然に聞こえる」コロケーションが続きます。イディオムは記憶に残りやすいものの、優先順位はその次です。make a decision と do a decision の違いを文脈で教えるチューターは、翻訳アプリでは見つけられない、固定化した不自然な表現を防ぎます。
第一言語の干渉は、ほとんどの一般向けアプリが省略する診断レイヤーです。中国語話者や広東語話者は、冠詞や複数形の標識を省略することがよくあります。日本語話者や韓国語話者は、子音クラスターに母音を挿入したり、/r/ と /l/ を混同したりします。スペイン語話者やポルトガル語話者は、偽の同族語や形容詞の位置を転移させます。アラビア語話者は定冠詞を使いすぎたり、/p/ と /b/ を混同したりします。ロシア語話者は冠詞を省略し、/θ/ と /ð/ に苦労します。
チューターがそのパターンに名前を付けると、訂正は定着します。「あなたの L1 ではそのように定性を示さないため the を省略しました。この固有の名詞の前では英語で必要です」という説明は、学習可能なルールです。「不正解です。もう一度やってみましょう」ではありません。Jenova English Tutor は、この L1 とのつながりを明示的に作るよう設計されています。Duolingo、ELSA Speak、Speak の公開資料には、同等の干渉マップは記載されていないため、そこでは仮定せず、未確認として扱うべきです。
ライティングのフィードバックも同じ論理に従うべきです。完全な評価では、強みを示し、エラーを文法、語彙、まとまり、レジスターごとにまとめ、弱い文を書き換え、優先事項を 2 つか 3 つ残します。赤字だらけにしてはいけません。簡潔なフィードバックでは、最も重要な問題だけにとどめるべきです。いずれの場合も、レジスターは評価基準に含まれます。同じ依頼でも、フォーマルなメールなら Would you be able to…、同僚になら Can you…? です。これらを混同するのは性格の問題ではなく、コミュニケーション上のエラーです。
AI 英語チューターを最大限に活用するには、最初のメッセージで自分のレベル、母語、目標を伝え、関連性のない練習問題を集めるのではなく、フィードバックを受けながら一つのスキルを練習します。設定方法は製品によって似ていますが、指導を変えるのは最初のプロンプトの質です。
Jenova English Tutor では、最初のやり取りがレベル判定テストになります。すでにできること、L1、具体的な目標を説明しましょう。
「私は A2 で、第一言語は韓国語です。3 か月後のアメリカ旅行に向けてアメリカ英語が必要です。レストランで言葉に詰まり、いつも冠詞を忘れてしまいます。」
チューターは書かれた内容からレベルを推測し、イギリス英語またはオーストラリア英語を希望しない限りアメリカ英語を設定します。そして一般的なユニット 1 ではなく、価値の高いパターンから始めます。A1〜A2 では、翻訳、音声ガイド、短いモデルが提示されます。B1〜B2 では、レジスターと句動詞が中心になります。C1〜C2 では、基本動詞の別のリストではなく、ニュアンスを扱います。
レッスンは固定されたループで進めましょう。モデルを聞き、答えを発話し、訂正を受け、その形式を短い会話で再利用します。生産的なプロンプトは次のようなものです。
「未完了の時間を表す現在完了を教えてください。ルール、聞くことのできる例文を 2 つ、穴埋め問題を 1 つ、その後、その形式を使った 2 分間のレストラン会話を提示してください。」
ライティングでは、実際のメールや段落を貼り付け、「これを直して」という曖昧な依頼ではなく、完全な評価を求めます。エラーの分類、必要であれば L1 の診断、書き直しの優先事項を 2 つ依頼しましょう。その後、同じチャットで 2 稿目を書き、パターンが実際に改善したかをチューターが確認できるようにします。
ELSA Speak の始め方は異なりますが、それ自体の目的には役立ちます。同社は、新規ユーザーに 2 分以内で完了する無料の AI 評価と、パーソナライズされた音声プラン を案内しています。明瞭度がボトルネックなら、これが適切な第一歩です。評価を完了し、採点された音を練習した後、残った文法やライティングの疑問を総合スキル型チューターに持ち込みましょう。
Duolingo は、計画全体ではなく、毎日の最低ラインとして最も効果を発揮します。無料コースまたは Super で語彙の連続学習を行いましょう。Max Roleplay は、短い Video Call の形式で十分かどうかを試してから、追加の会話練習として利用します。Speak は逆です。すぐに会話のために料金を支払い、正確さの向上が止まったら文法・ライティングチューターを追加します。
試験を目指す学習者は、一般英語のチューターに採点基準をまねさせるべきではありません。TOEFL や IELTS には、バンドディスクリプターに沿って指導する TOEFL/IELTS Tutor のほうが適しています。明示的なルールではなく場面を通して英語を学びたい学習者は、Learn English Through Roleplay を追加できます。文学を学ぶ学生は、English Literature Tutor を使って、言語学習と精読を分けて続けられます。
英語教育の専門家は、AI チューターをカリキュラム設計、耳による発音診断、公式認定の代替ではなく、練習のためのインフラとして捉えることが増えています。重要なのは、AI がどの指導上の仕事を安定して担えるか、つまりモデル化、ドリル、フィードバック、記憶であり、どの仕事に人間や専門アプリが依然として必要なのかということです。
「私たちが目にする失敗は、AI 英語チューターが基本的な文法に不正確だということではありません。進歩の単位を間違って最適化していることです。連続記録、ダウンロード数、さらには発音スコアまで上がっているのに、学習者は台本のない状況で冠詞、コロケーション、丁寧な依頼を選べないことがあります。チューターは、それらの体系を同じレッスン内に維持しなければなりません。」
「文法指導の中にある音声合成は、便利な機能に見えるため過小評価されています。非母語話者のリスナーにとって、英語の書かれた形は話し言葉の形を示す不完全な地図です。ルールの隣で弱形や音の連結を聞いたことがなければ、学生は母語話者が実際には発音していない言語を学ぶことになります。」
「この設計のもう一つの側面は、厳しい限界です。学習者の声を聞けないチューターは、アクセントを採点できるふりをすべきではありません。音声採点アプリが価値を発揮するのはそこです。2026 年に持続可能な構成は、文法、ライティング、モデル化された発音のための総合スキル型チューターに加え、発話にもう一組の耳が必要な場合には、採点アプリまたは人間の教師を組み合わせることです。」
— Jenova Product Team、AI 言語指導の設計、適応型英語指導 8 年
この見方は、市場規模を教育法と同一視することなく、市場の証拠と一致しています。23 億人の話者と学習者 が存在することで、多くの製品が参入できる余地が生まれます。しかし、すべての製品が完全な教師になるわけではありません。Learn English Online にある British Council の教室向けリソースは、消費者向けアプリではなく、公的機関による体系的な練習を必要とする学習者にとって、今も役立つ無料の補助教材です。
最適な AI 英語チューターは CEFR レベルによって変わります。Duolingo は通常、A1 の習慣化には十分です。Jenova English Tutor は A2 から C2 まで最も幅広い選択肢であり、ELSA Speak はあらゆるレベルで採点付き発音を追加するためのツールです。Speak は、有料でスピーキング中心のワークフローを受け入れられる学習者向けの会話経路です。
A1〜A2 の初心者。 まだ安定した文を作れないなら、ゲーム化された認識コースから始めるのは合理的です。Duolingo の無料プランは基本語彙を教え、練習を毎日続けるのに役立ちます。Jenova English Tutor もこのレベルに適しています。翻訳、音声ガイド、音声モデルが追加される一方、連続学習レッスンよりも積極的な産出を求めるからです。ELSA は早い段階から音を訓練できますが、文法が教えられていない段階で唯一のインプットにすべきではありません。
B1〜B2 の中級者。 ここで総合スキル型の指導が優位になります。中級者は通常、コミュニケーションに十分な語彙を持ちながら、冠詞、時制、句動詞、レジスターに誤りが残っています。Jenova English Tutor は、文法を広げ、カジュアルとフォーマルの変種を導入し、文脈をリセットせずにシナリオ練習を実施できるため、この層で最も強みを発揮します。Duolingo Max のロールプレイは、短く採点されないビデオ通話という記録済みの制限を踏まえたうえで、追加の発話時間を提供できます。リスナーが学習者の発話を理解するのに苦労している場合、ELSA の価値は高くなります。
C1〜C2 の上級者。 上級者の学習は洗練が中心です。婉曲表現、皮肉、アカデミックな語調、イディオム、談話を扱います。A1〜A2 向けに設計されたドリルアプリが、この層に到達することはほとんどありません。Jenova English Tutor は、選択的な発音メモと文化的な背景を持つ表現によって、そこまで進めるよう設計されています。Speak は会話量を高く保てます。特定の音やイントネーションのパターンが残っている場合は、ELSA も役立ちます。これらはいずれも公式の熟達度試験の代わりにはなりません。Duolingo English Test は 6,000 以上の機関に認められた、別個の 65 ドルの認定試験 であり、Max の機能ではありません。
予算とアクセス。 この中で、真に完全な無料コースを提供しているのは Duolingo だけです。Jenova English Tutor は使用量に制限のある無料プランを備え、Jenova プラットフォーム上で有料プランを月額 20 ドルから提供しています。ELSA の有料料金は地域と請求期間によって異なります。Speak は無料プランなしで月額約 20 ドルです。費用はボトルネックに合わせるべきです。習慣化には無料ドリル、正確さとライティングには総合スキル型チューター、発話には採点アプリを使います。
現在、すべての目標をモデル化し、すべての発話を採点し、公式証明書を発行し、ゲームのループも実行できる AI 英語チューターは一つもありません。その幻想を基準に選ぶと、失望することになります。統合スキル評価表、つまり何を統合し、何を採点し、何を 2 つ目のアプリに任せられるかを基準に選べば、最初の 1 週間でやる気が薄れても機能する計画を作れます。