記事書くためのツール
2026年のAIライティングアシスタント、本当に解決する悩みで選ぶ
3つのAIシステムのディープリサーチを統合し、主張を一次情報と照らし合わせ、確認できなかったものは落としました。453人のプロフェッショナル、33件の実験、2,582人の書き手、そしてAIが書いた謝罪への警告。
文 Samet Durgun · Subtextの共同創業者 · 14分で読めます
今年見つけたAIライティングアシスタントのリストは、どれもアフィリエイトページか、ベンダー自身が自社を1位に置くブログでした。信頼できるものが欲しかったので、自分でつくることにしました。同じリサーチのブリーフを3つのディープリサーチ系AI(ChatGPT、Claude、Gemini)に通し、レポートを統合したうえで、重要な主張は一次情報と照らし合わせて確認しました。途中で変わった数字もあります。2件の研究はどこにも見つからなかったので、削除しました。生き残ったものにはすべて、出典へのリンクをつけています。
始める前に、ひとつ開示しておきます。私はSubtextをつくっています。メッセージが相手にどう伝わるかを扱うアプリです。だからこの話題の対人的な側面に肩入れしがちですし、コミュニケーション研究を趣味で読んでいることも、この記事の後半でバレると思います。
結論を先に
ほぼひとつの言語で書いていて、打っている最中に文章を整えてほしいなら、Grammarlyがいまも最強のオールラウンド・エディターです。すでにある一文にもっといい言い回しを探しているなら、WordtuneとDeepL Writeを試してください。私のようにドイツ語と英語を行き来するなら、DeepL Write、LanguageTool、Grammarlyを同じ1週間で試して、いちばんイライラしないものを残せばいい。難しいメッセージには、どの文法チェッカーも役に立ちません。チャットボットにきちんと状況を説明するか、私が共同創業したSubtextを使ってください。Subtextは文脈を尋ね、一文字も変える前にまず下書きを読みます。メールの量をこなすだけなら、受信箱にすでに入っているGeminiかCopilotでほとんど間に合いますし、メールが仕事そのものになったらSuperhumanが次の一手です。
そして、私自身のツールの使い方を変えた発見がひとつあります。相手がAIの関与を疑うだけで信頼が下がる、しかも温かく個人的なメッセージほど代償が大きい、という結果を示す研究が複数あるのです。その研究はこのあと詳しく紹介します。
どのツールが優れているかを証明した研究はない
実際の文章で、GrammarlyとWordtuneとQuillBotを比べた独立系のベンチマークを探しました。存在しません。いちばん近いのは、アルゴリズムによる文章フィードバックを扱った33件の実験を対象にした2026年のAssessing Writing誌のメタ分析1 です。フィードバックは全体として効果があり(g = 0.36、小から中程度の効果)、第二言語で書く人がいちばん恩恵を受け、個々のツール間の差は統計的に有意ではありませんでした。思わず笑ったのは、GrammarlyとPigaiのフィードバックは学生の文章を測定可能なほど改善した一方で、ChatGPT単体のフィードバックは有意水準に届かなかったという点です。
Zapierは50以上のライティングツールをテストし2、プロダクト側から見ても近い結論に達しています。生のテキスト生成そのものはツール間でかなり似通ってきたので、日々どれを使うかを決めるのはワークフローと制御性、連携先になっている、と。だから「ツールAは精度94%、ツールBは87%」といった一覧記事を見たら、それは飾りだと思ってください。そうした数字の裏にある手法を公開している例は、誰も見たことがありません。
「ライティングアシスタント」はいまや4つの別物を指す
このカテゴリーはすでに分裂しています。Grammarly、LanguageTool、DeepL Write、ProWritingAidのようなエディターは、あなたがすでに書いた文章に反応します。WordtuneとQuillBotはリライトツールで、一文や一段落の代案を生成するためのものです。ChatGPT、Claude、Geminiはまず状況を考え、そのあとで書きます。JasperやWriter、Anywordのようなプラットフォームは、マーケティングや企業向けの文章を量産するために存在します。LanguageTool自身のサイトでも、この線引きに近いことを書いていて、文章を改善するツールと、代わりに生成するツールを分けています。AIを組み込んだメールクライアントは5番目のグループで、これは後段で別に扱います。
エディターを、解決する悩み別に見る
**Grammarly**がいまもデフォルトなのには理由があります。ブラウザでも、Gmailでも、Docsでも、スマホでも動き、プロンプトを待たずに打っている最中から反応します。トーン検出機能3 は、下書きが自信満々から不安げまでどう受け取られそうかにラベルをつけ、リライト機能はリクエストに応じてフォーマル度を調整します。同社は1日4,000万人以上のユーザーがいると発表しています。Proは年間プランで月額およそ12ドル、月払いなら30ドルで、AIプロンプトは2,000回分込みです。ただし注意点が2つ。トーンのラベルはあくまで製品側の主張で、実際の受け手の反応と突き合わせた独立研究はありません。リライトも個性を削り落とす傾向があり、これは後段で紹介する均質化の研究を見れば軽視できません。知っておく価値があるのは、Grammarlyは2025年にメールクライアントSuperhumanを買収し、親会社の名前までSuperhumanに変えたことです。今後さらにメールとの統合が深まると見ていいでしょう。
**DeepL Write**は最初のリサーチでは見落としていましたが、特にヨーロッパでは上位に入るべきツールです。文法を直し、文全体の言い換えを提示し、ビジネス、アカデミック、カジュアルといったスタイルや、フレンドリー、自信のある、外交的といったトーンを切り替えられます。対応言語は英語、ドイツ語、フランス語、イタリア語、ポルトガル語、スペイン語です。私は毎日英語とドイツ語を書き、たまにトルコ語も書きますが、最初の2つについてはDeepL Writeがいちばんバイリンガルの同僚が言い換えてくれるような感覚に近いです。Write Proは月額およそ7.50ドル。私にとっての不足は、トルコ語がまだないことです。
**LanguageTool**は派手さではなく対応言語数で勝負しています。30以上の言語で文法とスタイルをチェックし、ドイツ語をはじめヨーロッパの言語がいちばん手厚く、オープンソースのコアと、テキストの行き先にこだわるチーム向けのセルフホスティングも用意しています。Premiumは長期プランで月額5ドル前後。出力はGrammarlyより控えめで、提案の数も書き直しの量も少なく、それを好む人もいるでしょう。
**Wordtune**はある一瞬をうまく解決します。言いたいことは自分でわかっているのに、文がそれを言ってくれない瞬間です。フォーマル度の異なる複数の書き直しを生成し、短縮も拡張もでき、行き詰まったところで続きを書いてくれます。無料プランは1日10回の書き直し、有料プランはキャンペーン次第でだいたい月7〜10ドルの間を動いています。メールや短いメッセージに関しては、私が試した中でいちばん純粋なリライトに徹したツールです。
**QuillBot**は言い換えマシンです。流暢さからアカデミック、ヒューマナイザーまで10のモードがあり、語彙が元の文からどれだけ離れるかを調整するスライダーもついていて、年払いなら月額8ドル前後。指示すればトーンも変わります。ただし、書き直した版が読み手その人にどう届くかは、どんな言い換えツールも答えてくれない問いで、そのずれはエッセイよりメッセージのほうが響きます。
**ProWritingAid**は横に広げるのではなく縦に深めました。ペース配分、繰り返し、読みやすさ、紋切り型表現を扱う25種類以上の分析レポートに加え、フィクション向けの原稿全体の分析もあります。いちばん敬意を払いたい設計判断は、書き直さずに分析するアシスト型AIと、新しい文章を生成する生成AIを分けていることです。月額およそ10ドル、買い切りライセンスは399ドル前後。小説ならGrammarlyよりこちらを選びます。WhatsAppのメッセージなら、選びません。
ChatGPT、Claude、Geminiはゲームが違う
文法チェッカーが見ているのは目の前の一文だけです。チャットボットは状況全体を抱えられます。相手が誰か、それまでに何があったか、何を達成したいか、このメッセージがどう響くのが怖いか。デリケートな話ほど、修正より文脈がものを言います。
それぞれに独自の強みがあります。ChatGPTは会話の中で直接編集できるcanvas形式の下書きを追加し、単なるチャットログではなく実用的な執筆面になりました。Claudeはアップロードした文章サンプルからカスタムスタイルを構築するので、フォーマル/カジュアルの切り替えではなく、あなたの話し方そのものを学習でき、Projects機能は長い文書とその文脈をひとまとめに保ちます。GeminiはGoogleのスタック全体に入り込んでいて、2026年春以降はDocs内で文書の下書きを書き4、その際DriveやGmail、Chatの素材を使い、Match writing style機能は文書全体をひとつの一貫した声に寄せて編集します。
落とし穴は2026年のComputers and Composition誌の研究5 にあります。研究者はClaude、Gemini、Copilot、ChatGPTのバージョンを含む8つの生成AIプラットフォームに学術文章のサンプルを編集させ、その出力を人間による編集と比較しました。モデルが拾った文単位のエラーは人間の基準より少なく、一部のエラー種別は過剰に指摘し、別の種別は見逃していました。これらのシステムは書き直しはうまいのに、自信ほどには校正がうまくないのです。AIが関わった下書きは必ず専用のチェッカーに通すようにしているのは、この研究のせいです。
メールは、すでにお金を払っているものから始める
Gmail内のGeminiはスレッドの文脈を踏まえて返信を下書き・書き直しし、過去のメールを使った提案の個人化も始まっています。Outlookでは同じことをCopilotがやってくれます。下書き、トーンのコーチング、スレッド要約までこなしますが、Microsoft 365 Copilotのライセンスが必要です。iPhoneとMacでは、Apple Intelligenceがテキストとメールを無料・オンデバイスで別トーンに書き直します。レビュアーたち6 はそれを「有能で控えめ」と評していて、私もその両方の言葉に同意します。
メールに生きている人向けの有料アップグレードもあります。Superhumanはあなたの声で返信をあらかじめ書き、相手ごとの履歴をもとにトーンを調整し、音声機能付きのBusinessティアなら月額30〜40ドル前後です。Superhumanによれば、テストでは自動下書きの40%が1日以内に送信され、その大半が無編集のまま送られたとのこと。どちらの数字もSuperhuman自身の発表なので、独立した誰かが測定するまではマーケティングだと思っておいてください。ShortwaveはGmail専用で、より安く声を模倣しますが、価格の記載が情報源によってあまりに一貫していないので、契約前に公式サイトで確認することをおすすめします。Missiveは受信箱を共有するチーム向けで、動かすモデルを選べます。そしてFlowriteを覚えている人がいれば、それは2025年1月に買収され7、MailMaestroに統合されました。
専門特化型を、手短に
フィクション作家にはSudowriteがあります。Museという文章に特化したモデルと、章をまたいでキャラクターとプロットの一貫性を保つStory Bibleを核にしていて、月額およそ10ドルから。学術系の書き手にはまるごとひとつのサブエコシステムがあります。発見と下書きにはSciSpace、系統的レビューにはElicit、素早いエビデンス確認にはConsensus、投稿可能な原稿にはPaperpal。これらについて出回っている比較数値は、たいていベンダー自身のベンチマークページ由来なので、ピッチデッキを読むつもりで読んでください。マーケティングチームにはJasperがあり、ブランドボイスとスタイルルールを月額39ドルから規模拡張可能な出力に変え、Anywordは予測パフォーマンスモデルでコピーを採点します。その精度の数字もAnyword自身が出しているものです。企業にはWriterがあり、何千人もの社員をまたいで用語、スタイル、コンプライアンスを一貫させるために存在します。
研究は、AIがあなたの文章に何をすると言っているのか
いちばん強い証拠は、速さと仕上がりについて
いまも最良の因果関係研究はScience誌に載ったNoyとZhangのランダム化実験8 です。453人の大卒プロフェッショナルに職種ごとのライティング課題を割り当て、半数にChatGPTを使わせました。平均の完了時間は40%減り、評価された品質は18%上がり、いちばん弱い書き手がいちばん伸びました。これは2023年初頭のGPT-3.5の話で、いまのモデルはもっと強力です。
文単位を超えると、証拠は薄くなる
Journal of English for Academic Purposesに載った2026年の系統的レビュー9 は25件の実証研究を統合し、役割分担を見つけました。チャットボットが発想と初期の下書きを担当し、自動フィードバックツールが修正を担当する、という分担です。報告されている効果は表面的な品質と執筆プロセスに集中していて、論証や構成についてはより弱く、結果もばらついています。Assessing Writing誌のメタ分析も同じ方向を指していますが、ひとつひねりがあります。深いレベルの改善が見られた場合、それは表面的な改善より時間が経っても長持ちしていたのです。
みんな同じ響きになっていく
DoshiとHauserは短編小説を使った実験を行いました10。Science Advances誌に掲載されたものです。AIのアイデアを使えた書き手は、より創造的で書きぶりも良いと評価される作品を生み出し、特に創造性が低かった書き手ほど伸びました。ただし、同じ作品同士は測定可能なほど似通ってもいました。個人としては上達し、集団としては全員が収束していく。関連研究のAI Ghostwriter Effect11 は、自分では書いたと思っていないAIの文章にも、人は喜んで自分の名前を署名することを発見していて、これはこれで静かな問題です。
オートコンプリートは、気づかないうちに意見を動かす
2026年3月、Science Advances誌は2,582人の参加者による2件の事前登録実験12 を発表しました。参加者は社会問題についての文章を、微妙に偏ったオートコンプリート案を出すAIアシスタントと一緒に書きました。その後の本人の意見は、AIの立場のほうへ動いていました。ほとんどの人は気づいていませんでした。事前に警告しても効果はなく12、事後の説明も効果はありませんでした。同じ主張が静的なテキストとして提示されたときより、対話的な提案を通したときのほうが効果は強く出ました。オートコンプリートはいまやGmailにも、キーボードにも、上に挙げたツールの半分にも入り込んでいるので、この研究はずっと頭から離れません。
この先どこへ向かうかのヒントも。アライメント研究は、その場限りのプロンプトの代わりに、あなたの文章サンプルから個人のスタイルのルールを推論する13 方向へ進んでいて、これはパーソナライゼーション競争の次の行き先を示唆しています。
AIが書いたと疑われたとき、人はあなたをどう評価するか
SEO向けの一覧記事はこの話を飛ばしますが、メッセージに関してはどの機能よりもここが重要です。
コーネル大学の研究者は、AIのスマートリプライを使った会話に人を参加させ、その結果をScientific Reports誌に発表しました14。返信は会話を速くし、言葉遣いをより前向きにしました。ところが、相手がAIを使ったと疑っただけで、その相手をより非協力的だと評価し、距離を感じるようにもなりました14。ダメージを与えたのは疑いそのものであって、実際にAIが関わっていたかどうかは関係ありませんでした。
CHI 2022の研究15 はお悔やみや励ましのメールを対象にしました。AIの関与が開示されると書き手への信頼は下がり、参加者はAIが書いた感情的なメッセージを「偽物っぽい」と表現しました。もっと前の研究がすでにこのパターンに名前をつけています。Replicant Effect16 です。機械が書いたと疑われたプロフィールは、信頼が下がるという現象です。
私がいちばんよく引用する2025年の研究は、南カリフォルニア大学とフロリダ大学17 によるものです。1,000人を超える現役の社会人が、AIの助けのレベルを変えた職場メッセージを評価しました。AIを重く使った上司が誠実だと評価された割合はおよそ40〜52%だったのに対し、AIの助けが少ないメッセージは83%が誠実だと評価され、プロフェッショナルらしさの評価も同じように下がりました17。人は自分自身のAI利用については、上司のそれよりずっと甘く判断してもいました。著者たちの実務的な読み解きは私の考えと一致します。仕事のメールへの軽いAIの手直しは代償なく通り、重い生成のところで敬意が削られていく、という読みです。
AIES 2025で発表された論文18 は、そのメカニズムを説明します。AI支援ありとラベル付けされたメッセージは、両方向で人格のシグナルとして弱く読まれます。AI支援ありの謝罪は温かみが薄く感じられ、AI支援ありの非難は冷たさが薄く感じられる。支援なしの文章は「コストのかかるシグナル」として働きます。相手のために労力を払った証拠になる、ということです。
バランスも取っておくと、2025年のiScience誌の研究19 は、AIの介在がある種のやりとりでは信頼構築を早めうることを見つけています。代償が集中するのは、メッセージが労力や気持ちを運ぶはずの場面で、実務的なやりとりでは和らぎます。
というわけで、ここまでの内容に裏付けられた私自身のルールはこうです。事務的な連絡はAIに全面的に任せる、仕事のメールは軽くAIを使う、そして謝罪やお悔やみ、関係を左右するようなことについては自分で書き、AIは文法チェックだけに使う。難しいメッセージに助けは欲しいけれど、人間らしさまで外注したくはない。この緊張関係こそSubtextで大事にしていることで、この種の研究を読むたびに、それが実在する緊張だと確認させられます。
何度も書き直してしまうメッセージのために
ここまでのカテゴリーはどれも、「これをもっと良くして」という問いに何らかの形で答えています。エディターは書いたものを直し、リライトツールは代案を生成し、チャットボットは説明すれば状況を考え、マーケティングプラットフォームは大量にコピーを生産します。難しい個人的なメッセージにとって役立つのは、別の問いです。送る前のいま、これは何を語っているか、という問いです。
上のセクションの研究を読んで、この問いのほうが書き直しより重要だと確信しました。重い生成が読み手の目に映る誠実さを削り、支援なしの文章がコストをかけた労力のシグナルとして読まれるのなら、欲しいのは下書きを置き換えるツールではなく、下書きをあなた自身に返してくれるツールです。さっき自分で立てたルール、自分で書いてAIはチェックだけに使う、で言えば、これはそのチェックの工程にあたります。
その仕事のためにつくられたのがSubtextで、私はこれを共同創業しているので、これはレビューではなく主張として読んでください。一文ではなくやりとり全体を読み、あなたの下書きが受け取る側に何を伝えそうかに名前をつけ、その原因になっている言い回しを指し示します。だから送るものは最後まであなた自身の言葉のままです。チャットボットも、文脈を貼り付けて正しい問いを投げれば同じ場所にたどり着けます。違うのは、夜11時にそれを忘れずにやるのがあなたなのか、こちら側なのか、という点です。
| エディター | リライトツール | チャットボット | Subtext | |
|---|---|---|---|---|
| 文法とスタイルの修正 | 対応 | 部分的に対応 | 対応 | 対応 |
| 選んだトーンでの書き直し | 対応 | 対応 | 対応 | 対応 |
| 下書きがどう伝わりそうか教えてくれる | トーンのラベル | 非対応 | 聞けば教えてくれる | 対応 |
| メッセージ単体でなく、やりとり全体を読む | 非対応 | 非対応 | 貼り付ければ対応 | 対応 |
| 誰が受け取るのかを尋ねる | 非対応 | 非対応 | 非対応 | 対応 |
| 向いている用途 | 文書全般の執筆 | 文や段落単位の書き直し | うまくプロンプトを書けば何でも | 人と人のメッセージ |
ここでの「エディター」はGrammarly、LanguageTool、DeepL Write、「リライトツール」はWordtuneとQuillBot、「チャットボット」はChatGPT、Claude、Geminiを指します。
私ならこう組む
たいていの執筆は、2つのサブスクリプションでカバーできます。
- 打つ場所にいつもいるエディターをひとつ。主に英語で書くならGrammarly、複数の言語をまたぐならDeepL WriteかLanguageTool。
- 文脈の重い作業のためのチャットボットをひとつ。すでに使っているエコシステムから選べばいい。
そのうえで、状況に応じて足すもの。何度も書き直してまだ送れていないメッセージにはSubtext、一文が言うことを聞かないときはWordtune、原稿にはProWritingAid、1日に何十通もメールを送るようになったらSuperhuman、チーム全体でひとつの声が必要になったらJasperかWriter、フィクションにはSudowrite。
この記事内の価格は2026年8月時点で確認したものです。各社はプランを頻繁に変えるので、私のここの数字より各社の価格ページを信じてください。
ここまで全体を貫くパターンはこうです。基本性能はすでに収束していて、いまツールを分けているのはモデルの周りにあるもの。あなたのワークフローにどう馴染むか、そして読む相手に何をするか。その2つ目の問いこそ、私がこのリサーチでも、自分がつくるものでも、ずっと引っ張り続けているものです。
見落とした研究や、もっと厳しく検証すべき主張を見つけたら、私に連絡してください。この記事を守るより、間違いを直すほうを選びます。
Samet DurgunはSubtextの共同創業者です。メッセージの感情的なトーンを捉え、あなた自身の言葉で書き直すアプリをつくっています。ベルリン在住。
出典
本文中のリンクは、一次情報が存在するかぎり、そこへ直接向かっています。研究と報道は登場順に番号を振り、下の製品ページは本文中でリンクした箇所があり、ここには参照用として一覧にしています。価格や機能は変わるので、購入前に確認してください。
- Can algorithm-based feedback help students to write better? A meta-analysis, Assessing Writing, 2026
- Zapier、AIライティングツールの比較記事、50以上を検証
- TechCrunch、Grammarlyのトーン検出機能について
- Google Workspace Updates、Docs内のGemini、2026年4月
- Is genAI a good editor of academic writing?, Computers and Composition, 2026
- Six ColorsによるApple Intelligenceのレビュー
- Maestro LabsがFlowriteを買収、2025年1月
- Noy & Zhang, Experimental evidence on the productivity effects of generative AI, Science, 2023
- A systematic review of AI-assisted academic writing, Journal of English for Academic Purposes, 2026
- Doshi & Hauser, Generative AI enhances individual creativity but reduces the collective diversity of novel content, Science Advances, 2024
- Draxler et al., The AI Ghostwriter Effect, ACM TOCHI, 2024
- Williams-Ceci et al., Biased AI writing assistants shift users’ attitudes on societal issues, Science Advances, 2026、およびCornellによる要約
- Aligning LLMs by predicting preferences from user writing samples, arXiv, 2025
- Hohenstein et al., Artificial intelligence in communication impacts language and social relationships, Scientific Reports, 2023、およびCornell Chronicleによる要約
- Liu et al., Will AI console me when I lose my pet?, CHI 2022
- Jakesch et al., AI-mediated communication and the Replicant Effect, CHI 2019
- Professionalism and trustworthiness in AI-assisted workplace writing, International Journal of Business Communication, 2025、およびPsyPostによる要約
- Khadpe et al., on AI assistance and judgments of character, AIES 2025
- AI-mediated communication and trust-building, iScience, 2025
- Zapier、AIメールアシスタントの比較記事
ベンダーのドキュメント
- Grammarly Pro · DeepL Write · LanguageTool · Wordtune · QuillBot · ProWritingAid
- OpenAI canvas · Claude styles · Gemini in Docsのヘルプ · Gemini in Gmailのヘルプ · Copilot in Outlook · Apple Intelligence
- Superhuman · Shortwave · Missive
- Sudowrite · SciSpace · Elicit · Consensus · Paperpal · Jasper · Anyword · Writer