「AIっぽい文章」を記事から探したら、手元の下書きとコミット文で見つかった
制作ノートを読み返していて、英語から直訳したように読める文に、何度か引っかかりました。世間で「AIっぽい」と言われる型です。このサイトの文章はAIに下書きをさせて私が直して出しているので、どこかに残っていてもおかしくない。まず「AIっぽさ」の正体を調べ、次に自分の文章を測りました。何を測って、どこで見つかるようにしたかの記録です。
語彙の話だと思っていたら、レイヤーの話だった
最初は「これにより」「〜することができます」のような語を消せば済むと思っていました。調べると、それは一番浅いレイヤーでした。整理が上手だったのはQiitaのAI臭さを消すスキルと採点スクリプトの記事で、AIっぽさを4つのレイヤーに分けています。直す優先順に並べると、立場と主体(モノが主語になり、一人称が消える)、思考構造(「結論から言うと」で始まり、まとめで終わる)、語彙と文体、記号と書式。語を消しても「この機能はデータ出力を可能にします」の形が残っていれば、直訳のままです。
もう1つ、手がかりの強さで、語が3段階に分けてありました。人がまず書かない語はすぐ直す。強いけれど文脈次第の語は迷ったら直す。人も普通に使う語は、数が増えたときだけ直す。そして単発の弱い語まで消すと、今度は「直しすぎた文章」という別のテンプレになる。ここは読んで、たしかにそうだと思いました。
英語の構文がそのまま残る型は、coji/natural-japaneseというスキル(AIに渡す手順書の一式)のリファレンスが具体的でした。「この事実は、従来の前提が誤っていたことを示している」は「この事実から、従来の前提が誤っていたと分かる」に。「情報を整理することによって、判断のスピードが上がる」は「情報を整理すると、判断のスピードが上がる」に。「それは単純な話ではない。なぜなら、関係者の利害が複雑に絡み合っているからだ」は「関係者の利害が複雑に絡み合っていて、単純な話ではない」に。どれも日本語としては成立するので、読み流してしまいます。共通するのは、機能や事実が主語に立って何かを「示す」「可能にする」形です。人の行為か結果を中心に据えると消えます。
記事を測ったら、ほぼゼロだった
公開している記事とページの全文から、上の浅いレイヤーの語を探しました。「これにより」「することができ」「と言えるでしょう」「ではないでしょうか」「結論から言うと」「本記事では」。2026年9月8日の時点で、見つかったのは1件だけです。プライバシーポリシーの「これにより」で、規約文としては普通の用法でした。
理由は分かっています。8月の初めに、記事全体に生成AIの匂いがあると気になって、決め台詞で段落を締めない、ダーシを乱用しない、短い文を畳みかけない、全記事を同じ構成で書かない、と決めました。それを公開前の検査にも一部入れてあります。1か月かけて、浅いレイヤーは抜けていました。
次に、coji/natural-japaneseに付いている検査を自分のパソコンで動かして、記事にかけました。文を単語に切り分けて語彙と構文を見て、文の長さのばらつきも測るものです。試したのは公開済み5本と書きかけ2本。結果は、語彙も構文もゼロ。ただし「文の長さにばらつきが無い」という警告だけは、7本すべてに出ました。同じ検査を、付属していた人間の随筆12本(寺田寅彦や坂口安吾)にかけると、警告が出たのは3本だけです。私の記事は、人の随筆よりリズムが平らでした。文の長さは、読み返しても自分では分かりません。数えないと見えない癖でした。
癖は、記事の外に残っていた
同じ語を、公開しない側の文章の中からも探しました。Zenn(エンジニア向けの記事サイト)に出す下書き、作業の進めかたを書いた自分用のメモ、そしてコミット文(作業をgitに保存するとき、何をなぜ変えたかを添える説明文)です。
下書きには「結論から言うと」があり、「〜ではなく」が短い間隔で3回ありました。進めかたのメモには「〜ではなく」が7回。コミット文には、文をつなぐ全角ダーシ「——」が、直近60本のうち9本に、合わせて22回出ていました。数えたのは2026年9月8日、この作業を始めた時点の直近60本です。
白状すると、最初は「60本のうち22本」と書いていました。検索結果の行数を、そのまま本数と読んでいたからです。書いたものを別のAIに読ませたら数が合わないと言われ、数え直したら9本で、22は回数でした。行か、回か、本か。何を1と数えたかを添えないと、数は簡単に読み違えられます。
なぜ記事はきれいで、手元は残っていたのか。記事は人に読まれる前提で書いていて、出す前に必ず読み直しますが、コミット文と下書きは書いた瞬間にそのまま残ります。読み直す工程が無い場所に、癖はそのまま出ていました。
検査をどこに入れたか
語の一覧は1か所だけに置いて、公開前の検査と、どのファイルにでもかけられる小さなプログラムが、同じ一覧を読むようにしました。記事は公開前の検査で止まります。コミット文や下書きは、書いたあとにそのプログラムに通せば見えます。
検査に入れたのは、人がまず書かない語だけです。「解像度」や「最適化」のような語はAIが好むと言われますが、私の記事に出る「解像度」は全部が画像の解像度でした。「難読化」「正規化」も技術用語として正しい。単語だけで決めると、正しい用法まで弾いてしまいます。そこは人が読むことにしました。
それと、鉤括弧の中は見ないようにしました。この記事のように、語そのものについて書いている文章では、引用した語まで全部見つかってしまうからです。実際、最初にAIに渡す手順書で探したら7件あって、全部が引用でした。
外のスキル本体は入れていません。仕事の文書(議事録や報告書)向けに作られていて、「前置きを書かない」「見出しに結論を入れる」「太字は1か所」という約束が、記事ごとに構成を変えたいこのサイトの書きかたと合いません。借りたのは直訳の型の一覧と、語を強さで分けて扱う考えかたです。
直しすぎは、直訳と同じくらいまずい
語を消す作業を始めると、止めどころが難しい。「正直」「ぶっちゃけ」を1本に1回まで、短い文や体言止めを連打しない、敬体で書いたものを人間味のためにくだけさせない。そして具体を足すときに、数字や固有名詞を作らない。作るのは簡単なので、実測が無ければ書かないと決めています。
この記事も、書き終えてから同じプログラムに通しました。語は0件。文の長さは、起伏のない段落がいくつか挙がったので、そこだけ書き直しました。直したあとにもう一度通して、まだ起伏のない段落は残っています。全部を直すと、それはそれで機械の紋様になる気がして、そこで止めました。
後日談: 作業が終わるたびに、日本語を点検させる
この記事は2026年9月9日に書き、10月2日に出しました。このサイトの作業はAIに任せていて、コミット文も下書きも進めかたのメモも、まずAIが書いています。「検査をどこに入れたか」の節で書いた、どのファイルにでもかけられるプログラムは、9月9日の時点でもうありました。ただ、AIの書いた文章をそれに通すのは、私かAIが思い出したときだけでした。通さなくても、何も止まりません。癖が残っていたのは読み直す工程が無い場所だと分かったのに、公開前の検査のような工程を、その場所には足していなかったわけです。
2026年9月24日から、AIが作業を1つ終えるたびに、私への報告の最後に「日本語の点検」という見出しを付けさせることにしました。そこに書くのは2つです。1つは、その回に書いたコミット文や下書きを、そのプログラムに通した結果。もう1つは、日本語の書きかたを扱った外の資料をAIが1本読んだ記録で、採れそうな点を出典と一緒に、1点につき1つのファイルに残します。文章の決めごとを足していくための材料です。
見出しを付け忘れたときのために、別の仕組みも置きました。AIとは別に自動で動く検査です。AIが作業を終えようとすると、その見出しと、読んだ資料の出典があるかを確かめます。無ければ一度止めて、AIに報告を書き直させます。調べるのは、見出しと出典の形と、新しく足したファイルの名前が報告に書いてあるかまでです。プログラムの結果の中身は私が読んでいます。
8月に決めた4つを含めて、このサイトの文章の決めごとは1つの文書にまとめてあります。書き留めた点は、すぐにはそこへ入れません。採るかどうかは私が判断することにしていて、10月2日の時点で44点たまり、入れたのは次の4点です。
- 一文に3つ以上並べるときは、箇条書きにできないか考える
- 括弧の補足を足しすぎない
- 結論を早めに書く
- AIに渡す手順書も、同じ基準で書く
3つ目は、1節目でAIっぽい型に挙げた「結論から言うと」と、逆のことを言っているように見えるかもしれません。やめたのは、前置きの決まり文句で結論を予告する書きかたです。結論を先に書くこと自体は残しています。
4つ目の出どころは、yomiyasu を作者自身が紹介したZennの記事です。yomiyasu は、AIっぽい日本語を文の組み立てから読みやすく直すスキルです。7つの原則のうち6つは、この記事で書いたレイヤーとほぼ重なっていました。新しかったのは1つです。手順書の本文が直したい言い回しで書かれていると、読んだAIにその癖がうつる、という指摘です。
言われてみれば、私も日本語の書きかたを手順書にしてAIに渡しています。どのファイルにでもかけられるプログラムには、9月25日に括弧の補足を数える機能を足してあったので、10月1日に手順書2本をAIに通させました。直訳調の語は0件。ただ括弧の補足は千字あたり5.6と6.0で、公開中の記事の1.1の5倍ほど出ていました。10月2日の時点で、この2本はまだ直していません。直すときは同じプログラムに通す、と決めごとには書いてあります。
残りの40点は、まだ判断を待っています。読むほうの速さに、私の判断が追いついていません。