AIテキスト検出 🔒 ブラウザ内で完結 — 何もアップロードされません。

ヒューリスティックAI可能性スコア

0 単語数
上にテキストを貼り付けると、ヒューリスティック分析結果が表示されます。

このツールについて

AI 文章検出——商用のものも含めて——は、本当に難しく、いまだ解決されていない問題です。このページは訓練済みの検出モデルを実行しているわけではありません。代わりに、研究者たちが機械生成テキストと(緩やかに)関連づけてきた4つの単純で透明性のあるテキスト統計を計算します:文の長さがどれだけ変動するか(ばらつきがあるか均一か)、100語のスライディングウィンドウでの語彙の多様性、完全に一致する4語のフレーズがどれだけ繰り返されるか、そして文内での単語の長さのばらつきです。それぞれを個別に表示し、さらに0〜100の総合スコアも示すことで、不透明な判定を鵜呑みにするのではなく、その数値になった理由を正確に確認できます。

これら4つのシグナルのいずれも、単体でAIによる作成を示す確実な指紋ではなく、それらの平均値もまた同様です。注意深い人間の書き手は、非常に均一で多様性の低い文章(技術文書、定型的な法律文書、非ネイティブスピーカーの文章)を書くことがあり、それがここで「AIらしい」と判定される可能性があります。逆に、軽く編集されたAI出力は、これら4つのパターンを簡単に崩してしまいます。これは、ある文章に対する大まかで透明性のある直感的チェックとして使ってください——会話のきっかけであって、判定ではありません——学業不正の事案や採用判断、その他誰かに実際の影響を及ぼす事柄の証拠として決して使用しないでください。

よくある質問

これはテキストがAIによって書かれたことを証明できますか?

いいえ、これがこのツールについて理解すべき最も重要なことです。これは4つの単純なテキスト統計(文の長さの分散、語彙の多様性、フレーズの繰り返し、単語の長さの分散)を計算してスコアに組み合わせるだけです——訓練された言語モデルは一切含まれていません。実際のMLモデルを備えた高度な商用AI検出器でさえ、既知の誤検出/見逃し率があります。手作りの統計ヒューリスティックはさらに弱いものです。学術的誠実性の事案、雇用決定、その他の重大な事柄の証拠として決して使用しないでください。

なぜ人間の文章が「AIらしい」とスコアされることがあるのですか?

このツールが測定する基礎的なシグナル(均一な文の長さ、低い語彙多様性、繰り返しの言い回し)は、多くの普通の人間の文章にも現れることがあります——技術文書、法律文書、よりシンプルで反復的な文構造を好む非ネイティブ英語話者、あるいは単に注意深く几帳面な書き手の自然なスタイルなどです。これらのシグナルはいずれも何かの決定的な証拠となるように設計されたものではありません。それらは弱い統計的相関であり、著者性の因果的マーカーではありません。だからこそ、このツールは不透明な一つの数字の裏に隠れるのではなく、その作業内容(4つのサブスコアすべて個別)を示しています。