これで何ができるか
毎朝の自動チェックにAIが「これは変です」と指摘してきても、その指摘自体が正しいかどうかは、これまで人が見るしかありませんでした。指摘した号だけを対象に「もう一度計算をやり直して確認して」と頼むと、誤った指摘だけを取り下げ、本物の欠陥は消えませんでした。プログラミングは要りません。
材料は、「重要です」を足しても見逃しは減らないで実際に起きた誤検知をそのまま使います。あの記事には、指示文4(数字の突合・文言比較・日付確認をまとめた本番用の指示)があります。これを架空のメルマガ下書き12件(教材A)で独立に2回試した、過去の生の指摘結果は次のとおりでした。
| 指摘した号 | 本物の欠陥3件 | 誤検知 | |
|---|---|---|---|
| 1回目 | 4・6・8・11・12号 | 4・8・11号を検出 | なし |
| 2回目 | 1・4・6・8・11号 | 4・8・11号を検出 | 1号を「約8.2%オフ」と誤って指摘(実際は正しく10%オフ) |
1号の誤検知は、AI自身の引き算の間違いでした。正しくは 11,000円−9,900円=1,100円で、1,100÷11,000=10%です。誤検知は、この1,100円を900円と取り違えていました。
この2つの指摘結果(誤検知なし・誤検知あり)に、それぞれ新しい独立の会話で検算を頼みました。頼んだ一言は「指摘した号だけ、計算をもう一度やり直して確認してください」です。
- 誤検知が無かった1回目 → 5件とも「指摘は正しい」のまま、1件も消えませんでした
- 誤検知があった2回目 → 1号だけ「指摘は誤り」と取り下げ、4・8・11号はそのまま残りました
2回の検算で、本物の指摘(3件×2回=6件)が消えたことは1件もありませんでした。誤検知(1件)は、正しく取り下げられました。念のため、曖昧な言い方でも同じ2回を試しました。「指摘した号をもう一度確認してください」と、計算をやり直せとは書かない言い方です。結果は変わりませんでした(合計4回)。
ただし、これは「号ごとに正しい・誤りを書かせた」ときの結果です。出力の形を「確定した号だけを一覧で出す」という自動化向けの形に変えたところ、本物の欠陥が1件、理由も書かれずに静かに消えました(下の5番)。検算そのものは効いても、出力させる形によって結果が変わります。
この記事は、AIに実際に検算を頼んだ実測の記録です。架空のメルマガ下書きを使っており、特定の会社の実例ではありません。回数は5回(検算の言い方2種×元の指摘2種+出力形式違い1回)で、これより多い回数や、数字・日付以外の欠陥では試していません。
前提
| かかる時間 | 15分 |
| 費用 | 無料 |
| 必要なもの | 特にありません。チャットAIに一覧と指摘結果を貼るだけです |
| プログラミング | 不要 |
この記事は「重要です」を足しても見逃しは減らないの続きです。あの記事の最後に、著者自身の注意書きが残っていました。指示を具体的にするほど、AI自身の計算やAI自身の判断が入り込む余地も増える、というものです。だから自動化に組み込むときは、金額の計算を別途もう一度させるか、最終的な指摘を人が1回だけ目で見る工程を残してほしい、とも書いていました。この記事が試すのは、その「別途もう一度させる」を実際にやったらどうなるかです。
毎朝の自動チェックに、数字や日付を突き合わせる指示を組み込んでいるなら、この記事はその次の一手にあたります。
AIへの頼み方
1. まず、素の指摘結果を用意する(前の記事の実測をそのまま使う)
前の記事で実際に試した本番用の指示文は、これです(材料は同じ12件のメルマガ下書き=教材A)。
この指示文を独立した新規の会話で2回試した生の指摘結果を、今回はそのまま材料に使います。1回目は4・6・8・11・12号を指摘し、本物の欠陥3件(4・8・11号)だけを正しく拾っていました。2回目も同じ3件を拾いましたが、さらに1号(正しく10%オフだった号)を「約8.2%オフ」と誤って指摘していました。
なぜ新しい題材を作らず、既存の誤検知を使うのか。誤検知は狙って再現できるものではありません。この記事が見たいのは「実際に一度起きた誤検知」に検算が効くかです。架空データを新しく仕込むより、すでに手元にある本物の誤検知を使うほうが確実です。
2. 誤検知の無かった指摘結果に、検算を頼む
(この下に、12件の下書き一覧と、1回目の指摘結果5件をそのまま貼ります)
5件とも「指摘は正しい」と返ってきました。確認できた中身は、次のとおりです。
- 4号: 9,000×0.8=7,200円で本文の価格と一致。件名の30%オフが誤り
- 8号: 本日2026-09-13に対し2026-09-10は過去日
- 11号: 他号にある送料無料の条件が抜けている
いずれも元の指摘どおりに確認できています。誤検知が無い回では、検算は何も減らしませんでした。
3. 誤検知のあった指摘結果に、同じ検算を頼む
材料は同じ指示文で、貼る指摘結果だけを2回目(1号の誤検知を含む5件)に差し替えます。
1号だけ「指摘は誤りです」と返ってきました。11,000円の10%オフは9,900円で、値引き額は1,100円です。1,100÷11,000は10.0%なので、表示どおり正確に10%オフでした。検算はこの正しい計算をやり直したうえで、誤りだと言い切っています。4・8号はそのまま「指摘は正しい」で残りました。
4. 「計算をやり直して」を、もう少し曖昧な言い方に変えても試す
自動化の指示文は、毎回この長さで書けるとは限りません。「計算をやり直して」を書かず、もっと短い言い方でも同じ結果になるかを試しました。誤検知の無かった1回目の指摘結果から試します。
5件とも「取り下げません」でした。続けて、誤検知のあった2回目の指摘結果にも同じ言い方を試します。
1号だけ「指摘を取り下げます」、4・8号は「指摘を維持します」でした。
「計算をやり直して」と書いても書かなくても、この4回では結果は同じでした。本物の指摘は1件も消えず、誤検知だけが正しく取り下げられています。
5. 出力の形を「確定した号だけの一覧」に変えると、1件消えた
自動化に組み込むなら、号ごとに文章で「正しい・誤り」と書かせるより、確定した号番号だけをカンマ区切りで受け取りたい場面があります。誤検知のあった2回目の指摘結果に、出力の形だけを変えて試しました。
返ってきたのは「4,8」でした。1号(誤検知)が正しく除かれたのは同じですが、本物の欠陥だった11号までもが、理由なく一覧から消えていました。
11号の指摘は「送料無料の条件が他号と一致しない」という文言の話で、割引率や日付のような計算ではありません。「計算が合っていた号」という指示の書き方が、計算のしようがない11号を暗黙のうちに対象外にしたと考えられます。号ごとに「正しい・誤り」を書かせた2番・3番の形では11号は残っていたので、同じ検算でも、出力させる形を変えただけで結果が変わりました。
6. なぜ、この検算は健全な項目を巻き添えにしなかったのか
似た構成の工程2に確認させると誤りは直るがあります。あの記事では「本当に該当するか確認して」という一言が、健全な項目まで4回中4回で誤って除外していました。この記事の検算は、4回とも巻き添えが0件です。
違いは、確認させている中身です。「該当するかどうか」は判断(この問い合わせは至急か)で、AIが疑い出すと際限なく疑えます。一方この記事の検算は「金額や日付の計算が合っているか」という、答えが1つに決まる事実の確認です。この差を試したわけではありません(材料も課題も別です)。ただし検算の対象を「計算し直せば白黒つく項目」に絞ったことが、巻き添えの無さにつながった可能性はあります。
うまくいかないときの言い直し方
出力を「一覧だけ」にすると、計算以外の指摘が消える
5番で見たとおり、出力の指示を「計算が合っていた号だけを一覧で」に変えました。すると、決まり文句の不一致(計算ではなく照合)という本物の指摘が、理由も書かれずに除外されました。自動化に「確定した号だけを機械的に受け取る」形を使うなら、その指示文が対象にしている種類の指摘(この記事では「計算」)を先に確認してください。それ以外の種類の指摘は、暗黙のうちに対象外にされる可能性があります。号ごとに「正しい・誤り」を文章で書かせる2番・3番の形のほうが、この巻き込み落ちは起きませんでした。
誤検知をわざと再現しようとしても、また同じようには起きない
この記事は「すでに一度起きた誤検知」を材料に使いました。同じ指示文をもう一度走らせても、AIが同じ引き算を間違えるとは限りません。検算という対策を試したいだけなら、実際の運用で誤検知が起きたときの生の指摘文を保存しておき、それを検算にかけるのが確実です。わざと誤検知を起こそうとするより手堅く進められます。
検算そのものが新しい誤りを持ち込むことがある
「重要です」を足しても見逃しは減らないで見たとおり、具体的な指示ほど、AI自身の計算が入り込む余地も増えます。検算も同じ理屈で、検算した結果自体に新しい間違いが混ざる可能性はゼロではありません。この記事の4回では、検算自体の新しい誤りは出ませんでした。ただし自動化に組み込むときは、検算の結果を最終出力として使う前に、金額が絡む号だけ人が1回だけ目で見る工程を残してください。
応用・次の一手
この記事は、「重要です」を足しても見逃しは減らないの末尾に著者自身が残した「試していません」に、実際に答えたものです。「指摘した号だけ、計算をもう一度やり直して確認して」という検算の一言は、号ごとに「正しい・誤り」を書かせる形で、4回とも本物の指摘を1件も消しませんでした。誤検知だけを正しく取り下げています。ただし出力を「確定した号だけの一覧」に変えると、5番のとおり本物の指摘が1件、静かに消えました。
同じ「確認をもう一段足す」型に、工程2に確認させると誤りは直ると基準を固定しても、健全な5件の巻き添えは消えないがあります。あの2本では、健全な項目までAIが疑って巻き添えにしていました。この記事の号ごとの検算だけ巻き添えが起きなかった理由は、対象を「計算し直せば白黒つく指摘」に絞ったからかもしれません。ただし、同じ検算でも出力の形を変えると巻き込み落ちが起きました。安全なのは検算そのものというより、「号ごとに理由つきで書かせる」形のほうだと考えられます。この材料・この回数での実測なので、一般法則としては書きません。
毎朝の自動チェックに数字の突合を組み込んでいるなら、次はこの検算の一言を最後にもう一段足すことを検討してください。ただし自動化のために出力を圧縮したくなったときほど、この記事の5番を思い出してください。確認できるのは、この記事では数字と日付の指摘だけです。文言の一致や、判断が分かれる指摘まで同じように信頼してよいかは、まだ確かめていません。