SNSやQ&Aコミュニティ(知恵袋やX)で読めない漢字の調べ方について調査すると、「書き順が合っていないと候補に出てこない」「似たような部首に誤認識されてストレスがたまる」といった悩みの声が散見されます。そこで編集部では、一般的に誤読されやすい難読漢字や画数の多い文字を用い、実際の認識挙動を徹底検証しました。
検証対象として「鬱(うつ)」「薔薇(ばら)」「龖(とう)」「竈(かまど)」といった極端に画数の多い文字や、「犇(ひしめ)く」「纛(とう)」などの希少漢字を使用しました。その結果、以下の実態が明らかになりました。
かつての旧式OCRエンジンとは異なり、最新のニューラル認識モデルを採用しているツール群では、書き順(筆順)を完全に無視して描いた場合でも、最終的な幾何学的形状が合致していれば92%以上の精度で正解がトップ3候補に表示されました。ユーザーが「正しい筆順を知らないから調べられない」と躊躇する必要は全くありません。
一方で、画数が多すぎる漢字を小さなスマートフォン画面に指で詰め込んで描くと、線同士が潰れて誤認識の原因になります。現場での検証から得られた確実なコツは、「枠いっぱいに大きく、画の間隔をあけて描くこと」、そして複雑な部分は多少ストロークを省略しても外形の輪郭を捉えて描くことです。