なぜ「画面がきれいに見える」ことがアクセシビリティ合格の判断基準にならないのか。
視覚的な表現と基礎となる意味構造は別々の2つの層であり、視覚的に正常であることは基礎となるマークアップが正しいことを意味しないからだ——<div onClick>で作られたボタンは画面上では普通のボタンに見え、マウスクリックも完全に正常に動作するが、スクリーンリーダーが読み取るのは画面に表示されている見た目ではなく、基礎となるHTMLの意味構造だ。このボタンはスクリーンリーダーのユーザーにとっては存在しないも同然だ。
これはまさにアクセシビリティの問題が特に見落とされやすい理由でもある——目でチェックし、マウスで操作すると、このインターフェースは全く問題なく見える。問題を発見できる唯一の方法は、別のチェック手段に切り替えることだ——実際にキーボードで一通り操作する、あるいはスクリーンリーダーで一通り聞いてみる。視覚的なチェックだけでは、この種の問題は永遠に捉えられない。
AI生成の代替テキストが「技術的には正確だが機能的に盲目」というのは、具体的にどういう意味なのか。もっと完全な例を挙げられるか。
技術的に正確とは、テキストの客観的な説明に誤りがないことを指し、機能的に盲目とは、その説明がこの画像がこの文脈で本当に重要な情報を伝えていないことを指す。例えば、eコマースサイトの製品画像で、画面は「ハンガーにかかった赤いワンピース」だとする。AI生成の代替テキストが「ハンガーにかかった赤いワンピース」としか書かなければ、この文は完全に正確だが、スクリーンリーダーのユーザーがこの買い物という文脈で本当に必要とする情報を見逃している——このワンピースの素材、シルエット(フィットするか緩めか)、適した場面、これらこそが「買うかどうか」を決める重要な情報であり、「服がハンガーにかかっている」という視覚的な事実そのものではない。
このギャップが自動で捉えにくい理由は、W3Cの標準自体が代替テキストに「意図された機能を果たす」ことしか要求しておらず、代替テキストに含めるべき具体的な内容を規定していないからだ。自動化されたチェックツールは「代替テキストが記入されているか」は検証できるが、「その代替テキストが文脈上本当に重要な情報を捉えているか」は検証できない。この層の判断は現在もなお人の介入を必要とする。
「自動化ツールはアクセシビリティ問題の3〜4割しか捉えられない」とのことだが、残りの6〜7割は実務上どう補うべきか。
残りの6〜7割は主に「実際に体験する」ことでしか発見できない問題に属する。この種の問題はコードのスキャンや視覚的なチェックだけでは捉えられず、実際に支援技術でフローを一通り歩く必要がある。具体的な方法には以下が含まれる——キーボード(マウスを使わずに)でインターフェース全体を最初から最後まで操作し、すべてのインタラクティブ要素がTabキーでフォーカスできるか、順序が合理的か、Escでポップオーバーが閉じるかを確認する。無料のスクリーンリーダー(WindowsではNVDA、MacではVoiceOver)をブラウザと組み合わせて実際にページ内容を一通り聞き、読み上げの順序と情報が合理的かを確認する。
これらのチェックは完全には自動化できない。判断すべきなのは「使用体験が合理的かどうか」であり、「特定の技術仕様に適合しているかどうか」ではないからだ——例えばポップオーバーウィンドウのフォーカス管理は、コードが技術的に仕様に適合していても、実際にキーボードで操作すると、フォーカスの遷移ロジックが依然として混乱を招く場合がある。この種の体験レベルの問題は、実際に自分で一通り歩いてみて初めて捉えられる。
チームのリソースが限られており、この記事で触れたすべてのチェックをそろえられない場合、優先順位はどうつければいいのか。
リソースが限られている場合、優先的に対処する価値があるのは「影響範囲が最も広く、修正コストが最も低い」項目だ——意味論的なマークアップ(<div onClick>ではなく<button>を使う)と色のコントラストの2つは、通常一度ルールを設定すれば以降継続して適用できる基礎的な工程であり、コストが比較的抑えられ、最も基本的な使いやすさ(リンクがキーボードでフォーカスできるか、テキストがはっきり見えるか)に直接影響する。
複雑なインタラクションのキーボードナビゲーションとライブリージョンのアナウンスは、同様に重要だが、通常インタラクティブなコンポーネントごとに個別にテストする必要があり、時間的コストが高い。これらはリソースがより充実したときに対処すればよい。代替テキストの品質チェックについては、少なくとも「ユーザーの意思決定に直接影響する」重要な画像(製品画像、インフォグラフィックなど)を優先的に人が確認することを勧める。装飾的または二次的な画像はまずAI生成のバージョンで済ませ、後から段階的に補強すればよい。優先順位の核心ロジックは、まず基本的な使いやすさ(操作できるか、見えるか)を確保し、その後体験の質(使いやすいか、情報が十分に完全か)に対処することだ。
AI生成のインターフェースはきれいでレイアウトが整って見えるため、それがアクセシブルでもあると誤解しやすい——この記事はまさにそのギャップを扱う。AIが視覚的に「良く見える」ものを生成することと、支援技術のユーザーが実際に使えるかどうかの間には、しばしば大きな距離があり、しかも問題は配色のコントラストのような見つけやすいものだけに限らない。
スクリーンリーダーのユーザーにとって、ページは「どう見えるか」ではなく「読み上げるとどう聞こえるか」が重要であり、読み上げられる内容は基礎となる意味構造に依存する——ボタンは`