放課後の授業で英語を学んでいる子どもが英単語をたびたび誤って発音すると、保護者と言語聴覚士は同じ問いを立てます。まだ学習の途中だから誤っているのか、それとも語音を処理する過程のどこかに困難があるのか、という問いです。従来の構音検査は、どの音をどのように誤ったかを主に記録します。同じ誤りを示す子どもであっても、その背後にある処理能力の強みと弱みは大きく異なりうるのです。
では、韓国語と英語で同じ構造の課題を実施すれば、子どもが語音を聞き、保存し、産出する段階のうちどこでつまずいているのかを区別できるのでしょうか。
この問いに答えた論文を一本読んでみます。
- 題目: Development and Validation of a Korean (L1)-English (L2) Speech Processing Task System for Children with and without Speech Sound Disorders
- 学術誌: Folia Phoniatrica et Logopaedica
- 年: 2026
研究チームは、コンピュータで実施する語音処理課題(Speech Processing Task, SPT)の体系を作りました。SPTは、子どもが音を弁別する能力、音の単位を意識して操作する能力、頭の中に単語の音の形を保存する能力、音の順序を計画して話す能力を、段階ごとに評価します。5種類の課題を韓国語と英語でそれぞれ実施するため、下位課題は10個です。研究チームは、採点と結果の分析まで自動で処理されるよう体系を電算化しました。
この記事で使う主な用語は次のとおりです。
- 語音障害(Speech Sound Disorder, SSD): 効果的な話しことばによるコミュニケーションを妨げる、持続的な構音の困難。
- 第一言語(L1)と第二言語(L2): この論文ではL1が韓国語、L2が英語です。
- 外国語としての英語(English as a Foreign Language, EFL): 韓国のように、英語を生活言語ではなく教科として学ぶ環境。
- 定型発達児(Typically Developing, TD): この記事では、論文が語音障害児と比較した同年代の子どもをこう呼びます。
動機: 構音の正確さだけでは、子どもごとに異なる処理の弱みを見つけにくい
なぜ処理段階ごとの評価が重要なのか
論文が挙げた理由は次のとおりです。
- 語音障害児は、外見上は似たように話しづらそうにしますが、重症度、原因、指導への反応は子どもごとに大きく異なります。
- 臨床では、大半の子どもで発話障害の原因が明らかになりません。そのため、効果的な介入計画を立てるには包括的な評価が必要です。
- 語音知覚に関する先行研究は結果が分かれました。ある研究では語音障害児の知覚の正確さが低く、別の研究では群間差がありませんでした。
- 一方、音韻認識、音韻表象、運動プログラミングに関する研究は、語音障害児に処理の欠陥があるという結果を比較的一貫して示しました。
- 英語を外国語として学ぶ環境では、母語の構造と発音の習慣が英語の習得に大きく作用します。そのため、語音障害児は英語学習でより大きな困難を抱える可能性が高いです。
この最後の理由を裏づける先行研究(KimとHa)があります。語音障害児は音韻的短期記憶が低く、英語の語彙習得の成績も定型発達児より低いものでした。非語復唱の得点は、受容語彙の学習能力を有意に予測しました。後続の研究では、語音障害群の英語の子音の正確さが同年代より低く、韓国語の誤りパターンが英語の発音に持ち越される現象が観察されました。
評価の理論的枠組みは、StackhouseとWellsの語音処理モデルです。このモデルは処理経路を次の段階に分けます。
- 末梢聴覚処理
- 語音と非語音の区別
- 音声弁別
- 音韻認識(音韻の再認)
- 音韻表象
- 運動プログラミング
- 運動計画
- 運動実行
各段階に合わせた課題を実施すれば、子どもの強みと弱みを見つけて介入計画に反映できる、というのがこのモデルの主張です。
既存の研究が扱っていない部分
英語圏では、CTOPP(Comprehensive Test of Phonological Processing)とPAT-2(Phonological Awareness Test 2)が広く使われています。この2つの検査は、音韻認識、音韻記憶、迅速呼称といった個別の要素を信頼性高く評価します。韓国国内では、最近開発された韓国語構音音韻プロファイルが、非語復唱課題(Nonword Repetition Task, NRT)で運動プログラミングと音韻記憶を評価します。オランダのCAI(Computer Articulation Instrument)は、2〜7歳のオランダ語児向けの自動化された評価体系で、絵の呼称、単語・非語の復唱、最大反復速度の課題を含んでいます。
論文が指摘した空白は次のとおりです。
- 個別の下位技能だけを扱う検査では、語音処理の複数の段階を同時に調べにくいです。
- NRT一つには、聴覚弁別から音韻保存、運動計画まで複数の段階が同時に関与します。そのため、運動プログラミングの欠陥を正確に特定するには、他の段階を評価する課題も併せて必要です。
- 心理言語学に基づく評価は手続きが複雑で、臨床で使いにくいと批判されてきました。
- CAIは実施を自動化しましたが、得点計算は手作業です。対象はオランダ語児に限られ、弁別と音韻認識の評価が欠けています。
研究チームはこれに加えて英語の学習環境を考慮し、語音障害児のための評価体系を韓国語と英語の2言語で開発しました。
方法: 5つの課題を2言語で作り、専門家と子どものデータで検証した
論文は方法を3つの下位研究として説明しています。研究1は課題を開発して電算化し、研究2は妥当性と信頼性を検証し、研究3は定型発達児に課題を適用しました。この記事では、研究1の項目開発と採点・電算化を切り離し、4つの段階として説明します。段階1と段階2は研究1、段階3は研究2、段階4は研究3に当たります。
データと参加者
この論文では3種類のデータが使われました。その前に予備研究が一つありました。
- 予備研究: 語音障害児10人と定型発達児20人に、弁別、音韻表象、非語復唱の課題を韓国語と英語で実施しました。
- 専門家パネル: 内容的妥当性の評価のために専門家10人を選びました。研究チームは、最低10〜15人いれば内容的妥当性を信頼性高く評価できるというAndersonの勧告に従いました。
- 信頼性データ: 5〜7歳の子ども70人の項目ごとの回答を集めました。
- 適用研究の参加者: 5〜7歳の定型発達児30人です。男児23人、女児7人でした。
研究チームが5〜7歳を対象とした根拠は2つあります。子どもは4歳ごろに発話明瞭度が約100%に達し、音節単位の脱落課題はおおむね5歳後半に習得されます。
適用研究の参加者の選定基準は次のとおりです。
- 受容・表出語彙検査(REVT)の原点数が1SD以上(原文表記 ≥ 1SD)
- 韓国版レーヴン色彩マトリックス検査(K-CPM)の得点が85以上
- 우리말 조음음운평가 2(UTAP2)の子音正確度(Percentage of Correct Consonants, PCC)が1SD以上(原文表記 ≥ 1SD)
- 保護者の報告で、神経学的障害や聴覚障害の既往がない
- 週2回、1回30分以上の英語の授業を1年以上受けている
参加者の平均生活年齢は77.87か月(±10.63)でした。平均の非言語性知能得点は113.17(±16.85)でした。英語の構音はDEAP(Diagnostic Evaluation of Articulation and Phonology)で追加評価しました。
段階1: 5つの課題と項目の開発
- 入力: 予備研究の結果、先行文献、語音処理モデル
- 処理: 処理段階ごとに課題を定め、韓国語・英語の項目を別々に作る
- 出力: 2言語それぞれ5課題、合計10個の下位課題
- 研究チームは、予備研究の結果と文献レビューから予備項目を作りました。
- 語音処理モデルの入力、保存、出力の段階に合わせて5つの課題を構成しました。
- 英語の課題は、韓国語の課題を翻訳していません。英語を外国語として学ぶ5〜7歳の子どもに合った語彙と刺激で新しく作りました。
論文の表2は、5つの課題を処理段階と評価領域によって次のように分類しています。
- 入力段階: DT(知覚)、IPAT(音韻認識と表象)
- 保存段階: PRT(音韻表象)
- 出力段階: OPAT(音韻認識と表象)、NRT(運動プログラミング)
回答方式は、課題によって判断、絵の選択、発話と異なります。課題の構成は論文の表2で確認できます。
課題ごとの設計意図は次のとおりです。
- 弁別課題(Discrimination Task, DT): 子どもは、同じか似ている2つの音を聞き、同じか違うかを答えます。予備研究で群差も言語差もなかったため、研究チームは難易度を上げて感度を高めました。韓国語は無意味3音節の対を使い、英語はCV単音節の対(/sa/-/si/)をCVC単音節の対(/fæs/-/fæʃ/)と多音節の対に変えました。最終的な12対は、同じ音の6対と、摩擦音・破裂音など音声的特徴が異なる6対です。
- 入力音韻認識課題(Input Phonological Awareness Task, IPAT): 口頭で答えない4択の脱落課題です。「pineapple」から「apple」を除くと「pine」の絵を選ぶ、という形式です。選択肢には、正答(fish)、音が似た誤答(dish)、意味が似た誤答(turtle)、2番目の絵の単語(star)が入ります。
- 音韻表象課題(Phonological Representation Task, PRT): 絵と音を一緒に提示し、両者が合っているかを判断させます。12単語のうち6つは元の音で、6つは母音を変えた音(/εlifɔnt/-/εlifint/)です。
- 出力音韻認識課題(Output Phonological Awareness Task, OPAT): 構造はIPATと同じですが、子どもが残りの音節を自分で言わなければなりません。スクールバスの絵を見て/skuːl/を聞き、/bʌs/と答える、という形式です。
- 非語復唱課題(NRT): 運動プログラミングを評価します。韓国語は2〜4音節の10項目、英語は1〜3音節の10項目です。
音韻認識課題を入力型と出力型に分けた理由があります。語音障害児は、口頭で答える課題では音韻認識が実際より低く評価されることがあるためです。
段階2: 採点と電算化
- 入力: 子どもの選択回答と録音された発話
- 処理: 課題ごとの採点規則を適用し、クライアント・サーバー型の体系で自動処理する
- 出力: 原点数、100点換算得点、NRTの詳細指標
- NRTを除く4課題は、正答なら1点、誤答なら0点で原点数を求め、これを100点満点に換算します。
- NRTは、音節が正しい位置に置かれたかを問う配列得点を使います。前から(F)と後ろから(B)の2方向で音節の位置を確認して得点をつけます。
- 研究チームは、企画、デザイン、開発のチームと、言語聴覚学の教授・臨床家が共同で、プログラムの内容、提示形式、入力方法、採点規則を定めました。
論文本文は、目標の非語/haɾʌʣi/を[hamɾʌʣi]と言った場合を例に挙げています。付加された[m]があっても、前方向は[ha]で正しく始まっているため、正答とみなします。後方向は[m]で始まるため、1点を減点します。その他の回答例と得点は、論文の表1を参照してください。
このように採点すると、単純な正誤よりも、音節の順序をどれだけ正確に計画できたかがよく表れます。
電算化された体系は、課題を実施・評価するクライアント環境と、データや課題の資源を管理するサーバー環境に分かれます。評価は次の順序で進みます。
- 参加者の基本情報の入力
- 課題の選択
- 練習項目
- 本課題
- 終了画面
IPAT、PRT、OPATにはプレビュー機能があります。検査者はこの機能で、子どもが目標語彙を知っているかを先に確認します。結果画面では、正答が青、誤答が赤で表示され、課題ごとに原点数と100点換算得点が出ます。NRTの結果には、録音ファイル、目標子音、子どもの反応、音節得点、順序得点、挿入された子音の数、付加誤り率といった指標が併せて出力されます。
段階3: 内容的妥当性と内的一貫性の検証
- 入力: 専門家10人のアンケート回答、子ども70人の項目ごとの回答
- 処理: 内容妥当比と内容妥当性指数、クロンバックのαを計算する
- 出力: 課題別・項目別の妥当性の値、言語別の信頼性係数
- 研究チームは、Googleフォームで3部構成のアンケートを作りました。
- 第1部: 性別、年齢、学歴、臨床・研究の経歴
- 第2部: 各課題が該当する処理段階を評価するのに適切かを尋ねる項目
- 第3部: 48項目を5段階の尺度で評価
- 回答から、内容妥当比(Content Validity Ratio, CVR)と項目レベルの内容妥当性指数(Item-level Content Validity Index, I-CVI)を計算しました。
- 子ども70人の回答から、クロンバックのα(Cronbach’s α)を計算しました。韓国語の項目、英語の項目、2言語を合わせた項目の3つのまとまりに分けて求めました。
指標の意味と判断基準は次のとおりです。
- CVR: 専門家が十分に合意したかを表します。AyreとScallyのパネルサイズ基準に従い、0.80以上なら合意が十分とみなしました。
- I-CVI: 項目が評価目的に合っているかについての専門家の合意の程度です。10人のパネルでは、最小許容値は0.78です。
- クロンバックのα: 項目群が同じ対象をどれだけ一貫して測定しているかを表す値です。0から1の間をとり、0.70を超えればおおむね受け入れられる信頼性とみなします。
段階4: 定型発達児への適用
- 入力: 定型発達児30人の10個の下位課題の遂行データ
- 処理: 定められた順序で実施し、2×5の反復測定分散分析を適用する
- 出力: 言語と課題タイプの主効果、交互作用、事後比較の結果
- 参加者は、まずスクリーニング検査を受け、続いてDT、IPAT、PRT、OPAT、NRTの順に課題を遂行しました。
- 各課題で、理解を助けるために、韓国語版を先に、英語版を後に実施しました。
- IPAT、PRT、OPATの前には、子どもが目標単語をすべて知っているか、語彙の確認を行いました。
- すべての聴覚刺激は、最大2回まで聞かせました。
- NRTは、音声と映像を一緒に録画しました。訓練を受けた転記者2人がそれぞれ転記し、不一致は協議で整理しました。
- 言語(韓国語、英語)の2水準と課題の5水準による反復測定分散分析(Analysis of Variance, ANOVA)を実施しました。
反復測定分散分析は、同じ子どもが10個の課題をすべて遂行したときに、得点の差が言語によるものか、課題によるものか、両者の組み合わせによるものかを分けて検定します。球面性の仮定が満たされなかったため、研究チームはGreenhouse-Geisser補正を適用しました。
結果: 母語の優位が明確で、例外は弁別課題だけだった
内容的妥当性: 5つの課題すべてが基準を超えた
専門家10人の評価で、5つの課題はすべてCVR 0.80以上、CVI 0.90以上でした。項目レベルでも、すべての項目のCVRが0.80以上、CVIが0.78以上で、削除すべき項目はありませんでした。課題ごとの値は論文の表2で確認できます。
NRTだけがCVR 0.80、CVI 0.90で、他の課題より低い値でした。それでもNRTの値は、CVRの基準0.80とI-CVIの最小値0.78を下回りませんでした。専門家の評点は、OPATとIPATが4.70で最も高いものでした。
内的一貫性: 3つのまとまりすべてが0.70を超えた
子ども70人の回答から計算したクロンバックのαは次のとおりです。
- 韓国語の項目: 0.779
- 英語の項目: 0.886
- 2言語を合わせた項目: 0.912
3つの値すべてが0.70を超え、項目の内的一貫性が確認されました。韓国語の項目の係数が英語の項目より低い点は注目に値します。この記事が参照した論文本文には、この差に対する解釈は示されていません。
基礎評価: 英語の子音正確度が韓国語より低かった
課題を実施する前の構音検査で、2言語の差がまず確認されました。平均の子音正確度は、韓国語99.72%(±1.12)、英語97.45%(±3.90)でした。対応のあるt検定で、韓国語の子音正確度が英語より有意に高いという結果でした(t(29) = 3.734, p < 0.01)。平均の受容語彙得点は75.23(±16.52)、表出語彙得点は79.13(±14.48)でした。
言語別・課題別の遂行: 5課題のうち4課題で韓国語が高かった
DTを除く4課題で、韓国語の得点が英語より高くなりました。韓国語の課題のうち最も高い得点はPRT(93.60)で、英語の課題のうちではDT(93.40)が最も高いものでした。両言語とも、最も低い得点はNRTでした。
言語差の大きさをNRTとDTで計算すると次のとおりです。
- NRT: 韓国語86.18点、英語78.55点で、86.18−78.55=7.63点の差がありました。
- DT: 逆に英語が93.40−89.33=4.07点高くなりました。
その他の課題の言語別の平均と標準偏差は、論文の表4にあります。IPATとOPATは標準偏差が17.88〜25.73で、他の課題より大きいものでした。筆者はこの値を、同じ定型発達児であっても音韻認識課題では個人差が大きく現れたという意味に読んでいます。この解釈は論文にはなく、筆者の解釈です。
反復測定分散分析: 言語、課題、交互作用がすべて有意だった
分析の結果は次のとおりです。
- 言語の主効果: F(1, 29) = 10.601, p < 0.01
- 課題タイプの主効果: F(1.999, 57.985) = 4.420, p < 0.05
- 言語×課題の交互作用: F(2.628, 76.199) = 4.674, p < 0.01
課題間の事後比較では、DT、PRT、OPATの得点がIPATとNRTより有意に高くなりました。5つの課題が、易しい課題3つと難しい課題2つに分かれたことになります。交互作用はCOMPARE構文で追加分析しました。その結果、DTは英語が韓国語より有意に高く(p < 0.05)、残りの4課題は韓国語が英語より高くなりました。
論文の解釈: 母語の優位、母語の干渉、課題の複雑さ
研究チームは、結果を3つのテーマで解釈しました。
- 母語の優位: よく定着した韓国語の音韻表象が、知覚、保存、出力の各段階の処理をより効率的にすると考えました。DTだけが例外だった理由としては、2つを挙げました。DTは、語彙アクセスや運動プログラミングよりも初期の知覚処理に関与するため、母語の表象の影響が小さいという点です。また、韓国語の刺激はすべて3音節でしたが、英語の刺激は1〜3音節だったため、一部の英語の項目がより易しかった可能性があるという点です。
- 母語の干渉: 英語のNRTで、一部の子どもは/ʧoʊvæg/を[ʧoʊbæg]のように、韓国語の単語に近い形で言いました。なじみのない英語の音の連鎖を、韓国語の音韻パターンに頼って処理したという解釈です。
- 課題の複雑さ: NRTは、聴覚知覚、音韻符号化、音韻記憶、運動プログラミング、運動計画、構音のすべてが関与する課題です。IPATは、視覚的手がかりで音韻表象にアクセスし、目標の音を取り出し、声に出さずに頭の中で操作する、複数の段階を経ます。
第二言語の違いと障害を区別する問題: 筆者の解釈
この論文の本研究は、定型発達児だけを対象としました。そのため、障害群との直接比較の結果は予備研究にしかありません。予備研究では、語音障害群は両言語とも、発話の産出能力が定型発達群より有意に低いものでした。課題別に見ると次のとおりでした。
- DT: 群差はありませんでした。
- PRT: 言語差が有意でした。
- NRT: 言語差と群差がともに有意でした。
以下は論文の結論ではなく筆者の解釈であり、論文では検証されていません。本研究では、英語を1年以上学んだ定型発達児でも、NRTで英語の得点が韓国語より低くなりました(86.18−78.55=7.63点)。筆者は、この程度の言語差は、英語の学習過程でよく見られる差である可能性があると考えます。予備研究のように、同じ課題で群差まで現れる場合が、言語学習による差と障害を区別する手がかりになりうるかもしれません。
ただし、このような区別にSPTを使えるかどうかは、後続の研究が必要です。論文は、本研究で障害群を比較しておらず、語音障害児でのSPTの効果を十分に評価できなかったと述べています。予備研究も、語音障害児10人と定型発達児20人で、標本が小さいものです。
研究チームは、課題間の得点の組み合わせを解釈する例も示しました。IPATとPRTの得点が高いのにOPATだけが低ければ、困難は発話の出力段階にある可能性があります。IPATがOPATより低ければ、PRTの得点で、問題が音韻認識にあるのか音韻表象にあるのかを判断できます。
意義と限界
何が変わるのか
- 語音処理モデルの入力、保存、出力の段階を、5つの課題で併せて評価する体系を作りました。
- 同じ構造の課題を、韓国語と外国語である英語で並べて実施します。英語の課題は翻訳ではなく、英語を学ぶ5〜7歳の子どもに合わせて新しく作りました。
- 音韻認識を、口頭で答えない入力型と口頭で答える出力型に分け、語音障害児の音韻認識が低く評価される問題を減らそうとしました。
- NRTを音節配列得点で採点し、音節順序の計画能力をより精密に評価します。
- 実施、採点、結果表示が自動化されています。この機能で採点の負担が減る可能性はありますが、実際の効果は確認されていません。論文には、実施時間や労力が実際にどれだけ減ったかについての測定結果は示されていません。
実務家にとっての有用性
言語聴覚士や教師が、子ども一人ひとりの強みと弱みを段階別のプロファイルとして整理する際に、SPTを活用できる可能性があります。ただし、論文は定型発達児にしか適用しておらず、基準関連妥当性も確認できていないため、臨床群での妥当性は確認されていません。英語の発音の誤りが多い子どもに出会ったとき、韓国語と英語の得点差を、定型発達児30人の差と探索的に比較してみることができます。この比較は大まかな参考用であり、障害の有無を判断する基準ではありません。結果画面は、正誤と詳細な指標を自動で整理してくれます。この自動採点機能が手作業による採点の負担を減らす可能性はありますが、論文は実際の時間短縮を測定していません。
研究者にとっての有用性
課題開発、専門家による妥当性検証、子どもへの適用という3段階の手続きは、他の言語の組み合わせの評価ツールを作る際にも参考にできます。予備研究で差が出なかったDTの難易度を調整した過程は、項目を修正して感度を高めた例です。筆者は、論文の表4の値を、今後の語音障害児との比較研究で参考にできると考えます。論文がこのような用途を示しているわけではありません。
論文が示した限界
論文自身が示した限界は3つです。
- 本研究の標本が定型発達児だけであるため、語音障害児でのSPTの効果を十分に評価できませんでした。研究チームは、現在語音障害と診断されている子どもと、過去に既往がある子どもを含めた後続の臨床研究を計画しています。
- 英語の語音処理を評価する、比較可能な韓国国内の標準化検査がないため、基準関連妥当性を確認できませんでした。
- 参加者の社会経済的、文化的、言語的背景や、バイリンガル環境への接触の情報を集めませんでした。
筆者が考える適用条件
以下は論文に書かれた内容ではなく、筆者が実務での適用を念頭に付け加える条件です。
- 対象年齢と英語の経験が合っている必要があります。課題と参考得点は、英語の授業を1年以上受けた5〜7歳の子どもを基準に作られています。
- 表4の平均を規準として使うのは時期尚早です。30人の平均と標準偏差は大まかな比較に使い、個々の子どもの障害の有無を判定する基準としては使わないほうが安全です。
- 実施順序を守ってこそ、比較に意味があります。本研究は常に韓国語版を先に実施したため、英語版を先に行うと得点が変わる可能性があります。
- DTの言語間比較は慎重に読む必要があります。2言語の刺激は音節構造が異なるため、英語の得点が高いことを、英語の知覚能力がより優れているという意味には解釈しにくいです。
今すぐ試せること
- すでに評価した子どものデータがあれば、同じ子どもの韓国語と英語の得点を課題ごとに並べて差を計算し、論文の表4の差と探索的に比較します。NRTのように定型発達児でも英語が低い課題と、DTのように英語が低くない課題を分けて見ます。
- 非語復唱の回答を録音してあれば、前方向と後ろ方向の配列得点の規則で採点し直してみます。論文の表1の例のように、省略と付加が得点にどう反映されるかを確認するのが最初の一歩です。
- 音韻認識課題を口頭で答える形式でしか実施してこなかった場合は、絵を選ぶ形式の項目を数個併せて実施します。そのうえで、IPAT、PRT、OPATの3つの得点の組み合わせから、困難が出力段階にあるのか、表象段階にあるのかを判断してみます。