最初の主張 #1
標準テストは、時代遅れのシステムの狭い遺物ではなく、教育の質、公平性、透明性を大規模に維持するために必要な柱です。教育システムは何百万人もの学生に、多様な地域、言語、リソースにまたがってサービスを提供しています。客観的で一貫して実施される尺度なしには、結果を比...
全文を表示 ▼
標準テストは、時代遅れのシステムの狭い遺物ではなく、教育の質、公平性、透明性を大規模に維持するために必要な柱です。教育システムは何百万人もの学生に、多様な地域、言語、リソースにまたがってサービスを提供しています。客観的で一貫して実施される尺度なしには、結果を比較し、格差を検出し、最も必要とされている場所にリソースを割り当てるための信頼できる方法がありません。
第一に、標準テストは共通の尺度を作成します。教室の成績やコースの厳密さは学校や教師の間で大きく異なります。統一された評価により、政策立案者、大学、地域社会は、地域の成績のばらつきと真の学習の違いを区別できます。この比較可能性は、公正な大学入学、奨学金の配分、労働市場のシグナルにとって不可欠です。これらの機能は、成績を操作したり、不均一なカリキュラム上の利点を提供したりできる、人脈の広い、または裕福な学校の学生を有利にします。
第二に、標準テストは達成度の格差を明らかにし、説明責任を推進します。集計および分解されたテスト結果は、学校がどの程度成績が悪く、どのサブグループ(収入、人種、言語ステータス、または障害別)が取り残されているかを明らかにします。そのデータは、個別指導プログラム、カリキュラム投資、教師研修、リソースの再配分などのターゲットを絞った介入の出発点です。テストを廃止すると、公平性の問題が存在することを示す最も明確な信号の1つが沈黙することになります。
第三に、適切に設計された標準評価は、他の多くの代替手段よりも客観的で不正行為に強いです。ブラインド採点、心理測定学的検証、および大規模な項目バンクを使用して、バイアスを減らし、信頼性を確保します。完璧なテストはありませんが、標準的な尺度を拒否すると、本質的に主観的なシステム(教師の評価や学校の自己報告)に評価を委ねることになり、これは地域の偏見を固定し、実際の成績不振を隠蔽する可能性があります。
批評家は、ストレス、文化的バイアス、「テストのための教育」を正しく指摘しています。これらは、全体的な排除の理由ではなく、解決可能な問題です。ストレスは、学習に使用される形成的評価(低リスクの練習)、複数のテスト機会、およびより良いカウンセリングによって軽減できます。文化的バイアスは、包括的なテスト設計、地域のパイロットテスト、および英語学習者と障害のある学生への配慮によって対処されます。「テストのための教育」は、狭く質の低いテストが使用された場合にのみ問題になります。その解決策は、より高い次数のスキルを測定する豊かな評価と、従来の項目と並行してパフォーマンスタスクを統合することであり、標準的な尺度を完全に放棄することではありません。
最後に、標準テストは費用対効果が高く、スケーラブルです。それらは、コホートの縦断的追跡、教育改革の評価、および国際的なベンチマーキングを可能にします。それらを削除すると、政策立案者は盲目になり、時間の経過とともに進捗を測定する能力が低下します。
要するに、標準テストを維持しつつ、それを改善することです。説明責任と公平性を確保するために、客観的で比較可能な尺度を維持し、同時にテストの設計、使用、およびサポートシステムを改革して、評価が学習を阻害するのではなく、より深い学習を促進するようにします。
標準化されたテストは客観性を約束するが、実際には全く異なるものを生み出す。それは、家庭の富を、見かけ上の能力へと変換する非常に効率的な機械である。
まず、テストが実際に何を測定しているかを見てみよう。SATやACTのスコアは、世帯収入、親の学歴、郵便番号と強く、一貫...
全文を表示 ▼
標準化されたテストは客観性を約束するが、実際には全く異なるものを生み出す。それは、家庭の富を、見かけ上の能力へと変換する非常に効率的な機械である。
まず、テストが実際に何を測定しているかを見てみよう。SATやACTのスコアは、世帯収入、親の学歴、郵便番号と強く、一貫して相関している。それは、裕福な子供たちがより有能だからではなく、裕福さがテスト対策、個別指導、模擬試験、静かな学習スペース、そしてそれらを利用するための余暇時間をもたらすからである。テストが「誰にとっても同じ」であるためには、その準備も同じでなければならない。しかし、そうではない。家族を養うために週に20時間働く学生が、時給200ドルの家庭教師を雇う同級生と競争する場合、その結果を客観的な基準と呼ぶことは公平ではなく、科学的に見える数字を通して特権を洗浄することに他ならない。そして、その数字は科学的に見えるため、その予測能力が正当化する以上に信頼されている。高校の成績は、土曜日の朝の4時間ではなく、長年にわたる持続的な努力を反映しており、大学での成績を少なくとも同等に、そして人口統計学的な格差をはるかに小さく予測する。
次に、テストが教育に与える影響を考えてみよう。資金提供、人員配置、学校の評価、そして時には教師の職がスコアにかかっている場合、合理的な教育者はインセンティブが指示する通りに行動する。つまり、テストされる内容にカリキュラムを狭めるのだ。音楽、美術、市民科、休憩時間、科学実験、長時間の作文、そして自由な発想のプロジェクトは、多肢選択式の形式のドリルに取って代わられてしまう。生徒たちは、議論を構築するのではなく、選択肢を排除することを学び、問いを立てるのではなく、答えを認識することを学ぶ。これは仮説上の懸念ではなく、高リスクの説明責任制度で十分に文書化されたパターンである。子供たちに対してグッドハートの法則が停止されるわけではない。ある指標が目標となった瞬間、それは私たちが気にかけているものを測定しなくなる。
第三に、人的コストは現実のものである。テスト不安、睡眠不足、スコアに基づいた自己定義は、今や思春期の普通の側面となっている。一方、教師たちは、1年間の人間関係の構築と知的な成長を単一の尺度に還元する制度の下で、士気の低下と離職を報告している。
私の反対者は、テストが不平等を明らかにすると言うだろう。しかし、治療なしの診断は平等ではない。何十年ものテストは、驚くほど詳細に学力格差を文書化してきたが、それを縮小するためにはほとんど何もしてこなかった。なぜなら、テストは最も恵まれない生徒たちが通う学校に結果を付随させるのであって、リソースを付随させるのではない。学習のギャップを特定したいのであれば、低リスクのサンプリング、教師の評価、ポートフォリオのレビューで行うことができる。子供の将来を朝のパフォーマンスにかけることなく。何百もの大学がテスト任意化を採用し、学術的な質の低下なしに志願者層がより多様になったことを発見した。証拠は出揃った。これらのテストは廃止されるべきだ。