← 最新の論文
📄 medicine

Associations Between Multi-Source Formative Assessment and Summative Examination Performance in Undergraduate Diagnostic Medicine: Evidence Supporting Programmatic Assessment

本研究は、認知、手技、およびコミュニケーションの領域にわたる多角的な形成的評価が、学部レベルの診断医学試験の成績を予測する上で有意な増分妥当性を提供することを示しており、それによって多領域プログラム評価システムの設計を支持すると同時に、天井効果による理論課題の限界を浮き彫りにしている。

原著者: Tingting Liu, Xionghui Ma, Yi Huang, Ruxing Yang, Tianwen Lai

公開日 2026-07-17
📖 1 分で読めます☕ さくっと読める

原著者: Tingting Liu, Xionghui Ma, Yi Huang, Ruxing Yang, Tianwen Lai

原論文は CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/) でライセンスされています。 これは以下の論文のAI生成解説です。著者が執筆または承認したものではありません。技術的な正確性については原論文を参照してください。 免責事項の全文を読む

町で一番のパン職人が誰なのかを知りたいと考えているとしましょう。ある土曜日に、たった一度だけ巨大なケーキを焼いてもらい、その一つの結果だけで判断することもできます。それは「総括的(サマティブ)」なテスト、つまり一度きりで終わる大きな最終試験のようなものです。しかし、もし彼らが実際にどのように学んでいるのかを知りたいとしたらどうでしょうか?毎週パン作りを練習する様子を見たり、難しい生地にどう対処するかを見守ったり、顧客との話し方に耳を傾けたりしたらどうでしょうか?それが「形成的(フォーマティブ)」な評価です。これは、学生の成長を助けるために、時間をかけて行われる一連の小さく、リスクの低いチェックアップなのです。

医学教育の世界では、教師たちはこれら二つのアプローチをどのように組み合わせるのがベストかを探っています。彼らは「プログラマティック・アセスメント」と呼ばれるシステムを使用していますが、これは何百もの小さなタイルを使って巨大なモザイク画を作るようなものです。各タイルは、一つの小さな課題や素早いチェックアップです。その考え方は、すべてのタイルをまとめて見たとき、単一の大きな絵を見るよりも、学生のスキルのより鮮明な全体像が得られるというものです。しかし、ここで難しい問題があります。それらすべての小さなタイルは、本当に学生が最終試験でどれほど優れた成績を収めるかを予測できるのでしょうか?そして、脳の力、手のスキル、そして話すスキルをテストするような異なる種類のタイルは、それぞれパズルのピースとして独自の価値を加えているのでしょうか?

広東医科大学によるこの研究は、まさにその問いに深く切り込んでいます。研究者たちは、診断医学(患者のどこが悪いのかを見極める学習)のコースを受講している382人の医学生を調査しました。彼らは、一学期間を通じて行われた5つの異なる種類の宿題や練習課題を追跡し、それらはすべて単一のオンラインプラットフォームに記録されていました。彼らは、これらの「練習のタイル」が、学生の期末筆記試験のスコアを予測できるかどうかを知りたかったのです。

結果は以下の通りですが、これはまるで、一部のゲストが他のゲストよりもずっと役に立つ、サプライズパーティーのような展開となりました。まず、ほぼすべての種類の練習課題が、期末試験のスコアに関連していることが判明しました。練習で成績が良い学生は、期末試験でも成績が良い傾向にありました。しかし、どの課題が「真の独立した予測因子」であるか(つまり、他の課題がすでにカバーしていない新しい情報を、どれが付け加えているのか)を詳しく見てみると、興味深い結果が得られました。

「頭脳的」な課題は、まちまちでした。講義の直後に多肢選択式の質問に答えるという一種の宿題は、少し巧妙な罠であることが分かりました。全員のスコアが非常に高く(100点満点中平均89.04点)、天井効果が生じていたのです。つまり、ほとんどの人が上限に達してしまったため、優秀な学生と優れた学生を区別することができませんでした。それは簡単すぎ、かつ授業の直後すぎたため、有用な予測因子としては機能しませんでした。しかし、もう一つの認知的な課題である「問題解決型学習(PBL)」は、スーパースターでした。PBLでは、学生はグループで複雑な医学的謎解きに取り組みます。この課題は強力な予測因子であり、問題に対して論理的に思考する能力が成功への大きな鍵であることを示唆していました。

次に、「実践的」な課題がありました。学生は、身体診察(心音を聞いたり肺の音を聞いたりすること)を行っている自身のビデオを録画し、教師からフィードバックを受ける必要があります。このビデオ課題もまた、主要な勝者でした。これは、学生の知能やグループでの謎解きの成績を考慮した後でも、期末試験のスコアを予測しました。このことは、自分自身を録画し、フィードバックを受け、技術を修正するという行為が、単に手の動きを学ぶだけでなく、教材の内容を深く理解することに役立っていることを示唆しています。

最後に、「対人」の課題がありました。学生は、病歴聴取の方法を学ぶために、俳優(標準化患者)と会話する練習を行いました。この課題は、予測に小さくも確かなブーストをもたらしました。最大の要因ではありませんでしたが、他のテストが見逃していた独自の情報を付け加えました。

これらすべてのピースを合わせると、この研究は、異なる種類の練習課題が期末試験の成績の差の約50.5%を説明していることを明らかにしました。研究者たちは、優れた評価システムには、認知(思考)、手順(実行)、コミュニケーション(会話)という3種類の「タイル」すべてが必要であると結論付けました。また、もし宿題を将来の成功の優れた予測因子にしたいのであれば、それは授業の直後の素早い簡単なクイズではなく、学生を差別化できるほど挑戦的なものである必要があることも学びました。一つのオンラインプラットフォームを使用してこれらのデータを収集することで、学校は学生の歩みのより豊かで正確な全体像を構築することができ、学習とは単に一つの大きなテストに合格すること以上のものだということを証明しているのです。

自分の分野の論文に埋もれていませんか?

研究キーワードに一致する最新の論文のダイジェストを毎日受け取りましょう——技術要約付き、あなたの言語で。

Digest を試す →