top of page

Психологічна енкциклопедія

Очевидна валідність (face validity): що це і чому «тест виглядає правильним» ще не доводить його валідність

6 днів тому
Читати 13 хв

Автор: Український психологічний ХАБ · Опубліковано: 23 вересня 2026 · Редакційна політика


Очевидна валідність, або face validity, описує перше враження від вимірювального інструмента: чи здаються його завдання, запитання, формат і загальна логіка доречними для того, що він нібито вимірює. APA Dictionary of Psychology прямо наголошує: тест може виглядати доречним і водночас не мати достатньої емпіричної валідності.


Саме тому фраза «тест виглядає правильним» є корисним спостереженням, але слабким аргументом щодо якості вимірювання. Вона може сказати, що інструмент зрозумілий, правдоподібний і прийнятний для респондента. Вона не відповідає на головні психометричні питання: чи справді бали відображають заявлений конструкт, чи охоплено його важливі компоненти, чи структура тесту відповідає теорії, як результати пов’язані з іншими змінними та чи можна обґрунтовано використовувати ці бали саме для запланованого рішення.


Коротка відповідь


Очевидна валідність — це оцінка того, наскільки тест або шкала на поверхневому, інтуїтивному рівні здаються придатними для заявленої мети. Зазвичай її можуть оцінювати представники цільової групи, фахівці або інші зацікавлені користувачі інструмента.


У сучасних Standards for Educational and Psychological Testing валідність розуміють не як красиву властивість самого тесту, а як ступінь, у якому накопичені докази й теорія підтримують конкретні інтерпретації тестових балів для конкретного використання. Face validity не виділена там як самостійне джерело доказів валідності.


Практичне правило просте: очевидна валідність може бути корисною для розробки, зрозумілості, прийнятності та взаємодії з респондентом, але сама по собі не доводить психометричної валідності.


Що саме означає face validity


В українській професійній лексиці використовується термін «очевидна валідність». Англійська назва face validity буквально вказує на оцінювання «за зовнішнім виглядом» або «на перший погляд». Йдеться не про зовнішню валідність дослідження і не про статистичний коефіцієнт.


Коли людина бачить тест тривожності й каже: «так, ці запитання справді схожі на запитання про тривожність», вона висловлює судження про очевидну валідність. Коли майбутні користувачі переглядають нову шкалу і повідомляють, що формулювання зрозумілі, завдання доречні, а інструкція відповідає заявленій меті, це також належить до сфери face validity.


Таке судження може бути важливим на етапі розробки. Воно допомагає помітити очевидно недоречні, незрозумілі або неприйнятні елементи ще до масштабного психометричного дослідження. Проте воно залишається судженням про видиму правдоподібність інструмента, а не демонстрацією того, що його бали мають потрібне значення.


Науковий статус очевидної валідності


Сучасний стандарт: валідність стосується інтерпретації та використання балів


AERA, APA і NCME визначають валідність як ступінь, у якому докази й теорія підтримують інтерпретації тестових балів для запропонованого використання. Стандарти 2014 року окремо підкреслюють, що валідизують не «тест узагалі», а інтерпретації його балів у конкретному контексті. Один і той самий інструмент може мати достатні докази для однієї мети та недостатні для іншої.


Це принципове зміщення. Питання «цей тест валідний?» замінюється точнішим: «які інтерпретації цих балів, для якої популяції та для якого рішення підтримуються доказами?» Саме тому в сучасній психометрії один приємний зовнішній вигляд або інтуїтивна доречність пунктів не можуть завершити аргумент валідності.


Чому термін face validity залишається дискусійним


У частині методологічної літератури термін face validity прямо критикують як назву окремого типу доказів валідності. Наприклад, Kenneth Royal, 2016 закликав не подавати його як самостійний тип доказів валідності. Огляд сучасних підходів до валідизації також пояснює, що «поверхнева правдоподібність» не замінює доказовий аргумент. Cook & Hatala, 2016.


Ця критика не робить спостереження респондентів непотрібними. Вона уточнює, що потрібно правильно називати те, що ми отримали. Якщо люди кажуть «запитання зрозумілі й здаються доречними», це доказ зрозумілості, прийнятності або сприйманої відповідності. Щоб стверджувати, що бали мають певне психологічне значення, потрібні інші, сильніші лінії доказів.


Важливе уточнення: COSMIN включає face validity до змістової валідності


У клінічному вимірюванні та дослідженнях результатів у сфері здоров’я рамка COSMIN використовує іншу термінологічну організацію: content validity розглядається як оцінка релевантності, повноти й зрозумілості змісту, а face validity включається до цього блоку. Для інструментів, у яких про стан повідомляють самі пацієнти (patient-reported outcome measures, PROMs), перспектива пацієнтів і цільових користувачів є особливо важливою.


Отже, фраза «face validity не є доказом валідності» потребує рамкового уточнення. У Standards AERA/APA/NCME вона не є окремим джерелом доказів валідності; у COSMIN її можуть розглядати як частину ширшої оцінки змістової валідності. Спільним залишається головне: одного поверхневого враження недостатньо, щоб обґрунтувати всі інтерпретації й використання тестових балів.


Що саме оцінюють, коли перевіряють очевидну валідність


Найчастіше перевіряють чотири практичні речі: чи зрозуміло, що від людини вимагає інструкція; чи здаються запитання або завдання пов’язаними із заявленим конструктом; чи формат відповіді є логічним і зручним; чи не містить інструмент очевидно чужорідних, двозначних або неприйнятних елементів.


Для анкет і шкал має значення також те, як люди розуміють рейтингову шкалу: що для них означають категорії відповіді, чи відрізняються сусідні градації, чи зрозуміло, до якого періоду часу стосується запитання. Це може суттєво поліпшити якість інструмента, але все одно не перетворює оцінку зрозумілості на доказ конструктної валідності.


Очевидна валідність може стосуватися не лише тексту пунктів. Вона охоплює інструкції, послідовність завдань, графічне оформлення, відповідність мови цільовій аудиторії та загальну правдоподібність процедури. Проте дизайн, що «виглядає професійно», і психометрична якість — різні характеристики.


Хто має оцінювати face validity


Цільові користувачі дають унікальну інформацію про те, як тест сприймається зсередини процедури. Вони можуть помітити незрозумілу лексику, культурно чужі приклади, незручні категорії відповіді, образливі формулювання або запитання, сенс яких розробник вважав очевидним.


Експерти можуть оцінити, чи здаються завдання доречними з позиції теорії та професійної практики. Але експертне судження стає змістовно сильнішим, коли воно систематично перевіряє репрезентативність домену, відповідність специфікації тесту та покриття конструкта. У такому разі ми вже переходимо від простого «виглядає доречно» до змістової валідності.


Найкраще не змішувати ролі. Респондент добре повідомляє, як пункт зрозумілий і сприймається. Предметний експерт краще оцінює відповідність змісту теоретичній області. Психометрист оцінює структуру балів, надійність, похибку вимірювання, зв’язки з іншими змінними та інші джерела доказів.


Як оцінюють очевидну валідність на практиці


Когнітивні інтерв’ю та пілотування


Один із найінформативніших підходів — показати інструмент людям із цільової популяції та попросити пояснити, як вони зрозуміли інструкцію, конкретні формулювання, часові рамки й варіанти відповіді. Так можна побачити не лише фінальну відповідь, а й шлях, яким респондент надав їй значення.


У сучасних Standards аналіз процесів відповіді є окремим можливим джерелом доказів валідності, якщо він перевіряє теоретичні припущення про те, як люди фактично виконують завдання. AERA, APA & NCME, 2014. Тому якісне когнітивне інтерв’ю може вийти далеко за межі простої face validity, якщо воно спрямоване на перевірку конкретного механізму відповіді.


Оцінювання зрозумілості, доречності та прийнятності


Респондентів можна просити оцінити, наскільки пункт зрозумілий, доречний або важливий, а також залишити відкритий коментар. Такі рейтинги зручні для пошуку проблемних формулювань. Числове середнє або відсоток згоди роблять зворотний зв’язок структурованішим, але сам факт появи числа не перетворює суб’єктивну оцінку на повну психометричну валідизацію.


Для face validity немає одного універсального коефіцієнта, який за певного порога робив би тест «валідним». Якщо автори вводять власний індекс зрозумілості або доречності, потрібно читати, хто його оцінював, що саме означала шкала, скільки було респондентів і яке рішення автори робили з отриманого показника.


Експертний перегляд


Експертів можна просити позначати неясні або очевидно недоречні пункти. Але коли завдання полягає в тому, щоб систематично перевірити, чи охоплює набір пунктів усі суттєві аспекти конструкта, це вже питання змістової валідності. Термінологічна точність тут важлива, бо інакше в статті легко створити враження, ніби короткий експертний перегляд довів значно більше, ніж він насправді довів.


Чому «тест виглядає правильним» ще нічого не доводить


Тест може виглядати переконливо, але вимірювати занадто вузьку частину конструкта


Конструкт часто ширший за найочевидніші його прояви. Шкала може містити лише ті запитання, які читач легко впізнає як тематично релевантні, але пропускати важливі компоненти. Тоді висока face validity співіснує з недостатнім покриттям домену.


У Standards це описують через ризик construct underrepresentation — ситуацію, коли тест не охоплює важливі аспекти конструкта. AERA, APA & NCME, 2014. На поверхні тест може здаватися дуже тематичним, але його бали матимуть звужене значення.


Очевидні пункти можуть вимірювати щось додаткове


Запитання може виглядати ідеально доречним, але відповідь на нього залежатиме також від соціальної бажаності, читабельності, словникового запасу, мотивації, культурних норм або того, наскільки респондент здогадався про мету тестування. Такі сторонні впливи можуть змінити бали, хоча зовнішньо пункт усе ще «про правильну тему».


Саме тому психометрична перевірка розглядає не лише зміст пункту, а й те, як працює вся система вимірювання: процес відповіді, внутрішню структуру, зв’язки з іншими змінними, похибку, стабільність і придатність конкретної інтерпретації.


Непрямий пункт може мати низьку очевидність і водночас давати корисну інформацію


Не кожне валідне вимірювання має виглядати для респондента як пряме запитання про конструкт. Деякі психологічні властивості вимірюють через поведінкові завдання, патерни виконання або непрямі індикатори. Їхня логіка може бути неочевидною без знання теорії.


Тому низька face validity сама по собі також не є автоматичним доказом поганої валідності. Потрібно перевірити, чи існує теоретична і емпірична підстава для такого формату та чи підтримують дані потрібну інтерпретацію балів.


Очевидна валідність і змістова валідність — це не одне й те саме


Face validity питає: «чи здається цей інструмент доречним на перший погляд?» Змістова валідність ставить систематичніше питання: «чи релевантно і достатньо повно представлений домен змісту, на який ми хочемо поширити інтерпретацію?»


За Standards докази на основі змісту можуть включати логічні або емпіричні аналізи того, наскільки тестовий зміст представляє потрібний домен, а також експертні судження про зв’язок між частинами тесту і конструктом. Це значно сильніша процедура, ніж загальна відповідь «виглядає доречно».


У COSMIN межа формулюється трохи інакше: face validity включають до content validity, але змістова оцінка все одно повинна враховувати релевантність, повноту й зрозумілість для конкретного конструкта, популяції та контексту використання.


Очевидна валідність і конструктна валідність — це різні рівні питання


Конструктна валідність стосується того, чи узгоджується поведінка тестових балів із теоретичними очікуваннями щодо конструкта. Якщо теорія передбачає певну факторну структуру, зв’язок із близькими конструктами, слабший зв’язок із відмінними конструктами або відмінності між групами, ці гіпотези можна перевіряти емпірично.


Сучасні Standards виділяють докази на основі внутрішньої структури й зв’язків з іншими змінними. AERA, APA & NCME, 2014. Face validity таких перевірок не проводить. Людина може впевнено сказати, що шкала «дуже схожа на тест самооцінки», але це не покаже, чи її факторна структура, конвергентні й дискримінантні зв’язки справді відповідають моделі самооцінки.


Очевидна валідність і критеріальна валідність


Критеріально орієнтовані докази запитують, як тестові бали пов’язані із зовнішнім критерієм, якщо такий критерій доречно визначений. Наприклад, інструмент, який використовують для прогнозування майбутнього результату, потребує доказів того, що бали справді пов’язані з цим результатом у релевантній популяції.


Face validity нічого не говорить про силу такого зв’язку. Інструмент може виглядати надзвичайно правдоподібним, але майже нічого не прогнозувати. І навпаки, корисний предиктор може бути неочевидним для людини, яка бачить лише окремі завдання без теоретичного та статистичного контексту.


Очевидна валідність і надійність


Надійність і валідність відповідають на різні питання. Надійність стосується точності, узгодженості або відтворюваності вимірювання за визначених умов. Валідність стосується обґрунтованості інтерпретацій і використання отриманих балів.


Тест може мати високу face validity і низьку надійність. Він може складатися з дуже «правильних на вигляд» запитань, але давати нестабільні результати через шум, неоднозначність або надто малу кількість інформації. І навпаки, високий коефіцієнт надійності — наприклад, у задачах, де застосовується формула Спірмена–Брауна — не доводить, що тест вимірює потрібний конструкт. Надійність ≠ валідність.


Коли очевидна валідність справді має практичне значення


Мотивація і ставлення респондента


Сприйняття тесту може впливати на поведінку під час тестування. У дослідженні студентів Chan et al., 1997 сприймана face validity була пов’язана з подальшим виконанням когнітивного тесту опосередковано через мотивацію до тестування. Це окреме дослідження в конкретній вибірці, тому його не варто перетворювати на універсальний закон, але воно добре показує практичний механізм: якщо людина вважає процедуру безглуздою, це може змінювати її залученість.


Отже, хороший інструмент має бути не лише психометрично обґрунтованим, а й достатньо зрозумілим та прийнятним для реальних користувачів. Це особливо важливо в довгих анкетах, освітньому тестуванні, відборі персоналу, клінічному моніторингу та дослідженнях, де недовіра до процедури може збільшувати пропуски й недбалі відповіді.


Зрозумілість і довіра


У психологічному оцінюванні людина має розуміти, що з нею відбувається, у межах дозволеного процедурою. Непрозоре або очевидно недоречне завдання може погіршити співпрацю. Face validity тут працює як сигнал прийнятності й комунікаційної якості, а не як сертифікат точності вимірювання.


Чому занадто висока очевидність теж не завжди перевага


У деяких контекстах надто прозора мета пунктів може змінювати спосіб відповіді: респондент легше вгадує, яку характеристику оцінюють, і може свідомо чи несвідомо підлаштовувати відповіді. Наскільки це важливо, залежить від конструкта, мотивації, наслідків тестування та дизайну інструмента.


Тому максимальна очевидність не є універсальною ціллю. Завдання розробника — досягти достатньої зрозумілості й прийнятності, не підміняючи ними вимірювальну логіку тесту.


Очевидна валідність у перекладі та культурній адаптації


Український переклад може звучати природно, бути зрозумілим і мати високу face validity — і все одно залишатися лише перекладом. Добре відредагована мова не доводить, що значення конструкта, структура балів, норми, пороги або психометричні властивості перенеслись у нову мовну й культурну популяцію.


Актуальні ITC Guidelines for Translating and Adapting Tests вимагають розглядати адаптацію ширше за буквальний переклад: ураховувати мовні, психологічні й культурні відмінності та збирати емпіричні докази еквівалентності, надійності й валідності в різних мовних і культурних групах.


Тому формула «ми переклали опитувальник, носії мови сказали, що все зрозуміло, отже українська версія валідна» методологічно неправильна. Зрозумілість — важливий етап. Валідована культурна адаптація потребує окремої доказової програми.


Так само ліцензійний статус і психометрична якість — різні питання. Легальний дозвіл на переклад не доводить валідності адаптації, а хороші психометричні дані не скасовують авторського права та правил використання захищеного тесту.


Очевидна валідність у клінічному скринінгу


У психічному здоров’ї особливо небезпечно ототожнювати правдоподібний зміст опитувальника з діагностичною точністю. Скринінгова шкала може містити дуже очевидні симптоматичні запитання і виглядати переконливо, але це не робить окремий бал діагнозом.


Для клінічного використання потрібно знати, для якої популяції та мети отримано докази, які норми застосовуються, наскільки надійні бали, як працюють чутливість і специфічність, як поширеність стану впливає на позитивну та негативну прогностичну цінність, які наслідки має обраний поріг і чи потрібне подальше клінічне оцінювання.


Скринінг означає скринінг. Виявлення ймовірних випадків (case-finding) означає пошук людей, які можуть потребувати подальшої оцінки. Психологічне або клінічне оцінювання (assessment) є ширшою процедурою. Діагноз (diagnosis) означає клінічний висновок за відповідними критеріями та процедурою. Face validity не стирає ці межі.


Типові помилки інтерпретації


Помилка 1: «Пункти прямо питають про конструкт, отже тест валідний». Прямота формулювань показує лише тематичну очевидність. Вона не перевіряє повноту конструкта, структуру балів і зовнішні зв’язки.


Помилка 2: «Експерти переглянули анкету, тому конструктна валідність доведена». Експертний перегляд може підтримувати оцінку змісту. Конструктний аргумент потребує теоретичних та емпіричних перевірок гіпотез про поведінку балів.


Помилка 3: «90% респондентів сказали, що тест доречний — це коефіцієнт валідності 0,90». Відсоток згоди описує судження конкретної групи за конкретною процедурою. Він не є універсальним коефіцієнтом валідності тестових балів.


Помилка 4: «Якщо face validity низька, тест поганий». Низька очевидність може сигналізувати проблему зрозумілості або прийнятності, але інколи вимірювальна логіка навмисно непряма. Потрібно дивитися на весь валідизаційний аргумент.


Помилка 5: «Якщо face validity висока, додаткові дослідження не потрібні». Саме тут перше враження найчастіше перетворюють на надмірний висновок. Висока очевидність не відповідає на питання про надійність, похибку вимірювання, факторну структуру, інваріантність вимірювання, DIF, зв’язки з критеріями або клінічну корисність.


Помилка 6: «Переклад звучить природно, тому адаптація валідована». Природність мови — лише один аспект. Кроскультурна еквівалентність і валідність потребують окремих доказів.


Помилка 7: «Face validity — це те саме, що зовнішня валідність». Ні. Зовнішня валідність дослідження стосується можливості узагальнення висновків на інші популяції, ситуації або умови. Face validity стосується поверхневої правдоподібності інструмента.


Як читати статтю або мануал, де автори пишуть про face validity


Спочатку з’ясуйте, як саме автори визначили термін. У різних дисциплінах він може означати від простого неформального перегляду до структурованої оцінки зрозумілості й релевантності цільовими користувачами.


Далі подивіться, хто був оцінювачем. П’ять колег-розробників, двадцять пацієнтів із цільової групи та незалежна панель предметних експертів дають різні типи інформації. Саме число оцінювачів також не замінює питання про їхню релевантність до мети.


Перевірте метод: чи були когнітивні інтерв’ю, відкриті коментарі, структуровані рейтинги, повторні раунди редагування, попередньо визначені критерії? Чи показано, які саме зміни були внесені після зворотного зв’язку?


Найважливіше — знайдіть незалежні лінії доказів. Що відомо про зміст, процеси відповіді, внутрішню структуру, зв’язки з іншими змінними, надійність, похибку та придатність для цільової популяції? Якщо дослідники повідомляють лише face validity, їхній висновок має залишатися вузьким.


Також перевірте запланованої мети використання: для чого саме використовують результат. Вимоги до короткої дослідницької анкети, клінічного моніторингу, скринінгу, високоставкового відбору та індивідуального діагностичного рішення різні. Чим серйозніші наслідки, тим сильнішим має бути доказовий аргумент.


Коли результат перевірки face validity можна вважати корисним


Корисний результат відповідає на чітко поставлене вузьке питання. Наприклад: цільові користувачі правильно зрозуміли інструкцію; більшість формулювань сприймаються як доречні; два пункти були двозначними й переписані; один варіант відповіді не працював у цільовій культурі; учасники вказали на пропущений аспект досвіду.


Такий результат безпосередньо допомагає вдосконалити інструмент. Він стає проблемним, коли з нього роблять висновок вищого рівня: «отже тест вимірює конструкт», «отже шкала діагностує розлад» або «отже поріг клінічно правильний». Кожен із цих висновків вимагає інших доказів.


Що має бути після face validity у програмі валідизації


Після первинної перевірки доречності й зрозумілості дослідник повертається до ширшого валідизаційного аргументу. Standards пропонують збирати ті джерела доказів, які потрібні для конкретної інтерпретації: на основі змісту тесту, процесів відповіді, внутрішньої структури, зв’язків з іншими змінними та наслідків використання.


До цього додається оцінювання надійності й точності, похибки вимірювання, справедливості для релевантних груп, культурної та мовної придатності, а за потреби — діагностичної точності, responsiveness або здатності виявляти зміни. Не кожному тесту потрібен однаковий набір аналізів: набір доказів визначається конструктом, популяцією й метою.


Face validity добре працює на початку як фільтр очевидних проблем і як частина діалогу з користувачами. Вона стає слабким місцем лише тоді, коли її намагаються використати як фінальну відповідь на питання, яке значно ширше за перше враження.


FAQ: часті запитання про очевидну валідність


Чи є face validity «справжньою валідністю»?


Залежить від термінологічної рамки. У сучасних Standards AERA/APA/NCME face validity не є окремим джерелом доказів валідності. У COSMIN її включають до змістової валідності для певних класів інструментів вимірювання результатів у сфері здоров’я. У будь-якому разі одного враження «виглядає доречно» недостатньо для повного обґрунтування інтерпретації тестових балів.


Чи можна виміряти face validity числом?


Можна кількісно підсумовувати рейтинги зрозумілості, релевантності або прийнятності, наприклад часткою позитивних оцінок. Але універсального коефіцієнта face validity, який сам по собі доводить валідність тесту, немає. Число має інтерпретуватися лише в межах конкретної процедури.


Чи може тест мати високу очевидну, але низьку конструктну валідність?


Так. Пункти можуть дуже переконливо нагадувати потрібну тему, але охоплювати лише вузьку її частину, мати іншу факторну структуру або сильніше відображати сторонній конструкт. Саме тому потрібні емпіричні перевірки теоретичних гіпотез.


Чи може корисний тест мати низьку face validity?


Так. Деякі завдання працюють через непрямі індикатори, і їхня вимірювальна логіка не обов’язково очевидна респондентові. Низька очевидність може бути проблемою прийнятності, але не автоматичним спростуванням валідності.


Чим face validity відрізняється від content validity?


Face validity описує поверхневу, інтуїтивну доречність. Content validity систематично перевіряє, наскільки зміст релевантний і репрезентативний для визначеного домену. У COSMIN face validity може бути підкомпонентом content validity, але ці поняття все одно не варто механічно ототожнювати в інших рамках.


Чи доводить професійний дизайн тесту його валідність?


Ні. Гарний інтерфейс, авторитетна назва, логотип, графіки або переконливий звіт можуть підвищити довіру, але не створюють психометричних доказів. Оцінювати потрібно метод розробки, вибірку, валідизаційні гіпотези, надійність, похибку, норми та відповідність запланованої мети використання.


Чи є природний український переклад доказом валідованої адаптації?


Ні. Природність і зрозумілість української версії є важливими, але ITC вимагає ширшої адаптації й емпіричного підтвердження еквівалентності та психометричних властивостей у цільових мовних і культурних групах.


Чи можна поставити діагноз, якщо скринінговий тест має очевидну валідність і високий бал?


Ні. Високий бал на скринінгу залишається результатом скринінгу. Діагностичне рішення залежить від валідності інструмента для конкретного використання, характеристик точності, клінічного контексту, базової поширеності стану та повноцінного оцінювання за відповідними критеріями.


Головний висновок


Очевидна валідність відповідає на скромне, але корисне питання: чи виглядає інструмент доречним і зрозумілим для людей, які з ним працюють. Це може допомогти знайти проблемні формулювання, поліпшити прийнятність і підвищити якість взаємодії з респондентом.


Науковий висновок про валідність потребує значно більшого. Він будується з теорії, змісту, поведінки відповідей, структури даних, зв’язків з іншими змінними, надійності, похибки, популяційної та культурної відповідності й конкретної мети використання. Тест може чудово виглядати й погано вимірювати. Саме тому «виглядає правильно» — початок перевірки, а не її завершення.


Пов’язані статті





Джерела


American Educational Research Association, American Psychological Association, & National Council on Measurement in Education. (2014). Standards for Educational and Psychological Testing.


American Psychological Association. (2018). Face validity. APA Dictionary of Psychology.


Chan, D., Schmitt, N., DeShon, R. P., Clause, C. S., & Delbridge, K. (1997). Reactions to cognitive ability tests: the relationships between race, test performance, face validity perceptions, and test-taking motivation. Journal of Applied Psychology, 82(2), 300–310. https://doi.org/10.1037/0021-9010.82.2.300


Cook, D. A., & Hatala, R. (2016). Validation of educational assessments: a primer for simulation and beyond. Advances in Simulation, 1, 31. https://doi.org/10.1186/s41077-016-0033-y



Prinsen, C. A. C., Vohra, S., Rose, M. R., Boers, M., Tugwell, P., Clarke, M., Williamson, P. R., & Terwee, C. B. (2016). Guideline for selecting outcome measurement instruments for outcomes included in a Core Outcome Set.


Royal, K. D. (2016). “Face validity” is not a legitimate type of validity evidence! American Journal of Surgery, 212(5), 1026–1027. https://doi.org/10.1016/j.amjsurg.2016.02.018


Всеукраїнська психодіагностична асоціація. Очевидна валідність. Глосарій.

 
 
bottom of page