Контрольна група в психологічному експерименті: що це і навіщо вона потрібна
Автор: Український психологічний ХАБ · Опубліковано: 7 жовтня 2026 · Редакційна політика
Контрольна група в психологічному експерименті — це група учасників або інших одиниць дослідження, результати якої використовують як точку порівняння з експериментальною умовою. Її завдання полягає не в тому, щоб «нічого не робити», а в тому, щоб показати, з чим саме порівнюється дія досліджуваного впливу і які альтернативні пояснення результату дизайн намагається відсіяти.
У найпростішому міжгруповому експерименті одна група отримує експериментальний вплив, а інша — контрольну умову. Проте контроль може означати відсутність втручання, очікування, звичайну практику, плацебо, нейтральну активність або інше активне втручання. Вибір контролю визначає, на яке запитання відповість дослідження. Саме тому сучасна методологія розглядає контрольну умову як частину причинної логіки дизайну, а не як формальну «другу групу». Детальна логіка маніпуляції, змінних і внутрішньої валідності розкрита в матеріалі про експериментальний метод у психології.
Для психологічних досліджень це особливо важливо, бо результат може змінюватися не лише через специфічний компонент втручання. На нього впливають очікування учасників, увага дослідника, повторне тестування, природні коливання стану, плин часу, контакт із фахівцем, додаткові активності та інші чинники. Методологічний огляд Mohr та співавторів показує, що конструкція контрольної умови може суттєво визначати інтерпретацію результату психологічного рандомізованого дослідження.
Що таке контрольна група
Контрольна група — це група порівняння, для якої визначено контрольну умову. У класичному паралельному експерименті учасників розподіляють щонайменше між двома умовами: експериментальною та контрольною. Після цього вимірюють результат і оцінюють різницю між умовами.
Ключове слово тут — «порівняння». Контрольна група не є групою людей, яких просто залишили поза дослідженням. Її учасники проходять передбачену протоколом процедуру: вимірювання, спостереження, контакт із дослідницькою командою, а залежно від дизайну — звичайну допомогу, плацебо, нейтральне завдання, іншу інтервенцію або відкладене втручання.
Також варто розрізняти контрольну групу і контрольну умову. У міжгруповому дизайні контрольну умову отримує окрема група. У внутрішньоіндивідуальному дизайні та сама людина може пройти і експериментальну, і контрольну умову в різний час. Тоді окремої контрольної групи немає, але логіка контрольного порівняння зберігається.
Навіщо потрібна контрольна група
Будь-яка зміна після втручання має кілька можливих пояснень. Людина могла б покращитися й без експериментальної програми; показник міг випадково повернутися ближче до свого типового рівня; повторне виконання тесту могло дати ефект практики; учасники могли змінити поведінку через сам факт участі у дослідженні. Контрольна група створює емпіричну основу для оцінки того, що відбувалося б за альтернативної умови.
У термінах причинного висновку дослідника цікавить контраст між потенційними результатами: що сталося за експериментального впливу і що сталося б за обраної контрольної умови. Одночасно спостерігати обидва потенційні результати для тієї самої людини в один і той самий момент неможливо, тому експериментальний дизайн створює групове порівняння, яке наближує цей контрфактичний сценарій.
Контрольна група допомагає послабити кілька типів альтернативних пояснень:
природний перебіг стану або плин часу: зміна могла б статися незалежно від втручання;
регресію до середнього: після відбору людей з особливо високими або низькими початковими значеннями наступне вимірювання часто буває менш екстремальним навіть без причинної дії програми;
ефект повторного тестування: учасники можуть краще виконувати завдання лише тому, що вже бачили його;
очікування і контекст: переконання, що має відбутися покращення, увага дослідника та формат взаємодії можуть впливати на самозвіт і поведінку;
історичні події та супутні впливи: під час дослідження можуть статися події, що змінюють результат в обох групах;
спонтанні коливання та випадкову варіативність: окреме вимірювання може відрізнятися від типового рівня без стійкої зміни.
Важливо: контрольна група не усуває всі ці проблеми автоматично. Вона контролює лише ті чинники, які однаково або достатньо подібно діють у порівнюваних умовах. Якщо, наприклад, експериментальна група має щотижневий контакт із психологом, а контрольна не має жодного контакту, різниця між групами може відображати не лише специфічний компонент програми, а й увагу, очікування, соціальну взаємодію та структуру часу.
Контрольна та експериментальна групи: у чому різниця
Експериментальна група отримує умову або втручання, ефект якого досліджують. Контрольна група отримує умову, що задає еталон для порівняння. Ці ролі визначаються дослідницьким запитанням, а не цінністю чи «якістю» групи.
Наприклад, якщо досліджують нову програму тренування уваги, експериментальна група може виконувати спеціально розроблені вправи, а контрольна — інше завдання такої самої тривалості. Якщо дослідження порівнює дві вже існуючі програми, одна може бути позначена як експериментальна, а друга — як активний контроль. У такому випадку обидві групи щось роблять, але одна з них задає порівняльну умову для головного дослідницького контрасту.
Контрольна група не дорівнює «групі без втручання»
Поширене навчальне визначення описує контрольну групу як групу, яка не отримує експериментального впливу. Для найпростішого експерименту це допустиме спрощення, але для сучасної психологічної науки воно занадто вузьке. Огляд Mohr та співавторів виділяє різні конструкції контрольних умов для психологічних втручань, а CONSORT 2025 вимагає достатньо повного опису і експериментального втручання, і компаратора.
Правильніше визначати контроль через дослідницьку функцію: це умова, з якою порівнюють експериментальну умову, щоб оцінити певний причинний або описовий контраст.
Основні типи контрольних умов
Відсутність втручання або пасивний контроль
Учасники контрольної групи не отримують спеціально організованого втручання в межах дослідження, хоча можуть проходити ті самі вимірювання. Такий контроль добре показує, чи відрізняється результат експериментальної програми від природного перебігу та повторного вимірювання в конкретному контексті.
Його слабке місце полягає в тому, що він майже не контролює увагу, очікування, мотивацію, контакт із дослідником і структуру часу. Тому різниця на користь експериментальної групи ще не ізолює специфічний механізм програми.
Контроль списку очікування
Учасники потрапляють у список очікування і отримують програму пізніше. Це практичний дизайн, коли дослідники хочуть запропонувати втручання всім учасникам, але потребують періоду порівняння.
Список очікування відповідає приблизно на запитання «чи краще отримувати програму зараз, ніж чекати?». Він не створює такого самого досвіду, як активна інтервенція. У психологічних і психотерапевтичних дослідженнях тип контролю може змінювати величину спостережуваного ефекту. Кокранівський огляд 2022 року для досліджень психічних розладів виявив істотні відмінності між ефектами залежно від контрольної умови, водночас автори підкреслили низьку або дуже низьку певність доказів і значну методологічну неоднорідність. Це підтримує обережний висновок: компаратор має значення, але розмір цієї різниці залежить від конкретної галузі та дизайну.
Звичайна практика
Контрольна група продовжує отримувати звичайну допомогу, навчання або іншу практику, яка реально доступна без експериментальної програми. Такий дизайн часто ближчий до практичного запитання: чи дає нове втручання додаткову користь порівняно з тим, що люди зазвичай отримують.
Водночас «звичайна практика» має бути описана. В різних установах і для різних учасників вона може суттєво відрізнятися, а отже сама назва не гарантує стандартизованого компаратора.
Плацебо або імітаційний контроль
Плацебо-контроль намагається зробити досвід контрольної групи подібним до експериментальної, але без специфічного активного компонента, який перевіряють. У медикаментозних випробуваннях це може бути таблетка без активної речовини; у процедурних дослідженнях — імітаційна процедура. У психології повністю переконливе плацебо часто створити значно складніше, бо учасники можуть розуміти, яку саме діяльність вони виконують.
Тому слово «плацебо» не означає, що всі неспецифічні чинники ідеально вирівняно. Потрібно перевіряти, наскільки контрольна умова справді схожа за очікуваннями, правдоподібністю, контактом і навантаженням.
Контроль уваги
Контрольна група отримує приблизно таку саму кількість контакту, часу або уваги, але без ключового компонента експериментальної програми. Наприклад, якщо експериментальна група щотижня проходить структуроване тренування, контрольна може брати участь у нейтральних зустрічах тієї самої тривалості.
Такий контроль дозволяє краще відокремити специфічний зміст програми від самого факту регулярної взаємодії. Проте він не обов’язково вирівнює очікування користі.
Активний контроль
Активна контрольна група виконує змістовну активність або отримує інше втручання. Це може бути альтернативне тренування, інша психотерапевтична програма, освітній курс або стандартна активна терапія.
Активний контроль часто дає суворіше порівняння, але сам по собі не усуває ефекти очікування. Boot та співавтори показали, що якщо учасники очікують більшого покращення від експериментальної програми, ніж від активного контролю, різницю між групами не можна автоматично приписати специфічній силі експериментального компонента. Очікування варто вимірювати й, коли це можливо, вирівнювати конструкцією контролю.
Активний компаратор або альтернативне ефективне втручання
У прагматичних і клінічних дослідженнях нове втручання можуть порівнювати не з «нульовою» умовою, а з уже прийнятим або доказовим підходом. Тоді запитання змінюється: дослідження оцінює перевагу, еквівалентність, не гіршу ефективність або інший заздалегідь визначений контраст між двома активними стратегіями.
Такий дизайн не відповідає на запитання, чи працює кожне втручання порівняно з відсутністю допомоги. Він відповідає на сильніше практичне запитання про їхню відносну ефективність за конкретних умов.
Вибір контрольної групи визначає, що саме означає результат
Одна й та сама експериментальна програма може дати різний числовий ефект залежно від компаратора. Це не статистичний дефект саме по собі. Різні контрольні умови задають різні наукові питання.
Програма проти відсутності втручання: чи відрізняється результат від природного перебігу та повторного вимірювання?
Програма проти списку очікування: чи є користь від отримання програми зараз порівняно з очікуванням?
Програма проти контролю уваги: чи виходить ефект за межі часу та контакту з дослідником?
Програма проти плацебо або імітації: чи є перевага, яка не пояснюється частиною контекстних та очікувальних ефектів?
Програма проти активної альтернативи: чи є вона кращою за інше змістовне втручання?
Тому фраза «втручання було ефективним» без назви контрольної умови неповна. Науково змістовна формула має називати порівняння: «втручання дало кращий результат, ніж список очікування», «не перевершило активний контроль» або «мало подібний результат до стандартної практики».
Рандомізація і контрольна група — різні елементи дизайну
Наявність контрольної групи ще не означає, що дослідження рандомізоване. Рандомізація — це випадковий розподіл уже залучених учасників або кластерів між умовами. Контрольна група — це роль однієї з цих умов у порівнянні.
Якщо учасники самі обирають, до якої групи потрапити, або дослідник формує групи за доступністю, попередні відмінності між ними можуть бути пов’язані і з вибором умови, і з результатом. Наприклад, мотивованіші люди можуть частіше обирати тренування і водночас краще виконувати подальші завдання. У такому випадку сам факт наявності «контрольної групи» не усуває селекційне зміщення.
У рандомізованому дизайні випадковий розподіл зменшує систематичний конфаундинг між умовами. Проте він не гарантує, що в конкретній вибірці групи будуть ідентичними за віком, початковим рівнем симптомів чи іншими характеристиками. Пояснення CONSORT 2025 прямо наголошує: випадкові дисбаланси на старті можливі, а перевіряти їх серією тестів статистичної значущості не рекомендується. Важливіше описати базові характеристики та оцінити змістовну величину потенційно важливих дисбалансів.
Випадковий розподіл не дорівнює випадковій вибірці
Ці поняття вирішують різні завдання. Випадкова вибірка стосується того, кого залучили з ширшої популяції, і пов’язана з репрезентативністю та зовнішнім узагальненням. Випадковий розподіл стосується того, до якої умови потрапить уже залучений учасник, і насамперед підтримує внутрішню валідність причинного порівняння.
Експеримент може мати добре проведену рандомізацію на зручній студентській вибірці. Тоді порівняння між умовами може бути внутрішньо переконливим, але узагальнення на інший вік, культуру або клінічну популяцію вимагатиме окремих доказів.
Чи мають контрольна й експериментальна групи бути однаковими на початку
У рандомізованому експерименті мета полягає в тому, щоб процедура розподілу не створювала систематичної переваги одній з умов. Це не означає, що всі виміряні характеристики в готовій вибірці мають бути чисельно однаковими.
Навіть за бездоганної рандомізації невеликі випадкові відмінності неминучі. CONSORT 2025 рекомендує описувати важливі початкові характеристики, але не використовувати p-значення базових відмінностей як тест «успішності» рандомізації. Якщо є сильні прогностичні змінні, їх можна врахувати в заздалегідь визначеному аналізі або використовувати стратифіковану чи блокову схему рандомізації, коли це методологічно виправдано.
Підганяти склад груп після розподілу лише для того, щоб домогтися p > 0,05 за всіма базовими показниками, — погана логіка. Це змінює випадковий механізм розподілу і може створювати нові проблеми.
Очікування, засліплення і поведінка учасників
У психологічних експериментах учасники часто розуміють, яке завдання або втручання вони отримують. Повне засліплення, звичне для частини фармакологічних випробувань, для психотерапії, навчання або поведінкового тренування може бути неможливим.
Це не робить експеримент марним. Воно змінює те, які джерела зміщення потрібно контролювати іншими способами. Можна стандартизувати інструкції, вирівнювати тривалість і контакт між умовами, вимірювати очікування, засліплювати оцінювачів результату, коли це можливо, приховувати конкретну гіпотезу від учасників там, де це етично та методологічно допустимо, і заздалегідь визначати аналітичний план.
Засліплення є окремою методологічною темою, тому тут важливий принцип: контрольна група і засліплення виконують різні функції. Контроль створює порівняльну умову, а засліплення зменшує вплив знання про призначену умову на поведінку, оцінювання або інші етапи дослідження. Ризики, пов’язані з проведенням і вимірюванням результату, належать до ширшої теми ризику упередження.
Як правильно порівнювати експериментальну і контрольну групи
Головний статистичний об’єкт — різниця між умовами за заздалегідь визначеним результатом, а не окремий висновок «у цій групі p < 0,05, а в іншій p > 0,05».
Класична помилка полягає в тому, щоб провести тест до–після окремо в кожній групі, отримати статистично значущу зміну лише в експериментальній групі й оголосити, що групи відрізняються. Це логічно некоректно: як показали Gelman і Stern, різниця між «статистично значущим» і «статистично незначущим» сама по собі не є статистично значущою різницею. Потрібен прямий тест або модель порівняння між умовами.
Конкретний аналіз залежить від дизайну та типу даних. У паралельному експерименті це може бути пряме порівняння кінцевого результату з урахуванням початкового значення; у повторних вимірюваннях — модель взаємодії умови і часу або інша відповідна модель. Вибір статистичного методу має бути обґрунтований дизайном, а не підібраний після перегляду результатів.
Разом із p-значенням або замість його механічного акцентування потрібно показувати оцінку величини різниці та її невизначеність. Саме для цього використовують розмір ефекту і довірчі інтервали. Статистична значущість не говорить, наскільки велика або практично важлива різниця.
Що контрольна група не доводить сама по собі
Наявність контрольної групи підсилює дизайн, але не є автоматичним сертифікатом причинності. Причинний висновок залежить від того, як сформовано групи, чи збережено призначені умови, чи є вибуття, перехресне отримання втручань, систематичні відмінності вимірювання, невраховані супутні впливи та інші загрози.
У рандомізованому контрольованому дослідженні випадковий розподіл створює сильнішу основу для причинного контрасту. У нерандомізованому дослідженні група порівняння може бути корисною, але потрібно окремо обґрунтовувати контроль конфаундингу та селекційного зміщення. Тому словосполучення «контрольна група» не повинно підміняти опис механізму формування груп.
Контрольна група і група порівняння
У прикладних дослідженнях терміни «контрольна група» і «група порівняння» іноді вживають як синоніми. Проте для нерандомізованих дизайнів «група порівняння» часто точніше передає методологічний статус: є інша група, з якою зіставляють результат, але її учасники могли відрізнятися від експериментальної групи ще до впливу.
Таке слововживання дисциплінує причинні твердження. Якщо школи, клініки чи класи вже існували до дослідження і лише одна з них отримала програму, назва «контрольна група» не перетворює цей дизайн на рандомізований експеримент.
Приклад: програма зниження стресу
Уявімо, що дослідники перевіряють шеститижневу психологічну програму зниження стресу. Результат вимірюють валідованою шкалою до та після програми.
Варіант 1: контрольна група нічого не отримує. Якщо експериментальна група покращилася більше, можна сказати, що участь у програмі дала кращий результат, ніж відсутність спеціального втручання в цей період. Але частина різниці може бути пов’язана з увагою, очікуваннями та регулярними зустрічами.
Варіант 2: контрольна група перебуває у списку очікування. Порівняння показує перевагу участі зараз над очікуванням, але очікування майбутньої програми може саме по собі змінювати поведінку та оцінки.
Варіант 3: активний контроль відвідує шість нейтральних освітніх зустрічей такої самої тривалості. Тоді час, контакт і структура краще вирівняні, а різниця більше стосується специфічного змісту програми. Проте дослідники все одно мають перевірити, чи однаково правдоподібними та корисними здавалися обидві програми учасникам.
Варіант 4: нову програму порівнюють з уже ефективною психотерапією. Тоді питання полягає не в тому, чи вона краща за бездіяльність, а в тому, як її результат співвідноситься з чинним активним підходом.
Усі чотири дослідження можуть бути якісними, але вони відповідають на різні запитання. Саме тому назва контрольної умови повинна бути частиною інтерпретації.
Коли окрема контрольна група не потрібна
Контрольне порівняння можна побудувати без окремої паралельної групи. У внутрішньоіндивідуальному дизайні той самий учасник проходить кілька умов, а порядок може бути рандомізований або контрбалансований. У перехресному дизайні учасники отримують різні умови в різні періоди. У деяких одноосібних експериментальних дизайнах контроль забезпечують фази базової лінії, повторення та зміна умов.
Такі дизайни мають власні припущення: ефект порядку, навчання, втома, перенесення втручання, стабільність базової лінії та інші. Тому «відсутність окремої контрольної групи» не означає відсутність контролю як методологічного принципу.
Скільки контрольних груп може бути
Їх може бути більше однієї. Дослідження може одночасно містити, наприклад, експериментальну програму, активний контроль і список очікування. Це дозволяє відповісти на кілька різних питань: чи перевищує програма природну зміну, чи перевищує вона неспецифічну активність і наскільки результати залежать від типу компаратора.
Кілька умов потребують більшої вибірки, чіткішого плану аналізу та корекції інтерпретації множинних порівнянь. Додаткові групи виправдані тоді, коли кожна відповідає на змістовне запитання, а не просто ускладнює дизайн.
Розмір контрольної групи
Немає універсального правила, за яким контрольна група має містити певний відсоток від експериментальної. Розподіл учасників визначають дослідницьке питання, очікувана точність, статистична модель, вартість умов, прогнозоване вибуття та бажана потужність.
Для багатьох двогрупових експериментів рівний розподіл є статистично ефективним, якщо вартість і варіативність умов подібні. В інших ситуаціях співвідношення може бути нерівним. Кількість учасників слід обґрунтовувати плануванням вибірки, а не правилом «по 30 у кожній групі».
Вибуття, перехід між умовами і забруднення контролю
Навіть добре сформована контрольна група може втратити свою функцію під час дослідження. Якщо учасники вибувають з умов з різних причин, кінцеві групи можуть перестати відображати початковий механізм розподілу. Якщо контрольна група самостійно отримує подібне втручання, виникає забруднення або контамінація контролю. Якщо експериментальна група не дотримується програми, фактичний контраст між умовами слабшає.
Тому сучасне звітування має показувати не лише початковий розподіл, а й потік учасників, відхилення від призначених умов, пропущені дані та те, хто потрапив до аналізу. CONSORT 2025 розширює вимоги до опису фактичного надання втручань і компараторів, супутньої допомоги, аналізованих учасників та роботи з пропущеними даними.
Етика контрольної групи
У психологічних дослідженнях контрольна умова має відповідати загальним принципам етики психологічного дослідження: інформованій згоді, пропорційності ризику, конфіденційності, справедливому ставленню до учасників і належному дебрифінгу, якщо застосовувався обман.
Для клінічних випробувань особливо важливе питання, чи етично залишати контроль без доведеного лікування. Чинна Декларація Гельсінкі Всесвітньої медичної асоціації допускає плацебо або відсутність доведеного втручання за визначених умов: коли доведеного втручання немає або існують переконливі науково обґрунтовані методологічні причини і учасники не зазнають додаткового ризику серйозної чи незворотної шкоди через ненадання найкращого доведеного втручання. Це правило стосується медичних досліджень за участю людей і не слід механічно переносити на кожен лабораторний психологічний експеримент.
Як описувати контрольну групу в науковій статті
Прозоре звітування потребує більше, ніж фрази «була контрольна група». APA Journal Article Reporting Standards і кількісний стандарт JARS–Quant вимагають опису дизайну, учасників, процедур, призначення до умов і аналітичних рішень. Для рандомізованих випробувань CONSORT 2025 окремо наголошує на достатньому описі компаратора.
Для контрольної умови варто повідомляти:
що саме отримували або робили учасники;
тривалість, частоту, інтенсивність і формат контрольної активності;
хто проводив процедуру і наскільки вона була стандартизована;
як учасників розподіляли між умовами;
чи знали учасники, дослідники та оцінювачі про призначення;
які супутні втручання або послуги були дозволені;
як перевіряли дотримання протоколу, очікування та можливе забруднення умов;
скільки учасників вибуло і як це врахували в аналізі;
який саме міжгруповий контраст був первинним.
Чим точніше описано контроль, тим легше зрозуміти, що саме було ізольовано дизайном, повторити дослідження і коректно включити його в систематичний огляд або метааналіз.
Типові помилки в розумінні контрольної групи
«Контрольна група нічого не отримує»
Іноді так, але це лише один тип контролю. Плацебо, звичайна практика, увага, активна альтернатива або інша доза втручання теж можуть бути контрольними умовами.
«Якщо є контрольна група, причинність доведено»
Ні. Потрібно знати, як формувалися групи, чи була рандомізація, чи існували систематичні відмінності, як вимірювали результат і чи виникали вибуття, контамінація або інші загрози внутрішній валідності.
«Контрольна й експериментальна групи мають бути ідентичними»
У рандомізованому дослідженні вони мають формуватися за однаковими правилами і без систематичного зміщення, але випадкові числові відмінності в конкретній вибірці очікувані.
«p > 0,05 на старті доводить, що групи однакові»
Не доводить. CONSORT 2025 не рекомендує тести значущості базових відмінностей у рандомізованих випробуваннях. Нульовий результат такого тесту не встановлює еквівалентність груп, а значущий результат може бути випадковим дисбалансом.
«Зміна значуща в експериментальній групі, але незначуща в контрольній — отже ефект є»
Це одна з найпоширеніших помилок. Потрібно перевіряти різницю між групами безпосередньо. Gelman і Stern показали, чому відмінність між значущим і незначущим результатами не є автоматично значущою відмінністю.
«Активний контроль автоматично прибирає плацебо-ефект»
Ні. Boot та співавтори підкреслюють, що активні умови можуть залишати різницю в очікуваннях користі. Тому важливі правдоподібність контролю, очікування учасників і конкретний механізм, який дослідники намагаються ізолювати.
«Чим пасивніший контроль, тим чистіше дослідження»
Пасивний контроль може давати простіший контраст, але не обов’язково точніший причинний висновок про специфічний механізм втручання. Він залишає більше неспецифічних відмінностей між умовами.
Як читати дослідження з контрольною групою
Перед тим як прийняти висновок, варто поставити кілька запитань:
Яке саме дослідницьке питання ставилося і який контраст мав його перевірити?
Що отримувала контрольна група на практиці, а не лише як вона називалася?
Як учасників призначали до умов: випадково, за вибором, за закладом чи іншим механізмом?
Чи були умови подібними за часом, увагою, очікуваннями та інтенсивністю контакту настільки, наскільки цього вимагала гіпотеза?
Чи порівнювали групи безпосередньо, чи автори лише окремо тестували зміни всередині кожної групи?
Яка величина міжгрупової різниці та наскільки вона точна?
Скільки учасників вибуло і чи відрізнялося вибуття між умовами?
Чи могли учасники контрольної групи отримати подібне втручання поза протоколом?
Чи відповідає сила причинного твердження реальному дизайну?
Таке читання дозволяє перейти від ярлика «було контрольне дослідження» до оцінки того, що саме контрольовано і яке твердження підтримують дані.
Поширені запитання
Чи обов’язкова контрольна група в психологічному експерименті?
Для багатьох міжгрупових експериментів контрольна або інша порівняльна умова є центральною частиною дизайну. Однак окрема група потрібна не завжди: контроль може бути реалізований у внутрішньоіндивідуальному, перехресному або одноосібному експериментальному дизайні. Важлива не назва «контрольна група», а наявність порівняння, яке відповідає причинному запитанню.
Чи може контрольна група отримувати лікування або тренування?
Так. Вона може отримувати звичайну практику, активний компаратор, нейтральну програму, плацебо або інше втручання. Контроль означає функцію в дизайні, а не відсутність будь-якої діяльності.
Чи завжди контрольна група має бути меншою або такого самого розміру?
Ні. Розмір і співвідношення груп визначаються плануванням вибірки, статистичною ефективністю, вартістю та етичними або практичними міркуваннями. Рівний розподіл часто зручний, але не універсальний.
Що краще: список очікування чи активний контроль?
Вони відповідають на різні запитання. Список очікування корисний для оцінки переваги участі над очікуванням. Активний контроль краще вирівнює частину неспецифічних чинників і дозволяє суворіше тестувати специфічний компонент, але може бути складнішим, дорожчим і теж не усувати всі відмінності очікувань.
Чи потрібне плацебо в психологічному дослідженні?
Не завжди і часто його неможливо створити в тому самому сенсі, що у фармакології. Потрібна контрольна умова, яка відповідає конкретній гіпотезі. Якщо важливо відокремити специфічний механізм від очікувань і контакту, дизайн має максимально правдоподібно контролювати ці чинники.
Чи доводить статистично значуща різниця між групами причинний ефект?
Вона є частиною доказу, але причинність визначає весь дизайн. У рандомізованому експерименті з належним виконанням міжгрупова різниця має сильнішу причинну інтерпретацію. У нерандомізованому порівнянні потрібно враховувати альтернативні пояснення, конфаундинг і селекційне зміщення. Докладніше — у статті про причинність у психологічних дослідженнях.
Як зрозуміти, що контроль обрано добре?
Добрий контроль відповідає дослідницькому запитанню, робить порівнювані умови подібними за нерелевантними для гіпотези чинниками і відрізняє їх за тим компонентом, причинну роль якого перевіряють. Якість контролю оцінюють не за назвою, а за тим, які альтернативні пояснення він справді усуває або послаблює.
Висновок
Контрольна група — це інструмент порівняння, який надає експериментальному результату зміст. Вона показує, відносно чого оцінюють ефект, і допомагає відокремлювати досліджуваний вплив від природних змін, повторного тестування, очікувань, уваги та інших альтернативних пояснень.
Найважливіше питання при читанні експерименту звучить не «чи була контрольна група?», а «якою саме була контрольна умова і який причинний контраст вона дозволяє оцінити?». Відповідь на нього визначає, що саме означає міжгрупова різниця і наскільки далеко можна поширювати висновок.
Пов’язані статті
Експериментальний метод у психології: як працює експеримент, змінні та валідність — базова логіка експерименту, маніпуляції, змінних і валідності.
Рандомізація в психологічному дослідженні: що це і як працює випадковий розподіл — як формують умови випадковим розподілом і чому це не те саме, що випадкова вибірка.
Рандомізоване контрольоване дослідження в психології: дизайн, контроль і причинні висновки — повна архітектура РКД, від призначення до аналізу.
Причинність у психологічних дослідженнях: як обґрунтовують причинний ефект — контрфактична логіка, конфаундинг, припущення і межі причинних тверджень.
Розмір ефекту: що він показує і чому потрібен поруч зі статистичною значущістю — як оцінювати величину міжгрупової різниці, а не лише p-значення.
Ризик упередження в дослідженнях: як оцінюють систематичні помилки дизайну, проведення й звітування — як оцінювати систематичні помилки після вибору дизайну й контрольної умови.
