Оце подивився інтервʼю з Максом Кідруком, другу частину «Нових темних віків» якого я зараз читаю. Він сказав про те, що зумери вперше за історію тестування інтелекту показали гірші результати, порівняно з попередніми поколіннями. Я вирішив перевірити і спитав chatGPT про обʼєктивні дані тестувань. Насправді хороші дані про тести IQ знайти дуже важко. Памʼятаю, що колись зацікавився на яких даних будується відома мапа розподілу IQ по країнах, за якою Україна посідала чи не останнє місце в Європі, до речі. Я поліз шукати у першоджерелах і зʼясував, що дані по Україні отримані за двома тестами у двох школах — одна в Києві, а друга — це ліцей-інтернат десь під Києвом. Тести проводив заїжджий московський професор — а хто ж іще? — десь на початку 90-их. Ці дані були помножені на понижуючий коєфіцієнт — через що саме, я вже не вчитувався. Одним словом, дуже цікаве і корисне дослідження, з якого я, будучи представником низькоінтелектуальної нації, позитивної інформації видобути не зміг...
Але, оскільки в деяких країнах тестування інтелекту проводиться регулярно, деякі закономірності, здається, встановити вдалося. Перша — це так званий ефект Фліна, який полягає в історичному збільшенні тестових балів. Оскільки тести на IQ нормуються на 100, то людина, що одержала таку кількість балів у 1980 році, одержала би більше, якби проходила тест у 1930 році. Оригінальні оцінки цього ефекту варіюються, але chatGPT мені знайшов останні метадані з яких випливає, що в середньому це збільшення приблизно на 0.22 бали щороку. Це означає, що якби людину, що у 1930 році мала IQ 100, заморозили і протестували знову в 1980, то тест би показав, що її IQ є приблизно 89. Але все це дуже усереднені значення, з яких дуже важко видобути динаміку, що стосується поколінь. На жаль, регулярні тести проводяться лише кількох країнах, і тільки тести фінських призовників chatGPT знайшов у вигляді щорічної таблички. Результати по Данії і Норвегії він приблизно видобув з графіків, які знайшов. Для зручности, я попросив вивести їх за датою народження, а потім відняв рівень 1990 року в кожній країні, оскільки нормалізовані вони були на різні роки.
Виглядає це приблизно так:
Як бачимо, для Норвегії і Фінляндії результати між 1975 і 1990 роками виявилися досить близькими попри те, що це дуже різні країни з дуже різними народами, які навіть розмовляють мовами з різних мовних сімей. Для Данії є результати за багато років, але чомусь chatGPT їх не знайшов між найбільш цікавими 1960 і 1985 роками. Але для всіх трьох країн виглядає так, що у другій половині 70-их років минулого століття настав перелам: замість стабільного покращення результатів тестування інтелекту ми бачимо стабільне погіршення приблизно з тою самою швидкістю. Очевидно, пан Кідрук сплутав рік народження з роком тестування, а отже, помилився на одне покоління. Схоже, що першим поколінням, яке показало погіршення результатів є міленіали, а далі — то вже тренд.
Але, оскільки в деяких країнах тестування інтелекту проводиться регулярно, деякі закономірності, здається, встановити вдалося. Перша — це так званий ефект Фліна, який полягає в історичному збільшенні тестових балів. Оскільки тести на IQ нормуються на 100, то людина, що одержала таку кількість балів у 1980 році, одержала би більше, якби проходила тест у 1930 році. Оригінальні оцінки цього ефекту варіюються, але chatGPT мені знайшов останні метадані з яких випливає, що в середньому це збільшення приблизно на 0.22 бали щороку. Це означає, що якби людину, що у 1930 році мала IQ 100, заморозили і протестували знову в 1980, то тест би показав, що її IQ є приблизно 89. Але все це дуже усереднені значення, з яких дуже важко видобути динаміку, що стосується поколінь. На жаль, регулярні тести проводяться лише кількох країнах, і тільки тести фінських призовників chatGPT знайшов у вигляді щорічної таблички. Результати по Данії і Норвегії він приблизно видобув з графіків, які знайшов. Для зручности, я попросив вивести їх за датою народження, а потім відняв рівень 1990 року в кожній країні, оскільки нормалізовані вони були на різні роки.
Виглядає це приблизно так:
Як бачимо, для Норвегії і Фінляндії результати між 1975 і 1990 роками виявилися досить близькими попри те, що це дуже різні країни з дуже різними народами, які навіть розмовляють мовами з різних мовних сімей. Для Данії є результати за багато років, але чомусь chatGPT їх не знайшов між найбільш цікавими 1960 і 1985 роками. Але для всіх трьох країн виглядає так, що у другій половині 70-их років минулого століття настав перелам: замість стабільного покращення результатів тестування інтелекту ми бачимо стабільне погіршення приблизно з тою самою швидкістю. Очевидно, пан Кідрук сплутав рік народження з роком тестування, а отже, помилився на одне покоління. Схоже, що першим поколінням, яке показало погіршення результатів є міленіали, а далі — то вже тренд.

Стосовно причин chatGPT відповів так:
ВідповістиВидалитиНайімовірніша картина, на мою думку, складається з двох процесів.
1. Вичерпалися чинники, які раніше підвищували результати.
У Данії до когорти приблизно 1980 року одночасно збільшувалися середня тривалість освіти і зріст, а розмір сім’ї зменшувався. Освіта й зріст корелювали із середнім результатом майже ідеально на рівні когорт. Після досягнення загальної середньої освіти, доброго харчування та медичного обслуговування подальший приріст просто став малим. Hegelund et al., 2021.
У Норвегії додатковий рік обов’язкової освіти експериментально давав близько 0,6 IQ-бала, тобто розширення шкільної освіти справді було частиною попереднього ефекту Флінна. Коли цей процес завершився, відповідне джерело зростання зникло. Brinch & Galloway, 2012.
Але саме лише насичення пояснює плато, а не обов’язково спад. Для спаду потрібен додатковий чинник.
2. Змінився набір навичок, які постійно тренувалися.
Тут найпереконливішими кандидатами є:
- зменшення читання;
- менше усного та письмового рахунку;
- поширення калькуляторів;
- збільшення пасивного екранного часу;
- можлива зміна шкільних програм і способів навчання.
Це узгоджується зі структурою результатів. У Норвегії спад найбільше стосується словникового запасу та числового мислення, тоді як результати матричних завдань на абстрактне розпізнавання фігур залишалися значно стабільнішими. Новий психометричний аналіз 2025 року дійшов висновку, що спад переважно відображає саме зниження словесних і числових навичок, а не рівномірне падіння латентного загального фактора g. Nordmo, Norrøne & Lang-Ree, 2025.
Фінські первинні результати демонструють подібну деталь: після 1997 року тест Shapes знизився порівняно мало, тоді як Words і Number — набагато сильніше. Фінські дані.
Дані про використання часу в Норвегії також добре збігаються хронологічно:
- читання трохи зростало до 1980 року, а потім почало скорочуватися;
- частка чоловіків 16–24 років, які читали друковані матеріали у звичайний день, впала з 63% у 1971 році до 28% у 2000 році;
- найбільше падіння припало саме на 1990–2000 роки;
- одночасно збільшувався час перед телевізором та іншими екранами. Statistics Norway.
Норвезькі дослідники військових тестів прямо припускали, що зниження арифметичних результатів пов’язане з поширенням калькуляторів і комп’ютерів: молоді люди дедалі рідше рахували усно або на папері. Вони також зазначали, що старий тест синонімів міг поступово ставати менш відповідним сучасній лексиці. Storsve et al., 2018.
У Данії є ще одна конкретна підказка: спад наприкінці 1990-х збігся зі зменшенням частки юнаків, які вступали до трирічних академічних програм для 16–18-річних. Спочатку автори вважали це можливим поясненням, хоча пізніше спад було знайдено і серед академічних, і серед неакадемічних груп. Teasdale & Owen, 2005, Teasdale & Owen, 2008.
Тому я б сформулював робочу гіпотезу так:
Позитивний ефект Флінна припинився через насичення покращень освіти, харчування і здоров’я. Подальший невеликий спад був спричинений зміною когнітивної практики — насамперед меншою кількістю читання та ручного рахунку і більшим використанням калькуляторів та екранних медіа.
Це також пояснює, чому першими погіршуються не всі здібності однаково, а саме словесні та арифметичні навички.
Натомість масовий інтернет, соціальні мережі та смартфони не можуть пояснити початок переламу: перша норвезька когорта зі спадом проходила тест уже приблизно 1993–1994 року. Вони можуть лише посилювати пізнішу тенденцію.
Залишається ще один методологічний кандидат: мотивація під час військового тесту. Усі три наші ряди отримані від призовників; після завершення холодної війни ставлення до військової служби могло змінитися. Порівняння братів цього не виключає, бо молодший брат міг мати меншу мотивацію, ніж старший. Прямих доказів такого пояснення я поки не бачу, але його обов’язково треба залишити серед перевірюваних гіпотез.