Нова обчислювальна модель пізнання, під назвою IM-LEPP, інтегрує зір і мову в ієрархічній, енергетичній основі, пропонуючи єдине пояснення для уваги, розуміння мови та пам'яті.
Дослідження
Субір Варма, незалежний дослідник, запропонував IM-LEPP (Інтегрована мультимодальна латентна енергетична предиктивна обробка) у статті, опублікованій на arXiv 8 серпня 2026 року. Модель розширює попередню одномодальну модель (LEPP) для обробки як візуальної, так і лінгвістичної інформації. Спираючись на теорію, що генеративні нейронні мережі слугують ефективними теоріями когнітивної динаміки, IM-LEPP представляє пізнання як латентні стани, що протікають через вивчені енергетичні ландшафти, а не моделює нейронні ланцюги.
Архітектура слідує ієрархії типу "хаб-спок" (hub-and-spoke), що ґрунтується на основі контрольованого семантичного пізнання від Ламбона та ін. У цьому дизайні окремі конвеєри предиктивного кодування для візуальних об'єктів, сцен і мови сходяться на спільному амодальному вузлі, змодельованому на основі передньої скроневої частки. Кожен конвеєр зберігає власну ідентичність, перебуваючи під впливом поточного стану вузла, що дозволяє кожному прогнозу відображати повний мультимодальний контекст.
Стаття демонструє, що IM-LEPP може пояснити явища уваги, такі як сліпота через неуважність та бістабільність куба Неккера. Вона також пояснює усталені психолінгвістичні результати, включаючи теорію сюрпризу (surprisal), події N400/P600 ERP та реаналіз речень типу "garden-path". Модель пропонує фальсифіковану протилежність мовним моделям на основі трансформерів, підкреслюючи відмінності в чутливості до траєкторії для передбачення наступного слова. Крім того, у статті обговорюється ефективне засвоєння мови порівняно з LLM, описується підсистема семантичної/епізодичної пам'яті та розташовує модель у контексті передбачувального кодування, принципу вільної енергії, JEPA та ієрархічної часової пам'яті.
Чому це важливо
Для звичайної людини це дослідження свідчить про те, що наш мозок інтегрує інформацію з різних відчуттів у предиктивний, енергоефективний спосіб. Розуміння цього може допомогти пояснити, чому ми іноді пропускаємо очевидні речі (сліпота через неуважність) або сприймаємо неоднозначні зображення по-різному (бістабільність). Це також проливає світло на те, як ми обробляємо мову в реальному часі, включаючи реакцію мозку на несподівані слова чи граматичні помилки. Ці знання можуть бути використані для практичних стратегій покращення уваги, пам'яті та вивчення мови.
Що ви можете зробити
Щоб використати ці знання, практикуйте активне спостереження та уважність для підвищення концентрації уваги. Під час вивчення нової інформації намагайтеся пов'язувати її з кількома відчуттями (наприклад, зоровими та вербальними), щоб поглибити кодування. Киньте виклик своїм мовним навичкам, читаючи складні або неоднозначні тексти, що тренує предиктивну обробку мозку.
Джерело: arXiv q-bio.NC
Цікавитеся власним мозком? Пройдіть наш безкоштовний адаптивний IQ-тест або спробуйте 306 рівнів тренування мозку.