Як це працює

Методологія

Один із наших принципів — відкрито ділитися методами й визнавати обмеження. Ця сторінка робить цю обіцянку конкретною: як Telegram-пост стає опублікованим звітом, що саме автоматизовано і де метод слабкий.

Пайплайн від початку до кінця

  1. Збір

    Ми стежимо за 22 публічними українськими Telegram-каналами. Пост реєструється в момент появи, а потім переміряється чотири рази, на 15, 30, 45 і 60 хвилинах, щоб зафіксувати, як насправді розвиваються перегляди, реакції та коментарі, а не одне число в довільний момент. Гілки коментарів знімаються на кожному з цих замірів зі збереженням структури відповідей.

  2. Кластеризація

    Текст постів очищується й перетворюється на вектори мультимовною моделлю, після чого групується щільнісною кластеризацією. Пости різних каналів про одну подію потрапляють в один кластер. Пости, які ніщо інше не підтверджує, лишаються поза кластерами. Ми не заганяємо їх у групу заради того, щоб було що опублікувати.

  3. Аналіз

    Кожен кластер отримує згенероване зведення за журналістським стандартом, витяг ключових слів, класифікацію сентименту та перевірку на визначений набір маніпулятивних технік. Окремо шаблонні сигнали визначають тип посту (повітряна тривога, удар, погода, звичайна новина) і виявляють сутності: політиків, партії, держкомпанії та олігархів, разом з оцінками платного позитивного фреймінгу та скоординованих негативних кампаній.

  4. Фактчекінг

    Фактичні твердження витягуються й розкладаються на атомарні підтвердження (хто, що, коли, де, числа, цитати), щоб складене твердження з однією хибною складовою не могло сховатися за єдиним загальним вердиктом. Пошукові запити генеруються мовою тієї країни, де вкорінена історія, а не лише українською, щоб дістатися першоджерел, а не переказів. Докази зважуються за авторитетністю джерела, свіжістю та релевантністю; окрема модель визначає позицію кожного джерела: підтверджує, спростовує чи нейтральне. Вердикт — один із десяти, а числові та цитатні твердження додатково звіряються з повним текстом основного джерела.

  5. Публікація

    Відформатований звіт іде в наш Telegram-канал, JSON з аналізом — у публічний датасет, а дашборд звіту стає доступним за постійним посиланням. Усе це відбувається в одному запуску, тож опублікований звіт і опубліковані дані не можуть розійтися між собою.

Як насправді виглядають вердикти фактчекінгу

Із 2 420 перевіреного твердження:

Розподіл вердиктів за весь час, станом на 26 серпня 2026
ВердиктТвердженьЧастка
Неперевірне1 21550,2%
Правда85435,3%
Здебільшого правда2369,8%
Частково правда522,1%
Оманливе401,7%
Маніпуляція120,5%
Неправда110,5%

Половина всіх тверджень повертається як неперевірні, і ми публікуємо саме цей вердикт, а не перетворюємо брак доказів на присуд. Типовий випадок — новини, що ламаються просто зараз: у момент, коли твердження вперше розходиться, незалежних повідомлень про нього часто ще просто не існує. Пайплайн, який видавав би на них упевнений вердикт, повідомляв би вам те, чого не знає.

Обмеження

Прочитайте це, перш ніж цитувати будь-що з опублікованого нами.

  • Вибірка — це 22 канали, а не Telegram. Висновки описують канали, за якими ми стежимо. Вони не описують український інформаційний простір загалом, і сам набір каналів визначає, що ми взагалі здатні побачити.
  • Історії з одного джерела випадають. Кластеризації потрібне підтвердження в кількох каналах. Про новину, яку дав лише один канал, звіту зазвичай не буде, тож відсутність у нашому виводі не є доказом того, що новини не було.
  • Немає редактора під кожним звітом. Пайплайн працює автоматично. Зведення, позначки маніпуляцій і вердикти — це вивід моделей. Ми переглядаємо систему, а не кожен окремий звіт перед виходом.
  • Вердикти залежать від того, що віддає пошук. Покриття різниться за темою, мовою та моментом. Одне й те саме твердження може бути перевірним сьогодні й неперевірним завтра з причин, що не мають стосунку до його правдивості.
  • Сентимент і сигнали координації — статистика, а не доказ. Висока оцінка координації — це привід придивитися. Це не висновок про існування кампанії, і ми не подаємо його так.
  • Псевдонімізація — не анонімність. Що це означає на практиці — на сторінці датасету.

Знайшли помилку в опублікованому звіті: хибний вердикт, неправильно позначену маніпуляцію, кластер, що звів докупи різні історії? Напишіть: info@aisberg.live. Виправлення — це те, як метод стає кращим, а дані під ним публічні саме для того, щоб нас можна було перевірити.

Моделі

Пайплайн поєднує відкриті моделі з комерційними, підібрані під конкретний крок, а не одну на все. Векторизацію тексту, ранжування релевантності та класифікацію позиції джерел виконують спеціалізовані відкриті моделі; зведення, виявлення маніпуляцій і побудову вердикту — мовні моделі загального призначення.

Набір моделей змінюється, щойно з'являються кращі. Незмінною лишається вимога до них: кожен крок має давати результат, який ми зможемо опублікувати й обґрунтувати, а це виключає будь-який компонент, чий вивід неможливо перевірити.

Далі

Новини стають чистішими, коли їх хтось перевіряє

Кластери новин, вердикти фактчекера й посилання на дашборд виходять у Telegram-каналі щогодини. Читати — безкоштовно й без реєстрації. А якщо хочете, щоб цієї роботи ставало більше, до неї можна долучитись.

Підписатись на канал Стати волонтером