How many websites with traffic are there on the internet?
On a whim I asked myself: how can you find out how many websites that actually get traffic exist on the internet?
SEO Ideas
Fresh from my @SEOIdeas Telegram channel — the feed updates automatically (posts are in Ukrainian).
Latest posts from t.me/seoideas — pulled in automatically (in Ukrainian).
✨ П'ятничні новини: ✨ ⠀ Marcus покинув чат. LinkedIn тепер об'єднує аутричерів у групові чати: якщо п'ятеро пишуть тій самій людині за добу, всі летять в одну групу. Marcus, якщо ти це читаєш, повернись. ⠀ • Google з 30 серпня вимикають ручні санкції за паразитне SEO для європейських користувачів: та сама сторінка може бути понижена для американця і нормально ранжуватись для німця, а санкції в консолі лишаються, просто без наслідків для європейської видачі. Так Google пробують закрити провадження Єврокомісії за DMA зі штрафом до 10% глобальної виручки. ⠀ • Meta заплатять до $18 млрд 48 штатам за шкоду дітям. Підліткам за замовчуванням вмикаються ліміт 2 години на день, нічний блок нотифікацій, приховані лайки і стрічка без алгоритму. Нью-Мексико в угоді нема: там Meta вже визнали суспільною шкодою нарівні із забрудненням повітря. ⠀ • The Information пишуть, що Nvidia домовились купити Hugging Face за $12.9 млрд, контракт ще не підписаний. Anthropic тим часом збираються на IPO і казатимуть інвесторам про ринок понад $30 трлн. Це оцінка всієї роботи, яку AI теоретично міг би виконувати, соцмережі вже переказують її як прогноз доходу. Весь ВВП США 32 трлн. ⠀ 🫶 Від українських колег: 🫶 ⠀ • Сергій Кокшаров показав графіки консолі, де середня позиція покращується при падінні показів і навпаки. Причина виявилась у чекінгу позицій по понеділках: покази, позиція і CTR у консолі зашумлені трекерами, про щось суттєве кажуть тільки кліки. ⠀ • Олексій Матузний розібрав оновлені доки Google про canonicalization: rel="canonical" лишається сигналом, переоцінка займає до двох тижнів, а сторінкам з одного кластера дублікатів технічних правок може бути замало. ⠀ • Канал mypbn знайшов спадкоємця Million Dollar Homepage: на outbid.lol платиш більше за конкурента і стоїш вище в рейтингу. Автор каже про майже $100k за кілька днів. ⠀ • Google за вихідні полагодили баг з фавіконами у видачі і діру в Crawl Stats, сканування не постраждало, помітили в SEO Ideas. ⠀ • 16 і 17 вересня Google проводять безкоштовні віртуальні події Rethink 2026 про святковий сезон і вимірювання конверсій, анонс від k2 promo. Інші цікаві новини: ⠀ • Suganthan прочитав у вкладці Network, як Perplexity відбирає джерела: 16 детекторів намірів з фіксованими порогами, YouTube цитується активно, Reddit фетчиться і ігнорується, а на локальних запитах усі цитати забирають бізнеси з мапового індексу. У статті є скрипт, яким можна прочитати власну сесію. ⠀ • LinkedIn кажуть, що юзери бачать у стрічці на 40% менше згенерованого сміття, і за тиждень цифра перевернулась у переказах на мінус 40% охоплення авторам, які пишуть з AI. Реальна зміна майже без покриття: заклеймлений пост втрачає дистрибуцію, і про це знає тільки автор. ⠀ • Dan Petrovic пояснив, чому Google не каратимуть контент за сам факт генерації, і опублікував Dejan Chat Protocol, формат відповідей чат-ботів без води: відповідь одним реченням, одна тема за хід, деталі за вибором користувача. ⠀ • OpenAI забанили російську кампанію впливу: фейковий ізраїльський think tank, 34 з 36 статей скопійовані, сайт приписував собі Фукуяму й Чомскі. І розкотили рекламу в ChatGPT на 31 європейський ринок, України в списку нема. ⠀ • Суддя Amit Mehta у справі Penske проти Google назвав ситуацію з AI дуже несправедливою: AI-фічі Google збудовані на плечах видавців, а покращення продукту не мають імунітету від антимонопольного контролю. ⠀ • Ivana Flynn пояснила, що робити зі скаргами на авторські права (DMCA). Якщо через чиюсь скаргу ваші сторінки випали з видачі, оскаржуйте через пряму форму, бо лінк з консолі штовхає справу в довгу чергу. А знайти свої сторінки в базі скарг Lumen ще нічого не значить: поки Google не прибрали їх з видачі, реагувати нема на що. ⠀ Решта у випуску: Andrew Ng про скіли AI-інженера і security-агентів в OpenWorker, вайбкодери і .well-known/change-password, життя після спам-апдейту, Gemini 3.7 Flash в AI Mode і каруселі посилань, AI Overviews вже на 52% французьких запитів і модель Gemini 3.5 Transcribe. ⠀ Повний випуск ⠀ 💌 Підписатися на розсилку.
Read on Telegram →Google почали індексувати власні goto-редиректи з видачі. Запит site:google.com/goto показує їх із заголовками й описами чужих сторінок, тобто чужий контент виходить в індексі під доменом google.com. ⠀ Самі редиректи Google вже підтвердили офіційно: це захист від скрейперів і AI-систем, які збирають видачу. Derek Perkins з Nozzle каже, що на резидентних IP вони вже стоять майже на 100% запитів. ⠀ Розшифрувати закодовану адресу не можна, побачити з неї, куди веде клік, теж. Сервісам моніторингу позицій доведеться проходити кожен редирект окремим запитом, а аналітиці варто пильнувати, чи не почав органічний трафік з'їжджати в прямі заходи. ⠀ Детальніше в статті.
Read on Telegram →Завтра середа! А це означає новий лайв! Поговоримо про RAG для SEO. ⏰ 26 серпня о 18:30 ⠀ • Що RAG реально дає SEO, а що йому просто приписують? • Чи потрібна векторна база конкретно вашому сайту? • Як RAG покращує контент, перелінковку й programmatic SEO? • Чи допомагає це потрапляти у відповіді LLM? • Як зібрати перший MVP без складної та дорогої архітектури? ⠀ В ефірі Саша Хілова, Віра Сєчкіна і Олеся Коробка. ⠀ На стрімі розіграємо квиток на SERP Conf від нашого спонсора Collaborator. Переможець сам обирає: Рим 16 жовтня або Відень 3 листопада. ⠀ Дивитися наживо на YouTube-каналі SEO BAZA.
Read on Telegram →Кажуть Google за вихідні пофіксив баг з відображенням фавікону у видачі та втрату даних у звіті Crawl Stats.
Read on Telegram →Alex Galinos у своїй статті на Search Engine Land стверджує, що ~20% AI-трафіку, може помилково атрибутуватись в GA4 в direct. Методологія Джерело даних: Аналіз 51 200 подій і 1 661 цитованого сніпета за 9 місяців (вересень 2025 – червень 2026) для бренду у сфері перевезень. Механізм відстеження: Налаштування кастомного вимірювання (custom dimension) в GA4, яке фіксує переходи з URL-фрагментом #:~:text=, що додається Google під час кліку на цитований сніпет в AI Overviews. Аналітична класифікація: Групування відстежених сніпетів за тематичними категоріями та зіставлення подій із загальними сесіями органіки та прямого трафіку. Результати Помилкова атрибуція (22.4%): Майже чверть переходів з AI Overviews помилково записується в канал Direct замість Organic Search (з коливаннями від 16.8% до 29.3% на місяць), що занижує реальні показники SEO. Частка трафіку та волатильність: У середньому AI Overviews згенерували 7.53% органічних сесій із високою нестабільністю — від пікових 16–17% (лютий–березень 2026) до спаду до 2–4%. Висока концентрація: Основний трафік забезпечує вузьке коло сторінок (топ-сніпет приніс 2 276 подій при середньому показнику 31 на сніпет). Ефективні формати: Найкращу видимість отримують структуровані HTML-таблиці, точні ціни, графіки та конкретні маршрути; загальні гайди показують слабкі результати.
Read on Telegram →Google загубив дані в звіті статистики сканування в GSC за 15-16 серпня
Read on Telegram →Boost360° SEO Edition 2.0 — благодійна конференція від Boosta 📅 16 вересня, 11:00 (Київ) 💻 Онлайн + офлайн-афтепаті у Варшаві Практичні доповіді, панель про побудову бізнесів і нові формати без слайдів — SEO News, Hot Seat, Linkbuilding Bingo. 🔥 Спікери: Дмитро Бондар (Boosta), Анастасія Красюкова (UPCONR), Сергій Кокшаров (DevakaTalk), Ігор Шулежко (Rankup), Яна Шульга (Semscale), Світлана Величко (Links-Stream) та інші. 🇵🇱 Після ефіру — офлайн у Варшаві: SEO-дебати, нетворкінг, живе спілкування 💸 Донат від 500 грн — 100% на фонд KOLO 👉 Реєстрація: https://bit.ly/4wTsVJe
Read on Telegram →Google уточнив, як рахується position для AI Overviews у Search Console. Увесь AI Overview — це одна позиція. Тобто якщо всередині AIO є 10 джерел, усі 10 отримають однакову position незалежно від того, де саме знаходиться посилання. При цьому impression зараховується лише тоді, коли ваше посилання реально було проскролене або розгорнуте у viewport.
Read on Telegram →Google оновив парсинг JSON-LD: тепер HTML entities розкодовуються лише один раз. Тобто подвійний escaping більше не “виправляється” автоматично. Наприклад: Research & Development раніше Google міг прочитати як: Research & Development тепер отримає: Research & Development Що варто перевірити у structured data: &, ", <, &#.... По суті, Google перестав компенсувати некоректний double escaping у JSON-LD.
Read on Telegram →Google релізить оновлення Google Trends - обіцяє інтерактивні карти, що дозволять виявляти регіональні тенденції. https://lnkd.in/p/dQS-YuJx
Read on Telegram →✨ П'ятничні новини: ✨ ⠀ Зацініть сонячне затемнення у гуглі. ☀️ ⠀ • Meta краулять веб, можливо, щоб створити власний пошук. Пошуковик від Apple теж усі чекали, а він так і не з'явився, натомість моделі Apple на кілька років переїхали на Gemini. ⠀ • Google випустили Gemini 3.7 Flash і до кінця року віддають його за пів ціни. Модель думає ретельніше і з'їдає приблизно вдвічі більше токенів, тож по факту виходить та сама ціна, а з нового року повна. Тим часом застосунком Gemini користується вже мільярд людей на місяць. ⠀ • Ховали SEOшку, а поховали Sam Altman. Прямо у гуглі. Хтось повандалив його Wikipedia-сторінку, і інфа підтягнулась до панельки знань. Класика. ⠀ 🫶 Від українських колег: 🫶 ⠀ • На сторінці Poshuk мітапу тепер відгуки учасників, надсилайте ваші. Відновили і наші відео по середах. ⠀ • Новину про вотермарки в текстах Claude доповнили безкоштовним застосунком Lee Foot, де видно сигнал помітки в кожному слові, і розділом про те, який алгоритм може стояти за поміткою Claude. ⠀ • Девака знайшов діру у власному 20-річному акаунті LinkedIn: там назбиралось понад 10 резервних пошт, частина на давно дропнутих доменах, і з кожної досі можна логінитись. Перевірте свої підв'язані адреси і згадайте, куди підв'язані старі скриньки. ⠀ • Автор каналу seo_inside дивиться на CTR у Discover: за щастя тепер мати близько 9%, проти колишніх 13-15%. Здавалося б, до чого тут AI Overviews в Discover... ⠀ • Реєстратор автора каналу mypbn перестав приймати .org-домени зі словом casino будь-якою мовою. ⠀ • Саша Белевець шукає собі Head of PBN. Писати @Badbadman. Якщо влаштуєтесь, скажіть, що ви від SEO Baza, він заплатить нам $1500 🤑 Інші цікаві новини: ⠀ • Suganthan показав, що ChatGPT обирає бренди ще до того, як щось шукає: бере їх зі своєї пам'яті з тренування і вже під них пише пошукові запити, а цитати лише підтягують деталі. Rand Fishkin зробив з цього відео про марність порад бути там, звідки AI цитує. ⠀ • Gary Illyes пояснив, що таке alternate names: з групи однакових сторінок в індекс іде тільки канонічна, решта стає її альтернативними іменами. Мовні hreflang-версії саме такі, тож not indexed у Search Console для них не помилка, вони все одно показуються у видачі і збирають трафік. ⠀ • Koray Gubur виклав великий кейс про шаблони запитів: генератор QR-кодів виріс на 1 млн кліків за три місяці після міграції без зміни URL. URL картинок не міняються ніколи, а той самий анкор не повторюється більш як тричі. ⠀ • Dan Petrovic замінив простирадло інструкцій у CLAUDE.md одним рядком Use ASD-STE100, це стандарт авіаційної техдокументації, який модель уже знає. Ruben Hassid зібрав файл свіжих ознак AI-тексту, бо ем-тире з моделей уже вичистили. ⠀ • У Meta тим часом: добірка з пруфами про платежі неонацистам за пости, згенерований CSAM у рекламі і $942 млн за шкоду дітям, кримінальна скарга в Німеччині через AI-окуляри, а Jiahui Yu, один з найдорожчих дослідників, іде робити власну компанію. ⠀ • Приховані міркування моделей Anthropic, OpenAI і Gemini можна вкрасти через API: зашифровані блоки, які клієнт шле назад з кожним запитом, виявилось можливо розшифрувати. ⠀ • Anthropic дали дослідницькій версії Claude погратися з гіпотезою Рімана. Не розв'язав, але за 36 годин підняв частковий результат з 41.6% до 67.2%. Попередній рекорд тримався 37 років, і його автор сам перевіряв доведення. ⠀ • У Сан-Франциско здають гуманоїдів-прибиральників: $30 на годину, але під наглядом інших. ⠀ Решта у випуску: скарга 300 французьких газет на Google через AI Overviews, пейпер DeepMind про AI-маніпуляцію людьми, AI SEO-агент, що сам вивів сайт у топ, і фонд Aschenbrenner на $45 млрд, який обвалився за кілька днів. ⠀ Повний випуск ⠀ 💌 Нагадуємо про нашу поштову розсилку новин, підписатися можна тут.
Read on Telegram →Спочатку бабки💰 потім токени, каже Google 😁
Read on Telegram →Anthropic тепер додаватимуть невидиму вотермарку в увесь текст від Claude. Тригером стала стаття 50 AI Act в ЄС. Розкатали на весь світ. ⠀ Причому помічається весь текст, незалежно, чи він був повністю написаний клодом, чи тільки відредагований. Публічної перевірки поки що немає. Як і у SynthID від гугла. ⠀ Як воно приблизно може працювати ⠀ Модель обирає слова за хешованим ключем. Наприклад, потрібно дописати фразу Це був … день. На місце пропуску є чотири кандидати: гарний, хороший, чудовий і приємний. Секретний ключ, а це просто список з двадцяти-тридцяти випадкових чисел, разом з кількома попередніми словами дає одне число, і воно роздає кожному кандидату 0 або 1. За інших рівних турнір віддає перемогу слову з одиницею, і в текст іде гарний. ⠀ Підмінити слово помітка не може. Якщо після слів пішов на модель майже впевнена, що далі буде роботу, то серед кандидатів раз за разом витягається саме роботу, воно грає саме проти себе і виграє з будь-яким значенням. Помітка живе тільки на розвилках, де моделі байдуже, який з варіантів узяти. Тому в сухих фактологічних відповідях вона буде слабкою. ⠀ Як теоретично цьому протистояти ⠀ У SynthID найкраще збиває вотермарку переклад туди-назад через іншу мову і розбавляння великим шматком людського тексту. Заміна синонімами не працює. Дослідники з ETH Zurich ще на попередньому поколінні схем за $50 навчилися і знімати помітку, і підробляти її в чистому людському тексті, щоб підставити автора. ⠀ Детальніше в статті, там же схема, як воно влаштоване всередині, або одразу в довідці Anthropic.
Read on Telegram →Articles
On a whim I asked myself: how can you find out how many websites that actually get traffic exist on the internet?
Ever since Google changed the user-agent of its testing tools, what we see in them may not match reality at all.
How search engines find, understand and rank content: the three core SEO processes — crawling, indexing and ranking.
As you know, Google Search Console caps report exports at 1,000 rows.