ChatGPT, AI, Python для SEO - автоматизация
486 subscribers
66 photos
2 videos
53 links
Автоматизация с помощью python работы в seo.
Скрипты которые решают большинство вопросов в seo c исходным кодом.

Контакт https://t.me/devvver
Download Telegram
🖥 Log Analyzer Pro — это полнофункциональный анализатор логов на Python, сочетающий простоту Streamlit и мощность SQLite.
Основные возможности:

ℹ️ Работа с Big Data: уверенная обработка больших логов (тестировался 3 ГБ+) с использованием WAL-режима для ускорения записи. Если у вас небольшие по размеру логи лучше юзать этот.

ℹ️ Продвинутая фильтрация: встроенный конструктор условий для точечного поиска данных (мультивыбор из n параметров!).

ℹ️ Функционал для оценки нагрузки (Traffic), сегментации пользователей и выявления разных ботов.

ℹ️ Скорость: мгновенные отчеты благодаря автоматической индексации данных при импорте.
Максимум функционала для анализа серверной активности любой интенсивности.

Скачать с Гитхаба.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4🔥1
🔘 Бесплатный DR через API Ahrefs?

Отличные новости для SEO-специалистов и разработчиков! У Ahrefs есть публичный API, который позволяет запрашивать рейтинг домена (DR) абсолютно бесплатно.

Главный плюс - для этого вам даже не потребуется регистрировать API-ключ. Достаточно отправить простой GET-запрос и указать нужный сайт в параметре target.
Подробная документация доступна по ссылке:
Пример:
import requests

url = "https://api.ahrefs.com/v3/public/domain-rating-free"
params = {"target": "example.com"}
headers = {"Accept": "application/json"}

response = requests.get(url, params=params, headers=headers)
print(response.json())

На php
<?php
$target = "example.com";
$url = "https://api.ahrefs.com/v3/public/domain-rating-free?target=" . urlencode($target);

$ch = curl_init();
curl_setopt($ch, CURLOPT_URL, $url);
curl_setopt($ch, CURLOPT_RETURNTRANSFER, true);
curl_setopt($ch, CURLOPT_HTTPHEADER, [
"Accept: application/json"
]);

$response = curl_exec($ch);
curl_close($ch);

echo $response;
?>


Если вам не интересен код, вот сервис.
Массовая проверка DR сайтов в Ahrefs

Не совсем понятно причина такой щедрости, подозреваю что конкуренты уже дышат в спину.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍9🔥2🤡2
📈 Nginx Log Analyzer Ultimate: Интерактивный анализ логов, геолокация и детекция ботов на PHP

Браузерный анализатор логов access.log получил обновление.

🚀 Главные нововведения Ultimate-версии:

🌍 Автоматическая геолокация и флаги стран

Теперь флаги государств отображаются прямо в таблице IP-адресов и во всех детальных срезах. При просмотре карточки IP-адреса вы мгновенно получаете информацию о стране, диапазоне сети, ASN (провайдере) и домене.


 Специальная вкладка «🎃 Google Поисковые боты»

🔘 Выделенный раздел для детального мониторинга индексации вашего сайта.
🔘 PHP-скрипт в фоновом режиме запрашивает у Google актуальные списки IP-префиксов краулеров.
🔘 Автоматически разделяет обычных поисковых и специальных (Special) роботов Google.
🔘 Строит отдельный график активности ботов по часам.
🔘 Показывает таблицы IP-адресов роботов, их User-Agent и точное время заходов.
Если нужно больше ботов - справка.

⚡️  Сквозная навигация между отчетами

Все IP-адреса внутри модальных окон (например, при просмотре логов конкретной страницы или источника перехода) теперь снабжены флагами и стали кликабельными. Заметили подозрительный IP в логах URL? Один клик — и вы в его детальном профиле с геолокацией.


📂 Как начать работу?
Скачайте один файл index.php и загрузите его в любую папку на вашем хостинге.
Откройте страницу скрипта в браузере.
Перетащите в окно ваш файл access.log.

📂 Где взять файл лога?

Вариант 1: Через cPanel
В разделе «Метрики» выберите «Редактор необработанных журналов» (Raw Access Logs).
Кликните на нужный домен и скачайте архив .gz. Распакуйте его перед использованием.

Вариант 2: Через FTP/SFTP
Подключитесь к хостингу и поднимитесь на уровень выше папки public_html.
Зайдите в папку /logs — там лежат архивы логов по месяцам.
Скачайте файл вида yourdomain.com-Jun-2026.gz и распакуйте его.
(Если папка пуста, включите в cPanel галочку «Архивировать журналы в домашнем каталоге»)

💻 Скачать на GitHub: файл ai.php https://github.com/Devvver/Nginx-Log-Analyzer
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍5👌1
🚀 Автоматизируем SEO-аудит: Интерактивный дашборд на Python + Screaming Frog CLI!

Это демо для тех кто не знал что Screaming Frog можно запускать в фоновом режиме и получать результаты в своей панельке.

🎯 Главные фичи и функционал:

Headless-краулинг в один клик: Дашборд автоматически находит Screaming Frog на вашем компьютере и запускает сканирование в фоновом режиме. Вы видите прогресс-бар прямо в браузере.

📋 Интерактивный чек-лист из 31 SEO-параметра: Мгновенный срез состояния сайта. Всё от битых ссылок (4xx/5xx) и цепочек редиректов до дубликатов мета-тегов, отсутствия микроразметки (Schema/OpenGraph) и медленных страниц.

🖱 Интерактивный UX (Клик-инфо): Хотите узнать, на каких страницах дублируются заголовки H1 или где не настроен Canonical? Просто кликните по нужной строке в общем чек-листе — и подробная таблица с проблемными URL сразу откроется прямо под ним!

🔗 Все адреса страниц в таблицах оформлены как активные гиперссылки. Кликайте и сразу проверяйте страницу в новой вкладке.

💾 История сканирований: Больше не нужно перекрауливать сайт заново! Дашборд кэширует результаты. Вы можете в любой момент переключиться на ранее просканированные домены через быстрый список.

📥 Авто-экспорт отчетов: Система автоматически генерирует детальные CSV-отчеты по каждой ошибке и собирает их в один аккуратный ZIP-архив для отправки клиенту или разработчикам.

Пример - просто демо работы с функционалом лягушки, дорабатывайте на его базе дальше код.

Скачать с Гитхаб
👍10🔥3🙈1🤝1
TripleTree · менеджер семантики

Однофайловый браузерный сервис управления семантическим ядром. Не требует установки и сервера: один HTML-файл, данные хранятся локально в браузере (автосохранение сессии), AI-функции работают через API Anthropic по собственному ключу пользователя. Автор скрипта.

Данные и импорт

• Импорт семантического ядра из XLSX (запрос, показы, WS, Score, роль, структура папок из колонки пути).
• Догрузка запросов в существующую сессию из второго файла: дедупликация по нормализованной форме (стеммер Snowball), корзина не воскрешается, новые запросы попадают в «Неразобранное».
• Автосохранение сессии в браузере; ручное сохранение/загрузка файла сессии.
• Отмена последних операций (Undo, до 80 шагов): перемещения, роли, структура, схлопывание, удаление.

Структура (дерево папок)

- Папки и подпапки без ограничения вложенности; перетаскивание запросов и папок мышью, палитра «Переместить в…».
• Динамическая нумерация папок среди соседей уровня — ненавязчивая, пересчитывается при перестановке.
• Цветовые метки папок (зелёный / жёлтый / красный / синий).
• Красная метка = карантин: красное поддерево исключается из всех анализов, отчётов и листов экспорта; единственное место — лист «Запросы» с пометкой «КРАСНАЯ». В диалогах отбора чекбоксы красных подпапок по умолчанию сняты.
• Теги статуса папки: ✓ готово / ⟳ в работе / ⚠️ проблема — цветные бейджи в дереве, переключаются в контекстном меню.
• Метки Tier 1–3 — приоритет папки, три различимых цвета.
• Технические разделители структуры: именованная строка-линия перед группой папок; перетаскивается, переименовывается, не участвует в анализах, экспорте и нумерации.
• Схлопывание подпапок: все запросы поддерева собираются в папку, подпапки удаляются (с Undo).
• Удаление папки отправляет все её запросы в корзину.
• Корзина с восстановлением и очисткой; счётчики запросов и показов по каждой папке; URL папки с наследованием для вложенных.
• Поиск/фильтр по дереву.

Группировка кластера (AI, требует API-ключ Anthropic)

• AI-аудит (чистка): выявление мусорных, нецелевых и дублирующих запросов.
• Структура: создать и разложить: модель предлагает подпапки по интентам и раскладывает запросы; защита от групп-дублей (Жаккар покрытий) и микрогрупп.
• Раскладка по подпапкам: классификация запросов по существующей структуре.
• Разгруппировка по маркерам.
• После любой раскладки остаток корня автоматически уходит в подпапку «Нераспределенные» с красной меткой — сразу под карантином.

Таблица запросов

• Сортировки, фильтр по папке с исключающими токенами, «включая подпапки», выделения, массовые операции, копирование.
• Группы дублей (D-группы) по нормализованной форме.
• Плашки меток на запросах.
• Ручная установка/снятие вершины (хоткей V); глобальный прогон авто-вершин по всем папкам сессии (жёлтая подсветка спорных).

Правые панели (просмотр)

• Униграммы, Биграммы, Триграммы — частотный словарь области с весами.
• Хоткеи панелей: U

Экспорт XLSX

• Листы: Запросы (с пометкой красных), Структура (без красных и разделителей, с колонкой «Тег»), Униграммы / Биграммы / Триграммы, Корзина.
• Экспорт всей сессии или отдельной папки.

Интерфейс

• Светлая и тёмная темы (переключатель ☾/☀️, уважение системной настройки).


Распространяется по лицензии CC0 "Работает как есть, можете переделывать как вам надо".
Ссылка на файлы.
❤8
🔍 Получаем AI overview и топ 10 выдачи бесплатно через API

Компактный PHP-скрипт для парсинга поисковой выдачи Google, который одновременно собирает классический топ 10 и  AI Overview .
🟣Обратите внимание что ответ зависит от языка и страны, поэтому выбирайте ваш регион правильно.

Провайдер API (Bright Data) предоставляет при регистрации бесплатный баланс, которого хватает примерно на 5000 тестовых запросов. Для получения доступа привязывать банковскую карту не требуется.


🟣Получите API-ключ на платформе Bright Data (в разделе SERP API) и вставьте в сам скрипт (177 строка $apiKey)

Это демо, можете по аналогии встроить себе в панельку или доработать мой.

Исходный код (скопируйте код, создайте php файл, добавьте API ключ и залейте на хостинг)
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍5🔥3
Forwarded from SEO-специалист
Please open Telegram to view this post
VIEW IN TELEGRAM
👍3
🔍 Быстрый чек обратных ссылок: без сторонних библиотек и сложных скриптов

При линкбилдинге часто собираются огромные таблицы с обещанными размещениями. Но как узнать, какие из них действительно работают и не удалены, а не затерялись при публикации?

Для этого есть лёгкий утилитарный инструмент — backlink-finder.
Он сканирует список донорских страниц и показывает, какие из них реально ссылаются на ваши домены, собирая анкоры и атрибуты ссылок.

⚙️ Главные фишки:
Только стандартная библиотека:
Работает на чистом Python 3.9+ без единой внешней зависимости (pip install не потребуется).

Сбор параметров: Вытягивает не только факт наличия ссылки, но и anchor_text, атрибут rel (проверяет на nofollow, sponsored, ugc), а также итоговый URL.

Умный парсинг: Автоматически учитывает поддомены (например, mysite.com найдет и ссылки на blog.mysite.com), обрабатывает редиректы, <base href> и различные кодировки страниц.

Удобный вывод: Результаты выгружаются в CSV-файл, а сводный отчёт выводится прямо в терминал.

🚀 Быстрый старт:
Клонируем репозиторий:

git clone https://github.com/izzipizzy/backlink-finder.git
cd backlink-finder


Создаем файл urls.txt со списком страниц для проверки (по одной на строку) и запускаем сканирование:
python3 backlink_finder.py urls.txt --domains mysite.com --out found.csv

💡 Подсказка: Если доменов много, их можно вынести в отдельный файл domains.txt — скрипт подтянет его автоматически.
👍2🔥1
Гуглоиды подтвердили внедрение маскировки урлов в серпе через редирект на google.com/goto.

В чем суть проблемы? Я так понимаю это результат борьбы с парсерами. Теперь если не перейти по ссылке goto - вы не узнаете url страницы. И наверное с попытками перехода Гугл тоже будет бороться, показывая капчу, иначе зачем все это.

Что это значит для seo оптимизаторов? Если раньше скраперы накручивали показы, сканируя топы, то сейчас может оказаться что крутиться будут и переходы, так как чтобы узнать юрл парсеру нужно перейти по goto.
Готовьтесь к кликам по запросам от ботов.


Второе что интересное - не поломается ли работа ботов ChatGPT и других, которые частично использовали поиск в Google для выдачи ответа. Я надеюсь что они договорятся, потому что иначе может поломаться вся логика и останется только Bing и внутренний RAG поиск.

обновление 29.08.2026: найдены первые ссылки с goto в ChatGPT
https://x.com/metehan777/status/2093433841616617814

Невозможность предпросмотра ссылки: Раньше пользователь мог навести курсор на ссылку в поисковой выдаче (SERP) и в левом нижнем углу браузера увидеть реальный адрес сайта, куда он перейдет.
Я лично довольно часто юзал такой предпросмотр и для как пользователя это потеря.
🤔2
Как ИИ-системы выбирают источники? Разбор 500 реальных цитат в ChatGPT, Perplexity и Google AI Overviews.

Команда RankAI проанализировала выборку из 500 цитирований и сопоставила данные с крупнейшими исследованиями рынка (Ahrefs на 4 млн URL и Profound на 680 млн цитат).

Собрали главные инсайды и тренды GEO (Generative Engine Optimization):

1. Топ-10 Google больше не гарантирует попадание в ИИ

Лишь 38% ссылок из Google AI Overviews входят в органический Top-10 Google (семь месяцев назад этот показатель составлял 76%).
ИИ-системы используют алгоритмы мульти-поиска (fan-out queries) и собирают ответы по всей глубине выдачи.

2. У каждой платформы свои фавориты

ChatGPT чаще всего цитирует Википедию и крупные справочные ресурсы.
• Perplexity отдаёт явное предпочтение Reddit и форумным обсуждениям.
• Google AI Overviews распределяет ссылки равномернее и чаще других использует видео с YouTube.

3. Правило «Первой трети»

Около 44% всех цитат берутся из первых 30% объема страницы. Читатели и алгоритмы одинаково ценят прямой ответ в самом начале.

• Начало страницы (0–30%): ~44% цитирований
• Середина (30–70%): ~31% цитирований
• Конец (70–100%): ~25% цитирований


4. Формат имеет решающее значение

Нейросети чаще всего забирают данные из:
• Сравнительных таблиц
• Четко размеченных FAQ-блоков
• Коротких блоков с определениями вверху страницы
Длинные нарративные тексты цитируются значительно реже.

5. Независимость важнее бренд-контента

При сравнении продуктов ИИ почти всегда ссылается на сторонние обзоры и независимые площадки, а не на официальные страницы брендов.

6. Миф о Schema-разметке

Исследования показали: добавление микроразметки на уже цитируемые страницы не даёт прироста в количестве упоминаний. Разметка помогает алгоритмам распарсить страницу, но сам факт её наличия не является фактором ранжирования для ИИ.
👍1
🤖 ChatGPT втайне построил собственный поисковик: что такое Labrador?

Долгое время в SEO-сообществе считалось, что ChatGPT не имеет собственной поисковой базы и полностью зависит от выдачи Google или Bing. Это оказалось мифом. Анализ внутренних процессов показывает, что OpenAI разработала масштабную независимую поисковую архитектуру.

📂 Что известно о секретном индексе?

Кодовое имя — Labrador. Это не просто одна база данных, а целое семейство специализированных вертикальных индексов.

Направления поиска: Веб-страницы распределены по тематическим слоям:

общий веб, PDF-документы, YouTube, Википедия, академический архив arXiv, новости (с разделением по свежести), медицина, юриспруденция, финансы, товары (Shopping) и изображения. Индекс хранит полные тексты страниц, даты их обхода роботом и даты публикации.

Эксабайтный масштаб: Согласно вакансиям OpenAI, их поисковые системы проектируются под работу на эксабайтном масштабе. Команда нанимает инженеров для разработки гибридного поиска, сочетающего классический текстовый алгоритм ранжирования (BM25) и векторный поиск по эмбеддингам.

Агрессивный кэш вместо «живого» поиска: Около 58% сайтов в интернете загружаются дольше 0,8 секунды, что слишком медленно для масштабов ChatGPT. Чтобы ускорить ответы, OpenAI кэширует страницы.

🔍 Откуда появились доказательства?
След в серверном коде: С мая по июль 2026 года во внутренних данных ChatGPT (SSE-событиях) передавалось скрытое поле result_source. Наряду с внешними парсерами там фигурировал Labrador.

Показания под присягой: Руководитель ChatGPT Ник Терли на судебных слушаниях против Google признался, что разработка собственного индекса началась еще в 2023 году. Изначально OpenAI ставила сверхагрессивную цель — закрывать своими силами 80% поисковых запросов уже к концу 2023 года.

Эксперименты в реальном времени: Прямо сейчас идет масштабное A/B-тестирование товарного индекса (Shopping). Тест «prefer-index-over-serp-v3» (приоритет собственного индекса над внешними парсерами) затронул около 8% всех чатов пользователей.

🛰 Внешние провайдеры больше не нужны? Пока нужны. Полный переход на автономный поиск — это долгий процесс, который может занять не менее 5 лет даже при наличии доступа к данным крупных поисковиков.
Сейчас ChatGPT склеивает выдачу своего индекса с результатами минимум 8 внешних каналов. В их числе: сторонние парсеры (Bright Data, Oxylabs), лицензионные соглашения с Yelp и TripAdvisor, а также поисковая платформа Web IQ от Microsoft.


💡 Что это значит для бизнеса и маркетологов?


Прекратите ориентироваться только на Bing. Видимость вашего сайта там не гарантирует автоматическое попадание в выдачу ChatGPT — здесь работают алгоритмы Labrador и Microsoft Web IQ, чья логика отличается от стандартного поиска.

Заполняйте Yelp и TripAdvisor. Если у вас локальный бизнес, ChatGPT использует эти платформы как официальных лицензированных партнеров.

Проверяйте свой кэш. Используйте режим строгой изоляции (Lockdown Mode) в настройках ChatGPT, чтобы проверить, какие именно страницы вашего сайта уже сохранены во внутреннем кэше OpenAI.
👍2
Forwarded from SEOquick
Please open Telegram to view this post
VIEW IN TELEGRAM
❤1👍1💩1
1️⃣ Google обновил рекомендации по AI-контенту
Google дополнил документацию по использованию генеративного ИИ в контенте.

Главный акцент — на риске фактических ошибок: AI может уверенно генерировать недостоверную информацию, поэтому такой контент нужно проверять перед публикацией.

Причём речь идёт не только о статьях. Google отдельно упоминает title, meta description, structured data и alt-тексты.


А массовое создание страниц с помощью ИИ без дополнительной пользы для пользователя по-прежнему может подпадать под scaled content abuse.

Комментарий Евгения Молдовану : По факту title, description имеют слишком маленький размер чтобы их детектировать с помощью ИИ (метками). Скорее всего цель изменения - перенести ответственность на вебмастера, так как Google использует эти данные в AI Overview.


🔗 Официальная документация Google

2️⃣ Google против фейковых авторов, созданных с помощью AI

В рекомендациях Google по качеству контента отдельно появился важный момент: нельзя создавать ложное впечатление об авторе материала.

В частности, Google предупреждает о вымышленных именах, фальшивых регалиях и AI-сгенерированных фотографиях людей, если они используются для того, чтобы представить несуществующего эксперта как реального автора.


То есть схема «придумаем эксперта, сгенерируем ему фото, напишем убедительную биографию и будем публиковать от его имени» — уже не просто сомнительная практика, а то, на что Google прямо обращает внимание.

Комментарий Евгения Молдовану:
Гугл уже давно проверял это, советуя асессорам проверять авторов в поиске, использовать поиск по фото, искать экспертов в социальных сетях. Если у вас есть отдельные страницы О нас, Контакты, Редакция - можна и не использовать вообще профиль автора, тогда доверие будет распространяться от администраторов сайта и редакции (траст самого сайта). Если у вас нет фото автора - лучше его вообще не использовать. Если автор слабенький - возможно он вообще не нужен.



🔗 Официальная документация Google
🔥1