Вебмастер Букреев (Reader)
568 subscribers
107 photos
3 videos
3 files
6.33K links
Ридер для вебмастеров. Публикую самое интересное и полезное для вебмастеров. Подписывайся, чтобы не пропустить важные новости индустрии. Ну и все фишки палим тоже тут. Обсудить можно в чате: https://t.me/marafonbukreev
Download Telegram
Стек нарочно простой: Python-бот на Telegram Bot API (polling, без вебхуков), SQLite для всего состояния, Docker Compose для развёртывания на домашнем сервере.

Главный принцип архитектуры - разделение вероятностного и детерминированного. LLM (OpenAI Responses API, structured output) отвечает только за то, что действительно требует понимания языка: разобрать свободный русский текст в строгую схему (Pydantic), сформулировать похвалу, добавить недельному отчёту немного «человечности», иногда придумать новую тему раунда. Модель никогда не считает баллы, не хранит состояние и не имеет права отрицать то, что уже сохранено в базе - при обычном разговоре ей передаётся точный контекст из SQLite, и по нему она обязана сверяться.

Вся арифметика баллов живёт в одном модуле без единого обращения к LLM. Она детерминирована и покрыта тестами, а документация формул синхронизирована с кодом как источник истины.

Из инженерных деталей: обработка Telegram update идемпотентна по update_id, чтобы повторная доставка не начисляла баллы дважды; частичные отчёты - это upsert, неназванные поля не затираются; запись в уже закрытую неделю блокируется на уровне сервиса; плановые рассылки (утро/вечер/бэкап) идемпотентны через таблицу отправленных сообщений, что переживает рестарт контейнера.

Ежедневный бэкап SQLite с ретеншеном настроен отдельной джобой.

Ну, типа все 🙂
👌2😁1🤩1😐1
Гугл в строку поиска воткнул кнопку «Режим ИИ». Я так понимаю скоро вполне себе этот режим станет режимом по умолчанию, вместо «Поиск в Google».

Ну или не станет. Я ж эксперт - должен все возможные варианты озвучивать :-)))

50/50 короче.

Из интересного: если задать запрос, то в режиме «Поиск в Google» будет блок с ИИ-ответом и там указаны источники откуда взята информация.

Если тот же запрос пульнуть в «Режим ИИ» - там будет более полная/подробная информация БЕЗ ссылок на источники. те из этого режима даже при цитируемости вебмастера трафика не получат совсем..

Круто, счастье, ЗБС :-)
🤩1
Вышла GLM 5.3

Первый кейс под который вообще бенмарк делался..

Погнали. :-)

Полную табличку итоговую почищу чуть-чуть и в комментах закину.
🔥2
‼️ Рунету сегодня нехорошо. И, похоже, причина довольно железная. В буквальном смысле.

Вечером посыпались жалобы сразу на десятки совершенно не связанных между собой сервисов: банки, маркетплейсы, операторов связи, VK, Steam, Discord, онлайн-кинотеатры и прочее. Жалобы идут из разных регионов России.

Почти одновременно в Москве погас свет в нескольких районах. Сообщалось о проблемах в Гагаринском, Даниловском районе, Замоскворечье и районе Октябрьской. Были проблемы с мобильной связью, магазинами, транспортом. На Калужско-Рижской линии метро некоторое время увеличивали интервалы движения.

А теперь самое интересное.

Мне тут злые языки подсказали: смотрите в сторону Бутлерова, 7.

Для тех, кому адрес ничего не говорит: это ММТС-9, она же M9.

И вот это уже не просто "где-то дата-центр моргнул".

M9 - одна из ключевых телекоммуникационных площадок российского интернета. Там сконцентрировано огромное количество операторского оборудования и межоператорских соединений. Там же находится площадка MSK-IX. Сам MSK-IX в свое время называл Бутлерова, 7 самой востребованной в России локацией для межоператорского взаимодействия - на ней присутствовали сотни операторов.

И сообщения об аварии с электропитанием на M9 действительно есть. Некоторые хостеры уже сообщили клиентам о проблемах с питанием и деградации связности на площадке.

По одной из появившихся технических версий, сначала произошёл сбой в московской энергосистеме, после чего проблемы зацепили в том числе инфраструктуру в районе M9. Именно это могло дать такой красивый каскад: электричество → операторские узлы → маршрутизация/связность → одновременно "падают" десятки вообще не связанных между собой сервисов.

Но тут аккуратно: окончательно эту причинно-следственную цепочку пока никто официально не подтвердил. Так что пока это наиболее логичная рабочая версия, а не установленная причина.

И маленький технический нюанс.

Фраза "упала точка обмена трафиком и поэтому упал Рунет" - слишком примитивное объяснение. Интернет так не устроен, MSK-IX вообще географически распределён, маршруты резервируются, питание резервируется и все взрослые люди заранее готовятся к отказам.

Но когда проблемы возникают на площадке такой концентрации инфраструктуры, как M9, эффект получается очень заметным.

Что мы сегодня, собственно, и наблюдаем.

Судя по сообщениям, электричество и часть сервисов уже возвращаются. Теперь будет интересно дождаться нормального технического разбора аварии.

Потому что если версия про M9 подтвердится, главный вопрос будет уже не "почему упало", а почему резервирование не спасло от настолько массового эффекта. 🙂

Причем резервирование питания именно на этой точке - МНОГОКРАТНОЕ.
Интересно, какое количество полыхающих поп будет завтра на совещаниях и разборах…
🤮1
Клод продлил повышенные лимиты до 31 августа.

Раньше окончанием акции значилось 19 августа (сегодня собственно).
👍2💩2
Прекрасное. В панели регру не работает продление доменов. Не грузятся скрипты - домен недоступен. Реакции на тикет нет уже больше суток :-)))

ЗЫ. А так хотелось заплатить им денег…
Ой, а молодцы!!! Могут же!

А где бы программу/учебник глянуть… А то нашим могут и туда традиционные ценности и нравственность засунуть :-)
🔥1
Мне тут один знакомый программист на днях сказал «Да ладно, Грок новый - прямо почти как Опус, но в 10 раз дешевле».

Ну, я ж любопытный. Кто ж мешает подключить Грок и глянуть как он там, на нашем бенче?

Результат в табличке. Тут никакого открытия не случилось.

Законное 15 место в рейтинге и затраты на уровне топовых моделей.

Ждем следующего «убийцу Опуса» :-)
👍6❤1🤡1
Для желающих потестить новый Fable на дешевых аккаунтах (20 за подписку) Антропики выдали 85 евро (у меня европейский аккаунт) для extra-usage.

Соответственно погнал гонять свои бенчи. Результаты чуть попозже :-)
Описание подробное закину комментом - все с картинкой не влезает :-)
🔥6
Меня в последнее время страшно раздражает одна человеческая привычка.

Люди почему-то очень любят лучше других знать, что ИМ надо делать.

Кто-то месяцами бьется за спасение природы. Пишет обращения, ходит по инстанциям, тратит свое время, нервы и силы.

И обязательно найдется человек, который объяснит:

"Вы все неправильно делаете. Надо было не жалобы писать, а устраивать митинг".

Спасибо, блядь. Без тебя не догадались.

Кто-то берет СВОИ деньги и строит школу в качестве благотворительности.

И тут же появляется толпа людей, прекрасно знающих, как следовало распорядиться ЧУЖИМИ деньгами:

"Это вообще государство должно делать".
"Лучше бы детскому дому помог".
"Лучше бы больницу построил".
"Лучше бы раздал бедным".

Особенно прекрасно вот это "мог бы".

Да. Мог бы.

А еще мог бы купить яхту.
Мог бы закопать деньги на даче.
Мог бы вообще ничего не делать.

Потому что это его деньги.

Вы можете считать чужое решение неэффективным, неправильным, глупым или бессмысленным. Можете даже сказать об этом, если вас спросили.

Но есть большая разница между:

"Я бы сделал иначе"

и

"ТЫ ДОЛЖЕН БЫЛ сделать иначе".

Первое - мнение.
Второе - почему-то попытка получить право распоряжаться чужой жизнью.

Люди имеют право неправильно бороться за природу.
Неправильно заниматься благотворительностью.
Неправильно строить бизнес.
Неправильно воспитывать собаку.
Неправильно тратить собственные деньги.
Неправильно выбирать, на что потратить свое время.

И даже - страшно сказать - совершать собственные ошибки.

Не каждое действие другого человека обязано проходить вашу персональную экспертизу на предмет того, достаточно ли правильно он живет.

Поэтому у меня есть довольно универсальное пожелание обществу:

ОТЪЕБИТЕСЬ ОТ ДРУГИХ ЛЮДЕЙ.

Не в смысле "никому ничего не говорите".

А в смысле - перестаньте считать, что ваше представление о правильном автоматически становится обязанностью для окружающих.

Хотите спасать природу другим способом - спасайте.
Хотите построить другую школу - стройте.
Хотите пожертвовать деньги эффективнее - пожертвуйте.

Своими руками.
Свое время.
Свои деньги.

А другим оставьте роскошь самим решать, что им делать со своей жизнью.

Даже если они делают это не так, как сделали бы вы.

ЗЫ. По мотивам чтения нескольких чатов все лето :-)))
👍9🔥7
Ну что, вчера подговорили меня Muse Spark 1.3 потестить.

Сегодня я про него вспомнил, вчера сплошные 429 ошибки летели в API…

Если честно - не ожидал, но надо дождаться ценников за модельку. Результат вполне достойный - законное 9 место в рейтинге.
🔥3
До меня докатилась GTP-6 Astra. Не могу себе позволить не запустить тесты на ней.

Честно - удивлен результатом. Буду пробовать использовать в кодинге ее в первую очередь теперь.

И есть еще один странный фокус. По ощущениями Опус 5 стал ЛУЧШЕ выполнять задачи. Я не знаю что поменялось и как вообще могло после выхода двух фейблов, но… Не поленился - запустил тест еще раз на Опусе 5 и блямс: он тоже теперь закрыл 7/10 задач… А мне прям казалось что старые модели после выхода новых только тупеют… А вот оно как бывает.

Свежие данные по бенчмарку.

Это МОИ задачи из действующих репозиториев.

Не является советом/рекомендацией :-)
🔥7👍3
Открытие сентября. На auto.ru оказывается теперь без авторизации зайти и посмотреть «чо почем» вообще нельзя, как я понял :-)))
😁1🤬1
Небольшой бытовой кейс использования AI 🙂

Взял две фотографии рукописных таблиц с результатами выборов по нашему району Крылатское, загрузил в ChatGPT. Попросил свести цифры, проверить контрольные суммы и найти аномалии.

За несколько минут получил:
- сводные результаты и проценты;
- сравнение восьми участков;
- расхождение в 60 голосов: сумма партийных строк - 649, а действительных бюллетеней указано 709;
- любопытный контраст: на одном участке у кандидата 97,83%, а у партии - 39,45%.

Расхождение сначала заподозрил в распознавании. Попросил вывести исходные цифры, сверил с фото - прочитано правильно, не сходится сама таблица.

Бонусом - готовая новость для районного сайта:
https://krylatskoe.com/main/popov-i-edinaya-rossiya-lidiruyut-na-vosmi-uik-krylatskogo-rezultaty-i-raskhozhdenie-v-60-golosov.html

Вот за такие задачи и люблю AI: рутинную оцифровку и арифметику забирает себе, мне остаётся проверить исходники и разобраться, что означают найденные различия. 🙂
👍4🔥3
У меня тут больше вопросы, чем полезный пост.
Да, так тоже иногда бывает. :-)

Собственно решил поразвлекаться в SEO/GEO немного.
Выбрал себе донора для развлечений из «бывших» сайтов.
Основная проблема - на скрине…

А подскажите плиз:
1. Есть где-то актуальные инструкции по написанию статей? Ну типа как минимум должно быть это, надо упомянуть это и не забыть обязательно такой-то блок (Типа краткого содержания, FAQ и тп). Ну те что надо включить в ТЗ для текста, чтобы была хотя бы средненькая статья по нынешним стандартам.
2. А какими моделями сейчас народ тексты пишет вообще и ТЗ для них? Мне кажется условные Опусы/Фубли, Астры - это дикий перебор для текстов-то… Можно же что-то попроще использовать? ;-)
3. Ну вдруг - а у кого-то вообще на новых статьях нынче трафик есть? ;-)

ЗЫ. Спасибо за подсказки заранее.
ЗЗЫ. На скрине - это я себе SEO-аудитора собрал за пару дней. И нет, он не публичный. :-)
Я тут решил статку глянуть за последние 30 дней… Просто активно работаю над проектами в Клоде где-то дней 20… Можно будет еще через 10 глянуть - должен быть прирост приличный.

А как у вас со статистикой использования подписки?
Ну что, вчера выкатили новые модельки. Я ломанулся тестировать. Глядя на результаты - решил что я пожалуй сначала высплюсь. И все перепроверю :-)

Крч. Опус новый превзошел все мои ожидания.

Мало того - я на данный момент уже девятый час гоняю его в три сессии по разным проектам - прямо огонь. Он стал умнее, самостоятельнее и «правильнее». Я не знаю как это объективно сформулировать.

В общем кажется с выходом следующих моделей мне надо будет расширять/усложнять тесты.

По факту Opus 5.5 - первая модель которая самостоятельно решила 10/10, плюс по цене НИЖЕ Haiku 4.5 и вдвое быстрее прежих Опусов (и в 4 раза быстрее того дешевого Haiku)

Ну и да, на подмену теперь ему можно смело выбирать GPT-6 Sol для таких же задач и GPT-6 Luna для более простых.

В общем по-моему это прямо огненные результаты и первый такой КАЧЕСТВЕННЫЙ скачок в результатах между прошлыми/новыми моделями.

Повторюсь: оно при этом еще и дешевле быстрее. ШОК.
👍6🔥4🤔1😱1
Что-то, если честно, я немного не понимаю. ВСЕ ДРУЖНО улучшили модели, что мне реально скоро тесты переписывать? :-) Спрут подогнал ключик под DeepSeek.

3 МЕСТО!!!! За 16 центов!!!! И 15 минут!!!!

А чо происходит, мне кто-то объяснит? :-)

Или это вообще просто обвязку в виде CC и Codex так апнули за это время?
👍6
Антропики что-то расщедрились. То сброс лимитов подогнали, как у openAI. Теперь вот 250$ на работу облачных сессий выдают. Кратко - это способ продолжить работу сессии на мощностях от Антропиков при закрытой крышке ноутбука. Я так понимаю они делаю клон кода (текущей ветки) и продолжают работу сессии по запущенным инструкциям на своих мощностях. Это если кратко.

В общем кто планирует потестить - нажать кнопочку Claim надо.

Описание «что это» и «зачем» + инструкция по использованию:
https://code.claude.com/docs/ru/claude-code-on-the-web
❤3