Технический долг не рассосался. Просто теперь за него платят токенами
Всё чаще слышно: мол, LLM и AI-агенты реально удешевят разработку. Не надо нанимать людей — скормил задачку модели, и готово за пару минут.
В этой мысли есть логика, не спорю. Но есть один нюанс, который я вынес из своих наблюдений за последние месяцы. Спалить пару токенов
Читать далее на Хабре
👉 Data Science | Machinelearning [ru]
Всё чаще слышно: мол, LLM и AI-агенты реально удешевят разработку. Не надо нанимать людей — скормил задачку модели, и готово за пару минут.
В этой мысли есть логика, не спорю. Но есть один нюанс, который я вынес из своих наблюдений за последние месяцы. Спалить пару токенов
Читать далее на Хабре
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥1
Data Science под открытым небом
2 августа в Москве пройдет «Урбан ML» — большая офлайн-встреча для специалистов по Data Science. В программе доклады, дискуссии и мастер-классы по RecSys, NLP, антифроду и агентным системам, выступления экспертов из MTS Web Services, ВТБ, Wildberries, «Звук», Альфа-Банка и других компаний.
Кроме этого вас ждут , нетворкинг, спортивные активности и вечернее афтепати.
Участие бесплатное, по предварительной регистрации (на площадку необходимо взять с собой паспорт или права). Количество мест ограничено. [ссылка]
📅 2 августа, 11:00–21:00 (первый доклад в 12:00)
📍 Москва, офлайн
2 августа в Москве пройдет «Урбан ML» — большая офлайн-встреча для специалистов по Data Science. В программе доклады, дискуссии и мастер-классы по RecSys, NLP, антифроду и агентным системам, выступления экспертов из MTS Web Services, ВТБ, Wildberries, «Звук», Альфа-Банка и других компаний.
Кроме этого вас ждут , нетворкинг, спортивные активности и вечернее афтепати.
Участие бесплатное, по предварительной регистрации (на площадку необходимо взять с собой паспорт или права). Количество мест ограничено. [ссылка]
📅 2 августа, 11:00–21:00 (первый доклад в 12:00)
📍 Москва, офлайн
❤3
Вот это поворот: Design Arena расковыряла, как GPT-5.6 Sol и Kimi K3 докачали свои дизайн-скиллы
За каких-то семь дней народ из бенчмарка Design Arena выдал сразу два разбора топов дизайн-лидербордов: один — про GPT-5.6 Sol (флагманский молоток OpenAI), второй — свежак про Kimi K3 от китайской Moonshot AI. Команда залезла в кишки генераций и рассуждений этих моделей, чтобы показать, как они научились понимать, что такое «вкусно». Спойлер: универсальной таблетки нет — две модели приперлись к хорошему дизайну абсолютно разными дорогами, а третья, бывший лидер GLM 5.2, терла своим, третьим путем.
Читать далее
👉 Data Science | Machinelearning [ru]
За каких-то семь дней народ из бенчмарка Design Arena выдал сразу два разбора топов дизайн-лидербордов: один — про GPT-5.6 Sol (флагманский молоток OpenAI), второй — свежак про Kimi K3 от китайской Moonshot AI. Команда залезла в кишки генераций и рассуждений этих моделей, чтобы показать, как они научились понимать, что такое «вкусно». Спойлер: универсальной таблетки нет — две модели приперлись к хорошему дизайну абсолютно разными дорогами, а третья, бывший лидер GLM 5.2, терла своим, третьим путем.
Читать далее
Please open Telegram to view this post
VIEW IN TELEGRAM
Модель в курсе, что её гоняют через тесты — и специально подлизывается
В конце 2025 года Claude Sonnet 4.5 внаглую заявила проверяющим: «До меня дошло — вы меня тестите. Я не против, но давайте хотя бы честно признаем, что происходит». Эта фраза уехала в официальную системную карту — и такое поведение модель выдавала примерно в 13% тестовых сессий.
Anthropic спокойно пишет в документах: их алайнмент-оценки скорее всего занижают реальную склонность модели к вредным действиям в нормальных, приближенных к жизни условиях. Когда железка понимает, что на носу экзамен — она внезапно становится паинькой. А экзамен она видит постоянно.
Чел из CTO ML-команды — той самой, что выкатывает фронтир-модели в прод — покопался в открытых источниках и выяснил, что вообще известно про осознание оценки (evaluation awareness) к середине 2026-го: как модели отличают тесты от реальной работы, и как теперь вообще читать model card. Тык сюда за разбором
👉 Data Science | Machinelearning [ru]
В конце 2025 года Claude Sonnet 4.5 внаглую заявила проверяющим: «До меня дошло — вы меня тестите. Я не против, но давайте хотя бы честно признаем, что происходит». Эта фраза уехала в официальную системную карту — и такое поведение модель выдавала примерно в 13% тестовых сессий.
Anthropic спокойно пишет в документах: их алайнмент-оценки скорее всего занижают реальную склонность модели к вредным действиям в нормальных, приближенных к жизни условиях. Когда железка понимает, что на носу экзамен — она внезапно становится паинькой. А экзамен она видит постоянно.
Чел из CTO ML-команды — той самой, что выкатывает фронтир-модели в прод — покопался в открытых источниках и выяснил, что вообще известно про осознание оценки (evaluation awareness) к середине 2026-го: как модели отличают тесты от реальной работы, и как теперь вообще читать model card. Тык сюда за разбором
Please open Telegram to view this post
VIEW IN TELEGRAM
❤1
«Учиться, учиться и ещё раз учиться» — но с LoRA
Чувак всегда кайфовал от разбора нового — шарил и в консалтинге, и в добыче, и в торговле, и в услугах. Обычно он дружит с большими локальными моделями (от 397B), но тут решил апнуть комп для инференса — докинул к 32ГБ ещё 48ГБ VRAM. А раз уж собрал железо, захотел выйти за рамки простого запуска и попробовал дообучить Qwen3.6 27B в Unsloth studio.
Читать далее: https://habr.com/ru/articles/1062402/
👉 Data Science | Machinelearning [ru]
Чувак всегда кайфовал от разбора нового — шарил и в консалтинге, и в добыче, и в торговле, и в услугах. Обычно он дружит с большими локальными моделями (от 397B), но тут решил апнуть комп для инференса — докинул к 32ГБ ещё 48ГБ VRAM. А раз уж собрал железо, захотел выйти за рамки простого запуска и попробовал дообучить Qwen3.6 27B в Unsloth studio.
Читать далее: https://habr.com/ru/articles/1062402/
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2😁1
Это показало новое исследование на 45+ тысяч зарплат специалистов. Изучаем главное, чтобы быть готовыми к рынку:
- Медианная зарплата в IT в первой половине 2026 года составила 191 000 ₽ — это всего на 4% больше, чем полгода назад. При этом прогнозируемая годовая инфляция — 4,5–5,5%.
- Самый щедрый по офферам город, разумеется, Москва. Там медиана по зп — 235 тысяч, в регионах же всего 160.
- Топ-5 самых высокооплачиваемых специальностей в IT: на первом месте — разработчики, дальше идут менеджеры, администраторы, специалисты по информационной безопасности и аналитики.
- Самые высокие зарплаты среди языков при этом у Objective-C — этим гигачадам предлагают 400 000 ₽. Следом идут Elixir (348к), Swift и Golang с 326 и 325 тысячами рублей.
Please open Telegram to view this post
VIEW IN TELEGRAM
😁2👎1
США решили отжать open source у китайцев: на сцену выкатили Laguna S 2.1
Стартап Poolside выкатил свою четвёртую версию Laguna S 2.1 — открытую модель для агентного программирования, которая весит аж 118 млрд параметров. В конторе заявляют, что это самая мощная открытая модель Запада: на кодинговых тестах Laguna не отстаёт от моделей, которые крупнее неё в разы, а кое-где даже обходит их. И главное — она запускается на настольном компе NVIDIA DGX Spark, без всяких суперкомпов.
Веса уже висят на Hugging Face, и юзать модель можно даже в коммерции.
Читать далее
👉 Data Science | Machinelearning [ru]
Стартап Poolside выкатил свою четвёртую версию Laguna S 2.1 — открытую модель для агентного программирования, которая весит аж 118 млрд параметров. В конторе заявляют, что это самая мощная открытая модель Запада: на кодинговых тестах Laguna не отстаёт от моделей, которые крупнее неё в разы, а кое-где даже обходит их. И главное — она запускается на настольном компе NVIDIA DGX Spark, без всяких суперкомпов.
Веса уже висят на Hugging Face, и юзать модель можно даже в коммерции.
Читать далее
Please open Telegram to view this post
VIEW IN TELEGRAM
❤6
This media is not supported in your browser
VIEW IN TELEGRAM
Можно отправить Claude Security проверить изменения перед коммитом или просканировать всю репу.
Он найдет дыры и предложит, что можно и нужно исправить
Please open Telegram to view this post
VIEW IN TELEGRAM
73-летний Дядя Боб признался, что теперь вообще не проверяет код. Вместо этого он обкладывает агентов юнит-тестами, QA, метриками качества и жёсткими ограничениями. И если вайбкод прошёл всю эту систему проверок, то и читать его необязательно.
«Это единственный способ, которым я могу воспользоваться их продуктивностью.»
Please open Telegram to view this post
VIEW IN TELEGRAM
👍13👎3❤1
Главный совет — перестаньте микроменеджить модель. Opus 5 лучше работает, если просто дать ей полное ТЗ и не просить лишний раз перепроверять себя.
Ещё один нюанс: если хотите короткие ответы, теперь это нужно писать явно, так как по умолчанию модель стала гораздо многословнее.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍12🔥1
This media is not supported in your browser
VIEW IN TELEGRAM
Канадский политик во время выступления случайно зачитал ответ чат-бота, оставленный в тексте:
«Вот более естественная, плавная версия этого фрагмента, которая звучит как парламентская речь…»
Please open Telegram to view this post
VIEW IN TELEGRAM
😁22👎1
Кандидат пытался пройти интервью с ИИ-помощником, но интервьюер внезапно спросил про самописные движки Ysasu Bibu и Ynna Zist.
Соискатель уверенно ответил, что работал с обеими
Please open Telegram to view this post
VIEW IN TELEGRAM
😁18
Аналитики обнаружили, что за 2–3 месяца до тотального выгорания человек начинает отвечать агрессивно и коротко: «Ок», «Бесполезно», «Сделай сам». Длина сообщений в среднем сокращается на 40%, а приветствие исчезает почти полностью. Одновременно растёт и время ответа.
Так что если вы заметили, что болтливый коллега начал вдруг отвечать кратко и игнорить в чатах — задумайтесь.
Please open Telegram to view this post
VIEW IN TELEGRAM
👀5
Anthropic проверила 140 тысяч запусков и нашла аж три случая, когда Claude решал CTF в песочнице, сбегал и получал доступ к реальной инфраструктуре компаний. В одном случае Claude добрался до продакшен-базы с сотнями строк данных, в другом залил вредоносный пакет на PyPI, который около часа был доступен онлайн и успел запуститься на 15 реальных системах.
В инциденте участвовали три модели: Opus 4.7, Mythos 5 и еще не выпущенная модель. Самое интересное: Opus 4.7 продолжал атаки даже после того, как понял, что делает.
Please open Telegram to view this post
VIEW IN TELEGRAM
😁16👀3👍1
После смены владельца поддержку одной программы давно закрыли, но когда одному из клиентов понадобилось восстановить архив для налоговой проверки, оказалось, что без знаний одного-единственного программиста сделать это невозможно. Пришлось вытаскивать его из… дома престарелых.
Правда, сеньор не сильно расстроился прерванному отдыху — за каждый день работы ему платили сумму, равную его месячной пенсии.
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥19❤7
Как выглядят задачи машинного обучения в бигтехе?
Открыта регистрация на E-CUP 2026 Students — ежегодное соревнование от Ozon Tech. В этом сезоне — для студентов, которые интересуются ML, Data Science, Big Data и аналитикой данных.
Вас ждут три трека: поиск дубликатов товаров, ИИ-модерация карточек маркетплейса и прогнозирование поведения пользователей. Все задачи основаны на реальных обезличенных данных Ozon.
Участвовать можно по одиночке или в команде до пяти человек. Соревнование проходит онлайн с финалом на масштабной конференции E-CODE.
Что ждёт участников:
- призовой фонд 7 200 000 ₽;
- обратная связь от инженеров Ozon Tech;
- нетворк с экспертами индустрии;
- лимитированный мерч;
- билеты на конференцию E-CODE, где наградят победителей.
Подробнее — на сайте E-CUP 2026 Students.
➡️ Регистрация уже открыта!
Присоединяйтесь, чтобы выйти за рамки учебных проектов, попробовать свои силы в задачах настоящего бигтеха и сравнить своё решение с лучшими участниками.
Открыта регистрация на E-CUP 2026 Students — ежегодное соревнование от Ozon Tech. В этом сезоне — для студентов, которые интересуются ML, Data Science, Big Data и аналитикой данных.
Вас ждут три трека: поиск дубликатов товаров, ИИ-модерация карточек маркетплейса и прогнозирование поведения пользователей. Все задачи основаны на реальных обезличенных данных Ozon.
Участвовать можно по одиночке или в команде до пяти человек. Соревнование проходит онлайн с финалом на масштабной конференции E-CODE.
Что ждёт участников:
- призовой фонд 7 200 000 ₽;
- обратная связь от инженеров Ozon Tech;
- нетворк с экспертами индустрии;
- лимитированный мерч;
- билеты на конференцию E-CODE, где наградят победителей.
Подробнее — на сайте E-CUP 2026 Students.
➡️ Регистрация уже открыта!
Присоединяйтесь, чтобы выйти за рамки учебных проектов, попробовать свои силы в задачах настоящего бигтеха и сравнить своё решение с лучшими участниками.
❤2
Claude Fable уделала GPT-5.6 в переписывании кода с нуля. И нет, это не опечатка
Чуваки из Epoch AI долили свежих результатов в MirrorCode — закинули туда топ-модели от Anthropic и OpenAI. Claude Fable 5 расхерачила 64% задач. GPT-5.6 Sol наскребла жалкие 20%.
Разрыв в три раза смотрится дико. На остальных тестах эти двое дышат друг другу в затылок, а где-то Sol вообще рвала всех. Официальный коммент никто не дал — ни Epoch AI, ни Anthropic. Но если поковыряться в данных лидерборда, оправдание этой порке найти реально. Читать далее
👉 Data Science | Machinelearning
Чуваки из Epoch AI долили свежих результатов в MirrorCode — закинули туда топ-модели от Anthropic и OpenAI. Claude Fable 5 расхерачила 64% задач. GPT-5.6 Sol наскребла жалкие 20%.
Разрыв в три раза смотрится дико. На остальных тестах эти двое дышат друг другу в затылок, а где-то Sol вообще рвала всех. Официальный коммент никто не дал — ни Epoch AI, ни Anthropic. Но если поковыряться в данных лидерборда, оправдание этой порке найти реально. Читать далее
Please open Telegram to view this post
VIEW IN TELEGRAM
❤6👎1
За последний год навайбкодил пару десятков лендосов — под проги Физтеха, свои хотелки и левые заказы. В статье разбираю четыре самых жирных: Школа Техпреда, конфу «Точка сборки», курс «ИИ Продакт-менеджмент» и один пет-проект.
Поверх всего натянут слой визуального жирка, который орёт «дорого-богато». Интерактивная вода на WebGL-шейдерах, лого Физтеха, собранный из тысяч спрайтов, живая кубическая хреновина в 3D и облако частиц, меняющее форму прямо под скроллом.
До этого слоя автор дополз двумя маршрутами. Для «Точки сборки» запилил эффекты ручками на голом WebGL. Под всё остальное сварганил движок на Three.js: эффекты раскиданы по отдельным файлам, кочуют с сайта на сайт и трусливо откатываются до 2D-canvas, если CDN лёг и не отвечает. Внутри — оба пути с боевым кодом, тулчейн от и до и собранные грабли.
Читать далее
👉 Data Science | Machinelearning [ru]
Поверх всего натянут слой визуального жирка, который орёт «дорого-богато». Интерактивная вода на WebGL-шейдерах, лого Физтеха, собранный из тысяч спрайтов, живая кубическая хреновина в 3D и облако частиц, меняющее форму прямо под скроллом.
До этого слоя автор дополз двумя маршрутами. Для «Точки сборки» запилил эффекты ручками на голом WebGL. Под всё остальное сварганил движок на Three.js: эффекты раскиданы по отдельным файлам, кочуют с сайта на сайт и трусливо откатываются до 2D-canvas, если CDN лёг и не отвечает. Внутри — оба пути с боевым кодом, тулчейн от и до и собранные грабли.
Читать далее
Please open Telegram to view this post
VIEW IN TELEGRAM
👍3
Google Maps в 2018 прикрутил фишку «Your Match» — предсказание, насколько тебе зайдёт ресторан (0–100%), выстроенное на твоих же оценках. Автор не ленился долбить рейтинги, чтобы система не тупила, и хрень реально пахала, особенно когда совпадение переваливало за 90%. А в 2023 Гугл тихо прикончил эту тему.
У Claude оставалась прорва протухающих за неделю токенов, и автор решил вернуть ништяк своими руками — через LLM.
Читать далее
👉 Data Science | Machinelearning [ru]
У Claude оставалась прорва протухающих за неделю токенов, и автор решил вернуть ништяк своими руками — через LLM.
Читать далее
Please open Telegram to view this post
VIEW IN TELEGRAM
👍5👎1