Compacting conversation...
101 subscribers
294 photos
13 videos
4 files
173 links
Станьте первым спонсором, от $1: https://github.com/sponsors/talkstream

Для связи: @nafigator
Download Telegram
Spotify молодцы, довольно вирально вписали строчку текста в дизайн :)

А! Поделиться хотел фразой «ME, MYSELF, AND AI».
🔥2
Forwarded from Max Syabro and a Slop Driven Development (Max Syabro)
Сижу работаю с MiMo-V2-Pro в opencode

Китайцы в этот раз не пиздят

Мне очень комфортно, кажется у клода в этот раз должно начать играть технологическое отверстие ниже копчика.

Слушает что надо делать фактически, контекст держит, рассуждения топ.

Короче настоятельно рекомендую пробовать
🔥3
Как я использую Claude Code в BigTech

Пятница, я решил порефлексировать на тему того, как использую AI (а именно Claude Code). У нас сейчас активно продвигают AI-инструменты, и я решил использовать эту возможность для улучшения своих навыков и продуктивности на работе. Использую только Opus на максималках. Совсем конкретику разглашать не могу из-за конфиденциальности, так что будет слегка поверхностно. Но на вопросы отвечать могу. С метриками всё сложно, но скорость работы реально выросла.

Сильно помогают дополнительные integrations / skills / plugins. Они помогают работать с разными инструментами, с внутренними тулами и много с чем другим.

Я использую Claude Code в терминале, но дополнительно использую VS Code. Почти всегда использую именно агентский режим.

Вначале о юзкейсах.
1. Работа с данными. В моём проекте мне надо собирать данные, использовать внутренние фреймворки, мониторить, фиксить проблемы.
Условный пример промпта (сильно упрощённый): вот есть пайплайн по сбору данных. напиши новый пайплайн, который добавляет к ним фичи из такой-то таблицы. Следуй структуре и стилю оригинального пайплайна

Из самого удобного, что сделал недавно, был подход типа:
вот у меня есть 3 пайплайна, запускаемых один за другим, напиши новые версии с такими-то изменениями. запускай их один за другим, мониторь исполнение, если падают - исправляй, сообщи когда будет готово.

2. Autoresearch
Недавно Karpathy выложил репо с autoresearch - итеративное автоматическое улучшение модели/тренировки для оптимизации метрик. Я сделал нечто такое же, но проще - запуск в полуручном режиме, табличка для трекинга экспериментов, докидывание моих идей в список итераций. Работало несколько дней, неплохо улучшило ml метрики.

Паттерн был примерно такой:
- вот есть пайплайн. поищи идеи, составь список. Исключи из него просто увеличение количества эпох - это сделаем в конце
- запусти 10 первых идей, когда тренировка закончится, занеси их в табличку, проанализируй и обнови список приоритетных новых идей
- повторяй

3. Дебаг падающих jobs. Раньше я много с этим страдал, теперь Claude Code решает их практически автономно - частично из-за улучшения skills, частично благодаря улучшениям самой модели.

4. Недавно у нас появилось нечто типа Claw. Я попробовал... и понял, что для многих кейсов мне и так хватает Claude Code + cron. Но для поиска свежей инфы на внутрених ресурсах - годно.

5. Уже не юзкейс: я активно использую subagents и swarms of agents - это и результаты улучшает, и в целом быстрее

6. Итеративное улучшение между сессиями - я бы сказал, что это ключевая штука, которая упрощает мне жизнь.
Все сессии логируются по дефолту в Claude Code. По итогу каждой сессии я запускаю внутренний инструмент, который собирает список "выученного" - что новое научилась делать модель (например, дебажить новый тип jobs), как я её поправлял, какие команды разрешал делать, какие баги были сделаны и как исправлены. Всё это добавляется в рабочую память модели. Это реально помогает.

7. О фейлах. Естественно, не всё работает идеально. Иногда модель применяет неправильный подход дебага, иногда использует некорректный синтаксис, иногда косячит в работе с внутренними инструментами.

Скажу честно: ещё полгода назад я писал 95% кода своими ручками, но с тех пор как нам на работе раздали Claude Code + Opus, доля написанного мной кода стала резко падать. Агенты реально упрощают жизнь. Но главное, что стоит помнить - любой закоммиченный код это моя ответственность. Нельзя сказать "это агент накосячил", так что надо внимательно ревьювить весь код.
👍1
Позавчера имел глупость написать в промпте что-то типа «и включи какой-нибудь 0Claw, чтобы наблюдал за пайплайном, смотрел главную сайта на адекватность, анализировал логи, и фиксил и оптимизировал этот самый пайплайн». Клод обиделся и сделал всё на башах, что в общем-то и хорошо. Главное, что результат есть. Утром встаёшь — а у тебя там что-то пока само улучшилось :)

Главред-сисадмин, ещё и ненастоящий, но работает хорошо. Можно ли было представить такое сочетание в сайте-медиа? О времена, о нравы!
🔥2
Forwarded from Max Syabro and a Slop Driven Development (Max Syabro)
На Reddit всплыл тред про страницу в документации Anthropic, которую мало кто читал. Три инструкции для системного промпта, которые заметно снижают галлюцинации Claude.

Явно разрешить модели отвечать «I don't know». Без этого Claude заполняет пробелы в знаниях правдоподобной выдумкой.

Потребовать цитаты и источники на каждое утверждение. Если источника нет, модель должна отозвать утверждение.

При работе с длинными документами (>20K токенов) заставить модель сначала извлечь дословные цитаты из текста, а потом анализировать. Это убивает дрейф смысла при пересказе, когда модель незаметно сдвигает значение при суммаризации.

Есть нюанс. Статья arXiv 2307.02185 показала, что жёсткие требования к цитированию давят креативную генерацию. Рекомендуют два режима: режим исследования с тремя инструкциями для фактчекинга, обычный режим без них — для свободной генерации.

https://docs.anthropic.com/en/docs/test-and-evaluate/strengthen-guardrails/reduce-hallucinations
Как бы понятно без слов. Если вдруг лишние деньги — я бы рассчитывал на GPU-ресурсы в каком-то виде.
https://console.cloud.google.com/welcome

Прикольно. Вдруг надо кому.
Жду последний агент (психология нотификаций) для полной картины.


Вы же помните, что в Claude Code агенты есть любые, не только технари? :)
🔥1
С пэйволом на контентных сайтах идея простая: только чтение — бесплатно. Весь интерактив, даже в мелочах — недорогая, но подписка.

Челлендж непростой, естественно, ведь возникает зависимость от комьюнити, но это же хорошо для всех.

Зарядить заодно какой-то общий публичный рейтинг сайтов, прямо на весь интернет, по количеству денег в подписках. Всё циклично, посещаемость перестала быть популярной, всякие Яндекс.Каталоги в прошлом, и SimilarWeb подвинется. Может какой-то единый финстрип как метод ранжирования взлетит. И впервые в массмаркет пробьётся адекватная интеграция блокчейна 🎉
👍2
Бгг.

Инструкция с просьбой не использовать в текстах персонализацию в профиле прописана. И это, конечно, хорошо. Но модель с ней согласна не до конца!
Кажется, кризис ОЗУ может подойти к концу — Google выпустила алгоритм TurboQuant, который сжимает потребление памяти нейросетей в 6 раз и ускоряет их работу до 8 раз без потери качества.

Нейронкам больше не понадобится столько ОЗУ и графических процессоров, чтобы выполнять тот же объём задач.

На фоне этого акции производителей памяти начали падать. Теперь все снова ждут оперативу по нормальным ценам.

r/#technology
🔥3
Текст из консоли плохо копируется, закинь мне интродакшн в буфер обмена


Простейший трюк, который иногда прям облегчает жизнь :)
👍3🔥2
Зарядка 5 секунд для работы а течение дня. Зарядка менее чем за пять минут питает мышь до полутора месяцев 😱

Это ли не будущее. С маками совсем отвлёкся, а тем временем, оказывается, произошла технологическая революция с периферией. Хорошая батарея существенно повышает уровень комфорта — просто тем, что о зарядке не думаешь вообще.

А вот даунгрейдиться болезненно. Перелезать с Xiaomi с бесконечной батареей и практически моментальной зарядкой 120W на абсолютно убогий и отсталый в этой части Pixel — это было действительно больно. С iPhone аналогично.
👍1
Пропустил момент с заработком первых денег на кодинге. Ок-ок, вайб-кодинге.

Первый проект я не могу назвать успешным, но он был оплачен. В пайплайне требуется в конце ручной тюнинг по аудио/голосу (аудиокниги), но чисто технический подгон под вкусовщину. А основа окей.

А вот второй — успешный. Показать пока не могу. И он тут же привёл за собой запрос на точно такой же, третий, где разговор начался вообще с предоплаты.

Мне нравится каждый из выполненных проектов, и их перспективы — они есть у каждого из них.

Это не считая абсолютно волонтёрских, социальных, не оплачиваемых историй, которых у меня примерно 80% — именно они моя суперсила. Их покажу с удовольствием уже в самое ближайшее время.

Период чистых дофаминовых экспериментов мне нравился тоже, но сейчас увлечение постепенно выходит в прод. Безмерно рад. Хз что и как будет дальше, но в данный момент — я очень рад быть частью вот этого нового интересного времени.
🔥5👍3
Посоны, а поставьте звёздочек в GitHub, пожалуйста

https://github.com/talkstream/ru-text

Это такой супер-мега-офигенный инструмент, лучший для русского языка, который когда-либо появлялся для CLI. На основе знаний и опыта из всех библий текстового дизайна, типографики, стиля. Есть топовая оценивалка, не алгоритмическая, не накрутить.

Надо ⭐️10 штук для каталогов.

И поставьте себе, я юзаю теперь с контентом вообще всегда. Он ок с Claude Code, Claude Cowork, Codex, Cursor и Gemini CLI.
👍2
Forwarded from Aleksandr Gorshkov
Привет! Увидел твой последний пост про Github.

А ты не сталкивался с пайплайном для локализации сайтов? Саму проблему переводов решить легко, а вот с верификацией посложнее
👍1
⬆️ подскажите, пожалуйста ⬆️
Когда там уже обновится Google Translate. На дворе какой год ИИ, а там всё ещё плохой перевод.

И когда обновится, я ОЧЕНЬ надеюсь, что интерфейс изменится не радиально. Максимум — несколько минималистичных префиллов по тону и локальным языковым особенностям (типа, пола говорящего в Таиланде). И то, спрятать куда-нибудь в бургер.

Понимаю, Google, Big Data, то, сё. Но чёт даже ни А/Б, ни экспериментов не видать 🤷‍♂️
👍1
one.one.one.one — красивое решение для ввода NS от Cloudflare, например, в Android. Где можно вводить только хост.

Где можно IP, там оба NS соответственно 1.1.1.1 и 1.0.0.1.

Зачем: в целом шустрее интернет работает, плюс несложная разблокировка всякого там при простых фильтрах у провайдера.
👍1