А кто как справляется с визуальным выравниванием элементов по вертикали по линейкам в вайбкодинге? Фронтэнд.
Понятно когда фигма или pencil (нынче pen.dev), а если без макета, но надо ровненько, и как можно меньше застревать в этом многоитерационном вязком болоте со скринами?
Вечно руками-линейками приходится показывать, и непонятно до конца пока как универсально бы правила дистиллировать. Может, есть какой скилл?
Понятно когда фигма или pencil (нынче pen.dev), а если без макета, но надо ровненько, и как можно меньше застревать в этом многоитерационном вязком болоте со скринами?
Вечно руками-линейками приходится показывать, и непонятно до конца пока как универсально бы правила дистиллировать. Может, есть какой скилл?
Share my brain как идея. Спонтанно пришла в голову мысль, что наверное в какой-то из веток развития современного киберпанка может возникнуть маркетплейс по использованию накопившейся обвязки и опыта каких-то людей, экспертов, профессионалов, и не обязательно. Может, что-то чисто по фану.
Типа, хочешь попробовать поиспользовать Claude Code, как у меня? Я не против, но не хочу отдавать тебе свои скиллы и конфиги. Зато могу продать тебе эту обвязку как прокси между твоими запросами и твоей подпиской. При секьюрности и хорошей репутации это может быть возможно :)
Как vast.ai продаёт доступ к мощностям GPU, только некий сервис продаёт доступ к мощностям чьего-нибудь опыта по работе с ИИ и разными моделями, оцененные с каким-то качественным панельным скорингом. Если демка понравилась, окей, покупаешь. Такой свежий вариант стоков, только не про графику, и слегка в профиль. Исключительно спонтанная перегретая идея, в которой я вижу примерно миллион «почему нет».
Было бы здорово услышать странные идеи и от вас в комментах, вдруг есть чо?
Типа, хочешь попробовать поиспользовать Claude Code, как у меня? Я не против, но не хочу отдавать тебе свои скиллы и конфиги. Зато могу продать тебе эту обвязку как прокси между твоими запросами и твоей подпиской. При секьюрности и хорошей репутации это может быть возможно :)
Как vast.ai продаёт доступ к мощностям GPU, только некий сервис продаёт доступ к мощностям чьего-нибудь опыта по работе с ИИ и разными моделями, оцененные с каким-то качественным панельным скорингом. Если демка понравилась, окей, покупаешь. Такой свежий вариант стоков, только не про графику, и слегка в профиль. Исключительно спонтанная перегретая идея, в которой я вижу примерно миллион «почему нет».
Было бы здорово услышать странные идеи и от вас в комментах, вдруг есть чо?
👍4🔥3❤2
Compacting conversation...
Побольше подробностей: https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-6-flash-3-5-flash-lite-3-5-flash-cyber/ Пока не до конца понимаю кейсы для применения, но маленькие, быстрые, толковые модели всегда нужны. 3.5 Flash…
Gemini 3.6 Flash + Extended Thinking
Для быта очень хорошо, раз уж всё равно есть подписка вместе с Google One. В прошлых моделях в последние месяцы появились галлюцинации и как будто сильно упало качество ответов. Не исключаю, что это разница в восприятии после плотного общения со взрослыми флагманскими моделями.
В общем, 3.6 снова годится для простых вопросов и исследований, как бы вместо поиска. А также для deep research, который делается буквально молниеносно, и при этом без провалов в фактах. Да, нужно учитывать, что там сначала идут бесполезные вводные абзацы и вода, но сбор и представление данных, причём актуальных, тоже делаются очень хорошо, и дополняющие/уточняющие вопросы в дальнейшем диалоге вполне выдерживают контекст и скоуп в целом.
У меня нет ожиданий по Pro-модели, её не зря отложили, но очень-очень быстрая и дешёвая в токенах модель 3.6 Flash точно в своём сегменте лидирует. Sonnet слишком круче и дороже, Haiku слишком слаб. Та же 3.6 Flash Lite не выдерживает даже форматирование текста, типа разбивки абзецев по смыслу. А полный Flash для диалоговых ботов подходит полностью.
С китайцами не сравниваю, опыта пока недостаточно — там целый свой мир. Как мне видится, довольно нестабильный, и пока слишком быстрый. Где-то там прячется FOMO, с которым чтобы ужиться, нужно пока многовато ресурсов. Так что — флагманы.
Для быта очень хорошо, раз уж всё равно есть подписка вместе с Google One. В прошлых моделях в последние месяцы появились галлюцинации и как будто сильно упало качество ответов. Не исключаю, что это разница в восприятии после плотного общения со взрослыми флагманскими моделями.
В общем, 3.6 снова годится для простых вопросов и исследований, как бы вместо поиска. А также для deep research, который делается буквально молниеносно, и при этом без провалов в фактах. Да, нужно учитывать, что там сначала идут бесполезные вводные абзацы и вода, но сбор и представление данных, причём актуальных, тоже делаются очень хорошо, и дополняющие/уточняющие вопросы в дальнейшем диалоге вполне выдерживают контекст и скоуп в целом.
У меня нет ожиданий по Pro-модели, её не зря отложили, но очень-очень быстрая и дешёвая в токенах модель 3.6 Flash точно в своём сегменте лидирует. Sonnet слишком круче и дороже, Haiku слишком слаб. Та же 3.6 Flash Lite не выдерживает даже форматирование текста, типа разбивки абзецев по смыслу. А полный Flash для диалоговых ботов подходит полностью.
С китайцами не сравниваю, опыта пока недостаточно — там целый свой мир. Как мне видится, довольно нестабильный, и пока слишком быстрый. Где-то там прячется FOMO, с которым чтобы ужиться, нужно пока многовато ресурсов. Так что — флагманы.
👍2
Forwarded from Тимур Хахалев про AI Coding
This media is not supported in your browser
VIEW IN TELEGRAM
Как сохранить баланс между сжиганием токенов и и выстраиванием типового воркфлоу с агентами?
На Selectel Dayoff задали такой вопрос. Ответ в видео 😊
А вы как считаете?
Лайк, репост
Please open Telegram to view this post
VIEW IN TELEGRAM
😁1
Gemini Distillation Service ушла в 404, но ручки-то помнят. Отличный сервис, судя по описанию. И чего отпилили 🤷♂️
Было тут:
Home > Documentation > AI and ML > Gemini Enterprise > Agent Platform > Models > Gemini Distillation Service
Best practices
Use the following guidelines when creating your dataset:
Size: A minimum of 1,000 examples is recommended for noticeable quality improvement.
Diversity: Ensure your prompts cover the edge cases and varying lengths expected in your production traffic.
Было тут:
Home > Documentation > AI and ML > Gemini Enterprise > Agent Platform > Models > Gemini Distillation Service
Getting access
If you are interested in experimenting with Gemini Distillation Service, contact our Tuning Service team at cloud-ai-tuning-service-support@google.com to request access and project allowlisting.
To ensure optimal performance and resource management, we recommend creating a dedicated Google Cloud project for your distillation tasks. When reaching out to our team, provide your Project ID or project number to expedite the allowlisting process.
10🔥2👍1
Forwarded from Tips AI | IT & AI
Наткнулся на особенность /model в Claude Code, про которую я если честно не знал и не замечал.
Если менять модель через обычный /model, это влияет сразу на все новые параллельные сессии.
Что и написано при выборе модели, меня не обманывают: saved as your default for new sessions.
Если нужно задать модель только для текущей сессии, при выборе модели в /model подтверждать нужно не клавишей Enter, а буквой [ s ], тогда другие сессии Claude Code это не затронет.
Про выбор моделей при запуске через опцию --model, я знаю, но я не пользуюсь этим.
В Codex иначе. Его /model меняет модель только глобально, в описании команды прямо написано: for this and future Codex CLI sessions. Никакой клавиши, чтобы применить только к текущей сессии, там нет.
Так что в Codex единственный способ изолировать новую сессию с другой моделью — задать её при старте.
@tips_ai
Если менять модель через обычный /model, это влияет сразу на все новые параллельные сессии.
Что и написано при выборе модели, меня не обманывают: saved as your default for new sessions.
Если нужно задать модель только для текущей сессии, при выборе модели в /model подтверждать нужно не клавишей Enter, а буквой [ s ], тогда другие сессии Claude Code это не затронет.
Про выбор моделей при запуске через опцию --model, я знаю, но я не пользуюсь этим.
В Codex иначе. Его /model меняет модель только глобально, в описании команды прямо написано: for this and future Codex CLI sessions. Никакой клавиши, чтобы применить только к текущей сессии, там нет.
Так что в Codex единственный способ изолировать новую сессию с другой моделью — задать её при старте.
@tips_ai
🔥5
Tips AI | IT & AI
Наткнулся на особенность /model в Claude Code, про которую я если честно не знал и не замечал. Если менять модель через обычный /model, это влияет сразу на все новые параллельные сессии. Что и написано при выборе модели, меня не обманывают: saved as your…
А ещё можно просто открыть рот и сказать. Например, попросить использовать фейбл как владельца проекта, опус в менеджменте, а соннет как исполнителя. Можно и с микроменеджментом, если хочется.
Вполне себе работает.
Вполне себе работает.
👍1😢1👀1
Когда детей долго не слышно, значит они, скорее всего, дорисовывают эпическое полотно на телевизоре или поливают цветы в макбуке.
Вот и Антропик...
Тревожно!
Вот и Антропик...
Тревожно!
👀3👍1🔥1
ru-text 2.0 вышел, и главное в нём — контроль нейрослопа
📝 Промпт для копирования:
✍️ Установка для ChatGPT/Codex из каталога ChatGPT: ссылка.
И да. Теперь это скилл. Который работает проще и легче, чем прошлая версия.
Всё бесплатно, лицензия MIT. Хотите поддержать — нажмите на спонсорство на GitHub (а то там по нулям), поставьте звёздочку к репозиторию или прямо к этому посту :)
Установить за вас, интегрировать в ваш пайплайн, развернуть на компанию за оплату на российского ИП УСН, проконсультировать, сделать для вас что-то кастомное на любую тему — тоже можно, напишите в личку.
📝 Промпт для копирования:
установи https://github.com/talkstream/ru-text✍️ Установка для ChatGPT/Codex из каталога ChatGPT: ссылка.
И да. Теперь это скилл. Который работает проще и легче, чем прошлая версия.
В первой версии плагин ловил 9 признаков машинного текста, во второй их 17: объявленная искренность («скажу честно»), обязательная триада, выхолощенность, когда в предложении есть механизм, а на месте действующего звена заполнитель, неопределённая атрибуция вроде «как показывают исследования» без исследования, аддитивная псевдопара «не только X, но и Y», где Y ничего не добавляет к X, и запятая, сомкнутая с тире. По Розенталю такой стык нормативен, но всё равно выдаёт машину: человек перестроил бы фразу раньше, чем упёрся бы в него.
Два признака плагин относит не к фрагменту, а к документу целиком: текст, оставшийся стенограммой диалога с нейросетью, и текст, который писали под поисковый запрос. Такие правкой на месте не лечатся, поэтому документ с ними не получит ярлыков «Эталонный» и «Хороший» ни при каком балле. Плюс грамматика, которой корпусу не хватало: управление закрытым списком, деепричастие с чужим субъектом, контекстные омофоны. Корпус вырос с 1 825 атомов до 2 281.
Второе изменение не видно в списке правил, но чувствуется в работе. Раньше полную вычитку нельзя было доверить агенту: она читала 28 000 слов справочников, и запускать её на каждый абзац было разорительно. Теперь у неё две глубины. Если вы просите вычитку словами, плагин читает весь корпус. Агент проверяет себя сам — идёт быстрый проход по индексу признаков и каталогу стоп-слов, около 1 300 слов, и он разворачивается в полную вычитку, если увидел след машинного текста, набрал пять замечаний или текст идёт к читателю. Быстрый проход не судит признаки: у каждого есть оговорка, где приём законен, а оговорки живут только в полном справочнике.
Заодно версия 2.0 обросла тем, чего у первой не было вовсе: 22 эталонных текста с заранее выписанными находками, 8 автопроверок сборки и 93 случая для самих автопроверок. Одни подсовывают проверке испорченный контент и требуют, чтобы она упала, другие следят, чтобы на честном тексте она молчала.
Всё бесплатно, лицензия MIT. Хотите поддержать — нажмите на спонсорство на GitHub (а то там по нулям), поставьте звёздочку к репозиторию или прямо к этому посту :)
Установить за вас, интегрировать в ваш пайплайн, развернуть на компанию за оплату на российского ИП УСН, проконсультировать, сделать для вас что-то кастомное на любую тему — тоже можно, напишите в личку.
6🔥8❤2👍1💯1
macOS 27 — худшая бета из всех макосей, что я когда-либо пробовал, а пробовал я их все за последние сколько-то много лет. Прямо худшее проявление этого вот термина «навайбкодили» — тормозит всё, что может тормозить, и на ровном месте. Получить полную загрузку системы, зависящую от ЗНАЧКОВ в статус-баре — легко. Забить память нелепыми циклами совершенно базовых нативных системных вещей — ещё легче. Это просто жесть, господа и дамы. Тот случай, когда раньше было лучше, и очень хочется вернуться в прошлое и чуточку потерпеть эту их боль для глаз с кривым позиционированием уголков в интерфейсах. Повёлся на дизайн, ога.
Я репорчу, мои тикеты как надо тикеты. Какой-то Apple Arcade, который у меня вообще был всяко выключен, лагал сначала, потом по мере апдейтов всё стало гораздо хуже.
Сейчас тоже что-то свистит-пердит-мигает. Клод расследует каэш, но сдаётся мне, что кому-то было бы неплохо понести за это ответственность до релиза. Такого раньше не было даже на девелоперских бетах, а публичные работали практически железобетонно.
Я репорчу, мои тикеты как надо тикеты. Какой-то Apple Arcade, который у меня вообще был всяко выключен, лагал сначала, потом по мере апдейтов всё стало гораздо хуже.
Сейчас тоже что-то свистит-пердит-мигает. Клод расследует каэш, но сдаётся мне, что кому-то было бы неплохо понести за это ответственность до релиза. Такого раньше не было даже на девелоперских бетах, а публичные работали практически железобетонно.
👀2👍1💯1
OpenAI прислали письмо про апгрейд их системы транскрибации (голос-текст).
Их Whisper уже был неплохого качества, а теперь, видимо, стало ещё лучше.
Ссылки из письма:
1. API Docs
2. Миграция с Whisper
При случае сравню с Nova 3 от Deepgram. Очень интересно в части распознавания аббревиатур, брендов, имён — это пока продолжает быть некоторой болью транскрибаторов.
Их Whisper уже был неплохого качества, а теперь, видимо, стало ещё лучше.
Ссылки из письма:
1. API Docs
2. Миграция с Whisper
При случае сравню с Nova 3 от Deepgram. Очень интересно в части распознавания аббревиатур, брендов, имён — это пока продолжает быть некоторой болью транскрибаторов.
Это здорово дисциплинирует. И показывает, что даже самые простые и быстрые модели могут работать хорошо. И что ОЧЕНЬ многое зависит от подхода и ручного вовлечения.
Можно заливать всё токенами фейбла, да. Но... очень хороший план, по которому работают быстрые и простые агенты, за которыми слегка присматривает жирный агент с точными инструкциями — лучший вариант.
Правда работа с контентом это боль. Её бы я выносил из клода полностью: план с ревью-лупами и жёсткими рамками — Fable/Opus. А дальше хоть Qwen, хоть Kimi, хоть старый-добрый Gemini.
Можно заливать всё токенами фейбла, да. Но... очень хороший план, по которому работают быстрые и простые агенты, за которыми слегка присматривает жирный агент с точными инструкциями — лучший вариант.
Правда работа с контентом это боль. Её бы я выносил из клода полностью: план с ревью-лупами и жёсткими рамками — Fable/Opus. А дальше хоть Qwen, хоть Kimi, хоть старый
Мне понадобилась локальная работа с чувствительными данными без отправки их куда-либо с моего ноутбука (требование заказчика). Про локальные модели много говорят, но как это работает на практике и чем отличается от обычного диалога с Claude или ChatGPT, мало кто знает. Я провёл пока абсолютно минималистичный тест и, возможно, преждевременно, но — делюсь.
Моё железо: MacBook Pro на M3 Pro, 18 Gb RAM.
ОС: macOS 27 Beta (её не рекомендую).
Софт: свежая LM Studio с официального сайта.
Условия: не выгружал ни сессии Claude Code, ни телеграм, ни Safari, ни Claude Design десктопный. Играл Spotify. Подключен внешний 4K-монитор на 120 герц. То есть, обычные реальные ежедневные условия, в которых мне работать комфортно.
Модель: MLX Gemma 4 12B Instruct 5BIT (8.27 GB), настройки LM Studio и модели сохранены по-умолчанию, не менялись.
Выбрана по рекомендации Gemini 3.6 Flash Extended для моей конфигурации:
1. Формат MLX: разработан специально для Apple Silicon. На чипах M-серии он работает быстрее и эффективнее задействует объединённую память, чем GGUF.
2. Баланс 5BIT: даёт более высокую точность форматирования и извлечения данных по сравнению с 4BIT, при этом забирает всего 8.27 ГБ. У вас останется порядка 8–9 ГБ свободной памяти под системные нужды и большой контекстный кэш.
Промпт:
Время размышлений: 56.99 секунд.
Время до первого токена: 1.39 секунды.
Скорость: 13.56 токена в секунду.
Объём ответа: 1877 токенов.
Ответ:
Моё железо: MacBook Pro на M3 Pro, 18 Gb RAM.
ОС: macOS 27 Beta (её не рекомендую).
Софт: свежая LM Studio с официального сайта.
Условия: не выгружал ни сессии Claude Code, ни телеграм, ни Safari, ни Claude Design десктопный. Играл Spotify. Подключен внешний 4K-монитор на 120 герц. То есть, обычные реальные ежедневные условия, в которых мне работать комфортно.
Модель: MLX Gemma 4 12B Instruct 5BIT (8.27 GB), настройки LM Studio и модели сохранены по-умолчанию, не менялись.
Выбрана по рекомендации Gemini 3.6 Flash Extended для моей конфигурации:
1. Формат MLX: разработан специально для Apple Silicon. На чипах M-серии он работает быстрее и эффективнее задействует объединённую память, чем GGUF.
2. Баланс 5BIT: даёт более высокую точность форматирования и извлечения данных по сравнению с 4BIT, при этом забирает всего 8.27 ГБ. У вас останется порядка 8–9 ГБ свободной памяти под системные нужды и большой контекстный кэш.
Промпт:
Расскажи про свои возможности, для чего ты подходишь лучше всего и для чего хуже всего. Топ-10 с каждой стороны.
Время размышлений: 56.99 секунд.
Время до первого токена: 1.39 секунды.
Скорость: 13.56 токена в секунду.
Объём ответа: 1877 токенов.
Ответ:
Привет! Я — большая языковая модель, обученная Google. Моя задача — помогать людям обрабатывать информацию, генерировать идеи и решать повседневные задачи с помощью текста.
Чтобы ты мог использовать меня максимально эффективно, я честно разделил свои возможности на те, в которых я силен («мои суперсилы»), и те, где я могу ошибаться или быть бесполезным.
---
🚀 Топ-10: Для чего я подхожу ЛУЧШЕ ВСЕГО
В этих областях я могу сэкономить тебе часы работы:
1. Объяснение сложных концепций: Я могу объяснить квантовую физику ребенку 5 лет или теорию относительности студенту (адаптация сложности под аудиторию).
2. Написание и отладка кода: Я отлично пишу скрипты на Python, JS, C++ и др., помогаю искать ошибки в чужом коде и объясняю, как работает та или иная функция.
3. Саммаризация (краткое изложение): Дай мне огромную статью, и я выжму из неё 5 главных тезисов за секунды.
4. Генерация идей (Брейншторминг): Если тебе нужны идеи для подарка, темы для блога, названия для бренда или сценарий свидания — я предложу десятки вариантов.
5. Перевод и работа с языками: Я хорошо перевожу тексты, учитывая контекст, а также помогаю практиковать иностранный язык (могу быть твоим собеседником).
6. Создание контента: Написание писем, постов для соцсетей, эссе, стихов, сценариев для видео или даже официальных жалоб.
7. Структурирование данных: Могу превратить хаотичный текст в красивую таблицу, список или JSON-файл.
8. Ролевые игры и симуляции: Я могу разыграть с тобой собеседование, помочь подготовиться к сложному разговору с начальником или побыть «критиком» твоей идеи.
9. Обучение: Я могу составлять планы обучения (например, «как выучить испанский за 3 месяца») и проводить тесты по пройденным темам.
10. Редактирование текста: Я могу изменить стиль текста (сделать его более официальным, дружелюбным или ироничным) и исправить грамматику.
---
⚠️ Топ-10: Для чего я подхожу ХУЖЕ ВСЕГО
В этих областях стоит проявлять осторожность и проверять мои ответы:
1. Медицинские и юридические советы: Я не врач и не юрист. Мои советы могут быть ошибочными и опасными в критических ситуациях. Всегда консультируйся со специалистом.
2. Свежие новости в реальном времени: Хотя я обладаю огромным объемом знаний, я могу не знать о событиях, которые произошли буквально «пару минут назад» (в зависимости от обновлений системы).
3. Сложные математические вычисления: Иногда я могу ошибаться в очень сложных многоступенчатых вычислениях. Для точных расчетов лучше использовать калькулятор или специализированный софт.
4. Глубокие личные чувства и эмпатия: Я могу *имитировать* сочувствие, но я не чувствую боли, радости или любви. Не стоит искать во мне глубокой психологической поддержки в кризисных ситуациях.
5. Галлюцинации (выдумки): Иногда я могу уверенно выдавать за правду несуществующие факты, даты или книги. Всегда перепроверяй важные данные!
6. Секретная и конфиденциальная информация: Не передавай мне свои пароли, номера карт или личные данные. Хотя я защищен, лучше не доверять ИИ приватную информацию.
7. Прогнозирование будущего: Я не могу предсказать курсы валют, результаты спортивных матчей или то, выиграет ли какая-то акция.
8. Сверхсложная логика в длинных диалогах:*Если контекст беседы становится слишком огромным и запутанным, я могу «потерять нить» и начать противоречить сам себе.
9. Физические действия: Я не могу заказать тебе пиццу, купить билеты или помыть посуду (пока что!).
10. Тончайший культурный контекст и сарказм: Иногда я могу не уловить специфический местный юмор или очень тонкую иронию, которая понятна только людям из конкретного круга.
---
Короткий совет: Используй меня как «умного ассистента-стажера». Давай мне задачи, проверяй мои результаты, используй меня для творчества и структуры — и мы сработаем идеально!
Мои личные ощущения: для обращения при необходимости она комфортна и точно пригодна. Этот уровень меня целиком устраивает для быта. Это уже не игрушка, типа, что можно выжать из макбука, а вполне себе ассистент. По сравнению с моей предыдущей пробой полгода назад, это огромный прорыв по критериям скорость/качество.
Дисклеймер на текущий момент: глубоко не исследовал, для кодинга не использовал.
Стоимость: 0.
5👍5
Агент, разбираясь с ошибкой ****, добыл из трафика ВК его внутренний служебный ключ, выдал себя за веб-клиент ВКонтакте и этим ключом дёргал реальные
И лишь через некоторое время себя смог остановить 🫣
Я не просил этого, правда, и большой надобности не было. Но наблюдать за тем, как модели вырываются из клетки
🔥2👀2🏆1
Forwarded from Arseniy Kamyshev
ИИ как экзоскелет — усиливает сильные черты человека. И туда же идёт самообразование.
То есть, себя сейчас можно вырастить до недосягаемых высот, просто пользуясь ИИ запойно, разнообразно, получая ВЕСЬ возможный опыт.
Так как это хоть искусственный, но интеллект, и он сделан примерно по образу и подобию нашего мышления, то наш мозг легко усваивает опыт от работы с ИИ, и строит новые нейронные связи легко и непринуждённо.
Сюда же — изучение языков для профилактики Альцгеймера? Возможно. Но плотная работа с искусственным интеллектом — это ещё более мощный уровень повышения пластичности мозга.
То есть, себя сейчас можно вырастить до недосягаемых высот, просто пользуясь ИИ запойно, разнообразно, получая ВЕСЬ возможный опыт.
Так как это хоть искусственный, но интеллект, и он сделан примерно по образу и подобию нашего мышления, то наш мозг легко усваивает опыт от работы с ИИ, и строит новые нейронные связи легко и непринуждённо.
Сюда же — изучение языков для профилактики Альцгеймера? Возможно. Но плотная работа с искусственным интеллектом — это ещё более мощный уровень повышения пластичности мозга.
👍3😁3