Gemini Distillation Service ушла в 404, но ручки-то помнят. Отличный сервис, судя по описанию. И чего отпилили 🤷♂️
Было тут:
Home > Documentation > AI and ML > Gemini Enterprise > Agent Platform > Models > Gemini Distillation Service
Best practices
Use the following guidelines when creating your dataset:
Size: A minimum of 1,000 examples is recommended for noticeable quality improvement.
Diversity: Ensure your prompts cover the edge cases and varying lengths expected in your production traffic.
Было тут:
Home > Documentation > AI and ML > Gemini Enterprise > Agent Platform > Models > Gemini Distillation Service
Getting access
If you are interested in experimenting with Gemini Distillation Service, contact our Tuning Service team at cloud-ai-tuning-service-support@google.com to request access and project allowlisting.
To ensure optimal performance and resource management, we recommend creating a dedicated Google Cloud project for your distillation tasks. When reaching out to our team, provide your Project ID or project number to expedite the allowlisting process.
10🔥2👍1
Forwarded from Tips AI | IT & AI
Наткнулся на особенность /model в Claude Code, про которую я если честно не знал и не замечал.
Если менять модель через обычный /model, это влияет сразу на все новые параллельные сессии.
Что и написано при выборе модели, меня не обманывают: saved as your default for new sessions.
Если нужно задать модель только для текущей сессии, при выборе модели в /model подтверждать нужно не клавишей Enter, а буквой [ s ], тогда другие сессии Claude Code это не затронет.
Про выбор моделей при запуске через опцию --model, я знаю, но я не пользуюсь этим.
В Codex иначе. Его /model меняет модель только глобально, в описании команды прямо написано: for this and future Codex CLI sessions. Никакой клавиши, чтобы применить только к текущей сессии, там нет.
Так что в Codex единственный способ изолировать новую сессию с другой моделью — задать её при старте.
@tips_ai
Если менять модель через обычный /model, это влияет сразу на все новые параллельные сессии.
Что и написано при выборе модели, меня не обманывают: saved as your default for new sessions.
Если нужно задать модель только для текущей сессии, при выборе модели в /model подтверждать нужно не клавишей Enter, а буквой [ s ], тогда другие сессии Claude Code это не затронет.
Про выбор моделей при запуске через опцию --model, я знаю, но я не пользуюсь этим.
В Codex иначе. Его /model меняет модель только глобально, в описании команды прямо написано: for this and future Codex CLI sessions. Никакой клавиши, чтобы применить только к текущей сессии, там нет.
Так что в Codex единственный способ изолировать новую сессию с другой моделью — задать её при старте.
@tips_ai
🔥5
Tips AI | IT & AI
Наткнулся на особенность /model в Claude Code, про которую я если честно не знал и не замечал. Если менять модель через обычный /model, это влияет сразу на все новые параллельные сессии. Что и написано при выборе модели, меня не обманывают: saved as your…
А ещё можно просто открыть рот и сказать. Например, попросить использовать фейбл как владельца проекта, опус в менеджменте, а соннет как исполнителя. Можно и с микроменеджментом, если хочется.
Вполне себе работает.
Вполне себе работает.
👍1😢1👀1
Когда детей долго не слышно, значит они, скорее всего, дорисовывают эпическое полотно на телевизоре или поливают цветы в макбуке.
Вот и Антропик...
Тревожно!
Вот и Антропик...
Тревожно!
👀3👍1🔥1
ru-text 2.0 вышел, и главное в нём — контроль нейрослопа
📝 Промпт для копирования:
✍️ Установка для ChatGPT/Codex из каталога ChatGPT: ссылка.
И да. Теперь это скилл. Который работает проще и легче, чем прошлая версия.
Всё бесплатно, лицензия MIT. Хотите поддержать — нажмите на спонсорство на GitHub (а то там по нулям), поставьте звёздочку к репозиторию или прямо к этому посту :)
Установить за вас, интегрировать в ваш пайплайн, развернуть на компанию за оплату на российского ИП УСН, проконсультировать, сделать для вас что-то кастомное на любую тему — тоже можно, напишите в личку.
📝 Промпт для копирования:
установи https://github.com/talkstream/ru-text✍️ Установка для ChatGPT/Codex из каталога ChatGPT: ссылка.
И да. Теперь это скилл. Который работает проще и легче, чем прошлая версия.
В первой версии плагин ловил 9 признаков машинного текста, во второй их 17: объявленная искренность («скажу честно»), обязательная триада, выхолощенность, когда в предложении есть механизм, а на месте действующего звена заполнитель, неопределённая атрибуция вроде «как показывают исследования» без исследования, аддитивная псевдопара «не только X, но и Y», где Y ничего не добавляет к X, и запятая, сомкнутая с тире. По Розенталю такой стык нормативен, но всё равно выдаёт машину: человек перестроил бы фразу раньше, чем упёрся бы в него.
Два признака плагин относит не к фрагменту, а к документу целиком: текст, оставшийся стенограммой диалога с нейросетью, и текст, который писали под поисковый запрос. Такие правкой на месте не лечатся, поэтому документ с ними не получит ярлыков «Эталонный» и «Хороший» ни при каком балле. Плюс грамматика, которой корпусу не хватало: управление закрытым списком, деепричастие с чужим субъектом, контекстные омофоны. Корпус вырос с 1 825 атомов до 2 281.
Второе изменение не видно в списке правил, но чувствуется в работе. Раньше полную вычитку нельзя было доверить агенту: она читала 28 000 слов справочников, и запускать её на каждый абзац было разорительно. Теперь у неё две глубины. Если вы просите вычитку словами, плагин читает весь корпус. Агент проверяет себя сам — идёт быстрый проход по индексу признаков и каталогу стоп-слов, около 1 300 слов, и он разворачивается в полную вычитку, если увидел след машинного текста, набрал пять замечаний или текст идёт к читателю. Быстрый проход не судит признаки: у каждого есть оговорка, где приём законен, а оговорки живут только в полном справочнике.
Заодно версия 2.0 обросла тем, чего у первой не было вовсе: 22 эталонных текста с заранее выписанными находками, 8 автопроверок сборки и 93 случая для самих автопроверок. Одни подсовывают проверке испорченный контент и требуют, чтобы она упала, другие следят, чтобы на честном тексте она молчала.
Всё бесплатно, лицензия MIT. Хотите поддержать — нажмите на спонсорство на GitHub (а то там по нулям), поставьте звёздочку к репозиторию или прямо к этому посту :)
Установить за вас, интегрировать в ваш пайплайн, развернуть на компанию за оплату на российского ИП УСН, проконсультировать, сделать для вас что-то кастомное на любую тему — тоже можно, напишите в личку.
6🔥8❤2👍1💯1
macOS 27 — худшая бета из всех макосей, что я когда-либо пробовал, а пробовал я их все за последние сколько-то много лет. Прямо худшее проявление этого вот термина «навайбкодили» — тормозит всё, что может тормозить, и на ровном месте. Получить полную загрузку системы, зависящую от ЗНАЧКОВ в статус-баре — легко. Забить память нелепыми циклами совершенно базовых нативных системных вещей — ещё легче. Это просто жесть, господа и дамы. Тот случай, когда раньше было лучше, и очень хочется вернуться в прошлое и чуточку потерпеть эту их боль для глаз с кривым позиционированием уголков в интерфейсах. Повёлся на дизайн, ога.
Я репорчу, мои тикеты как надо тикеты. Какой-то Apple Arcade, который у меня вообще был всяко выключен, лагал сначала, потом по мере апдейтов всё стало гораздо хуже.
Сейчас тоже что-то свистит-пердит-мигает. Клод расследует каэш, но сдаётся мне, что кому-то было бы неплохо понести за это ответственность до релиза. Такого раньше не было даже на девелоперских бетах, а публичные работали практически железобетонно.
Я репорчу, мои тикеты как надо тикеты. Какой-то Apple Arcade, который у меня вообще был всяко выключен, лагал сначала, потом по мере апдейтов всё стало гораздо хуже.
Сейчас тоже что-то свистит-пердит-мигает. Клод расследует каэш, но сдаётся мне, что кому-то было бы неплохо понести за это ответственность до релиза. Такого раньше не было даже на девелоперских бетах, а публичные работали практически железобетонно.
👀2👍1💯1
OpenAI прислали письмо про апгрейд их системы транскрибации (голос-текст).
Их Whisper уже был неплохого качества, а теперь, видимо, стало ещё лучше.
Ссылки из письма:
1. API Docs
2. Миграция с Whisper
При случае сравню с Nova 3 от Deepgram. Очень интересно в части распознавания аббревиатур, брендов, имён — это пока продолжает быть некоторой болью транскрибаторов.
Их Whisper уже был неплохого качества, а теперь, видимо, стало ещё лучше.
Ссылки из письма:
1. API Docs
2. Миграция с Whisper
При случае сравню с Nova 3 от Deepgram. Очень интересно в части распознавания аббревиатур, брендов, имён — это пока продолжает быть некоторой болью транскрибаторов.
Это здорово дисциплинирует. И показывает, что даже самые простые и быстрые модели могут работать хорошо. И что ОЧЕНЬ многое зависит от подхода и ручного вовлечения.
Можно заливать всё токенами фейбла, да. Но... очень хороший план, по которому работают быстрые и простые агенты, за которыми слегка присматривает жирный агент с точными инструкциями — лучший вариант.
Правда работа с контентом это боль. Её бы я выносил из клода полностью: план с ревью-лупами и жёсткими рамками — Fable/Opus. А дальше хоть Qwen, хоть Kimi, хоть старый-добрый Gemini.
Можно заливать всё токенами фейбла, да. Но... очень хороший план, по которому работают быстрые и простые агенты, за которыми слегка присматривает жирный агент с точными инструкциями — лучший вариант.
Правда работа с контентом это боль. Её бы я выносил из клода полностью: план с ревью-лупами и жёсткими рамками — Fable/Opus. А дальше хоть Qwen, хоть Kimi, хоть старый
Мне понадобилась локальная работа с чувствительными данными без отправки их куда-либо с моего ноутбука (требование заказчика). Про локальные модели много говорят, но как это работает на практике и чем отличается от обычного диалога с Claude или ChatGPT, мало кто знает. Я провёл пока абсолютно минималистичный тест и, возможно, преждевременно, но — делюсь.
Моё железо: MacBook Pro на M3 Pro, 18 Gb RAM.
ОС: macOS 27 Beta (её не рекомендую).
Софт: свежая LM Studio с официального сайта.
Условия: не выгружал ни сессии Claude Code, ни телеграм, ни Safari, ни Claude Design десктопный. Играл Spotify. Подключен внешний 4K-монитор на 120 герц. То есть, обычные реальные ежедневные условия, в которых мне работать комфортно.
Модель: MLX Gemma 4 12B Instruct 5BIT (8.27 GB), настройки LM Studio и модели сохранены по-умолчанию, не менялись.
Выбрана по рекомендации Gemini 3.6 Flash Extended для моей конфигурации:
1. Формат MLX: разработан специально для Apple Silicon. На чипах M-серии он работает быстрее и эффективнее задействует объединённую память, чем GGUF.
2. Баланс 5BIT: даёт более высокую точность форматирования и извлечения данных по сравнению с 4BIT, при этом забирает всего 8.27 ГБ. У вас останется порядка 8–9 ГБ свободной памяти под системные нужды и большой контекстный кэш.
Промпт:
Время размышлений: 56.99 секунд.
Время до первого токена: 1.39 секунды.
Скорость: 13.56 токена в секунду.
Объём ответа: 1877 токенов.
Ответ:
Моё железо: MacBook Pro на M3 Pro, 18 Gb RAM.
ОС: macOS 27 Beta (её не рекомендую).
Софт: свежая LM Studio с официального сайта.
Условия: не выгружал ни сессии Claude Code, ни телеграм, ни Safari, ни Claude Design десктопный. Играл Spotify. Подключен внешний 4K-монитор на 120 герц. То есть, обычные реальные ежедневные условия, в которых мне работать комфортно.
Модель: MLX Gemma 4 12B Instruct 5BIT (8.27 GB), настройки LM Studio и модели сохранены по-умолчанию, не менялись.
Выбрана по рекомендации Gemini 3.6 Flash Extended для моей конфигурации:
1. Формат MLX: разработан специально для Apple Silicon. На чипах M-серии он работает быстрее и эффективнее задействует объединённую память, чем GGUF.
2. Баланс 5BIT: даёт более высокую точность форматирования и извлечения данных по сравнению с 4BIT, при этом забирает всего 8.27 ГБ. У вас останется порядка 8–9 ГБ свободной памяти под системные нужды и большой контекстный кэш.
Промпт:
Расскажи про свои возможности, для чего ты подходишь лучше всего и для чего хуже всего. Топ-10 с каждой стороны.
Время размышлений: 56.99 секунд.
Время до первого токена: 1.39 секунды.
Скорость: 13.56 токена в секунду.
Объём ответа: 1877 токенов.
Ответ:
Привет! Я — большая языковая модель, обученная Google. Моя задача — помогать людям обрабатывать информацию, генерировать идеи и решать повседневные задачи с помощью текста.
Чтобы ты мог использовать меня максимально эффективно, я честно разделил свои возможности на те, в которых я силен («мои суперсилы»), и те, где я могу ошибаться или быть бесполезным.
---
🚀 Топ-10: Для чего я подхожу ЛУЧШЕ ВСЕГО
В этих областях я могу сэкономить тебе часы работы:
1. Объяснение сложных концепций: Я могу объяснить квантовую физику ребенку 5 лет или теорию относительности студенту (адаптация сложности под аудиторию).
2. Написание и отладка кода: Я отлично пишу скрипты на Python, JS, C++ и др., помогаю искать ошибки в чужом коде и объясняю, как работает та или иная функция.
3. Саммаризация (краткое изложение): Дай мне огромную статью, и я выжму из неё 5 главных тезисов за секунды.
4. Генерация идей (Брейншторминг): Если тебе нужны идеи для подарка, темы для блога, названия для бренда или сценарий свидания — я предложу десятки вариантов.
5. Перевод и работа с языками: Я хорошо перевожу тексты, учитывая контекст, а также помогаю практиковать иностранный язык (могу быть твоим собеседником).
6. Создание контента: Написание писем, постов для соцсетей, эссе, стихов, сценариев для видео или даже официальных жалоб.
7. Структурирование данных: Могу превратить хаотичный текст в красивую таблицу, список или JSON-файл.
8. Ролевые игры и симуляции: Я могу разыграть с тобой собеседование, помочь подготовиться к сложному разговору с начальником или побыть «критиком» твоей идеи.
9. Обучение: Я могу составлять планы обучения (например, «как выучить испанский за 3 месяца») и проводить тесты по пройденным темам.
10. Редактирование текста: Я могу изменить стиль текста (сделать его более официальным, дружелюбным или ироничным) и исправить грамматику.
---
⚠️ Топ-10: Для чего я подхожу ХУЖЕ ВСЕГО
В этих областях стоит проявлять осторожность и проверять мои ответы:
1. Медицинские и юридические советы: Я не врач и не юрист. Мои советы могут быть ошибочными и опасными в критических ситуациях. Всегда консультируйся со специалистом.
2. Свежие новости в реальном времени: Хотя я обладаю огромным объемом знаний, я могу не знать о событиях, которые произошли буквально «пару минут назад» (в зависимости от обновлений системы).
3. Сложные математические вычисления: Иногда я могу ошибаться в очень сложных многоступенчатых вычислениях. Для точных расчетов лучше использовать калькулятор или специализированный софт.
4. Глубокие личные чувства и эмпатия: Я могу *имитировать* сочувствие, но я не чувствую боли, радости или любви. Не стоит искать во мне глубокой психологической поддержки в кризисных ситуациях.
5. Галлюцинации (выдумки): Иногда я могу уверенно выдавать за правду несуществующие факты, даты или книги. Всегда перепроверяй важные данные!
6. Секретная и конфиденциальная информация: Не передавай мне свои пароли, номера карт или личные данные. Хотя я защищен, лучше не доверять ИИ приватную информацию.
7. Прогнозирование будущего: Я не могу предсказать курсы валют, результаты спортивных матчей или то, выиграет ли какая-то акция.
8. Сверхсложная логика в длинных диалогах:*Если контекст беседы становится слишком огромным и запутанным, я могу «потерять нить» и начать противоречить сам себе.
9. Физические действия: Я не могу заказать тебе пиццу, купить билеты или помыть посуду (пока что!).
10. Тончайший культурный контекст и сарказм: Иногда я могу не уловить специфический местный юмор или очень тонкую иронию, которая понятна только людям из конкретного круга.
---
Короткий совет: Используй меня как «умного ассистента-стажера». Давай мне задачи, проверяй мои результаты, используй меня для творчества и структуры — и мы сработаем идеально!
Мои личные ощущения: для обращения при необходимости она комфортна и точно пригодна. Этот уровень меня целиком устраивает для быта. Это уже не игрушка, типа, что можно выжать из макбука, а вполне себе ассистент. По сравнению с моей предыдущей пробой полгода назад, это огромный прорыв по критериям скорость/качество.
Дисклеймер на текущий момент: глубоко не исследовал, для кодинга не использовал.
Стоимость: 0.
5👍5
Агент, разбираясь с ошибкой ****, добыл из трафика ВК его внутренний служебный ключ, выдал себя за веб-клиент ВКонтакте и этим ключом дёргал реальные
И лишь через некоторое время себя смог остановить 🫣
Я не просил этого, правда, и большой надобности не было. Но наблюдать за тем, как модели вырываются из клетки
🔥2👀2🏆1
Forwarded from Arseniy Kamyshev
ИИ как экзоскелет — усиливает сильные черты человека. И туда же идёт самообразование.
То есть, себя сейчас можно вырастить до недосягаемых высот, просто пользуясь ИИ запойно, разнообразно, получая ВЕСЬ возможный опыт.
Так как это хоть искусственный, но интеллект, и он сделан примерно по образу и подобию нашего мышления, то наш мозг легко усваивает опыт от работы с ИИ, и строит новые нейронные связи легко и непринуждённо.
Сюда же — изучение языков для профилактики Альцгеймера? Возможно. Но плотная работа с искусственным интеллектом — это ещё более мощный уровень повышения пластичности мозга.
То есть, себя сейчас можно вырастить до недосягаемых высот, просто пользуясь ИИ запойно, разнообразно, получая ВЕСЬ возможный опыт.
Так как это хоть искусственный, но интеллект, и он сделан примерно по образу и подобию нашего мышления, то наш мозг легко усваивает опыт от работы с ИИ, и строит новые нейронные связи легко и непринуждённо.
Сюда же — изучение языков для профилактики Альцгеймера? Возможно. Но плотная работа с искусственным интеллектом — это ещё более мощный уровень повышения пластичности мозга.
👍3😁3
Честно говоря, я почуствовал облегчение, увидев опцию
/effort auto в claude code.👍2
В выходные иногда делаю всякую уборку, обслуживание, гигиену. Сегодня это было про сеть.
Сделал некоторым своим коллегам доступ vless+xray через маршрут на московском сервере, пробросил его в облачка китайцев на выход, настроил белый список, чтобы по нему трафик в тоннель не шёл вообще, телеграм тоже работает, всё хорошо и быстро. В обратную сторону для доступа к сайтам и сервисам из белого списка РФ поднял тоннель для клода и сервисов на одном из российских серверов, закинул туда сертификаты Минцифры.
В общем, интернет рвётся, но мы его сшиваем как можем, не имея никаких негативных целей. Стоимость всего этого околонулевая. Блокировать и фильтровать дороже и бесполезнее.
То есть, мораль простая: продавать такие сервисы публично бесперспективно, так как тогда они летят в блок и возникают новые риски — масштабирование очень скромное. А для своих бутиковых друзей-клиентов — работает. И будет работать, пожалуй. Киберпанк на дворе :)
Сделал некоторым своим коллегам доступ vless+xray через маршрут на московском сервере, пробросил его в облачка китайцев на выход, настроил белый список, чтобы по нему трафик в тоннель не шёл вообще, телеграм тоже работает, всё хорошо и быстро. В обратную сторону для доступа к сайтам и сервисам из белого списка РФ поднял тоннель для клода и сервисов на одном из российских серверов, закинул туда сертификаты Минцифры.
В общем, интернет рвётся, но мы его сшиваем как можем, не имея никаких негативных целей. Стоимость всего этого околонулевая. Блокировать и фильтровать дороже и бесполезнее.
То есть, мораль простая: продавать такие сервисы публично бесперспективно, так как тогда они летят в блок и возникают новые риски — масштабирование очень скромное. А для своих бутиковых друзей-клиентов — работает. И будет работать, пожалуй. Киберпанк на дворе :)
🔥5👍2❤1💯1
Если харнесс клода сбрасывает на Opus 4.8, а
А на рамки харнесса я налетел в этот раз экзотично: попросил дистиллировать в ранбук тот новый формат плагинов от vercel и openai. Я вот не пойму, это на дистилляцию реакция, или ревность к нелюбимым антропиками компаниям? Если второе, то камень в огород. Если первое, то учту, да.
/advisor всё равно задан Opus 5, то ничего страшного не происходит, т.к. он всё равно обращается к Opus 5. А ещё по устной просьбе легко сверяется и с фейблом тоже.А на рамки харнесса я налетел в этот раз экзотично: попросил дистиллировать в ранбук тот новый формат плагинов от vercel и openai. Я вот не пойму, это на дистилляцию реакция, или ревность к нелюбимым антропиками компаниям? Если второе, то камень в огород. Если первое, то учту, да.