Боюсь сглазить, но Opus 5 очень хорошо слушается, и он проактивен ровно в том объёме, в котором мне надо. Теперь главное чтобы его не улучшали, и чтобы сбросили лимиты пару раз 👍
Please open Telegram to view this post
VIEW IN TELEGRAM
👍3😁1
Оказывается, мало кто знает о таких вот страницах статуса работы сервисов.
Список по ИИ ниже.
Примерно то же самое обычно есть у многих крупных брендов, где сетевая инфраструктура развесистая и от неё зависит работоспособность клиентов.
Вот OpenAI:
https://status.openai.com/
Вот Anthropic:
https://status.claude.com/
У Gemini немного отличается:
https://aistudio.google.com/status
Grok:
https://status.x.ai/
DeepSeek:
https://status.deepseek.com/
Список по ИИ ниже.
Примерно то же самое обычно есть у многих крупных брендов, где сетевая инфраструктура развесистая и от неё зависит работоспособность клиентов.
Вот OpenAI:
https://status.openai.com/
Вот Anthropic:
https://status.claude.com/
У Gemini немного отличается:
https://aistudio.google.com/status
Grok:
https://status.x.ai/
DeepSeek:
https://status.deepseek.com/
👍2
Fable спрошен об одном: не пересчитать находки Opus, а предсказать, где я ошибусь следующим. Три класса названы поимённо с историей инстансов, и отдельным пунктом — «к чему все семь раундов структурно слепы»: правильна ли вообще архитектура, честен ли раскол на два коммита, не делает ли эта правка следующую правку этого файла опаснее.
Они неплохо работают вместе на циклах ревью.
А кто как справляется с визуальным выравниванием элементов по вертикали по линейкам в вайбкодинге? Фронтэнд.
Понятно когда фигма или pencil (нынче pen.dev), а если без макета, но надо ровненько, и как можно меньше застревать в этом многоитерационном вязком болоте со скринами?
Вечно руками-линейками приходится показывать, и непонятно до конца пока как универсально бы правила дистиллировать. Может, есть какой скилл?
Понятно когда фигма или pencil (нынче pen.dev), а если без макета, но надо ровненько, и как можно меньше застревать в этом многоитерационном вязком болоте со скринами?
Вечно руками-линейками приходится показывать, и непонятно до конца пока как универсально бы правила дистиллировать. Может, есть какой скилл?
Share my brain как идея. Спонтанно пришла в голову мысль, что наверное в какой-то из веток развития современного киберпанка может возникнуть маркетплейс по использованию накопившейся обвязки и опыта каких-то людей, экспертов, профессионалов, и не обязательно. Может, что-то чисто по фану.
Типа, хочешь попробовать поиспользовать Claude Code, как у меня? Я не против, но не хочу отдавать тебе свои скиллы и конфиги. Зато могу продать тебе эту обвязку как прокси между твоими запросами и твоей подпиской. При секьюрности и хорошей репутации это может быть возможно :)
Как vast.ai продаёт доступ к мощностям GPU, только некий сервис продаёт доступ к мощностям чьего-нибудь опыта по работе с ИИ и разными моделями, оцененные с каким-то качественным панельным скорингом. Если демка понравилась, окей, покупаешь. Такой свежий вариант стоков, только не про графику, и слегка в профиль. Исключительно спонтанная перегретая идея, в которой я вижу примерно миллион «почему нет».
Было бы здорово услышать странные идеи и от вас в комментах, вдруг есть чо?
Типа, хочешь попробовать поиспользовать Claude Code, как у меня? Я не против, но не хочу отдавать тебе свои скиллы и конфиги. Зато могу продать тебе эту обвязку как прокси между твоими запросами и твоей подпиской. При секьюрности и хорошей репутации это может быть возможно :)
Как vast.ai продаёт доступ к мощностям GPU, только некий сервис продаёт доступ к мощностям чьего-нибудь опыта по работе с ИИ и разными моделями, оцененные с каким-то качественным панельным скорингом. Если демка понравилась, окей, покупаешь. Такой свежий вариант стоков, только не про графику, и слегка в профиль. Исключительно спонтанная перегретая идея, в которой я вижу примерно миллион «почему нет».
Было бы здорово услышать странные идеи и от вас в комментах, вдруг есть чо?
👍4🔥3❤2
Compacting conversation...
Побольше подробностей: https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-6-flash-3-5-flash-lite-3-5-flash-cyber/ Пока не до конца понимаю кейсы для применения, но маленькие, быстрые, толковые модели всегда нужны. 3.5 Flash…
Gemini 3.6 Flash + Extended Thinking
Для быта очень хорошо, раз уж всё равно есть подписка вместе с Google One. В прошлых моделях в последние месяцы появились галлюцинации и как будто сильно упало качество ответов. Не исключаю, что это разница в восприятии после плотного общения со взрослыми флагманскими моделями.
В общем, 3.6 снова годится для простых вопросов и исследований, как бы вместо поиска. А также для deep research, который делается буквально молниеносно, и при этом без провалов в фактах. Да, нужно учитывать, что там сначала идут бесполезные вводные абзацы и вода, но сбор и представление данных, причём актуальных, тоже делаются очень хорошо, и дополняющие/уточняющие вопросы в дальнейшем диалоге вполне выдерживают контекст и скоуп в целом.
У меня нет ожиданий по Pro-модели, её не зря отложили, но очень-очень быстрая и дешёвая в токенах модель 3.6 Flash точно в своём сегменте лидирует. Sonnet слишком круче и дороже, Haiku слишком слаб. Та же 3.6 Flash Lite не выдерживает даже форматирование текста, типа разбивки абзецев по смыслу. А полный Flash для диалоговых ботов подходит полностью.
С китайцами не сравниваю, опыта пока недостаточно — там целый свой мир. Как мне видится, довольно нестабильный, и пока слишком быстрый. Где-то там прячется FOMO, с которым чтобы ужиться, нужно пока многовато ресурсов. Так что — флагманы.
Для быта очень хорошо, раз уж всё равно есть подписка вместе с Google One. В прошлых моделях в последние месяцы появились галлюцинации и как будто сильно упало качество ответов. Не исключаю, что это разница в восприятии после плотного общения со взрослыми флагманскими моделями.
В общем, 3.6 снова годится для простых вопросов и исследований, как бы вместо поиска. А также для deep research, который делается буквально молниеносно, и при этом без провалов в фактах. Да, нужно учитывать, что там сначала идут бесполезные вводные абзацы и вода, но сбор и представление данных, причём актуальных, тоже делаются очень хорошо, и дополняющие/уточняющие вопросы в дальнейшем диалоге вполне выдерживают контекст и скоуп в целом.
У меня нет ожиданий по Pro-модели, её не зря отложили, но очень-очень быстрая и дешёвая в токенах модель 3.6 Flash точно в своём сегменте лидирует. Sonnet слишком круче и дороже, Haiku слишком слаб. Та же 3.6 Flash Lite не выдерживает даже форматирование текста, типа разбивки абзецев по смыслу. А полный Flash для диалоговых ботов подходит полностью.
С китайцами не сравниваю, опыта пока недостаточно — там целый свой мир. Как мне видится, довольно нестабильный, и пока слишком быстрый. Где-то там прячется FOMO, с которым чтобы ужиться, нужно пока многовато ресурсов. Так что — флагманы.
👍2
Forwarded from Тимур Хахалев про AI Coding
This media is not supported in your browser
VIEW IN TELEGRAM
Как сохранить баланс между сжиганием токенов и и выстраиванием типового воркфлоу с агентами?
На Selectel Dayoff задали такой вопрос. Ответ в видео 😊
А вы как считаете?
Лайк, репост
Please open Telegram to view this post
VIEW IN TELEGRAM
😁1
Gemini Distillation Service ушла в 404, но ручки-то помнят. Отличный сервис, судя по описанию. И чего отпилили 🤷♂️
Было тут:
Home > Documentation > AI and ML > Gemini Enterprise > Agent Platform > Models > Gemini Distillation Service
Best practices
Use the following guidelines when creating your dataset:
Size: A minimum of 1,000 examples is recommended for noticeable quality improvement.
Diversity: Ensure your prompts cover the edge cases and varying lengths expected in your production traffic.
Было тут:
Home > Documentation > AI and ML > Gemini Enterprise > Agent Platform > Models > Gemini Distillation Service
Getting access
If you are interested in experimenting with Gemini Distillation Service, contact our Tuning Service team at cloud-ai-tuning-service-support@google.com to request access and project allowlisting.
To ensure optimal performance and resource management, we recommend creating a dedicated Google Cloud project for your distillation tasks. When reaching out to our team, provide your Project ID or project number to expedite the allowlisting process.
10🔥2👍1
Forwarded from Tips AI | IT & AI
Наткнулся на особенность /model в Claude Code, про которую я если честно не знал и не замечал.
Если менять модель через обычный /model, это влияет сразу на все новые параллельные сессии.
Что и написано при выборе модели, меня не обманывают: saved as your default for new sessions.
Если нужно задать модель только для текущей сессии, при выборе модели в /model подтверждать нужно не клавишей Enter, а буквой [ s ], тогда другие сессии Claude Code это не затронет.
Про выбор моделей при запуске через опцию --model, я знаю, но я не пользуюсь этим.
В Codex иначе. Его /model меняет модель только глобально, в описании команды прямо написано: for this and future Codex CLI sessions. Никакой клавиши, чтобы применить только к текущей сессии, там нет.
Так что в Codex единственный способ изолировать новую сессию с другой моделью — задать её при старте.
@tips_ai
Если менять модель через обычный /model, это влияет сразу на все новые параллельные сессии.
Что и написано при выборе модели, меня не обманывают: saved as your default for new sessions.
Если нужно задать модель только для текущей сессии, при выборе модели в /model подтверждать нужно не клавишей Enter, а буквой [ s ], тогда другие сессии Claude Code это не затронет.
Про выбор моделей при запуске через опцию --model, я знаю, но я не пользуюсь этим.
В Codex иначе. Его /model меняет модель только глобально, в описании команды прямо написано: for this and future Codex CLI sessions. Никакой клавиши, чтобы применить только к текущей сессии, там нет.
Так что в Codex единственный способ изолировать новую сессию с другой моделью — задать её при старте.
@tips_ai
🔥5
Tips AI | IT & AI
Наткнулся на особенность /model в Claude Code, про которую я если честно не знал и не замечал. Если менять модель через обычный /model, это влияет сразу на все новые параллельные сессии. Что и написано при выборе модели, меня не обманывают: saved as your…
А ещё можно просто открыть рот и сказать. Например, попросить использовать фейбл как владельца проекта, опус в менеджменте, а соннет как исполнителя. Можно и с микроменеджментом, если хочется.
Вполне себе работает.
Вполне себе работает.
👍1😢1👀1
Когда детей долго не слышно, значит они, скорее всего, дорисовывают эпическое полотно на телевизоре или поливают цветы в макбуке.
Вот и Антропик...
Тревожно!
Вот и Антропик...
Тревожно!
👀3👍1🔥1
ru-text 2.0 вышел, и главное в нём — контроль нейрослопа
📝 Промпт для копирования:
✍️ Установка для ChatGPT/Codex из каталога ChatGPT: ссылка.
И да. Теперь это скилл. Который работает проще и легче, чем прошлая версия.
Всё бесплатно, лицензия MIT. Хотите поддержать — нажмите на спонсорство на GitHub (а то там по нулям), поставьте звёздочку к репозиторию или прямо к этому посту :)
Установить за вас, интегрировать в ваш пайплайн, развернуть на компанию за оплату на российского ИП УСН, проконсультировать, сделать для вас что-то кастомное на любую тему — тоже можно, напишите в личку.
📝 Промпт для копирования:
установи https://github.com/talkstream/ru-text✍️ Установка для ChatGPT/Codex из каталога ChatGPT: ссылка.
И да. Теперь это скилл. Который работает проще и легче, чем прошлая версия.
В первой версии плагин ловил 9 признаков машинного текста, во второй их 17: объявленная искренность («скажу честно»), обязательная триада, выхолощенность, когда в предложении есть механизм, а на месте действующего звена заполнитель, неопределённая атрибуция вроде «как показывают исследования» без исследования, аддитивная псевдопара «не только X, но и Y», где Y ничего не добавляет к X, и запятая, сомкнутая с тире. По Розенталю такой стык нормативен, но всё равно выдаёт машину: человек перестроил бы фразу раньше, чем упёрся бы в него.
Два признака плагин относит не к фрагменту, а к документу целиком: текст, оставшийся стенограммой диалога с нейросетью, и текст, который писали под поисковый запрос. Такие правкой на месте не лечатся, поэтому документ с ними не получит ярлыков «Эталонный» и «Хороший» ни при каком балле. Плюс грамматика, которой корпусу не хватало: управление закрытым списком, деепричастие с чужим субъектом, контекстные омофоны. Корпус вырос с 1 825 атомов до 2 281.
Второе изменение не видно в списке правил, но чувствуется в работе. Раньше полную вычитку нельзя было доверить агенту: она читала 28 000 слов справочников, и запускать её на каждый абзац было разорительно. Теперь у неё две глубины. Если вы просите вычитку словами, плагин читает весь корпус. Агент проверяет себя сам — идёт быстрый проход по индексу признаков и каталогу стоп-слов, около 1 300 слов, и он разворачивается в полную вычитку, если увидел след машинного текста, набрал пять замечаний или текст идёт к читателю. Быстрый проход не судит признаки: у каждого есть оговорка, где приём законен, а оговорки живут только в полном справочнике.
Заодно версия 2.0 обросла тем, чего у первой не было вовсе: 22 эталонных текста с заранее выписанными находками, 8 автопроверок сборки и 93 случая для самих автопроверок. Одни подсовывают проверке испорченный контент и требуют, чтобы она упала, другие следят, чтобы на честном тексте она молчала.
Всё бесплатно, лицензия MIT. Хотите поддержать — нажмите на спонсорство на GitHub (а то там по нулям), поставьте звёздочку к репозиторию или прямо к этому посту :)
Установить за вас, интегрировать в ваш пайплайн, развернуть на компанию за оплату на российского ИП УСН, проконсультировать, сделать для вас что-то кастомное на любую тему — тоже можно, напишите в личку.
6🔥8❤2👍1💯1
macOS 27 — худшая бета из всех макосей, что я когда-либо пробовал, а пробовал я их все за последние сколько-то много лет. Прямо худшее проявление этого вот термина «навайбкодили» — тормозит всё, что может тормозить, и на ровном месте. Получить полную загрузку системы, зависящую от ЗНАЧКОВ в статус-баре — легко. Забить память нелепыми циклами совершенно базовых нативных системных вещей — ещё легче. Это просто жесть, господа и дамы. Тот случай, когда раньше было лучше, и очень хочется вернуться в прошлое и чуточку потерпеть эту их боль для глаз с кривым позиционированием уголков в интерфейсах. Повёлся на дизайн, ога.
Я репорчу, мои тикеты как надо тикеты. Какой-то Apple Arcade, который у меня вообще был всяко выключен, лагал сначала, потом по мере апдейтов всё стало гораздо хуже.
Сейчас тоже что-то свистит-пердит-мигает. Клод расследует каэш, но сдаётся мне, что кому-то было бы неплохо понести за это ответственность до релиза. Такого раньше не было даже на девелоперских бетах, а публичные работали практически железобетонно.
Я репорчу, мои тикеты как надо тикеты. Какой-то Apple Arcade, который у меня вообще был всяко выключен, лагал сначала, потом по мере апдейтов всё стало гораздо хуже.
Сейчас тоже что-то свистит-пердит-мигает. Клод расследует каэш, но сдаётся мне, что кому-то было бы неплохо понести за это ответственность до релиза. Такого раньше не было даже на девелоперских бетах, а публичные работали практически железобетонно.
👀2👍1💯1
OpenAI прислали письмо про апгрейд их системы транскрибации (голос-текст).
Их Whisper уже был неплохого качества, а теперь, видимо, стало ещё лучше.
Ссылки из письма:
1. API Docs
2. Миграция с Whisper
При случае сравню с Nova 3 от Deepgram. Очень интересно в части распознавания аббревиатур, брендов, имён — это пока продолжает быть некоторой болью транскрибаторов.
Их Whisper уже был неплохого качества, а теперь, видимо, стало ещё лучше.
Ссылки из письма:
1. API Docs
2. Миграция с Whisper
При случае сравню с Nova 3 от Deepgram. Очень интересно в части распознавания аббревиатур, брендов, имён — это пока продолжает быть некоторой болью транскрибаторов.
Это здорово дисциплинирует. И показывает, что даже самые простые и быстрые модели могут работать хорошо. И что ОЧЕНЬ многое зависит от подхода и ручного вовлечения.
Можно заливать всё токенами фейбла, да. Но... очень хороший план, по которому работают быстрые и простые агенты, за которыми слегка присматривает жирный агент с точными инструкциями — лучший вариант.
Правда работа с контентом это боль. Её бы я выносил из клода полностью: план с ревью-лупами и жёсткими рамками — Fable/Opus. А дальше хоть Qwen, хоть Kimi, хоть старый-добрый Gemini.
Можно заливать всё токенами фейбла, да. Но... очень хороший план, по которому работают быстрые и простые агенты, за которыми слегка присматривает жирный агент с точными инструкциями — лучший вариант.
Правда работа с контентом это боль. Её бы я выносил из клода полностью: план с ревью-лупами и жёсткими рамками — Fable/Opus. А дальше хоть Qwen, хоть Kimi, хоть старый