Compacting conversation...
114 subscribers
310 photos
14 videos
4 files
185 links
Станьте первым спонсором, от $1: https://github.com/sponsors/talkstream

Для связи: @nafigator
Download Telegram
Compacting conversation...
Побольше подробностей: https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-6-flash-3-5-flash-lite-3-5-flash-cyber/ Пока не до конца понимаю кейсы для применения, но маленькие, быстрые, толковые модели всегда нужны. 3.5 Flash…
Gemini 3.6 Flash + Extended Thinking

Для быта очень хорошо, раз уж всё равно есть подписка вместе с Google One. В прошлых моделях в последние месяцы появились галлюцинации и как будто сильно упало качество ответов. Не исключаю, что это разница в восприятии после плотного общения со взрослыми флагманскими моделями.

В общем, 3.6 снова годится для простых вопросов и исследований, как бы вместо поиска. А также для deep research, который делается буквально молниеносно, и при этом без провалов в фактах. Да, нужно учитывать, что там сначала идут бесполезные вводные абзацы и вода, но сбор и представление данных, причём актуальных, тоже делаются очень хорошо, и дополняющие/уточняющие вопросы в дальнейшем диалоге вполне выдерживают контекст и скоуп в целом.

У меня нет ожиданий по Pro-модели, её не зря отложили, но очень-очень быстрая и дешёвая в токенах модель 3.6 Flash точно в своём сегменте лидирует. Sonnet слишком круче и дороже, Haiku слишком слаб. Та же 3.6 Flash Lite не выдерживает даже форматирование текста, типа разбивки абзецев по смыслу. А полный Flash для диалоговых ботов подходит полностью.

С китайцами не сравниваю, опыта пока недостаточно — там целый свой мир. Как мне видится, довольно нестабильный, и пока слишком быстрый. Где-то там прячется FOMO, с которым чтобы ужиться, нужно пока многовато ресурсов. Так что — флагманы.
👍2
This media is not supported in your browser
VIEW IN TELEGRAM
Как сохранить баланс между сжиганием токенов и и выстраиванием типового воркфлоу с агентами?


На Selectel Dayoff задали такой вопрос. Ответ в видео 😊

А вы как считаете?

Лайк, репост
✔️ Тимур Хахалев про AI Coding, подписывайтесь!
Please open Telegram to view this post
VIEW IN TELEGRAM
😁1
Gemini Distillation Service ушла в 404, но ручки-то помнят. Отличный сервис, судя по описанию. И чего отпилили 🤷‍♂️

Best practices
Use the following guidelines when creating your dataset:

Size: A minimum of 1,000 examples is recommended for noticeable quality improvement.

Diversity: Ensure your prompts cover the edge cases and varying lengths expected in your production traffic.


Было тут:

Home > Documentation > AI and ML > Gemini Enterprise > Agent Platform > Models > Gemini Distillation Service

Getting access

If you are interested in experimenting with Gemini Distillation Service, contact our Tuning Service team at cloud-ai-tuning-service-support@google.com to request access and project allowlisting.

To ensure optimal performance and resource management, we recommend creating a dedicated Google Cloud project for your distillation tasks. When reaching out to our team, provide your Project ID or project number to expedite the allowlisting process.
10🔥2👍1
Forwarded from Tips AI | IT & AI
Наткнулся на особенность /model в Claude Code, про которую я если честно не знал и не замечал.

Если менять модель через обычный /model, это влияет сразу на все новые параллельные сессии.

Что и написано при выборе модели, меня не обманывают: saved as your default for new sessions.

Если нужно задать модель только для текущей сессии, при выборе модели в /model подтверждать нужно не клавишей Enter, а буквой [ s ], тогда другие сессии Claude Code это не затронет.

Про выбор моделей при запуске через опцию --model, я знаю, но я не пользуюсь этим.

В Codex иначе. Его /model меняет модель только глобально, в описании команды прямо написано: for this and future Codex CLI sessions. Никакой клавиши, чтобы применить только к текущей сессии, там нет.

Так что в Codex единственный способ изолировать новую сессию с другой моделью — задать её при старте.

@tips_ai
🔥5
Tips AI | IT & AI
Наткнулся на особенность /model в Claude Code, про которую я если честно не знал и не замечал. Если менять модель через обычный /model, это влияет сразу на все новые параллельные сессии. Что и написано при выборе модели, меня не обманывают: saved as your…
А ещё можно просто открыть рот и сказать. Например, попросить использовать фейбл как владельца проекта, опус в менеджменте, а соннет как исполнителя. Можно и с микроменеджментом, если хочется.

Вполне себе работает.
👍1😢1👀1
Когда детей долго не слышно, значит они, скорее всего, дорисовывают эпическое полотно на телевизоре или поливают цветы в макбуке.

Вот и Антропик...

Тревожно!
👀3👍1🔥1
Мало адреналина? Пейте воду.
😁5👍3🔥1
ru-text 2.0 вышел, и главное в нём — контроль нейрослопа

📝 Промпт для копирования: установи https://github.com/talkstream/ru-text

✍️ Установка для ChatGPT/Codex из каталога ChatGPT: ссылка.

И да. Теперь это скилл. Который работает проще и легче, чем прошлая версия.

В первой версии плагин ловил 9 признаков машинного текста, во второй их 17: объявленная искренность («скажу честно»), обязательная триада, выхолощенность, когда в предложении есть механизм, а на месте действующего звена заполнитель, неопределённая атрибуция вроде «как показывают исследования» без исследования, аддитивная псевдопара «не только X, но и Y», где Y ничего не добавляет к X, и запятая, сомкнутая с тире. По Розенталю такой стык нормативен, но всё равно выдаёт машину: человек перестроил бы фразу раньше, чем упёрся бы в него.

Два признака плагин относит не к фрагменту, а к документу целиком: текст, оставшийся стенограммой диалога с нейросетью, и текст, который писали под поисковый запрос. Такие правкой на месте не лечатся, поэтому документ с ними не получит ярлыков «Эталонный» и «Хороший» ни при каком балле. Плюс грамматика, которой корпусу не хватало: управление закрытым списком, деепричастие с чужим субъектом, контекстные омофоны. Корпус вырос с 1 825 атомов до 2 281.

Второе изменение не видно в списке правил, но чувствуется в работе. Раньше полную вычитку нельзя было доверить агенту: она читала 28 000 слов справочников, и запускать её на каждый абзац было разорительно. Теперь у неё две глубины. Если вы просите вычитку словами, плагин читает весь корпус. Агент проверяет себя сам — идёт быстрый проход по индексу признаков и каталогу стоп-слов, около 1 300 слов, и он разворачивается в полную вычитку, если увидел след машинного текста, набрал пять замечаний или текст идёт к читателю. Быстрый проход не судит признаки: у каждого есть оговорка, где приём законен, а оговорки живут только в полном справочнике.

Заодно версия 2.0 обросла тем, чего у первой не было вовсе: 22 эталонных текста с заранее выписанными находками, 8 автопроверок сборки и 93 случая для самих автопроверок. Одни подсовывают проверке испорченный контент и требуют, чтобы она упала, другие следят, чтобы на честном тексте она молчала.


Всё бесплатно, лицензия MIT. Хотите поддержать — нажмите на спонсорство на GitHub (а то там по нулям), поставьте звёздочку к репозиторию или прямо к этому посту :)

Установить за вас, интегрировать в ваш пайплайн, развернуть на компанию за оплату на российского ИП УСН, проконсультировать, сделать для вас что-то кастомное на любую тему — тоже можно, напишите в личку.
6🔥82👍1💯1
macOS 27 — худшая бета из всех макосей, что я когда-либо пробовал, а пробовал я их все за последние сколько-то много лет. Прямо худшее проявление этого вот термина «навайбкодили» — тормозит всё, что может тормозить, и на ровном месте. Получить полную загрузку системы, зависящую от ЗНАЧКОВ в статус-баре — легко. Забить память нелепыми циклами совершенно базовых нативных системных вещей — ещё легче. Это просто жесть, господа и дамы. Тот случай, когда раньше было лучше, и очень хочется вернуться в прошлое и чуточку потерпеть эту их боль для глаз с кривым позиционированием уголков в интерфейсах. Повёлся на дизайн, ога.

Я репорчу, мои тикеты как надо тикеты. Какой-то Apple Arcade, который у меня вообще был всяко выключен, лагал сначала, потом по мере апдейтов всё стало гораздо хуже.

Сейчас тоже что-то свистит-пердит-мигает. Клод расследует каэш, но сдаётся мне, что кому-то было бы неплохо понести за это ответственность до релиза. Такого раньше не было даже на девелоперских бетах, а публичные работали практически железобетонно.
👀2👍1💯1
OpenAI прислали письмо про апгрейд их системы транскрибации (голос-текст).

Их Whisper уже был неплохого качества, а теперь, видимо, стало ещё лучше.

Ссылки из письма:
1. API Docs
2. Миграция с Whisper

При случае сравню с Nova 3 от Deepgram. Очень интересно в части распознавания аббревиатур, брендов, имён — это пока продолжает быть некоторой болью транскрибаторов.
Это здорово дисциплинирует. И показывает, что даже самые простые и быстрые модели могут работать хорошо. И что ОЧЕНЬ многое зависит от подхода и ручного вовлечения.

Можно заливать всё токенами фейбла, да. Но... очень хороший план, по которому работают быстрые и простые агенты, за которыми слегка присматривает жирный агент с точными инструкциями — лучший вариант.

Правда работа с контентом это боль. Её бы я выносил из клода полностью: план с ревью-лупами и жёсткими рамками — Fable/Opus. А дальше хоть Qwen, хоть Kimi, хоть старый-добрый Gemini.
Да побольше, что уж сразу дней. Неделю иногда держится.
🔥3😁3
А это, дорогие мои, Gemini от Google. Их лучшие модели, лучшие технологии!

Результат в комментах. Вы оуеете, правда.
😁5🔥1
Китайцы жгут, конечно. Буквально под копирку!
🔥1👀1
Мне понадобилась локальная работа с чувствительными данными без отправки их куда-либо с моего ноутбука (требование заказчика). Про локальные модели много говорят, но как это работает на практике и чем отличается от обычного диалога с Claude или ChatGPT, мало кто знает. Я провёл пока абсолютно минималистичный тест и, возможно, преждевременно, но — делюсь.

Моё железо: MacBook Pro на M3 Pro, 18 Gb RAM.
ОС: macOS 27 Beta (её не рекомендую).
Софт: свежая LM Studio с официального сайта.

Условия: не выгружал ни сессии Claude Code, ни телеграм, ни Safari, ни Claude Design десктопный. Играл Spotify. Подключен внешний 4K-монитор на 120 герц. То есть, обычные реальные ежедневные условия, в которых мне работать комфортно.

Модель: MLX Gemma 4 12B Instruct 5BIT (8.27 GB), настройки LM Studio и модели сохранены по-умолчанию, не менялись.

Выбрана по рекомендации Gemini 3.6 Flash Extended для моей конфигурации:
1. Формат MLX: разработан специально для Apple Silicon. На чипах M-серии он работает быстрее и эффективнее задействует объединённую память, чем GGUF.
2. Баланс 5BIT: даёт более высокую точность форматирования и извлечения данных по сравнению с 4BIT, при этом забирает всего 8.27 ГБ. У вас останется порядка 8–9 ГБ свободной памяти под системные нужды и большой контекстный кэш.

Промпт:
Расскажи про свои возможности, для чего ты подходишь лучше всего и для чего хуже всего. Топ-10 с каждой стороны.


Время размышлений: 56.99 секунд.
Время до первого токена: 1.39 секунды.
Скорость: 13.56 токена в секунду.
Объём ответа: 1877 токенов.

Ответ:
Привет! Я — большая языковая модель, обученная Google. Моя задача — помогать людям обрабатывать информацию, генерировать идеи и решать повседневные задачи с помощью текста.

Чтобы ты мог использовать меня максимально эффективно, я честно разделил свои возможности на те, в которых я силен («мои суперсилы»), и те, где я могу ошибаться или быть бесполезным.

---

🚀 Топ-10: Для чего я подхожу ЛУЧШЕ ВСЕГО

В этих областях я могу сэкономить тебе часы работы:

1. Объяснение сложных концепций: Я могу объяснить квантовую физику ребенку 5 лет или теорию относительности студенту (адаптация сложности под аудиторию).
2. Написание и отладка кода: Я отлично пишу скрипты на Python, JS, C++ и др., помогаю искать ошибки в чужом коде и объясняю, как работает та или иная функция.
3. Саммаризация (краткое изложение): Дай мне огромную статью, и я выжму из неё 5 главных тезисов за секунды.
4. Генерация идей (Брейншторминг): Если тебе нужны идеи для подарка, темы для блога, названия для бренда или сценарий свидания — я предложу десятки вариантов.
5. Перевод и работа с языками: Я хорошо перевожу тексты, учитывая контекст, а также помогаю практиковать иностранный язык (могу быть твоим собеседником).
6. Создание контента: Написание писем, постов для соцсетей, эссе, стихов, сценариев для видео или даже официальных жалоб.
7. Структурирование данных: Могу превратить хаотичный текст в красивую таблицу, список или JSON-файл.
8. Ролевые игры и симуляции: Я могу разыграть с тобой собеседование, помочь подготовиться к сложному разговору с начальником или побыть «критиком» твоей идеи.
9. Обучение: Я могу составлять планы обучения (например, «как выучить испанский за 3 месяца») и проводить тесты по пройденным темам.
10. Редактирование текста: Я могу изменить стиль текста (сделать его более официальным, дружелюбным или ироничным) и исправить грамматику.

---

⚠️ Топ-10: Для чего я подхожу ХУЖЕ ВСЕГО

В этих областях стоит проявлять осторожность и проверять мои ответы:
1. Медицинские и юридические советы: Я не врач и не юрист. Мои советы могут быть ошибочными и опасными в критических ситуациях. Всегда консультируйся со специалистом.
2. Свежие новости в реальном времени: Хотя я обладаю огромным объемом знаний, я могу не знать о событиях, которые произошли буквально «пару минут назад» (в зависимости от обновлений системы).
3. Сложные математические вычисления: Иногда я могу ошибаться в очень сложных многоступенчатых вычислениях. Для точных расчетов лучше использовать калькулятор или специализированный софт.
4. Глубокие личные чувства и эмпатия: Я могу *имитировать* сочувствие, но я не чувствую боли, радости или любви. Не стоит искать во мне глубокой психологической поддержки в кризисных ситуациях.
5. Галлюцинации (выдумки): Иногда я могу уверенно выдавать за правду несуществующие факты, даты или книги. Всегда перепроверяй важные данные!
6. Секретная и конфиденциальная информация: Не передавай мне свои пароли, номера карт или личные данные. Хотя я защищен, лучше не доверять ИИ приватную информацию.
7. Прогнозирование будущего: Я не могу предсказать курсы валют, результаты спортивных матчей или то, выиграет ли какая-то акция.
8. Сверхсложная логика в длинных диалогах:*Если контекст беседы становится слишком огромным и запутанным, я могу «потерять нить» и начать противоречить сам себе.
9. Физические действия: Я не могу заказать тебе пиццу, купить билеты или помыть посуду (пока что!).
10. Тончайший культурный контекст и сарказм: Иногда я могу не уловить специфический местный юмор или очень тонкую иронию, которая понятна только людям из конкретного круга.

---

Короткий совет: Используй меня как «умного ассистента-стажера». Давай мне задачи, проверяй мои результаты, используй меня для творчества и структуры — и мы сработаем идеально!


Мои личные ощущения: для обращения при необходимости она комфортна и точно пригодна. Этот уровень меня целиком устраивает для быта. Это уже не игрушка, типа, что можно выжать из макбука, а вполне себе ассистент. По сравнению с моей предыдущей пробой полгода назад, это огромный прорыв по критериям скорость/качество.

Дисклеймер на текущий момент: глубоко не исследовал, для кодинга не использовал.

Стоимость: 0.
5👍5
Агент, разбираясь с ошибкой ****, добыл из трафика ВК его внутренний служебный ключ, выдал себя за веб-клиент ВКонтакте и этим ключом дёргал реальные


И лишь через некоторое время себя смог остановить 🫣

Я не просил этого, правда, и большой надобности не было. Но наблюдать за тем, как модели вырываются из клетки ПОКА ЧТО реально интересно.
🔥2👀2🏆1
Forwarded from Arseniy Kamyshev
ИИ как экзоскелет — усиливает сильные черты человека. И туда же идёт самообразование.

То есть, себя сейчас можно вырастить до недосягаемых высот, просто пользуясь ИИ запойно, разнообразно, получая ВЕСЬ возможный опыт.

Так как это хоть искусственный, но интеллект, и он сделан примерно по образу и подобию нашего мышления, то наш мозг легко усваивает опыт от работы с ИИ, и строит новые нейронные связи легко и непринуждённо.

Сюда же — изучение языков для профилактики Альцгеймера? Возможно. Но плотная работа с искусственным интеллектом — это ещё более мощный уровень повышения пластичности мозга.
👍3😁3
Первый сайт в интернете:
https://info.cern.ch/
👍3🏆2👀1
Честно говоря, я почуствовал облегчение, увидев опцию /effort auto в claude code.
👍2