Compacting conversation...
133 subscribers
345 photos
17 videos
5 files
207 links
Станьте первым спонсором, от $1: https://github.com/sponsors/talkstream

Для связи: @nafigator
Download Telegram
Только что вышли модели Gemini 3.8 Live и 3.5 Transcribe.

При этом качество ещё первой Live-модели на моём раге для писателя — оно всё ещё сохраняется высоким.

Мне прямо интересно, как, до какого уровня шагнул гугл с новыми моделями. И вперёд ли. А то всякое бывает :)

https://blog.google/innovation-and-ai/technology/developers-tools/build-real-time-voice-applications-gemini-audio/

Также заанонсили Gemini 3.8 Live Extended Thinking, которая какая-то совсем лютая. Но практику применения пока что не понял.
👍2
Japistani 😭

Ради одного только этого стоит смотреть второй сезон «Джентельменов» 👍

Не говоря уже про всё остальное.
О. TypeSafe доступы начали раздавать. Вы уже попробовали? Как впечатления?
Вот этот кусок в дисциплинах помогает получать вёрстку поровнее, а не «опять ты нифига не отсмотрел перед показом / нет-нет, я отсмотрел! / значит, плохо отсмотрел!» в диалогах с ИИ-агентом:

## Вертикаль меряется по глифам, а не по боксам

**Закон.** Бокс строки — это не буквы: он несёт полупросвет `(line-height − font-size) / 2`
сверху и снизу плюс запас под выносные элементы внутри кегля. Поэтому выравнивание и просветы,
проверенные только по `getBoundingClientRect` / `getComputedStyle`, дают зелёный замер на
визуально кривой вёрстке.

**Делай так:**

- Пара «крупный элемент + мелкая подпись» (цифра и регалия, иконка и заголовок, логотип и
слоган) выравнивается при обрезанных боксах: `text-box: trim-both cap alphabetic` на обоих
элементах. Где свойство не поддерживается — компенсация считается из метрик шрифта
(`ctx.measureText().actualBoundingBoxAscent/Descent`), а не подбирается на глаз.
- Просветы между блоками считаются оптически: к зазору между боксами прибавляются полупросветы
строк с обеих сторон. Равные `margin` ≠ равные просветы.
- Контрольный замер печатает **обе** величины — по боксам и по глифам. Расхождение больше 2 px —
правка, а не округление.
- Перед показом человеку: кадр 1:1 и прямой вопрос кадру «что стоит неровно по вертикали».

**Проверкой не считается:** «середины боксов совпали» без глифов; «отступы одинаковые» без
полупросветов; линза по координатам вместо растра.

**Арбитр — глаз человека.** Видит перекос при зелёном замере — неверен замер: найди величину,
которую он не мерил, и добавь её в проверку. Проверка, печатающая «чисто» на кривом кадре, —
имитация проверки.


Вдруг надо 🤷‍♂️
3
типичный AGENTS.md
💯4😁3
Каждый раз, когда приходится переключиться на $100-тариф, я даю обратную связь.

Антропики, блин. Понятно, что всё к тому идёт, к удорожанию результата, но всему же есть предел. Только вот модели их понимают смысл этого выражения про предел слишком буквально.
Токенов стало не хвататать очень сильно. Как бы ни ужимался, как бы ни экономил. А ведь это только начало тенденции к удорожанию результата...

Кто на Астре, там тоже так теперь, да?
💯1
Кстати, довольно незаметно прошла новинка в Claude Code:
Usage limit reached · continuing automatically at 12am · esc to cancel
/low-priority to continue now at lower priority · uses your weekly limit


Во-первых, если утыкаешься в лимит, то он продолжает потом работу самостоятельно.
Во-вторых, можно продолжать, подъедая недельный лимит, и медленно.

Смотрю на это как на признание проблемы с чрезмерной эффективностью лимитов. Просто совсем контакт с реальностью потеряли.
👍2
Forwarded from Мемофора
5😁4
Если вы любите работать на ultracode, который запускает развесистые панели, то вы могли заметить, что это происходит нестабильно, а в последнее время ещё и с диким оверкиллом в отдельных случаях. Раньше было лучше!

Вручную всё контролировать в долгих сессиях довольно тяжело, но лишаться панелей, где они абсолютно уместны для исследований и повышения качества результата — тоже как-то не комильфо.

Такая вот инструкция для CLAUDE.md (проектного или глобального) помогает снизить уровень оверкилла панелями. Иногда существенно:
## Соразмерность машинерии

**Когда:** перед `Workflow` или веером субагентов.

- Ревью обязательно при любом размере задачи. Цена ошибки меняет объём проверки; строгость одна.
- Веер обязателен для плана, недоверенного входа, нового слоя состояния, артефакта для клиента, риска потери данных, правки этого файла. В остальном — только с ответом: что он поймает из того, чего не покажет команда в терминале? Ответ — в промпт веера. Без ответа — команда-доказательство, один проход ревью, отчёт в пять строк.
- Объём проверки не задают уровень усилия, лимиты и остаток контекста. `ultracode` разворачивает `Workflow` под каждую существенную задачу — это не ответ на вопрос.


На английском сами там изобразите, только просите проверить с fable 5.1 max effort, скормив ему также и чейнджлог. В моём варианте выше всё это уже сделано, и результат — вот такой. Довольно компактный. Головняка и перерасхода снимает мама не горюй.

Stay tuned, кстати. Голод рождает гениальные решения в экономии без потери эффективности, а то и с её повышением. Участвую в довольно эпичном, причём совершенно легальным в плане ToS Anthropic эксперименте, который сам себе и придумал. А то лимиты, ишь.
👍3
Compacting conversation...
Если вы любите работать на ultracode, который запускает развесистые панели, то вы могли заметить, что это происходит нестабильно, а в последнее время ещё и с диким оверкиллом в отдельных случаях. Раньше было лучше! Вручную всё контролировать в долгих сессиях…
Идея настолько же гениальная, насколько и примитивная, даже тупая: использовать подход TypeSafe для... аудита->прокси по анализу своих сессий? Или даже для полудинамического CLAUDE.md?

Направление мысли примерно такое.

Потенциал экономии токенов высокий — на мой взгляд, точно выше единицы. Что открывает перспективы.

Я в лимитах весь до завтра. Можете попробовать поисследовать сами, если TypeSafe вам доступ уже открыли.
Вчера и сегодня снова наблюдаю странную выдачу в консоли у Claude Code CLI, план пишется крайне плотно, так было перед выходом Opus 5.

Видимо Opus 5.2 не за горами, я бы ждал его в понедельник-вторник. Сбросов лимитов, наверное, не будет. Ванга в чате, да.

Haiku 5 тоже вероятен, так как поддавливает и Luna с высоким эффортом, и Gemini Flash внезапно начал убедительно набирать обороты. Я понимаю, что сравнивать следует с Flash Lite, но кто их разберёт.

Fable 5.2 вероятен тоже, просто работа над ошибками, коррекция, и более стабильная связка с проработанным Opus. Да может и Sonnet с Haiku тоже заявятся сразу как 5.2, а совместный релиз ознаменуется ещё и апдейтами клиентов, и будет нацелен скорее на связность и системность работы всего семейства, а то полуручной роутинг сейчас — боль и угадайка.

Прогноз основывается на ожиданиях и интуиции. Это было бы здорово прям. А как будет в реальности... Возможно, вялотекуще, как обычно.

Ещё маленький шанс Mythos в паблик есть, но совсем маленький, это явление если и встанет в какой-то тайминг (сомневаюсь), то скорее ближе к непосредственно IPO.
👍1
Forwarded from НИИ ИИ
Anthropic добавляет поддержку AGENTS.md в Claude Code.

Начиная с сегодняшнего дня в версии 2.1.277, если в папке нет CLAUDE.md, Claude будет проверять наличие и использовать AGENTS.md.

Вы можете включить или выключить это поведение в /config.

pimenov.ai
👍5
Compacting conversation...
Идея настолько же гениальная, насколько и примитивная, даже тупая: использовать подход TypeSafe для... аудита->прокси по анализу своих сессий? Или даже для полудинамического CLAUDE.md? Направление мысли примерно такое. Потенциал экономии токенов высокий…
TypeSafe и Jev. Мой первый же запрос к этому продукту — возможность локального использования, а не подключение очередного API. Алгоритм не выглядит самым сложным, судя по комментариям в интернете, так что хайп рискует перетечь в «форки» быстро.

А продакты молодцы, запустили хорошо :)
👍1
Compacting conversation...
TypeSafe и Jev. Мой первый же запрос к этому продукту — возможность локального использования, а не подключение очередного API. Алгоритм не выглядит самым сложным, судя по комментариям в интернете, так что хайп рискует перетечь в «форки» быстро. А продакты…
Интересно даже в процессе подготовки к работе почитать всякое, это Opus чекает всё и учится работать с Jev:

Разведка закрыта, план написан, идёт гейт-ревью. Коротко о том, что уже установлено фактом (каждое число снято командой в этой сессии):

Ключ рабочий — GET /v1/models вернул HTTP=200, аккаунт видит jev-latest и jev-preview; живой POST /v1/systemone ответил моделью jev-1.13.0.

Экономика Jev: $0,042 за миллион входных токенов, выход бесплатен. Моя живая проба — три вопроса, 402 входных токена — стоила $0,0000169. Батчинг вопросов в один запрос по кукбуку вендора даёт 12,2× по деньгам и 10,0× по времени на документе в 54 тысячи знаков.

Скорость: тёплое соединение из Бангкока — 0,30 с; из них 0,236 с — сетевой RTT, то есть счёт самой модели около 60 мс. Вендорские «150 мс» — их цифра, к ней из Таиланда прибавляется четверть секунды.

Каналы нашлись все три, и MCP есть: https://docs.typesafe.ai/mcp отвечает без авторизации и даёт поиск плюс read-only rg по виртуальной файловой системе доков; фид — llms.txt (109 страниц, 18 кукбуков) и llms-full.txt на 874 КБ; Context7 уже индексирован. Плюс плагин typesafe@typesafe-ai для CLI.

Русский — главный открытый вопрос, и первый сигнал тревожный в интересную сторону. На одном и том же русском обращении русские формулировки вопросов дали уверенность 0,75, а английские вопросы по тому же русскому тексту — 0,94. Одна точка выводом не является, но гипотеза «английские инструкции по русскому состоянию» ушла в план отдельным шагом: если подтвердится на корпусе, это меняет способ писать вопросы для всех русских задач.