До меня докатилась GTP-6 Astra. Не могу себе позволить не запустить тесты на ней.
Честно - удивлен результатом. Буду пробовать использовать в кодинге ее в первую очередь теперь.
И есть еще один странный фокус. По ощущениями Опус 5 стал ЛУЧШЕ выполнять задачи. Я не знаю что поменялось и как вообще могло после выхода двух фейблов, но… Не поленился - запустил тест еще раз на Опусе 5 и блямс: он тоже теперь закрыл 7/10 задач… А мне прям казалось что старые модели после выхода новых только тупеют… А вот оно как бывает.
Свежие данные по бенчмарку.
Это МОИ задачи из действующих репозиториев.
Не является советом/рекомендацией :-)
Честно - удивлен результатом. Буду пробовать использовать в кодинге ее в первую очередь теперь.
И есть еще один странный фокус. По ощущениями Опус 5 стал ЛУЧШЕ выполнять задачи. Я не знаю что поменялось и как вообще могло после выхода двух фейблов, но… Не поленился - запустил тест еще раз на Опусе 5 и блямс: он тоже теперь закрыл 7/10 задач… А мне прям казалось что старые модели после выхода новых только тупеют… А вот оно как бывает.
Свежие данные по бенчмарку.
Это МОИ задачи из действующих репозиториев.
Не является советом/рекомендацией :-)
🔥7👍3
Открытие сентября. На auto.ru оказывается теперь без авторизации зайти и посмотреть «чо почем» вообще нельзя, как я понял :-)))
😁1🤬1
Небольшой бытовой кейс использования AI 🙂
Взял две фотографии рукописных таблиц с результатами выборов по нашему району Крылатское, загрузил в ChatGPT. Попросил свести цифры, проверить контрольные суммы и найти аномалии.
За несколько минут получил:
- сводные результаты и проценты;
- сравнение восьми участков;
- расхождение в 60 голосов: сумма партийных строк - 649, а действительных бюллетеней указано 709;
- любопытный контраст: на одном участке у кандидата 97,83%, а у партии - 39,45%.
Расхождение сначала заподозрил в распознавании. Попросил вывести исходные цифры, сверил с фото - прочитано правильно, не сходится сама таблица.
Бонусом - готовая новость для районного сайта:
https://krylatskoe.com/main/popov-i-edinaya-rossiya-lidiruyut-na-vosmi-uik-krylatskogo-rezultaty-i-raskhozhdenie-v-60-golosov.html
Вот за такие задачи и люблю AI: рутинную оцифровку и арифметику забирает себе, мне остаётся проверить исходники и разобраться, что означают найденные различия. 🙂
Взял две фотографии рукописных таблиц с результатами выборов по нашему району Крылатское, загрузил в ChatGPT. Попросил свести цифры, проверить контрольные суммы и найти аномалии.
За несколько минут получил:
- сводные результаты и проценты;
- сравнение восьми участков;
- расхождение в 60 голосов: сумма партийных строк - 649, а действительных бюллетеней указано 709;
- любопытный контраст: на одном участке у кандидата 97,83%, а у партии - 39,45%.
Расхождение сначала заподозрил в распознавании. Попросил вывести исходные цифры, сверил с фото - прочитано правильно, не сходится сама таблица.
Бонусом - готовая новость для районного сайта:
https://krylatskoe.com/main/popov-i-edinaya-rossiya-lidiruyut-na-vosmi-uik-krylatskogo-rezultaty-i-raskhozhdenie-v-60-golosov.html
Вот за такие задачи и люблю AI: рутинную оцифровку и арифметику забирает себе, мне остаётся проверить исходники и разобраться, что означают найденные различия. 🙂
👍4🔥3
У меня тут больше вопросы, чем полезный пост.
Да, так тоже иногда бывает. :-)
Собственно решил поразвлекаться в SEO/GEO немного.
Выбрал себе донора для развлечений из «бывших» сайтов.
Основная проблема - на скрине…
А подскажите плиз:
1. Есть где-то актуальные инструкции по написанию статей? Ну типа как минимум должно быть это, надо упомянуть это и не забыть обязательно такой-то блок (Типа краткого содержания, FAQ и тп). Ну те что надо включить в ТЗ для текста, чтобы была хотя бы средненькая статья по нынешним стандартам.
2. А какими моделями сейчас народ тексты пишет вообще и ТЗ для них? Мне кажется условные Опусы/Фубли, Астры - это дикий перебор для текстов-то… Можно же что-то попроще использовать? ;-)
3. Ну вдруг - а у кого-то вообще на новых статьях нынче трафик есть? ;-)
ЗЫ. Спасибо за подсказки заранее.
ЗЗЫ. На скрине - это я себе SEO-аудитора собрал за пару дней. И нет, он не публичный. :-)
Да, так тоже иногда бывает. :-)
Собственно решил поразвлекаться в SEO/GEO немного.
Выбрал себе донора для развлечений из «бывших» сайтов.
Основная проблема - на скрине…
А подскажите плиз:
1. Есть где-то актуальные инструкции по написанию статей? Ну типа как минимум должно быть это, надо упомянуть это и не забыть обязательно такой-то блок (Типа краткого содержания, FAQ и тп). Ну те что надо включить в ТЗ для текста, чтобы была хотя бы средненькая статья по нынешним стандартам.
2. А какими моделями сейчас народ тексты пишет вообще и ТЗ для них? Мне кажется условные Опусы/Фубли, Астры - это дикий перебор для текстов-то… Можно же что-то попроще использовать? ;-)
3. Ну вдруг - а у кого-то вообще на новых статьях нынче трафик есть? ;-)
ЗЫ. Спасибо за подсказки заранее.
ЗЗЫ. На скрине - это я себе SEO-аудитора собрал за пару дней. И нет, он не публичный. :-)
Ну что, вчера выкатили новые модельки. Я ломанулся тестировать. Глядя на результаты - решил что я пожалуй сначала высплюсь. И все перепроверю :-)
Крч. Опус новый превзошел все мои ожидания.
Мало того - я на данный момент уже девятый час гоняю его в три сессии по разным проектам - прямо огонь. Он стал умнее, самостоятельнее и «правильнее». Я не знаю как это объективно сформулировать.
В общем кажется с выходом следующих моделей мне надо будет расширять/усложнять тесты.
По факту Opus 5.5 - первая модель которая самостоятельно решила 10/10, плюс по цене НИЖЕ Haiku 4.5 и вдвое быстрее прежих Опусов (и в 4 раза быстрее того дешевого Haiku)
Ну и да, на подмену теперь ему можно смело выбирать GPT-6 Sol для таких же задач и GPT-6 Luna для более простых.
В общем по-моему это прямо огненные результаты и первый такой КАЧЕСТВЕННЫЙ скачок в результатах между прошлыми/новыми моделями.
Повторюсь: оно при этом еще и дешевле быстрее. ШОК.
Крч. Опус новый превзошел все мои ожидания.
Мало того - я на данный момент уже девятый час гоняю его в три сессии по разным проектам - прямо огонь. Он стал умнее, самостоятельнее и «правильнее». Я не знаю как это объективно сформулировать.
В общем кажется с выходом следующих моделей мне надо будет расширять/усложнять тесты.
По факту Opus 5.5 - первая модель которая самостоятельно решила 10/10, плюс по цене НИЖЕ Haiku 4.5 и вдвое быстрее прежих Опусов (и в 4 раза быстрее того дешевого Haiku)
Ну и да, на подмену теперь ему можно смело выбирать GPT-6 Sol для таких же задач и GPT-6 Luna для более простых.
В общем по-моему это прямо огненные результаты и первый такой КАЧЕСТВЕННЫЙ скачок в результатах между прошлыми/новыми моделями.
Повторюсь: оно при этом еще и дешевле быстрее. ШОК.
👍6🔥4🤔1😱1
Что-то, если честно, я немного не понимаю. ВСЕ ДРУЖНО улучшили модели, что мне реально скоро тесты переписывать? :-) Спрут подогнал ключик под DeepSeek.
3 МЕСТО!!!! За 16 центов!!!! И 15 минут!!!!
А чо происходит, мне кто-то объяснит? :-)
Или это вообще просто обвязку в виде CC и Codex так апнули за это время?
3 МЕСТО!!!! За 16 центов!!!! И 15 минут!!!!
А чо происходит, мне кто-то объяснит? :-)
Или это вообще просто обвязку в виде CC и Codex так апнули за это время?
👍6
Антропики что-то расщедрились. То сброс лимитов подогнали, как у openAI. Теперь вот 250$ на работу облачных сессий выдают. Кратко - это способ продолжить работу сессии на мощностях от Антропиков при закрытой крышке ноутбука. Я так понимаю они делаю клон кода (текущей ветки) и продолжают работу сессии по запущенным инструкциям на своих мощностях. Это если кратко.
В общем кто планирует потестить - нажать кнопочку Claim надо.
Описание «что это» и «зачем» + инструкция по использованию:
https://code.claude.com/docs/ru/claude-code-on-the-web
В общем кто планирует потестить - нажать кнопочку Claim надо.
Описание «что это» и «зачем» + инструкция по использованию:
https://code.claude.com/docs/ru/claude-code-on-the-web
❤3
Очень мне понравилась недавно одна фраза, подсмотренная «где-то у кого-то». (с)
«LLM на данный момент - это, по сути, система рычагов для ваших навыков и вашего опыта.»
Вчера занимался улучшением одного из сайтов. LLM предложила немного улучшить поиск по сайту. Мне что-то вспомнилась Bonica, где был шикарный поиск вхождений ключей. С морфологией, словарям (вместо лемматизатора кривого) и кучей фишек. В общем я сказал - а давай улучшим. Вот репозиторий моего старого проекта, там есть стек, логика и алгоритмы. Погнали. 🙂
Обсудили, собрали стенд, написали тесты, погоняли-покрутили параметры. Теперь у меня есть плагин для WP (который несколько сложно разворачивается, тк нужен отдельный поисковый движок и индексатор к нему).
ИТОГО:
Раньше поиск на сайте искал буквальное совпадение: «хранение яблок» и «хранить яблоки» были для него разными запросами, а ответ шёл 3–4 секунды. Теперь поиском занимается отдельный поисковый движок. Он держит индекс всех 6к+ статей, обновляет его каждую ночь и отвечает за сотые доли секунды. Вся страница с результатами открывается примерно за секунду.
Что он умеет:
• понимает русскую морфологию: «морковь», «моркови», «морковку» — это одно слово;
• знает садовые пары: «обрезать» = «обрезка», «сажать» = «посадка», «хранить» = «хранение». Таких пар 31;
• знает синонимы: помидор = томат, картошка = картофель, клубника = земляника и ещё 6 пар;
• под каждой статьёй теперь показывает абзац из статьи, где подсвечено найденное.
Как решается, что показать выше:
1. Сначала ищутся статьи, где есть все слова запроса. Если таких нет, ищутся статьи со всеми словами, кроме одного, чтобы не показывать пустую страницу.
2. «Как», «когда», «почему» и другие вопросительные слова не учитываются.
3. Совпадение в заголовке весит в 10 раз больше, чем совпадение в тексте.
4. Редкие слова важнее частых: «пасынкование» говорит о теме больше, чем «томат».
5. Если слова стоят рядом и в том же порядке, что в запросе, статья выше.
6. Если заголовок начинается со всего запроса, статья идёт первой: «лунный календарь» → «Лунный календарь для садоводов…».
7. Если запрос из одного слова, выше та статья, где оно стоит ближе к началу заголовка.
8. Каждое слово запроса в заголовке даёт небольшую надбавку, поэтому «Как сохранить морковь» стоит выше статьи, где морковь и хранение упоминаются только в тексте.
9. При прочих равных выше статья, где слова запроса встречаются в тексте чаще.
И самое главное за что я пока еще обожаю LLM: от решения до работающего поиска на проде - полтора часа! Естестсвенно не считая индексации 6к статей. Это чистое время разработики + деплоя.
«LLM на данный момент - это, по сути, система рычагов для ваших навыков и вашего опыта.»
Вчера занимался улучшением одного из сайтов. LLM предложила немного улучшить поиск по сайту. Мне что-то вспомнилась Bonica, где был шикарный поиск вхождений ключей. С морфологией, словарям (вместо лемматизатора кривого) и кучей фишек. В общем я сказал - а давай улучшим. Вот репозиторий моего старого проекта, там есть стек, логика и алгоритмы. Погнали. 🙂
Обсудили, собрали стенд, написали тесты, погоняли-покрутили параметры. Теперь у меня есть плагин для WP (который несколько сложно разворачивается, тк нужен отдельный поисковый движок и индексатор к нему).
ИТОГО:
Раньше поиск на сайте искал буквальное совпадение: «хранение яблок» и «хранить яблоки» были для него разными запросами, а ответ шёл 3–4 секунды. Теперь поиском занимается отдельный поисковый движок. Он держит индекс всех 6к+ статей, обновляет его каждую ночь и отвечает за сотые доли секунды. Вся страница с результатами открывается примерно за секунду.
Что он умеет:
• понимает русскую морфологию: «морковь», «моркови», «морковку» — это одно слово;
• знает садовые пары: «обрезать» = «обрезка», «сажать» = «посадка», «хранить» = «хранение». Таких пар 31;
• знает синонимы: помидор = томат, картошка = картофель, клубника = земляника и ещё 6 пар;
• под каждой статьёй теперь показывает абзац из статьи, где подсвечено найденное.
Как решается, что показать выше:
1. Сначала ищутся статьи, где есть все слова запроса. Если таких нет, ищутся статьи со всеми словами, кроме одного, чтобы не показывать пустую страницу.
2. «Как», «когда», «почему» и другие вопросительные слова не учитываются.
3. Совпадение в заголовке весит в 10 раз больше, чем совпадение в тексте.
4. Редкие слова важнее частых: «пасынкование» говорит о теме больше, чем «томат».
5. Если слова стоят рядом и в том же порядке, что в запросе, статья выше.
6. Если заголовок начинается со всего запроса, статья идёт первой: «лунный календарь» → «Лунный календарь для садоводов…».
7. Если запрос из одного слова, выше та статья, где оно стоит ближе к началу заголовка.
8. Каждое слово запроса в заголовке даёт небольшую надбавку, поэтому «Как сохранить морковь» стоит выше статьи, где морковь и хранение упоминаются только в тексте.
9. При прочих равных выше статья, где слова запроса встречаются в тексте чаще.
И самое главное за что я пока еще обожаю LLM: от решения до работающего поиска на проде - полтора часа! Естестсвенно не считая индексации 6к статей. Это чистое время разработики + деплоя.
🔥8👍3😱1