⚪️ ZCode провайдеры
Заи улучшили работу с провайдерами в Zcode - вот чего нынче можно туда добавлять
(ц) Ну и хорошо!
@deksden_notes
Заи улучшили работу с провайдерами в Zcode - вот чего нынче можно туда добавлять
(ц) Ну и хорошо!
@deksden_notes
👍8🔥6❤2
⚪️ Jev на OpenRouter
Хайповый Jev теперь на openrouter! пожалуй, самый удобный способ попробовать - а это must do задача для тестирвоания. Не каждый день условно "новые" способы использования нейронок появляются. Уверен, последователей скоро появится много, надеюсь их назовут jev-like в честь признания заслуги авторов, TypeSafe.
(ц) интересное дело на выхи
Upd 1️⃣ :
🔗 тред с анонсом : https://x.com/OpenRouter/status/2100744709589316009
Если сделать чего то с Jev, и отправить меншен в Хвиттере @jjacky, то топ-10 интересных проектов дадут $20 кредитов на опенроутере. Мелочь, а приятно!
@deksden_notes
Хайповый Jev теперь на openrouter! пожалуй, самый удобный способ попробовать - а это must do задача для тестирвоания. Не каждый день условно "новые" способы использования нейронок появляются. Уверен, последователей скоро появится много, надеюсь их назовут jev-like в честь признания заслуги авторов, TypeSafe.
(ц) интересное дело на выхи
Upd 1️⃣ :
🔗 тред с анонсом : https://x.com/OpenRouter/status/2100744709589316009
Если сделать чего то с Jev, и отправить меншен в Хвиттере @jjacky, то топ-10 интересных проектов дадут $20 кредитов на опенроутере. Мелочь, а приятно!
@deksden_notes
👍6❤5👌3🔥1
Forwarded from Refat Talks: Tech & AI
Jev - это сенсор, а не собеседник
Вы уже могли слышать про TypeSafe AI (основатель - соавтор InstructGPT из OpenAI), они пару дней назад вышли из стелса и показали модель, которая не умеет писать текст зато отвечает в десятки раз быстрее и дешевле LLM. Ну как отвечает, скорее выбирает, но иногда это ровно то, что нужно.
Работает так: скидываешь ей данные и задаешь вопросы с заранее известными вариантами. Она не пишет ответ, а сразу выбирает вариант и говорит, насколько уверена. Промпт при этом никуда не делся - он живет внутри вопроса.
В общем эту штуку можно сравнить с датчиком, по сути же - это умный классификатор.
Родион уже прогнал Jev на практике: как реранкер в RAG она обошла Voyage, Qwen3-Reranker и Cohere, а как модератор чат-бота вышла в 5 раз быстрее и дешевле gpt-oss-120b. Мне еще понравилась демка с оптимизацией browser use.
Что еще стоит посмотреть:
Мой тейк: штука полезная только при сильно лучшей экономике, и есть проблема всех узких решений (реранкеров, маленьких моделей, файнтюна): фронтир-лабы вливают миллиарды в универсальные модели, и те становятся лучше и быстрее даже в узких задачах просто по дороге. Бонусом LLM может "объяснить" свой выбор, а тут нет. И как любой классификатор, такие штуки по-настоящему раскрываются на своем железе: при нагрузке дорога до облака съедает всю экономию скорости.
Поэтому моя ставка не на TypeSafe, а на идею. Либо большие лабы добавят режим типа "выбор с вероятностью" в свои API, либо китайцы наклепают открытых версий и тогда "типизированные" решения станут таким же примитивом, как structured output. В обоих случаях выигрывает интерфейс/способ, а не компания.
🔥 ➕ 🔁 @nobilix
Вы уже могли слышать про TypeSafe AI (основатель - соавтор InstructGPT из OpenAI), они пару дней назад вышли из стелса и показали модель, которая не умеет писать текст зато отвечает в десятки раз быстрее и дешевле LLM. Ну как отвечает, скорее выбирает, но иногда это ровно то, что нужно.
Работает так: скидываешь ей данные и задаешь вопросы с заранее известными вариантами. Она не пишет ответ, а сразу выбирает вариант и говорит, насколько уверена. Промпт при этом никуда не делся - он живет внутри вопроса.
В общем эту штуку можно сравнить с датчиком, по сути же - это умный классификатор.
Родион уже прогнал Jev на практике: как реранкер в RAG она обошла Voyage, Qwen3-Reranker и Cohere, а как модератор чат-бота вышла в 5 раз быстрее и дешевле gpt-oss-120b. Мне еще понравилась демка с оптимизацией browser use.
Что еще стоит посмотреть:
- Опенсорс-реплики появились за трое суток: openjev (демо в браузере), jevmlx для Mac, vllm-jev-decison под vLLM, Verdict-open-jev - ближе всего к оригиналу: не логиты LLM, а энкодер ModernBERT.
- Тред на HN, 1800+ поинтов. Главный спор - про слово "can't hallucinate": тип гарантирован, суждение нет. CEO отвечает лично.
- Разбор Anthony Maio: самая трезвая критика. RLCD (метод обучения) не раскрыт, калибровка описывает популяцию ответов, а не конкретный ответ.
- Бенчмарк на 2000 фишинговых писем: в лоб Jev проиграл Haiku с треском, 63% против 81%. А потом автор разбил решение на пять маленьких вопросов в одном вызове и получил 95%. Самая поучительная история про то, как эту штуку надо готовить. Еще 15 независимых эвалов с кодом - в каталоге awesome-jev - 👍.
Мой тейк: штука полезная только при сильно лучшей экономике, и есть проблема всех узких решений (реранкеров, маленьких моделей, файнтюна): фронтир-лабы вливают миллиарды в универсальные модели, и те становятся лучше и быстрее даже в узких задачах просто по дороге. Бонусом LLM может "объяснить" свой выбор, а тут нет. И как любой классификатор, такие штуки по-настоящему раскрываются на своем железе: при нагрузке дорога до облака съедает всю экономию скорости.
Поэтому моя ставка не на TypeSafe, а на идею. Либо большие лабы добавят режим типа "выбор с вероятностью" в свои API, либо китайцы наклепают открытых версий и тогда "типизированные" решения станут таким же примитивом, как structured output. В обоих случаях выигрывает интерфейс/способ, а не компания.
🔥 ➕ 🔁 @nobilix
👍20🔥16👀2
⚪️ Minimax CLI вышла как open source
И опять - не десктоп, а cli
🔗 репо : https://github.com/MiniMax-AI/minimax-code
terminal TUI, headless CLI, and ACP - на TS.
(ц) ну и хорошо!
@deksden_notes
И опять - не десктоп, а cli
🔗 репо : https://github.com/MiniMax-AI/minimax-code
terminal TUI, headless CLI, and ACP - на TS.
(ц) ну и хорошо!
@deksden_notes
👍5
⚪️ Qwen 3.8 Omni Flash
Ещё один флеш, на этот раз ещё и омни-модальный! Прям эра флешей наступила. По бенчам чуть хуже qwen 3.8 Flash - но мультимодальность, на входе текст, картинки, аудио, видео. На выходе - текст.
Цена: $0.15 ($0.016) / $0.47
🔗 Блог : https://qwen.ai/blog?id=qwen3.8-omni-flash
🔗 Карточка модели : https://www.qwencloud.com/models/qwen3.8-omni-flash#api-reference
Картинка с бенчами в комментах ⬇️
@deksden_notes
Ещё один флеш, на этот раз ещё и омни-модальный! Прям эра флешей наступила. По бенчам чуть хуже qwen 3.8 Flash - но мультимодальность, на входе текст, картинки, аудио, видео. На выходе - текст.
Цена: $0.15 ($0.016) / $0.47
🔗 Блог : https://qwen.ai/blog?id=qwen3.8-omni-flash
🔗 Карточка модели : https://www.qwencloud.com/models/qwen3.8-omni-flash#api-reference
Картинка с бенчами в комментах ⬇️
@deksden_notes
👍7
⚪️ Акция на Kimi K3 в Cline Desktop
Временно - бесплатно! Сроки не объявлены
🔗 Анонс : https://x.com/cline/status/2100995309656854903
(ц) налётаем )
@deksden_notes
Временно - бесплатно! Сроки не объявлены
🔗 Анонс : https://x.com/cline/status/2100995309656854903
(ц) налётаем )
@deksden_notes
1👍7🔥2
⚪️ Акция - Jev на Vercel AI Gateway бесплатно
До 25 сентября, то есть недельку можно погонять хайповую модель даром.
🔗 Анонс : https://x.com/vercel_dev/status/2101116818463281579
@deksden_notes
До 25 сентября, то есть недельку можно погонять хайповую модель даром.
🔗 Анонс : https://x.com/vercel_dev/status/2101116818463281579
@deksden_notes
👍10
⚪️ Для чего Jev?
А вот - тьма проектов:
🔗 сайт : https://jevable.com/
Реально много проектов
за линк грац @ikiwi
——
Upd 1️⃣ : а вот и фирменные скиллы подъехали - это не про "для чего", скорее, а "как":
🔗 смотрите тут: https://github.com/typesafe-ai/skills
@deksden_notes
А вот - тьма проектов:
🔗 сайт : https://jevable.com/
Реально много проектов
за линк грац @ikiwi
——
Upd 1️⃣ : а вот и фирменные скиллы подъехали - это не про "для чего", скорее, а "как":
🔗 смотрите тут: https://github.com/typesafe-ai/skills
@deksden_notes
1🔥17❤8👍4❤🔥1👌1
⚪️ Qwen Image 2.1
Немного неожиданный день для релиза - алибаба дропнула Qwen Image 2.1, 7B модель с открытыми весами! Конечно, лучше, эффективнее, круче чем раньше - кто бы сомневался.
Сморите:
🔗 Бложик с деталями: https://qwen.ai/blog?id=qwen-image-2.1
🔗 Гитхаб : https://github.com/QwenLM/Qwen-Image-2.1
🔗 ModelScope: https://www.modelscope.cn/models/Qwen/Qwen-Image-2.1
🔗 Обнимашки : https://huggingface.co/Qwen/Qwen-Image-2.1
🔗 Демка с обнимашек: https://huggingface.co/spaces/Qwen/Qwen-Image-2.1
Особенности, которые указал вендор:
• бенчи (в комментах)
• генерация картинок с прозрачным фоном
• до 10 референсов для генерации
• указание целевых зон разметкой (рисуем области "карандашом") и модель меняет их
• возможность дать три референса фигуры с разных сторон и получить материал в любых позах с любой стороны
• улучшена эстетика текстов и портретов
(ц) вот и славно
@deksden_notes
Немного неожиданный день для релиза - алибаба дропнула Qwen Image 2.1, 7B модель с открытыми весами! Конечно, лучше, эффективнее, круче чем раньше - кто бы сомневался.
Сморите:
🔗 Бложик с деталями: https://qwen.ai/blog?id=qwen-image-2.1
🔗 Гитхаб : https://github.com/QwenLM/Qwen-Image-2.1
🔗 ModelScope: https://www.modelscope.cn/models/Qwen/Qwen-Image-2.1
🔗 Обнимашки : https://huggingface.co/Qwen/Qwen-Image-2.1
🔗 Демка с обнимашек: https://huggingface.co/spaces/Qwen/Qwen-Image-2.1
Особенности, которые указал вендор:
• бенчи (в комментах)
• генерация картинок с прозрачным фоном
• до 10 референсов для генерации
• указание целевых зон разметкой (рисуем области "карандашом") и модель меняет их
• возможность дать три референса фигуры с разных сторон и получить материал в любых позах с любой стороны
• улучшена эстетика текстов и портретов
(ц) вот и славно
@deksden_notes
🔥7👍6
⚪️ Лист ожидания осени
Давайте составим чек-лист чего мы ждём в ближайшее время, начало осени:
• Клодовские 5.2 - соннет, фублю и опуса. Хайку уже не ждём?
• Грока 4.7 и, видимо, 4.8
• Кими К3.1
• Гпт в 6 поколении - Сола, Луну. А Терру ждём?
❓что ещё забыл?
——
upd 1️⃣ : да, гемини 4 про, наверное, надо добавить. Видимо, с флешем 4! Не то чтобы были утечки о релизе, но в списке пусть будет
——
upd 2️⃣ : из китов - анонсирвовлась работа над квен 4 и мимо 2.6
наверное, минимакс м3.1/3.5 может ещё выйти
@deksden_notes
Давайте составим чек-лист чего мы ждём в ближайшее время, начало осени:
• Клодовские 5.2 - соннет, фублю и опуса. Хайку уже не ждём?
• Грока 4.7 и, видимо, 4.8
• Кими К3.1
• Гпт в 6 поколении - Сола, Луну. А Терру ждём?
❓что ещё забыл?
——
upd 1️⃣ : да, гемини 4 про, наверное, надо добавить. Видимо, с флешем 4! Не то чтобы были утечки о релизе, но в списке пусть будет
——
upd 2️⃣ : из китов - анонсирвовлась работа над квен 4 и мимо 2.6
наверное, минимакс м3.1/3.5 может ещё выйти
@deksden_notes
👍9🔥2
⚪️ ZCode - в opensource!
Помните лёгкий шитсторм последних дней на тему Zcode крадёт ваши репо? Как в своё время было у Grok Build?
Так вот - дело закончилось аналогично - ZCode выходит в опенсорсе! omfg))
Хорошая дестктопная упряжка - и в opensource!
Приятно
🔗 анонс: https://x.com/zcode_ai/status/2101844704933621971
🔗 репо: https://github.com/zai-org/ZCode
(ц) всё - к лучшему!
@deksden_notes
Помните лёгкий шитсторм последних дней на тему Zcode крадёт ваши репо? Как в своё время было у Grok Build?
Так вот - дело закончилось аналогично - ZCode выходит в опенсорсе! omfg))
Хорошая дестктопная упряжка - и в opensource!
Приятно
🔗 анонс: https://x.com/zcode_ai/status/2101844704933621971
🔗 репо: https://github.com/zai-org/ZCode
(ц) всё - к лучшему!
@deksden_notes
👍15🔥2
⚪️ FreeBuff подписки
FreeBuff, видимо, хочет стать OpenCode Go и предлагает подписки.
🔗 Планы тут : https://freebuff.com/plans
▶️ Сомнение вызывает возможность работы из РФ через ВПН, проверть надо. Также сомневаюсь в возможности мультиакков.
А так - вроде бы коэффициент для не-вендора вполне интересный.
‼️ Если кто будет брать - дайте обратную связь, любопытно чего там и как
@deksden_notes
FreeBuff, видимо, хочет стать OpenCode Go и предлагает подписки.
🔗 Планы тут : https://freebuff.com/plans
▶️ Сомнение вызывает возможность работы из РФ через ВПН, проверть надо. Также сомневаюсь в возможности мультиакков.
А так - вроде бы коэффициент для не-вендора вполне интересный.
‼️ Если кто будет брать - дайте обратную связь, любопытно чего там и как
@deksden_notes
👍2👀1😎1
⚪️ Deksden Notes Бот - для дайджеста чата
ИИ релизы у нас вроде бы не ранее завтра, так что удобный момент -
пришла пора открыть тестирование MVP бота с дайджестом чата.
🔗Линк : @deksden_notes_bot
В чем плюс пользования ботом вместо обычной рассылки дайджеста в чат:
• дайджест приходит в бота
• расписание доставки (время) настраивается
• формат дайджеста в боте настраивается глубоко: можно выбрать стандартный формат (несколькими сообщениями) или расширенный (используя md форматирование в одном большом сообщении)
• можно выбрать формат описания главных тем - все обсуждаевшиеся три варианта доступны, можно включить любой или даже все три (напомню - это расширенное обсуждение, резюма обсуждения или текущее вбранное для рассылки краткое изложение)
• остальные блоки дайджеста тоже можно включить или выключить
• доступен архив дайджестов, можно заказать на выбранную дату (архив постепенно будет пополнен "вглубь" истории чата, думаю, на полгода, наверное)
• доступно бесплатно для подписчиков канала и чата
• возможно, в будущем - основной канал доставки дайджеста, из чата можем убрать, чтобы не спамить
▶️ Оформление сделано по заявка моих иждивенцев - фанатов нашей собаки Фани (мальтипу, полное имя "Фанта"). Потом, возможно, сделаю несколько стилей на выбор, кому что нравится.
‼️ Принимается обратная связь, буду благодарен за отзывы, идеи и всё такое. Не забываем, это MVP, ему от роду 2 дня
@deksden_notes
ИИ релизы у нас вроде бы не ранее завтра, так что удобный момент -
пришла пора открыть тестирование MVP бота с дайджестом чата.
🔗Линк : @deksden_notes_bot
В чем плюс пользования ботом вместо обычной рассылки дайджеста в чат:
• дайджест приходит в бота
• расписание доставки (время) настраивается
• формат дайджеста в боте настраивается глубоко: можно выбрать стандартный формат (несколькими сообщениями) или расширенный (используя md форматирование в одном большом сообщении)
• можно выбрать формат описания главных тем - все обсуждаевшиеся три варианта доступны, можно включить любой или даже все три (напомню - это расширенное обсуждение, резюма обсуждения или текущее вбранное для рассылки краткое изложение)
• остальные блоки дайджеста тоже можно включить или выключить
• доступен архив дайджестов, можно заказать на выбранную дату (архив постепенно будет пополнен "вглубь" истории чата, думаю, на полгода, наверное)
• доступно бесплатно для подписчиков канала и чата
• возможно, в будущем - основной канал доставки дайджеста, из чата можем убрать, чтобы не спамить
▶️ Оформление сделано по заявка моих иждивенцев - фанатов нашей собаки Фани (мальтипу, полное имя "Фанта"). Потом, возможно, сделаю несколько стилей на выбор, кому что нравится.
‼️ Принимается обратная связь, буду благодарен за отзывы, идеи и всё такое. Не забываем, это MVP, ему от роду 2 дня
@deksden_notes
🔥11👍9❤🔥1💘1
⚪️ Grok 4.7
Релиз нашего бота с дайджестом чата (https://t.me/deksden_notes/1279) открыл дорогу для фронтирных лаб сделать свои релизы.
Первым рискнул пойти грок - вот и кончились 10 дней Илона - в этот раз всего х2 получилось. В Grok Build модель уже появилась.
Рассматриваем бенчи грока. По AAI выходит между Gpt 5.5 и Glm 5.3. Слабее Opus 5.
Потестим, конечно!
Бенчи накидаю в комменты к посту ⬇️
——
Upd 1️⃣ :
🔗 бложик : https://x.ai/news/grok-4-7
@deksden_notes
Релиз нашего бота с дайджестом чата (https://t.me/deksden_notes/1279) открыл дорогу для фронтирных лаб сделать свои релизы.
Первым рискнул пойти грок - вот и кончились 10 дней Илона - в этот раз всего х2 получилось. В Grok Build модель уже появилась.
Рассматриваем бенчи грока. По AAI выходит между Gpt 5.5 и Glm 5.3. Слабее Opus 5.
Потестим, конечно!
Бенчи накидаю в комменты к посту ⬇️
——
Upd 1️⃣ :
🔗 бложик : https://x.ai/news/grok-4-7
@deksden_notes
🤣7🔥1
Forwarded from Тринадцатый токен
Я тут сделал себе небольшой блог. Хочется иногда выкладывать что-то побольше телеграм-поста — с графиками и таблицами. Мне не зашел телеграмовский Rich Text.
Выложил туда разбор своего эксперимента Midas: пробовал обыграть букмекера на The International 2026 с помощью двенадцати LLM. Давал моделям статистику по доте, подключал инструменты, показывал и прятал коэффициенты. Ставки, если что, виртуальные.
В плюс не вышла ни одна модель. Но когда я полез разбираться, нашлись довольно любопытные вещи. Например, агенты без коэффициентов в среднем оценивали вероятности хуже броска монетки. То есть модель ходила в интернет, что-то читала, тратила токены и возвращалась с прогнозом похуже. Но агенты же уже достаточно умные, чтобы самостоятельно найти нужную информацию. Разве не так?🤓
В объяснениях при этом всё выглядело вполне разумно: модели ссылались на статистику, личные встречи и форму команд. И когда примерно одно и то же пишут двенадцать разных моделей, уже кажется, что гипотезу неплохо проверили. Хотя все они вполне могут держаться за одно и то же неудачное предположение.
Разобрал, чем моделям помогали коэффициенты, насколько полезен такой консенсус и куда ушли виртуальные деньги. Заодно отдельно проверил, что получится у Astra.
Получилось довольно подробно:
https://anc13nt.dev/ru/articles/midas/
#гостевойпост
Выложил туда разбор своего эксперимента Midas: пробовал обыграть букмекера на The International 2026 с помощью двенадцати LLM. Давал моделям статистику по доте, подключал инструменты, показывал и прятал коэффициенты. Ставки, если что, виртуальные.
В плюс не вышла ни одна модель. Но когда я полез разбираться, нашлись довольно любопытные вещи. Например, агенты без коэффициентов в среднем оценивали вероятности хуже броска монетки. То есть модель ходила в интернет, что-то читала, тратила токены и возвращалась с прогнозом похуже. Но агенты же уже достаточно умные, чтобы самостоятельно найти нужную информацию. Разве не так?
В объяснениях при этом всё выглядело вполне разумно: модели ссылались на статистику, личные встречи и форму команд. И когда примерно одно и то же пишут двенадцать разных моделей, уже кажется, что гипотезу неплохо проверили. Хотя все они вполне могут держаться за одно и то же неудачное предположение.
Разобрал, чем моделям помогали коэффициенты, насколько полезен такой консенсус и куда ушли виртуальные деньги. Заодно отдельно проверил, что получится у Astra.
Получилось довольно подробно:
https://anc13nt.dev/ru/articles/midas/
#гостевойпост
Please open Telegram to view this post
VIEW IN TELEGRAM
Sergey Samozhen
Я попробовал обыграть букмекера с помощью AI - Сергей Саможён
Двенадцать моделей прогнозировали The International 2026 и выбирали виртуальные ставки. Ни одна не вышла в плюс. После турнира я разобрал, на чём они теряли деньги и чем им помогали коэффициенты.
🔥1