КОнчейн AIVIBE
129 subscribers
142 photos
31 videos
27 links
AI, TON и разработка.

Акуна-Матата.
Тут нет никакой объективности
Download Telegram
😏 Что за модель прошла...

В последние пол года рынок ИИ как обычно не испытывает трудности с вниманием и маркетингом в целом, но есть одна закономерность, которая очень заметно прослеживается за мои примерно два года в этой тематике.

Раньше выход каждой новой модели подразумевал какой то новый сдвиг, который реально было интересно предвкушать. Мы - неандертальцы тех времен, по сравнению с нынешним поколением, встречали визгом новость о том что модель теперь может "подумать в отдельном окне" прежде чем дать ответ, или что можно заранее запрограммировать кодом формат ответа, длину, и тд. Кстати вариативность ответов от точных до творческих приходилось изменять цифрами в коде. Поиск в интернете перед ответом и вообще использование инструментов окончательно перевернуло всю игру и мы получили агентов.

Так вот, эти интересные времена закончились, и теперь мы не получаем "новых способностей" внутри модели, мы получаем "новую настройку" модели. Когда вышла новость о том что пендосы запретили Фэйбл 5 для всех НЕГРАЖДАН Омерики, то это был хайп который раздувала сама Омерика. Им нужно чтобы все обсуждали что нейросети у них такие мощные и сильные что аж пентагону приходится их закрывать.

На самом деле это реакция на то что в Китае внегласно сделали именно такую систему со всеми нейросетями. До тех пор пока партия не одобрит релиз новой модели, людям ничего не дают. Китай по своей традиции скрывает свою силу, по этому вы часто можете встречать что платформы китайских моделей для самих китайцев и для неграждан почти всегда разные. Америке выгодно все внимание притягивать к себе чтобы всегда быть во всем лучшей.

Сейчас уе у всех есть достаточно умные модели чтобы заменить людей почти во всех известных областях, Результат выдавать научились. Теперь нужно научиться делать этот результат постоянным и дешевым, за счет изменения самой технологии "подсчета" либо за счет обвязок на саму модель и ее последующим управлением. Поэтому делать AI проекты все еще актуально как никогда.

Вы не замените Чат ГПТ или Дипсик нарынке, но вы всегда можете настроить систему так, чтобы ваше решение было удобнее, быстрее, лучше, экономнее, практичнее и т.д. чем это из коробки от большой корпорации. Малый и средний бизнес тут имеют явное преимущество.

Поэтому обсуждать выходы моделей уже совсем не интересно. Нас в ближайшее время будут обучать что нужно использовать разные модели для разных задач (примерно через год модели сами будут разные куски задачи проходить разными версиями), нам будут говорить как модели что то взломали, как модели кого то обманули, как модели кого то спасил, создали новый рецепт, написали симфонию, а нигер может мне тут не сидеть и не пиз.... Но каждый выход модели в двух словах будет звучать как "модель стала умнее! и долго работает!" и каждый раз еще умнее, еще дольше, еще глубже...

По факту сами модели не будет люто меняться, будут меняться процессы и их порядок которые происходят во время того как она думает и то "в каких условиях" она думает. Это и есть в общих чертах та самая "обвязка модели". В это понятие входит промтиженеринг, понимание вообще того как происходит процесс мышления модели, понимание того как она использует инструменты, как ее направлять в мышлении, как направлять ее ограничениями среды и т.д.

/Накидай в конце умную мысль типа я к ней вел весь пост.
Please open Telegram to view this post
VIEW IN TELEGRAM
1
ИИ никогда не придумает ничего нового, ни каких новых законов физики, он не скажет как создать клетку которая убивает рак если у него спросить, он никогда не выдаст то чего у него нет в голове.

С человеком кстати точно так же... Если что мы тоже умеем миксовать исключительно ТОЛЬКО то что однажды было в нашем поле восприятия.

Робот может написать симфонию? А человек может придумать новый цвет?
1
Этот день настал...

Начинаю разработку торговых агентов на TON.

https://github.com/ton-blockchain/acton-contracts

Буду натягивать свои старые наработки на рельсы блокчейна. Аминь.
2
Антигравити сегодня байтит новой Гемини.

Я начинал свой путь вайбкодинга именно с инфраструктуры и моделей Гугла. И хотя я редко о них пишу, они на ощупь такие же как и хайпующие модели. Просто не хайпуют.
1
КОнчейн AIVIBE
Антигравити сегодня байтит новой Гемини. Я начинал свой путь вайбкодинга именно с инфраструктуры и моделей Гугла. И хотя я редко о них пишу, они на ощупь такие же как и хайпующие модели. Просто не хайпуют.
В 2 раза дешевле прошлой версии, дольше кодит, лучше кодит, заточена на работу с инструментами. Сейчас это самая сильная модель для кодинга и агентских задач от Гугл. Что реально заметно в работе, она в отличие от китайцев и даже хайповых моделей вообще ОЧЕНЬ МАЛО генерирует лишних токенов. Она прям очень аккуратная. Как будто бы даже лучше держит фокус.
1
Все таки пора перестать уже сравнивать модели как таковые вообще. Правельнее сравнивать их обвязки.
1
Там Илон Маск выпустил Grok 4.6 и это прям неожиданно приятное изменение. Раньше я вообще не ставил Грок серьезно в один ряд с остальными моделями пендосов. Сегодня Илон заставил себя уважать в очередной раз. Я еще не перестал получать эмоции от происходящего, но это точно заявка на участие в гонке лидеров.

Там еще вышла DeepSeek 4 PRO по той же цене что и прошлая версия, и по традиции она лучше и дольше кодит чем старая. везде пюс минус по чуть чуть.

Сегодня буду тестировать все вышедшие новинки за последнее время и сделаю в итоге свой личный ТОП глист моделей + обвязок.

Не так давно Илон купил Cursor, и после этого как мы видим Грок стал дохуя умный. А еще говорят через пару недель выйдет еще один грок еще круче. Очень интересно наблюдать. Я так рад что мы отходим от темы дефицита и на нас снова будут сыпаться миллионы бесплатных токенов, лишь бы мы покодили их моделями+агентами.

Честно признаюсь в последнее время вайбкодинг стал больше походить не на процесс где я с разными программами и нейросетями пытаюсь собрать проект, а процесс в котором я ищу проект жертву, чтобы устроить с ним цифровую групповуху с разными агентами, обвязками и автоматизациями в целом. Сам процесс работы превратился в фетиш. Прям как я мечтал 😊
Please open Telegram to view this post
VIEW IN TELEGRAM
1
Когда я был инфлом тона меня люто раздражал интерфейс телеги потому что большую часть дня он был передо мной.

Теперь меня раздражает это...
1
Media is too big
VIEW IN TELEGRAM
Это я после того как напостил умных постов про вайбкодинг и пошел делать проекты без знания кода.
😁31
КОнчейн AIVIBE
Список моделей которые должны выйти до конца лета. Qwen уже вышла.
Замечательно, теперь еще GLM 5.3 вышла. Говорят в этот раз уверено дотянула до Fable 5 (сам еще не тестил). Веса выложат через 2 недели. То есть блядь китайскиеоткрытые модели теперь на уровне топовых мировых. думал это произойдет в лучшем случае через пол года. А это произошло сегодня.

Все по расписанию. Гемини только поспешили на +1 модель. Сегодня вечер исследований получается.
1
КОнчейн AIVIBE
Замечательно, теперь еще GLM 5.3 вышла. Говорят в этот раз уверено дотянула до Fable 5 (сам еще не тестил). Веса выложат через 2 недели. То есть блядь китайскиеоткрытые модели теперь на уровне топовых мировых. думал это произойдет в лучшем случае через пол…
GLM 5.3 была самой интересной из новинок честно признаюсь, только закончил работать со всеми новыми моделями. Очень понравилось что мои утверждения раскрываются прямо перед глазами.

Модели больше не делают "самыми умными". На этом факте я уже готов вступать в откровенные споры. Все таки оказалось важнее контролировать факус модели, уметь ее анализировать свои действия и весь контекст в целом, понимать какой именно результат и в каких рамках нужно выдать в итоге и не терять цепочку рассуждений и решений.

Именно GLM 5.3 которую выкатили как "равной Fable и SOL" не сказать что ощутимые но заметные. До топовых моделей конечно не дотянули (как всегда чуть чуть), но сам факт того что скоро любой сможет локально запускать модель по уровню очень близкому к самым дорогим платным решениям очень щекочет нутро. В следующем посте сделаю первый вариант своего обзора на новые модели, я еще не совсем решил/понял как лучше выдавать такой пост, поэтому буду надеяться что вам понравится.
1
@durov ну че ты емае закинь пацану денег, больше чем все эфективные менеджеры сделал в соло.

t.me/zkproof
1
Уже второй день как начал активно юзать Manus из за бесплатной недельной подписки и ни разу не пожалел.

Короче это идеальный пример того о чем я говорил выше - сила модели не влияет на результат как ее обвязка.

🔗 Manus - ни в одних бенчмарках не указан как топ. Нигде не хайпится и не рекламируется. Выполняет задачу не хуже чем Codex, местами даже лучше. Я первый раз вижу что модель выдает такие результаты просто потому что у нее грамотно, я бы даже сказал ювелирно настроен процесс работы.

Там сейчас бесплатно дают среднюю и быструю версию, по ощущениям вообще не уступают Terra и Luna в Codex GPT только у вас будет полный безлимит на них. Изначально Манус создан как агент для работы. То есть он подходит для всего. Именно для кодинга он подходит идеально, хотя нигде прям так не позиционируется. Ребята очень советую просто потрогать если еще не пробовали. Теперь буду более серьезно относиться к проектам которые позиционируют себя просто как агенты. Я так понимаю там уже достаточно сильный и конкурентный рыночек сформироваться успел.

Отдельно кайфую с этого щелчка. Когда он заканчивает работу то делает звук щелчка. Это реально ощущается будто ты даешь задание и через пару минут по щелчку получаешь результат. Сука нраица.
Please open Telegram to view this post
VIEW IN TELEGRAM
1
Спустя 4 дня делаю обещанный разбор новых моделей:

Как оказалось из коробки мануса, лучше самого мануса ничего не работает. Это максимально "сросшийся" симбиоз модели и обвязки где модель изначально создавали под обвязку или наоборот хз. Но случай уникальный на моей практике. Сразу понятно что там серьезная команда и продуктолог там не зря получает зарплату.

На удивление GLM 5.3 оказалась в итоге значительно сильнее чем я ожидал. Она на прямых сравнениях в одинаковых задачах порвала Fable 5 от антропиков, сделав работы быстрее, сгенерировав меньше токенов, и при этом она сама по себе дешевле. Вот точные цифры разницы в цене: на выходе цена Fable 5 больше чем в 11 раз, на входе — в 7+ раз. При этом GLM у меня для решения задач потратила примерно на 10-15% меньше.

*для справки в задаче было создать с нуля приложение с реферальной системой доступное в web+телеграм web app, c подключением базы данных supabase , регистрациями, авторизацией, логика ежедневных чекинов, балансы токенов, заранее прописаным стеком. То есть у модели есть полный план с правильно прописаной реализацией голого проекта. Ей нужно собрать этот проект по инструкции и после провести результаты тестов. И вот уже на основе того какие результаты тестов + фактическое состояние проекта, я делаю вывод насколько и в чем модель ошиблась или пропустила чтолибо. Я не претендую на то что это какой то явный тест, но конкретно в моей практике работы, мне повзоляет понять разницу модели, когда в одних и тех же условиях я вижу разное исполнение от разных моделей.


Gemini 3.7 вообще понравилось, я бы ее использовал постоянно и скорее всего так и будет когда закончится манус. Она дешевая и реально выполняет роль "рабочей лошадки". Ее преимущество перед другими, это то что когда она заканчивает работу, она явно честно и более точно сразу говорит где результат может не соответствовать ожиданиям. Вообще уникальность или даже преиммущество моделей Gemini именно в том что они в отличие от других ориентированы на то чтобы пониамть что ожидает получить человек и дать ему именно это, а не то что он пишет. Это с одной стороны плюс, а с другой минус. Но зная эту особенность, ее можно всегда использовать в пользу 🙂

Grok 4.6 - так отлично в начале себя показывала. Я уже думал реальо круто, но нет, в итоге спустя несколько дней понял что с ней не так. В общем ее лучше использовать конкретно под определенные четко измеримые задачи. Она вроде бы может в долгое и сложное, но слишком стабильно делает "небольшие ошибки" которые в итоге когда работа затягивается или требует точных пошаговых действий или необходимости в контексте держать много инфы и правильно распорядиться информацией чтобы выдать полезный результат, наличие мелких постоянных ошибок в рассуждениях, на долгой дистанции в конце выдают большое неудовлетворительное расхождение. В общем после его ошибок хочется не отправить новый промпт чтобы исправить что то, а откатить прям нахуй все на один шаг назад.

DeepSeek - такой же дипсик короче. Вот прям как держал свою нишу так и держит. Железобетонная дешевая китайская дистиляция Американских фронтиров. Если бы меня попросили дать самое короткое описание дипсик я бы описал это так:

"DS- отвечаю правду говорю!
Пользователь- откуда ты знаешь что правда?
DS- хрен знает, но отвечаю правда.
(он реально говорит правду)"

Это был аналитический разбор доктора нейротантрических наук и действующего практика транс серфинга виртуальности ❤️
Please open Telegram to view this post
VIEW IN TELEGRAM
2🔥1
После того как потрогал за мануса, решил сразу же изучить гермес. Потому что все таки "глубина" решений будет за такими агентами, а кодексы и клоды пока не так сильно готовы запаковываться. Но это конечно все веяние трендов и игры техно гигантов, истинных мотивов там слишком много чтобы так однобоко утверждать.

Короче гермес или хермес - газ обкатывать!
1
КОнчейн AIVIBE
Уже второй день как начал активно юзать Manus из за бесплатной недельной подписки и ни разу не пожалел. Короче это идеальный пример того о чем я говорил выше - сила модели не влияет на результат как ее обвязка. 🔗 Manus - ни в одних бенчмарках не указан как…
Я короче признаю: Manus = Codex/Clode.

Единственный его минус как и кодекса это то что это обвязка срасшаяяся с моделью от которой не убежать вообще. Даже Codex на его фоне не так "урезан" в плане возможности кастомизации. Но вы не слушайте меня думая что одно хуже другого.

Коробочные варианты являются лучшими решениями для ежедневной работы. То есть если вы тот самый замечательный и великолепный представитель 1% землян которые уже научились использовать AI в работе и ускорились используя все его преимущества, то вам нахер не всралось то что я пишу про кастомизацию.

Конкретно я в этой истории исследователь. Мне важно понимать и знать что сейчас непосредственно происходит на рынке, если бы я работал над какой то одной моделью или делал что то конкретное в определенном секторе AI, я бы так же не морочился. Но я пришел в AI не чтобы найти себе профессию, а чтобы использовать новую технологию и улучшать жизни землян. Поэтому для меня важно следить сразу за всеми направлениями бесконечно расширяющегося рынка AI (что уже практически невозможно).

Условно говоря цены на нейронки сегодня зависят за сколько бедняк в медной шахте готов выйти на еще одну смену чтобы не умереть от голода и принести домой воды с рисом, а так же от того как партия республиканцев в США решит вести ресурсно-технологическую политику на фоне неконтролируема развивающегося Китая который уже обогнал США, но это пока не афишируется потому что у каждой из сторон на это есть свои причины. И между этим бедняком и политиками двух сверх держав есть тысячи других промежуточных звеньев...

И пока шатлы бороздят просторы нашей.... я уже забыл о чем я. Ах да, учитесь в AI, пиздец полезно - отвечаю.
2
Не дурно я в этом году поработал кодером (даже отдохнуть успел месяц).

Два года назад я не мог сформулировать толком разницу между фронтендом и бэкендом.

Динамичненько 🚬
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍1
Вот она новая эра развития AI. Deep Seek выкатили свой вариант создания обвязки моделей.

Главный принцип их идеи - все вокруг самой модели является плагином.

Недавно OpenAI и Anthropic вместе обсуждали публично что индустрии нужно прийти к тому чтобы создать единый формат самих плагинов и скилов для агентов, чтобы они были полностью универсальны и переиспользуемы для всех поделей/обвязок.

И тут наши друзья из поднебесной выкатывают сразу некий привет из будущего. Пока что мало людей в мире понимают насколько это одновременно простое, гениальное и ультракрутое решение.

Я прям двумя руками топлю за то что такой подход станет стандартом всего харнеса, и заложит на практике руками разработчиков по всему миру то что мы будем называть стандартом.

Я пока только изучаю одним глазом, много работы руки не дотягиваются жадно потрогать эту малышку. Я вам гарантирую - пару дней и она будет подо мной 🚬
Please open Telegram to view this post
VIEW IN TELEGRAM
1