very vibe coding
123 subscribers
465 photos
126 videos
13 files
1K links
Канал Алексея Макрушина об экспериментах в области vibe coding и всего интересного, что есть в области AI, ML и тому подобного
Download Telegram
tko_presentation_TKO_Presentation_Final.pdf
119.8 KB
Побаловался с новым агентом minimax.io

Рекомендую потестить, пожалуй, очень старательный товарищ. Честно говоря, дал ему безнадежную задачку - поправить слайд в презентации. Старался минут 15-20. Сделал (это кстати, как я тоже пробовал - презентация на питоне). Но, видимо, паверпойнт слишком сложная штуковина, нормально программировать себя не дает. Получилось так себе, но за попытку зачет.

П.С. В ПДФ получилось гораздо лучше - в паверпойнте, увы, все выглядит совсем неважно... любопытненько
👍2
Google подумал-подумал, и отрубил мне использование агента Gemini CLI в терминале - говорит, на нашей территории это невозможно. Обидно, конечно - буду рабоать либо с Claude Code, либо с Gemini как обычно, через браузер. Оно, может, и не так современно, но контроля гораздо больше...
😢1
Forwarded from Data Secrets
Австралийские ученые изобрели биологический искусственный интеллект

Из система называется PROTEUS (PROTein Evolution Using Selection). Это платформа для направленной эволюции молекул прямо внутри живых клеток млекопитающих.

Направленная эволюция – это когда эволюционные процессы белков или генов искусственно ускоряют и "направляют", чтобы получить молекулы с нужными свойствами. За ее изобретение в 2018 году Фрэнсис Х. Арнольд дали Нобелевку.

Но тогда метод работал только для бактерий или дрожжей, то есть для единичных простых белков. А PROTEUS – первый метод, который делает directed evolution для клеток млекопитающих. Кратко, как это работает:

➖ Специальные вирусоподобные частицы (VLV) заносят нужный ген в клетку и делают в нём случайные мутации, как будто перемешивают «параметры» белка.

➖ Если мутировавший белок работает лучше (например, активирует нужный сигнал сильнее), клетка даёт сигнал, и именно этот вариант распространяется дальше – как награда в Reinforcement Learning.

➖ Лучшие гены снова мутируют, снова проходят отбор. Все это похоже на эволюционный поиск гиперпараметров, но внутри живых клеток.

Буквально живой аналог AutoML. Авторы сами говорят, что вдохновлялись именно алгоритмами ИИ. И кстати, это уже работает на хомячках. Скоро будут тестировать и на людях, но там нужна дополнительная работа с иммунитетом.

Если такое заработает массово и стабильно – последствия могут быть революционными. Лекарства, выработка антител, синтетическая биология…

В такое будущее даже хочется.
Please open Telegram to view this post
VIEW IN TELEGRAM
❤1🔥1
Непростая доля селфхостера..

Устанавливаю на свой сервер различные приложения, последнее - appflowy, инструмент управления проектами. Приложение опенсорс, можно сидеть на бесплатной подписке с облаком от разработчиков, но это всегда ограничения. Поэтому ставлю приложение на свой сервер, и там же будут храниться все мои базы. Звучит классно, но установка - это прямо-таки пазл. Разворачивание контейнеров, пробрасывание портов, настройка аутентификации. Два вечера и два утра убиты. Зато еще немного погрузился в обратный прокси с Caddy, попользовался Portainer для контейнеров, опять же, OAuth2 от Google. Надеюсь, в следующий раз будет проще
❤2🏆1
KIRO - новый хайп среди агентов. Как я понимаю, работает на основе Клода, на основе запроса пишет постановку задачи, архитектуру, план - и программирует. Собственно то, чем я в последнее время занимался в ходе вайбкодинга. Интересно. Записался в лист ожидания
Ждем, возможно, на следующей неделе, GPT-5 от OpenAI
А вот кто еще вайбкодит с ClaudeCode - выпустили https://vibetunnel.sh/ который позволяет работать с Клодом удаленно, через терминал или любой браузер. Поделитесь, кто попробовал
Из других новостей:

Nvidia запустила нейронки маленького размера Nemotron, дистиллированные из DeepSeek. Утверждают, что SOTA. Многие профи говорят, что для промышленного применения маленькая нейронка с хорошей обвязкой промптами и контекстом часто лучше чем просто большая модель без нужной обвязки - так что надо погружаться.

А еще один ох отцов ИИ из Мета Ян Лекун разместил ссылочку на новую модель - что это пока непонятно (мне), но можно скачать, и это интересно, так как архитектура какая-то новая - LLMD.

Из новостей маркетинга - и Google, и OpenAI на решали международную математическую олимпиаду на золото, причем вроде бы Гугл сделал это раньше, но маркетинговый отдел, который согласовывает новости, будет работать в понедельник, так что Сэм весь хайп получил в одиночестве ))

И еще плюшки от OpenAI - с понедельника Агента начнут раскатывать на нормальные подписки (за $20), и, судя по всему, новая модель, которая выйдет в ближайшее время, будет очень крутой. Где там DeepSeek со своим R2? Так глядишь, снова придется откладывать релиз

И напоследок - вышел новый бенчмарк для агентов, люди проходят, машины - пока не очень. Впрочем, это уже интересно разве что тем, кто дошел до обучения нейронок
Для тех, кто размышляет о своем железе для локальных моделей - видосик от моего любимого железячника. В частности, о том, почему M3 Ultra в Mac Studio лучше чем M4 Max. Впрочем, уже M5 не за горами, будет ли только там в линейке Ultra? Я же пока наслаждаюсь минимальным M4 в Mac mini - тоже очень достойная машинка )) Доволен
Forwarded from Data Secrets
Qwen только что релизнули свою новую ризонинг-модель

Буквально несколько дней назад они заявили, что теперь будут выпускать ризонеры и не-ризонеры отдельно (вместо гибридных моделей), показали свежий чекпоинт не рассуждающего Qwen3-235B-A22B, и пообещали скоро вернутся с ризонинг-моделью.

Ждать пришлось недолго и скоро наступило спустя пять дней (учитесь, OpenAI и xAI). Только что стартап поделился моделью Qwen3-235B-A22B-Thinking-2507. Название – язык сломаешь, зато метрики стоящие.

На многих тестах модель обгоняет Gemini 2.5 Pro, o4-mini и свежую версию R1. То есть мало того, что это новая опенсорс SOTA. Это вполне себе уровень закрытой frontier модели. Мед.

Контекст – 256к токенов. Попробовать модель уже можно в чате или через API (стоит 0.7$ и 8.4$ соответственно за input и output, у провайдеров, скорее всего, будет дешевле).

Веса лежат тут.
Пишу мало, потому что путешествую в отпуске по загнивающим Европам. Времени на занятия ИИ нет, но зато пользуюсь Claude каждый день, чтобы спланировать путешествие и заказать отель. Визы мы получили за три дня до вылета (французы - молодцы, справились за три недели и дали на год), билеты и гостиницы я заранее не заказывал и даже не смотрел. Так что теперь каждый вечер сидим с Клодом и смотрим, где остановиться завтра. Впечатления такие: во-первых, полезно. Во-вторых, контекст заканчивается буквально за три-четыре запроса - видимо, в поиске много информации потребляется. Когда поставил research, Клод изучил 289(!) источников. Поэтому сделал проект с общим описанием задачи и каждый раз запускаю новый поиск.

При этом цены на отели пишет неправильные, доступность номеров на 3 человек - тоже та еще проблема. Когда совсем беда - бросаю интеллект и бучу сам. Правда, как показала практика, в половине отелей на их сайтах заказывать гораздо дешевле )) Можно было бы, конечно, заморочиться всякими агентами и пр., но лень - это просто выбор пути и отелей (задачка комбинаторной сложности..)

В общем, есть еще куда совершенствоваться
🍾2
Инсайдеры говорят, что память для Клода близка к выходу - сначала будет поиск по старым сообщения, а там, глядишь и пошире раскатают. Но это браузерная версия.

А текущий хит - Claude Code. Тут хорошие и плохие новости. Хорошие - появились субагенты, каждый может специализироваться на своем. А плохая - вводят недельные лимиты против тех, кто юзает его 24/7. А таких, говорят, много. Вот для него память тоже можно делать, но пока кастомно, тоже ждем официального продукта.
Прикольно. По ссылочке в гитхаб инструкция по модификации системного промпта для ChatGPT. Может бы и занялся, но в последнее время плотно пересел на Claude и Gemini. Но может кому пригодится

https://github.com/DenisSergeevitch/chatgpt-custom-instructions

https://t.me/denissexy/10529
❤1
Очередные мини-модели от китайцев для установки на свои мощности. Конечно, пока все это достаточно спорно, но через год-полтора модели уровня сегодняшних топ вполне смогут размещаться на домашних серверах..
Пожалуй, самые интересные новости сегодняшнего утра - GitHub выкатил формат, позволяющий запускать модели из кода или командной строки, причем это универсальный формат, совместимый с OpenAI SDK (т.е. все будет работать с большинством агентов). API от ChatGPT, Anthropic и пр. не нужны, достаточно API от GitHub с бесплатной подпиской. По ней будут работать бесплатные модели, по платной - работают модели покруче с контекстом побольше. Бонус в том, что над кодом можно работать не тратя деньги на подписки и установку собственных моделей, при этом можно практически мгновенно переключиться на собственные или проплаченные модели.

И тут же похожая новость от HuggingFace, которые дают возможность запускать автоматизированные задачи из терминала и скриптов. Как это работает, пока мне менее понятно, и подписка нужна платная, но тренд понятен - в связи с ростом популярности Claude Code и других аналогичных инструментов, работающих в терминале, для них создается все больше и больше инструментов, дающих доступ ко всему и вся. То, что доктор прописал, очень круто
❤1
Свершилось чудо! Ребята из OpenAI выпустили в Open Source модели, называются gpt-oss-120b и gpt-oss-20b.

Судя по тому, что они сами пишут в бенчмарках, это лучшие модели подобного форм-фактора на сегодняшний день.

Элементом является то, что модели включают в себя reasoning и вызов инструментов (tool use). Это означает, что их можно использовать в агентных приложениях в собственных продуктах.

Модели уже завезли в Ollama, так что можно поменять где-нибудь в системе автоматизации название модели с чего-нибудь на gpt-oss:latest и посмотреть, что будет :-)

Пробуем тут: https://www.gpt-oss.com/

Хороший день.
👍2❤1
Ну и, кстати, новость поменьше Claude Opus обновили до 4.1, уже доступен в Claude Code и на платных подписках. Ждем chstGPT-5 и новостей от Gemini.

И бонусом промпт в одно предложение, который существенно ограничивает фантазию Клода, если вы понимаете о чем я
В целом тренд на маленькие модели набирает обороты и новые модельки от OpenAI грозят стать отраслевым стандартом надолго, как llama 3. Для многих это будут первые модели к себя на компах. Посмотрим, как будет в жизни, но выглядит релиз очень многообещающе
❤1