с ИИ-агентами можно создавать сайты, коворили они...
ИИ-агенты упрощают работу, говорили они...
ИИ-агента на самом деле 👆👆👆
По итогу всё починили, но нестабильность работы колоссальная
#косяки
ИИ-агенты упрощают работу, говорили они...
ИИ-агента на самом деле 👆👆👆
По итогу всё починили, но нестабильность работы колоссальная
#косяки
Всем утро доброе!
Еще один косяк работы агентов. Он должен был сконвертировать заметки из формата Evernote в Obsidian и загурзить в отдельную папку. В итоге вместо конвертации текущей заметки, он решил, что уже делал эту работу и пропустил конвертацию самого файла, придумал что 1 заметка пустая, и описал всё это.
При этом скилл автоматизации работы с заметками в Обсидиан у него прописан и там есть информация, что нужно использовать скрипт автоматизации.
Всё больше прихожу к выводу, что ИИ-агентов можно в какой-то ограниченной части работы программы использовать, там где невозмодно четких алгоритмов прописать, а для все остального эффективнее автоматизировать через "тупые программы", которые делают то, что о них ожидаешь.
#размышления #косяки
Еще один косяк работы агентов. Он должен был сконвертировать заметки из формата Evernote в Obsidian и загурзить в отдельную папку. В итоге вместо конвертации текущей заметки, он решил, что уже делал эту работу и пропустил конвертацию самого файла, придумал что 1 заметка пустая, и описал всё это.
При этом скилл автоматизации работы с заметками в Обсидиан у него прописан и там есть информация, что нужно использовать скрипт автоматизации.
Всё больше прихожу к выводу, что ИИ-агентов можно в какой-то ограниченной части работы программы использовать, там где невозмодно четких алгоритмов прописать, а для все остального эффективнее автоматизировать через "тупые программы", которые делают то, что о них ожидаешь.
#размышления #косяки
🕊2
При этом вещи связанные с кодом делают. Не на "Ура!", но делают:
• 1 промт сделай калькулятор Триатлона
• 5 минут работы
• 2 дня мелких корректировок и правок (суммарно на час чистой работы)
и, я готов, представить калькулятор триатлона.
Лучший в своём роде!
https://dimino.me/triatlon/calc/
#триатлон
• 1 промт сделай калькулятор Триатлона
• 5 минут работы
• 2 дня мелких корректировок и правок (суммарно на час чистой работы)
и, я готов, представить калькулятор триатлона.
Лучший в своём роде!
https://dimino.me/triatlon/calc/
#триатлон
👍1
Please open Telegram to view this post
VIEW IN TELEGRAM
Немного подробнее про генератор вселенных на Hermes Agent (Из поста выше). Он называется Noustiny.
Штука в том, что ты не пишешь сценарий. Бросаешь «семечко» — завязку, идею, пару персонажей — а система разворачивает из него дерево сюжетных веток. Захотел в середине истории добавить сцену, где герой сворачивает не туда? Вставляешь — и следующие события переписываются сами. Персонаж при этом не плывёт визуально: образ держится единым через всю историю.
Голос клонируется через ElevenLabs — можно скинуть ссылку на YouTube, и рассказчик заговорит нужным тембром. На выходе — готовое видео, можно публиковать.
Интересно даже не то, что видео генерится. А то, что меняется сам подход к нарративу: история перестаёт быть линией и становится пространством вариантов. Написал — и пошёл гулять по веткам.
Технически это не просто скилл упакованный в одном файле, а 12 инструментов на Python, 13 скиллов, два цикла обработки.
https://github.com/UfukNode/Noustiny
#Hermes
Штука в том, что ты не пишешь сценарий. Бросаешь «семечко» — завязку, идею, пару персонажей — а система разворачивает из него дерево сюжетных веток. Захотел в середине истории добавить сцену, где герой сворачивает не туда? Вставляешь — и следующие события переписываются сами. Персонаж при этом не плывёт визуально: образ держится единым через всю историю.
Голос клонируется через ElevenLabs — можно скинуть ссылку на YouTube, и рассказчик заговорит нужным тембром. На выходе — готовое видео, можно публиковать.
Интересно даже не то, что видео генерится. А то, что меняется сам подход к нарративу: история перестаёт быть линией и становится пространством вариантов. Написал — и пошёл гулять по веткам.
Технически это не просто скилл упакованный в одном файле, а 12 инструментов на Python, 13 скиллов, два цикла обработки.
https://github.com/UfukNode/Noustiny
#Hermes
Forwarded from Сергей Пименов
Наткнулся на статью, которая дала мне новый взгляд на Codex Desktop. Автор — Meta Alchemist — описал штуку, до которой я сам не додумался: оказывается, Codex Desktop можно использовать не как терминал для кода, а как полноценный визуальный конструктор интерфейсов.
Суть простая: Codex собирает UI, запускает его, делает скриншот, смотрит на результат через vision, находит косяки, правит и повторяет — пока не станет хорошо. Плюс генерирует ассеты через imagegen и даже проводит A/B-тесты вариантов прямо в процессе. То есть дизайн-цикл, который обычно занимает часы ручного тыканья, сворачивается в несколько итераций.
Я перевёл и адаптировал статью — с промптами, воркфлоу и мастер-промптом, который можно скопировать и сразу применить. Там есть примеры для игровых интерфейсов, продуктовых дашбордов и даже извлечение art bible из готового проекта.
Если вы работаете с Codex и до сих пор используете его как умную командную строку — почитайте, это реально другой уровень.
Статья на сайте: https://pimenov.ai/articles/codex-desktop-visual-design-loop/
Суть простая: Codex собирает UI, запускает его, делает скриншот, смотрит на результат через vision, находит косяки, правит и повторяет — пока не станет хорошо. Плюс генерирует ассеты через imagegen и даже проводит A/B-тесты вариантов прямо в процессе. То есть дизайн-цикл, который обычно занимает часы ручного тыканья, сворачивается в несколько итераций.
Я перевёл и адаптировал статью — с промптами, воркфлоу и мастер-промптом, который можно скопировать и сразу применить. Там есть примеры для игровых интерфейсов, продуктовых дашбордов и даже извлечение art bible из готового проекта.
Если вы работаете с Codex и до сих пор используете его как умную командную строку — почитайте, это реально другой уровень.
Статья на сайте: https://pimenov.ai/articles/codex-desktop-visual-design-loop/
Forwarded from Двач
Please open Telegram to view this post
VIEW IN TELEGRAM
👀1
ИИ-агенты перенесли сайт на платформу EmDAash, и вот что получилось....
Хоть работали, но работали на GLM-5.1 и на DeepSeek 4 Pro.
Вот он результат: от того, что было, это сильно отличается. Частично разочарование, но частично радость, что мы переехали на новую платформу.
За вечер или за завтра все косяки отработаем, и все будет хорошо!
По ощущениям, при работе через Codex скорость выше и качество лучше.
#триатлон #emdash #codex #deepseek #glm #сайтостроение
Хоть работали, но работали на GLM-5.1 и на DeepSeek 4 Pro.
Вот он результат: от того, что было, это сильно отличается. Частично разочарование, но частично радость, что мы переехали на новую платформу.
За вечер или за завтра все косяки отработаем, и все будет хорошо!
По ощущениям, при работе через Codex скорость выше и качество лучше.
#триатлон #emdash #codex #deepseek #glm #сайтостроение
🫡1
На прошлой неделе не мог войти в Codex, потому что тот запрашивал код из СМС. В итоге, плюнул на него и на все выходные бросил попытки авторизации.
Сегодня, по приколу, решил еще раз авторизоваться, и он пустил без запроса СМС-кода.
Чудо-чудное, диво-дивное) Видимо есть какая-то динамическая проверка этапа с СМС-кодами, для скомпрометирвоанных аккаунтов. А чтобы экономить и регулярно не тратится на коды, они её обнуляют в некий промежуток временги.
Вообщем, классический вариант "я ничего не делал, оно само починилось" или "прилетело НЛО и всё починило" =)
#Codex
Сегодня, по приколу, решил еще раз авторизоваться, и он пустил без запроса СМС-кода.
Чудо-чудное, диво-дивное) Видимо есть какая-то динамическая проверка этапа с СМС-кодами, для скомпрометирвоанных аккаунтов. А чтобы экономить и регулярно не тратится на коды, они её обнуляют в некий промежуток временги.
Вообщем, классический вариант "я ничего не делал, оно само починилось" или "прилетело НЛО и всё починило" =)
#Codex
Полностью согласен с автором по всем пунктам статьи. Хотелось бы добавить, что таких людей "Генералистов с AI" намного сложнее отоюрать в компанию и вырастить в компании, чем специалистов с одним прокаченным скилом.
Ну и еще размышление, созвучное с тем, что есть в статье, что процесс перевода на работу с AI должен быть процессом перевода не отдельных отделов, а именно ВСЕЙ компании. Сложный и по сути дорогостоящий процесс, дообучения и замены людей, который не факт, что будет экономически эффективен т.к. скорость работы внутри команды возрастёт, а скорость получения информации от клиента - нет.
По мне, это эффективно для "продуктовых" команд, а не проектных - в который есть сильная зависимость от получение информации и решений от клиента.
#размышления_на_тему
Ну и еще размышление, созвучное с тем, что есть в статье, что процесс перевода на работу с AI должен быть процессом перевода не отдельных отделов, а именно ВСЕЙ компании. Сложный и по сути дорогостоящий процесс, дообучения и замены людей, который не факт, что будет экономически эффективен т.к. скорость работы внутри команды возрастёт, а скорость получения информации от клиента - нет.
По мне, это эффективно для "продуктовых" команд, а не проектных - в который есть сильная зависимость от получение информации и решений от клиента.
#размышления_на_тему
Telegram
Технозаметки Малышева
Миграция bottlneck
Andrew Ng написал на днях то, о чём я много думаю последний год: AI-native команды работают принципиально иначе.
Не быстрее пишут код, тестируют, пишут документы, а иначе. Роли размываются.
Инженер - это одновременно продакт, дизайнер…
Andrew Ng написал на днях то, о чём я много думаю последний год: AI-native команды работают принципиально иначе.
Не быстрее пишут код, тестируют, пишут документы, а иначе. Роли размываются.
Инженер - это одновременно продакт, дизайнер…
Codex стал мобильным приложением для телефона. Огонь!
Вообще поработал с Claude Desktop я понял, что для меня Codex приятнее в работе.
По качеству работы последняя версия GPT 5.5 всё таки пока лучше китайских аналогов.
Как пишут "интернеты" китацы отстают на несколько месяцев со своими open source моделями.
#Codex
Вообще поработал с Claude Desktop я понял, что для меня Codex приятнее в работе.
По качеству работы последняя версия GPT 5.5 всё таки пока лучше китайских аналогов.
Как пишут "интернеты" китацы отстают на несколько месяцев со своими open source моделями.
#Codex
👍1
Forwarded from Николай Хлебинский
На прошлой неделе команда Cactus Compute (стартап, делающий встроенные LLM для мобильных устройств) выложила в open-source маленькую модель Needle на 26 миллионов параметров. Лицензия MIT, можно брать в любой коммерческий продукт. Главное в ней не размер сам по себе, а то, что она умеет на основе запроса на естественном языке делать так называемый function calling (то есть сама вызывает нужные сервисы и функции) и работает локально, прямо на телефоне или часах, без интернета и без обращений к чужим серверам. Не выходя в сеть, она вызовет нужный сервис: запросит погоду, создаст митинг в зуме, отправит письмо или сообщение.
Модель дистиллировали из Gemini 3.1 Flash Lite: большая модель служила учителем, маленькая училась у нее, предобучение заняло 27 часов. Бюджет вычислений, который еще пару лет назад тянули только фронтир-лаборатории, сегодня помещается в эксперимент команды из нескольких человек.
До сих пор function calling жил в API OpenAI, Anthropic, Google: каждый вызов агента, распознающего запрос на естественном языке, означал запрос в их API за деньги. Теперь это переезжает на железо пользователя в виде микро-LLM, встроенных в приложения для компьютеров и телефонов. На самом деле для 80% задач бизнеса большие модели с огромной стоимостью обучения и дорогими токенами не нужны. Нас ждет волна софта с втроенными небольшими моделями, где цена одного вызова LLM падает с долей цента за токен до стоимости электричества телефона.
Для нашего локального контекста это означает, что нас теперь есть команда крепких ИИ-мидлов которые могут жить прямо на нашем устройстве, а не в облаке за подпиской в валюте. Контроль качества для CRM, ассистент кассира в кофейне, роутер заказов в точке выдачи, такие функции теперь могут гонять локально, без счета за токены и без зависимости от того, дойдет ли запрос до серверов в другой стране.
Проект Needle: https://github.com/cactus-compute/needle
Модель дистиллировали из Gemini 3.1 Flash Lite: большая модель служила учителем, маленькая училась у нее, предобучение заняло 27 часов. Бюджет вычислений, который еще пару лет назад тянули только фронтир-лаборатории, сегодня помещается в эксперимент команды из нескольких человек.
До сих пор function calling жил в API OpenAI, Anthropic, Google: каждый вызов агента, распознающего запрос на естественном языке, означал запрос в их API за деньги. Теперь это переезжает на железо пользователя в виде микро-LLM, встроенных в приложения для компьютеров и телефонов. На самом деле для 80% задач бизнеса большие модели с огромной стоимостью обучения и дорогими токенами не нужны. Нас ждет волна софта с втроенными небольшими моделями, где цена одного вызова LLM падает с долей цента за токен до стоимости электричества телефона.
Для нашего локального контекста это означает, что нас теперь есть команда крепких ИИ-мидлов которые могут жить прямо на нашем устройстве, а не в облаке за подпиской в валюте. Контроль качества для CRM, ассистент кассира в кофейне, роутер заказов в точке выдачи, такие функции теперь могут гонять локально, без счета за токены и без зависимости от того, дойдет ли запрос до серверов в другой стране.
Проект Needle: https://github.com/cactus-compute/needle
👍1👀1