very vibe coding
120 subscribers
460 photos
126 videos
13 files
980 links
Канал Алексея Макрушина об экспериментах в области vibe coding и всего интересного, что есть в области AI, ML и тому подобного
Download Telegram
Forwarded from Вайб-кодинг
Нашёл бесплатный опенсорс инструмент, который за секунды превращает любые PDF, Word, Excel или отсканированные изображения в чистый Markdown:

• текст в правильном порядке
• таблицы в HTML
• формулы в LaTeX
• OCR
• 109 языков

Работает через CLI, Python или веб (mineru.net). Запускается локально на твоём компьютере. 100% приватно.
Больше 70000 звёзд на GitHub. 😋
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥1
Forwarded from Вайб-кодинг
This media is not supported in your browser
VIEW IN TELEGRAM
NVIDIA открыла исходный код модели визуальной локализации LocateAnything-3B.

Модель умеет находить объекты даже в очень плотных сценах. Например, на изображении с десятками миньонов, стоящих вплотную друг к другу, она корректно выделяет каждого отдельной рамкой.

Главное отличие от большинства существующих моделей - это способ генерации ограничивающих рамок. Обычно координаты (x1, y1, x2, y2) предсказываются последовательно, цифра за цифрой. Это замедляет работу, а ошибки на ранних этапах могут влиять на последующие координаты, особенно если объектов много.

В LocateAnything-3B используется параллельное декодирование, тоесть модель сразу предсказывает готовые рамки целиком, а не строит их поэтапно. За счёт этого детекция становится стабильнее, особенно в сценах с большим количеством объектов.
Для обучения использовались не только классические датасеты для распознавания объектов, но и данные для распознавания интерфейсов, OCR и анализа структуры документов. Поэтому модель умеет находить как реальные объекты, так и элементы пользовательского интерфейса и текстовые области.

Модель содержит 3 млрд параметров и распространяется с открытым исходным кодом. 💜
Please open Telegram to view this post
VIEW IN TELEGRAM
Ну, кстати. Если кто-то раздумывает над платной подпиской, но не хочет тратить много - берите Антропик за 20 баксов (даже дешевле, если за год платить), ставьте Sonnet - и наслаждайтесь. Это отличное вхождение в мир LLM. Окупите потраченные деньги на паре больших презентаций, сделанных с Claude Design.
Forwarded from эйай ньюз
Anthropic опубликовали блогпост с деталями перевыпуска Fable 5

Официально подтвердили что причиной блокировки стал репорт амазона, где Fable 5 нашла уязвимость и написала код который её может использовать. Те же самые уязвимости могли найти и использовать Opus 4.8, GPT 5.5 и Kimi K2.7. Тем не менее Anthropic натренировали более жёсткий классификатор, который будет перекидывать запросы на Opus 4.8.

Доступ должны включить всем у кого он был в течение ~суток. До 7 июля до половины лимитов подписок Pro, Team, Max и Premium Enterprise могут быть использованы на Fable 5, дальше по кредитам.

@ai_newz
Fable вернулся... А я пока тестирую Sonnet на изготовлении презентаций...
Ну, в общем, да. Похоже, что Sonnet действительно очень прожорлив на токены. По крайней мере, при подготовке презентации с Опус они уходят не сильно быстрее Соннета.

Чувствую себя так, как будто купил в магазине бутылку кефира, которая по цене хороша, а по размерам оказалась раза в полтора меньше прежней модели...

Fable, конечно, круто, но по АПИ его будут использовать только крейзи сотрудники айти компаний. Единственное, что нас спасет пока - это GPT-5.6. Может, глядя на него и Fable будет доступнее, но для этого надо сначала модель выпустить в паблик..
Forwarded from Вайб-кодинг
This media is not supported in your browser
VIEW IN TELEGRAM
Anthropic выпустили официальную библиотеку промптов для Claude.

И она полностью бесплатна. Там есть:
- Планирование, отладка, ревью кода, безопасность, автоматизация

Каждый промпт сопровождается пояснениями, как и почему он работает. Библиотека создана самой Anthropic.

🎉🎉🎉
Please open Telegram to view this post
VIEW IN TELEGRAM
❤2
Прежде чем вам пересылать такие посты, я обычно спрашиваю своего кло - интересно, стоит заняться?

С память я и без кло знаю - что важно. Но вот когда дойдут до этого руки... У меня сейчас, кстати, стоят параллельно claude-mem и agentmemory. Иногда использую, но не сказать, чтобы это прям в систему вошло

https://t.me/machinelearning_interview/2855
Fable вернулся, но чуда не случилось. Склонен согласиться с критиками, что теперь это просто Опус, магия пропала. Интересно, что будет с GPT-5.6, насколько зарежут Sol.
Forwarded from Вайб-кодинг
Несколько ресурсов по harness engineering, которые я с большим удовольствием изучаю в последнее время:

» https://walkinglabs.github.io/learn-harness-engineering/en/ — отличный курс о том, как продуктивно ограничивать поведение агента, какие проблемы возникают при использовании LLM (особенно с удержанием контекста) и как сделать harness более агентным и доводящим задачи до корректного завершения.
» https://twotimespi.dev — создай упрощённого агента на Python (Tau). Начни с uv tool install tau-ai.
» https://humanlayer.dev/blog/skill-issue-harness-engineering-for-coding-agents — уроки и выводы из неудач и успехов в построении harness-ов для кодинг-агентов за 12+ месяцев.
» https://langchain.com/blog/the-anatomy-of-an-agent-harness — обзор высокого уровня множества компонентов, которые должны правильно сойтись в harness-е, чтобы агент работал.

🐸🐸🐸
Please open Telegram to view this post
VIEW IN TELEGRAM
Cursor наконец дообучил свою модельку на мощностях xAI. Раньше они работали с Kimi-2.6 - интересно, насколько новая модель ее развитие, или писали прямо все свое с нуля.

Предложение интересное, особенно для тех, кто сидит на Курсоре, но у меня и так уже три модели по подписке - GPT, Claude, GLM, плюс по апи DeepSeek - пятую уже не осилю

https://t.me/data_secrets/9508
У Клода есть фишка, которой я пользуюсь чаще и чаще - Claude Design. Начинаю отвыкать от самостоятельного изготовления презентаций. Думаю, что это уже навсегда.
Когда я вайбкодю, очень часто использую разные модели. Одна программирует - другие проверяют. Это позволяет находить много ошибок, и бонус в том, что разные модели на код смотрят по разному, здесь разнообразие принципиально важно.

Запустил проверку с 4 моделями - Fabel, GPT, GLM, DeppSeek. Из интересного - DeepSeek хотя и самая слабая модель из этих, нашел несколько критичных проблем, которые не увидели другие. GPT- нашел больше всего. А Fable - даже не стал искать. Он посчитал, что оркестратору это не нужно. Очень в духе Антропиковских моделей - никогда не видел таких ленивых ИИ у других компаний ))
Новый стандарт для голосовых ассистентов - надеюсь, недолго ждать когда появятся подобные локальные модели. Тот же Sber может постараться - его Salut для распознавания голоса я использую активно.

Думаю, через какое-то время и у мошенников уйдет украинский акцент..

https://t.me/vibecoding_tg/3445
Раньше были лайфхаки для домохозяек и всякие «очумелые ручки». Теперь - рецепты для вайбкодеров. Ниже - один из них.

https://t.me/vibecoding_tg/3449

Есть еще популярный промпт caveman - по моему опыту работает, хотя и не идеально, но я его использую не для выдачи моделей, а для подготовки промптов у агентов.

https://t.me/lovedeathtransformers/10809
ChatGPT вышел, а лимиты обновили у Claude code )) опять два дня можно жечь токены без разбора.

Хорошо, что модели разной силы, дешевые модели тоже нужны, потому что палить токены на поиск с дорогими - зашквар.

Вот чего OpenAI не хватает - это нормальной организации агентов. У Клода здесь все лучше и понятнее сделано. За последнее время я стал гораздо лояльнее к GPT, но есть еще места, где Клода пока не заменить (лучше пишет, лучше делает презентации, лучше работает с агентами)..
Ну и кстати, еще одна интересная обнова - Muse Spark 1.1. от Мета. Дешевле Grok 4.5 и по тестам сильнее. Осталось только Gemini 3.5 Pro долждаться, и вся семья в сборе (американская). А от китайцев ждем обновление DeepSeek, MiniMax..

И похоже, надо внимательнее посмотреть на OpenHands

https://t.me/data_secrets/9519