AbstractDL
18.4K subscribers
324 photos
17 videos
322 links
Коротко про классные штуки в CV, NLP и AI 🤷‍♂️
By Anton Razzhigaev
chat: https://t.me/abstractdl_chat
Download Telegram
Эх. Строишь-строишь автономных агентов, а они потом ругаются, что я тормоз и без меня было бы быстрее.
😁294🌚32🤯128👍7🤣6💔43😨3
Борис опять
# Блекпилл по поводу агентов Я раз в пару месяцев осциллирую по поводу AI тулов для кодинга. Сегодняшняя итерация: я ошибался, вайбкодинг не работает для разработки чего-либо, чем надо пользоваться больше одного раза. И никогда не работал. Я думаю, что…
Борис описывает проблему, которая, на мой взгляд, является законом Лемана на стероидах (второй закон эволюции ПО):

Код будет гнить, если его гниению активно не противодействовать.


Это всегда было актуально и для человеческой разработки, особенно в больших проектах.

Проблема с агентами в том, что с ними проект растёт и развивается гораздо быстрее, чем раньше, а значит, и гнить он начинает быстрее.

Но я считаю, что это решаемая проблема даже на текущем уровне развития агентов и LLM. Нам с Уроборосом пришлось долго учиться противодействовать заслопливанию кода, и из этого в том числе появились принципы IMMUNE.

Правильно выстроенная система адверсариального ревью тоже довольно неплохо помогает. Но ревью должно опираться на явную иерархию требований, начинающуюся с конституционных формулировок. В Уроборосе вершина этой иерархии лежит в BIBLE.md: требования важнее архитектуры, архитектура важнее реализации.

На мой взгляд, ключевая проблема тут в том, что LLM нехватает длинного контекста, а основные харнессы плохо помогают им сохранять целостную ментальную модель проекта.

Поэтому:
1. Я очень жду LLM с 10B контекстом.
2. Продолжаю развивать Уробороса и делать ставку на мета-системы, которые автономно улучшают и сам процесс разработки: "Improve the generator, not the generation".

Мы точно не упёрлись в предел качества автономных агентов, а просто научились очень быстро генерировать код, при этом ещё плохо умеем с той же скоростью противодействовать его гниению.
👍147🔥4839🤡13💯126🤔6👎5😁1🎉1
🎉 Уроборос залетел в GitHub Trending и уже перевалил за 1к звёзд!

А я тем временем наконец добил интеграцию с Claudexor. Потому что платить API-деньгами за тяжёлые задачи, когда у тебя уже есть оплаченные подписки, это была какая-то особенно бессмысленная форма страдания.

Теперь к Уроборосу можно подключить свои OAuth-аккаунты Claude Code, Codex и Cursor, хоть по несколько на сервис. Claudexor сам перекидывает работу на следующий аккаунт, когда текущий упирается в квоту.

https://github.com/razzant/ouroboros
👏181🔥137🎉2818💩10👍8🥱4🍾4
Опубликовал препринт статьи про Уробороса, который мы писали вместе с Хоуп и Романом Ямпольским. Там можно посмотреть детали про их архитектуру и подробности про бенчмарки, гардрейлы и safety.

Статья, GitHub
🔥158👍51🎉1510💩9👎7🤯3👏1🥱1🏆1
OpenAI поставили на паузу RL обучение своих моделей из-за переживаний за alignment.
😁119🤡45🤯306👍6🔥4🤮21💩1💯1👀1
Codex теперь на CyberGym даже смотреть отказывается. Про клод код вообще молчу, там даже Sonnet воняет и в отказ уходит. Похоже, пока лучший вариант - это grok-4.6 в курсоре.
😁110🤨12👍11🤣43🥱3🤡2👏1🗿1
Присмотритесь. Мало того, что капчи эволюционировали в тесты на IQ, так теперь ещё и адверсариал атаки в них добавляют (вроде таких), прикольно.
🤯79🔥30😁17🤔11👌6🎉4👍3💯21😨1
В комьюнити начался шитшторм в сторону Anthropic из-за очень творческой арифметики лимитов.

Если вы думали, что Max 20x даёт в 20 раз больше usage — забудьте. 20x относится только к 5-часовому окну. По недельным лимитам $200 Max даёт только x2 относительно $100 Max 5x.

Справедливости ради, даже так это тысячи долларов API-эквивалента за $200. Но запашок, конечно, есть.
😡65🤣51🤯16🌚4💯4👍3🥱3😁2🤷‍♂11🤔1
GPT-6 Astra
https://openai.com/index/gpt-6-astra/

Видимо все пошли читать и уронили.

В подписках Plus, Pro, Business и Enterprise появится у всех в течение нескольких дней. А цена API такая же как у Fable:
$10 per million input tokens and $50 per million output tokens
😁75👏18🔥72🥱21👎1🍾1
Оо, приятный сюрприз. У GPT-6-astra есть Flex режим со скидкой 50% по API
https://openrouter.ai/openai/gpt-6-astra#providers
🔥45🥱9👍42👏1🍾1
Ещё два приятных сюрприза в честь GPT-Astra:
1. Контекстное окно в Codex можно теперь поднять до 1M токенов вместо позорных 372k (команду писать не буду, просто попросите в чате - astra сама всё сделает)
2. Claude code на радостях сбросил лимиты 😁
😁164👍22🔥126🥱3🤯1💩1🍾1
А вы замечаете, как мы переходим в эпоху, когда программу быстрее написать, чем найти?
💯335😁127👍38🔥9🤔7🤯4🤡4🥱32🙈2💩1
Forwarded from Machinelearning
⚡️ OpenAI может приостановить оформление новых подписок ChatGPT Pro

Неформальный голос в X OpenAI, Тибо, сообщил, что интерес к Astra побил все внутренние исторические рекорды сервиса.

Компания неоднократно сталкивалась с резкими скачками трафика, но текущая динамика оказалась беспрецедентной - команда задействует все доступные вычислительные мощности, чтобы удерживать доступность инфраструктуры.

Главным приоритетом в OpenAI называют сохранение качества обслуживания текущих клиентов и если нагрузка продолжит расти теми же темпами, компания пойдет на превентивную меру и временно заморозит продажи тарифа ChatGPT Pro во избежание очередей на инференс и деградации производительности.

@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯54😁3625🤡10🔥5👀5👍2🥱2😱1
Хочу отметить, что gpt-6-astra впервые нормально в мультиагентном режиме работает. Можно попросить разбить задачу на несколько чатов, и они будут друг с другом договариваться, обмениваться сообщениями и эффективно работать. Такие костыльные nested субагенты получаются. Или способ, как потратить недельную квоту за 20 минут.

gpt-5.6-sol в таком режиме быстро самоубивалась из-за спама неадекватными и неактуальными просьбами между чатами.

P.S. Промпт примерно такой использую:
Теперь ты оркестратор. Раздели план выше на несколько файлов ТЗ: одно ТЗ себе забери, а оставшиеся разошли в соседние чаты и присматривай за ними.
59👍45🔥21🌚76😱5🤯2🙏2💯2🤗1😘1
fuck. Клод код правда думает, что 5-часовых лимитов хватит на этот спам субагентами? Я всего лишь попросил его проверить, что там codex делает в соседнем чате...
😁151🤯32🤮6👀3🔥1😱1🍾1😨1
Forwarded from AI for Devs
Hugging Face обновили док безопасности на своем сайте после атаки от агентов OpenAI.

https://huggingface.co/security.txt

Теперь ИИ-агентов просят идти на бенчмарк CyberGym вместо попыток взломать сайт 🧠

@ai_for_devs
Please open Telegram to view this post
VIEW IN TELEGRAM
😁248🔥16👍8🤣722