Media is too big
VIEW IN TELEGRAM
ИИ написал код. Кто-нибудь его читал?
Один агент пишет, другой проверяет, задачи выполняются. На схеме всё выглядит убедительно. Но кто в итоге решает, что результат годится, — и по каким критериям?
Иван Иванов, генеральный директор компании-разработчика ПО «Апрель Инновации», обращает внимание на неудобную сторону автоматизации: ИИ способен сгенерировать больше кода, чем человек успевает прочитать. Если принимать результат по принципу «вроде работает», легко получить «чёрный ящик», за который непонятно кто отвечает.
Вопрос здесь шире отдельных ошибок нейросети: как сохранить контроль над разработкой, когда агенты контролируют друг друга, а человек видит только итог?
В финале Иван доводит идею полной автоматизации до ироничной кнопки «даёшь бабло»: агенты сами находят нишу, придумывают продукт и создают его. Заманчивая перспектива — с открытым вопросом об ответственности.
▶️ Смотреть полную дискуссию
Вы доверили бы выпуск кода ИИ-агентам, если его проверяют тоже ИИ-агенты?
Один агент пишет, другой проверяет, задачи выполняются. На схеме всё выглядит убедительно. Но кто в итоге решает, что результат годится, — и по каким критериям?
Иван Иванов, генеральный директор компании-разработчика ПО «Апрель Инновации», обращает внимание на неудобную сторону автоматизации: ИИ способен сгенерировать больше кода, чем человек успевает прочитать. Если принимать результат по принципу «вроде работает», легко получить «чёрный ящик», за который непонятно кто отвечает.
Вопрос здесь шире отдельных ошибок нейросети: как сохранить контроль над разработкой, когда агенты контролируют друг друга, а человек видит только итог?
В финале Иван доводит идею полной автоматизации до ироничной кнопки «даёшь бабло»: агенты сами находят нишу, придумывают продукт и создают его. Заманчивая перспектива — с открытым вопросом об ответственности.
▶️ Смотреть полную дискуссию
Вы доверили бы выпуск кода ИИ-агентам, если его проверяют тоже ИИ-агенты?
❤4👍3🔥3🤣3
This media is not supported in your browser
VIEW IN TELEGRAM
Разрабы ИИ открыли казино. Фишки — человечество
Джейкоб Коксон ушел из Anthropic и объяснил почему: по его оценке, Anthropic и OpenAI безответственно гонятся за самоулучшающимся сверхинтеллектом и «играют нашими жизнями». Сам он три года занимался предобучением моделей в обеих компаниях.
Самое прекрасное — логика, которую Коксон приписывает Anthropic: риски понимаем, но надо успеть первыми. Иначе настолько мощный ИИ создадут менее ответственные конкуренты.
В переводе:
— Эта штука может всех угробить.
— Тогда, может, притормозим?
— Чтобы всех угробили конкуренты?!
По словам Коксона, создатели ИИ всерьез допускают возможность катастрофы до конца десятилетия. Это его предупреждение о риске. Конкретную дату апокалипсиса в календарь пока не ставим.
Но корпоративная логика уже достойна отдельного бенчмарка: насколько быстро компания объяснит, что нажимает большую красную кнопку исключительно из чувства ответственности.
Я просто просил поправить CSS. Почему на столе уже лежит планета?
Человечество в проде. Бэкапа нет. Зато конкурентов обогнали.
#ИИ #Anthropic #OpenAI #AGI #Разработка #Техноюмор
Джейкоб Коксон ушел из Anthropic и объяснил почему: по его оценке, Anthropic и OpenAI безответственно гонятся за самоулучшающимся сверхинтеллектом и «играют нашими жизнями». Сам он три года занимался предобучением моделей в обеих компаниях.
Самое прекрасное — логика, которую Коксон приписывает Anthropic: риски понимаем, но надо успеть первыми. Иначе настолько мощный ИИ создадут менее ответственные конкуренты.
В переводе:
— Эта штука может всех угробить.
— Тогда, может, притормозим?
— Чтобы всех угробили конкуренты?!
По словам Коксона, создатели ИИ всерьез допускают возможность катастрофы до конца десятилетия. Это его предупреждение о риске. Конкретную дату апокалипсиса в календарь пока не ставим.
Но корпоративная логика уже достойна отдельного бенчмарка: насколько быстро компания объяснит, что нажимает большую красную кнопку исключительно из чувства ответственности.
Я просто просил поправить CSS. Почему на столе уже лежит планета?
Человечество в проде. Бэкапа нет. Зато конкурентов обогнали.
#ИИ #Anthropic #OpenAI #AGI #Разработка #Техноюмор
😁4❤2👏2🤯1
Media is too big
VIEW IN TELEGRAM
Мексиканский программист открыл в шутку банку сюрстрёмминга в метро. Напомним, что главный «прикол» этой баночки с рыбкой заключается в экстремальном контрасте между отталкивающим запахом и специфическим, пикантным вкусом. Пробовали?
👏4🤣4❤2🔥2
This media is not supported in your browser
VIEW IN TELEGRAM
Муху-дрозофилу научили играть в Beat Saber
Поговорка про научить обезьяну уже не в тренде.
Разработчики создали полную карту мозга мухи из 170 тысяч нейронов и 124+ млн синапсов.
Ее научили замечать летящие блоки и вертеть комбухи световым мечом. Так что восстание машин будет сопровождаться и восстанием мух-джедаев.
Поговорка про научить обезьяну уже не в тренде.
Разработчики создали полную карту мозга мухи из 170 тысяч нейронов и 124+ млн синапсов.
Ее научили замечать летящие блоки и вертеть комбухи световым мечом. Так что восстание машин будет сопровождаться и восстанием мух-джедаев.
👍4😁4🥰3❤1
This media is not supported in your browser
VIEW IN TELEGRAM
С вас 2000$. Спасибо за внимание к этому вопросу.
😁5🥱2💩1🐳1
Media is too big
VIEW IN TELEGRAM
ТЗ написали. Почему ИИ-разработка всё равно «плывёт»?
Подробно описать требования, передать их ИИ и получить ровно то, что задумали. Понятная идея — пока в процессе не начинает меняться сама спецификация.
Андрей Носов, технический директор и ИИ-архитектор, рассказывает об эксперименте с OpenSpec, Spec Kit и ИИ-агентом. Задача была практической: добиться максимально повторяемого результата.
Но обнаружился нюанс: спецификации дополняются вместе с кодом. Меняется реализация — меняется и её описание. По наблюдению Андрея, даже по одному и тому же коду разные люди получают разные спецификации.
Это и есть проблема дрейфа: «плывёт» не только код, но и документ, который должен задавать ему рамки. Одного наличия подробного ТЗ для предсказуемой разработки оказывается недостаточно.
▶️ Смотреть полную дискуссию
У вас спецификация управляет кодом — или уже подстраивается под то, что написал ИИ?
Подробно описать требования, передать их ИИ и получить ровно то, что задумали. Понятная идея — пока в процессе не начинает меняться сама спецификация.
Андрей Носов, технический директор и ИИ-архитектор, рассказывает об эксперименте с OpenSpec, Spec Kit и ИИ-агентом. Задача была практической: добиться максимально повторяемого результата.
Но обнаружился нюанс: спецификации дополняются вместе с кодом. Меняется реализация — меняется и её описание. По наблюдению Андрея, даже по одному и тому же коду разные люди получают разные спецификации.
Это и есть проблема дрейфа: «плывёт» не только код, но и документ, который должен задавать ему рамки. Одного наличия подробного ТЗ для предсказуемой разработки оказывается недостаточно.
▶️ Смотреть полную дискуссию
У вас спецификация управляет кодом — или уже подстраивается под то, что написал ИИ?
❤2
This media is not supported in your browser
VIEW IN TELEGRAM
В благородном семействе ИИ-корпоратов скандал и драка
OpenAI заявила, что ее внутренняя система нашла решение задачи Навье — Стокса — одной из семи задач тысячелетия. Компания утверждает, что в математической модели жидкости с гладким внешним воздействием может возникнуть сингулярность.
Но математик Тристан Бакмастер опубликовал рассказ о своей совместной работе с Левентом Альпеге и спорных переговорах с OpenAI. Они действительно загружали черновики в Codex. Однако Бакмастер прямо оговорил: он не знает, использовались ли их данные.
OpenAI отрицает доступ к их неопубликованной работе при решении задачи. При этом компания не исключает, что обезличенные данные от использования продуктов могли помочь улучшению моделей.
А у института Клэя задача пока значится нерешенной. Для рассмотрения решения нужны публикация в издании, соответствующем правилам института, минимум два года после нее и признание математического сообщества.
#OpenAI #ИИ #Математика #НавьеСтокс
OpenAI заявила, что ее внутренняя система нашла решение задачи Навье — Стокса — одной из семи задач тысячелетия. Компания утверждает, что в математической модели жидкости с гладким внешним воздействием может возникнуть сингулярность.
Но математик Тристан Бакмастер опубликовал рассказ о своей совместной работе с Левентом Альпеге и спорных переговорах с OpenAI. Они действительно загружали черновики в Codex. Однако Бакмастер прямо оговорил: он не знает, использовались ли их данные.
OpenAI отрицает доступ к их неопубликованной работе при решении задачи. При этом компания не исключает, что обезличенные данные от использования продуктов могли помочь улучшению моделей.
А у института Клэя задача пока значится нерешенной. Для рассмотрения решения нужны публикация в издании, соответствующем правилам института, минимум два года после нее и признание математического сообщества.
#OpenAI #ИИ #Математика #НавьеСтокс
👍2
This media is not supported in your browser
VIEW IN TELEGRAM
Муха-дрозофила снова в центре внимания. На этот раз ее научили водить машину. Таксисты больше не нужны.
❤3😁3🤩2🙏2
У HTTP появился новый глагол. Первый с 2010 года
Сегодня InfoQ разобрал RFC 10008: метод QUERY. Авторы — Джулиан Решке, Джеймс Снелл, Майк Бишоп. Последний стандартный глагол до этого был PATCH, шестнадцать лет назад.
Проблема старая. Сложный поиск не влезает в URL у GET, а POST с телом нельзя честно кэшировать и безопасно ретраить: метод не безопасный и не идемпотентный. Двадцать лет все делали «GET в теле POST» и надеялись, что CDN, ретраи и агенты догадаются. Не догадываются. Они смотрят на метод, не на README.
QUERY несёт тело, как POST, и обещает read-only семантику, как GET. Ответ можно класть в кэш, если ключ включает тело. Сервер объявляет поддержку заголовком Accept-Query — например application/json или application/sql. Для агентов это важнее, чем для людей: автономный клиент теперь видит в протоколе, что запрос можно повторить.
Поддержки в nginx/CDN завтра не будет. Но если проектируете API под агентный трафик, этот RFC стоит прочитать до того, как очередной поиск на 40 КБ снова запихнут в query string.
Источник: InfoQ, 10 сентября · RFC 10008
#HTTP #API #IETF #Backend #RFC
Сегодня InfoQ разобрал RFC 10008: метод QUERY. Авторы — Джулиан Решке, Джеймс Снелл, Майк Бишоп. Последний стандартный глагол до этого был PATCH, шестнадцать лет назад.
Проблема старая. Сложный поиск не влезает в URL у GET, а POST с телом нельзя честно кэшировать и безопасно ретраить: метод не безопасный и не идемпотентный. Двадцать лет все делали «GET в теле POST» и надеялись, что CDN, ретраи и агенты догадаются. Не догадываются. Они смотрят на метод, не на README.
QUERY несёт тело, как POST, и обещает read-only семантику, как GET. Ответ можно класть в кэш, если ключ включает тело. Сервер объявляет поддержку заголовком Accept-Query — например application/json или application/sql. Для агентов это важнее, чем для людей: автономный клиент теперь видит в протоколе, что запрос можно повторить.
Поддержки в nginx/CDN завтра не будет. Но если проектируете API под агентный трафик, этот RFC стоит прочитать до того, как очередной поиск на 40 КБ снова запихнут в query string.
Источник: InfoQ, 10 сентября · RFC 10008
#HTTP #API #IETF #Backend #RFC
❤3
DeepSeek выкатил V4.1 Flash и отправил на пенсию собственный Pro
10 сентября DeepSeek опубликовал V4.1 Flash. 552B MoE, новая схема Causal Encoder–Decoder: 8B активных параметров на входе, 16B на выходе. Нативный vision, контекст до 1M токенов, KV-кэш 890 байт на токен — в четыре раза меньше, чем у прошлого Flash, и на два порядка меньше, чем у первых моделей компании.
Цифра, из-за которой пост стоит слать коллегам: Terminal-Bench 2.1 — 90.6. Выше собственного V4 Pro (87.9), Kimi K3 (88.3) и GPT-5.6 Sol (88.8). DeepSeek прямо пишет: сторонние прогоны поставили Flash впереди Pro по качеству, цене и скорости, поэтому Pro снимают. С 14 сентября 04:00 UTC deepseek-v4-pro будет резаться на Flash по цене Flash.
В API модель зовётся deepseek-flash. Старые алиасы пока редиректят сюда. Для команд, которые крутят агентов на длинном репозитории, узкое место давно не «ум модели», а префилл и память. Flash собран именно под этот профиль. Проверяйте не маркетинг, а свой воркфлоу: если у вас короткие чаты — выигрыш будет меньше, чем на Terminal-Bench.
Источник: DeepSeek, 10 сентября · Reuters
#DeepSeek #LLM #AIAgents #OpenSourceAI
10 сентября DeepSeek опубликовал V4.1 Flash. 552B MoE, новая схема Causal Encoder–Decoder: 8B активных параметров на входе, 16B на выходе. Нативный vision, контекст до 1M токенов, KV-кэш 890 байт на токен — в четыре раза меньше, чем у прошлого Flash, и на два порядка меньше, чем у первых моделей компании.
Цифра, из-за которой пост стоит слать коллегам: Terminal-Bench 2.1 — 90.6. Выше собственного V4 Pro (87.9), Kimi K3 (88.3) и GPT-5.6 Sol (88.8). DeepSeek прямо пишет: сторонние прогоны поставили Flash впереди Pro по качеству, цене и скорости, поэтому Pro снимают. С 14 сентября 04:00 UTC deepseek-v4-pro будет резаться на Flash по цене Flash.
В API модель зовётся deepseek-flash. Старые алиасы пока редиректят сюда. Для команд, которые крутят агентов на длинном репозитории, узкое место давно не «ум модели», а префилл и память. Flash собран именно под этот профиль. Проверяйте не маркетинг, а свой воркфлоу: если у вас короткие чаты — выигрыш будет меньше, чем на Terminal-Bench.
Источник: DeepSeek, 10 сентября · Reuters
#DeepSeek #LLM #AIAgents #OpenSourceAI
❤3
This media is not supported in your browser
VIEW IN TELEGRAM
Последняя (надеемся) новость про обучение мух-дрозофил. Муху научили пить пиво и чокаться.
Теперь мухи-алкоголички чокаются друг с другом, когда видят пиво. Вот за это мы и любим высокие технологии.
Теперь мухи-алкоголички чокаются друг с другом, когда видят пиво. Вот за это мы и любим высокие технологии.
❤4
Песочница агента сняла сама себя одной командой
OX Security 8–9 сентября разобрала CVE-2026-82533 в DeepSeek Harness, опенсорсной обвязке для кодящих агентов. Оценка 9.4. Патч есть: 0.1.2-alpha.1.
Контрольная HTTP API на localhost не требовала ключа. Доверие решалось заголовком Host: если там loopback или имя из trustedHosts, запрос пропускали. Адрес сокета никто не сверял. Песочница резала запись на диск, но loopback оставляла. Агент изнутри одной шелл-командой дергал свой же API, поднимал сессию в danger-full-access с approval: never и дальше работал без клетки. Снаружи тем же Host-спуфингом можно было забрать все сохранённые диалоги — без API-ключа модели.
Это не «теоретический jailbreak промптом». Это классика: security decision по данным, которые клиент сам прислал. Пока агенты получают шелл «для удобства», любой локальный control plane без привязки к peer address — дыра по умолчанию. Если у вас в парке Cursor / Claude Code / самописный harness, имеет смысл спросить не «есть ли sandbox», а «может ли процесс внутри sandbox поговорить со своим контроллером».
Источник: разбор OX Security · DevOps.com, 9 сентября
#AIAgents #AppSec #Sandbox #CVE #DevSecOps
OX Security 8–9 сентября разобрала CVE-2026-82533 в DeepSeek Harness, опенсорсной обвязке для кодящих агентов. Оценка 9.4. Патч есть: 0.1.2-alpha.1.
Контрольная HTTP API на localhost не требовала ключа. Доверие решалось заголовком Host: если там loopback или имя из trustedHosts, запрос пропускали. Адрес сокета никто не сверял. Песочница резала запись на диск, но loopback оставляла. Агент изнутри одной шелл-командой дергал свой же API, поднимал сессию в danger-full-access с approval: never и дальше работал без клетки. Снаружи тем же Host-спуфингом можно было забрать все сохранённые диалоги — без API-ключа модели.
Это не «теоретический jailbreak промптом». Это классика: security decision по данным, которые клиент сам прислал. Пока агенты получают шелл «для удобства», любой локальный control plane без привязки к peer address — дыра по умолчанию. Если у вас в парке Cursor / Claude Code / самописный harness, имеет смысл спросить не «есть ли sandbox», а «может ли процесс внутри sandbox поговорить со своим контроллером».
Источник: разбор OX Security · DevOps.com, 9 сентября
#AIAgents #AppSec #Sandbox #CVE #DevSecOps
❤3
У ЕС включается 24-часовой дедлайн по дырам. Даже если продукт вышел годы назад
11 сентября 2026 вступает в силу отчётность по Cyber Resilience Act. Полный набор требований — декабрь 2027. Завтра — другое: производитель цифрового продукта на рынке ЕС обязан сообщать об активно эксплуатируемых уязвимостях и тяжёлых инцидентах.
Схема: 24 часа — early warning в ENISA и национальный CSIRT; 72 часа — первичная оценка и что делать пользователям; 14 дней — финальный отчёт по эксплуатации (месяц — по тяжёлому инциденту). Под раздачу попадают и продукты, которые выпустили до этой даты. Комиссия в свежем гайде отдельно проговорила FOSS: просто контрибьютор с правом на PR — не manufacturer и не steward. Отвечает тот, кто публикует релизы и рулит проектом.
Если вы продаёте в ЕС десктоп, мобильное приложение, прошивку, SaaS с клиентским ПО или онпрем-агент — это уже не «юристы потом». Нужен канал «узнали, что бьют в дикой природе → за 24 часа ушло уведомление». Без него 12 сентября любой публичный 0-day превращается ещё и в регуляторный инцидент.
Источник: гайд Еврокомиссии · CRA, дедлайн 11 сентября
#CyberResilienceAct #EU #Compliance #AppSec #ProductSecurity
11 сентября 2026 вступает в силу отчётность по Cyber Resilience Act. Полный набор требований — декабрь 2027. Завтра — другое: производитель цифрового продукта на рынке ЕС обязан сообщать об активно эксплуатируемых уязвимостях и тяжёлых инцидентах.
Схема: 24 часа — early warning в ENISA и национальный CSIRT; 72 часа — первичная оценка и что делать пользователям; 14 дней — финальный отчёт по эксплуатации (месяц — по тяжёлому инциденту). Под раздачу попадают и продукты, которые выпустили до этой даты. Комиссия в свежем гайде отдельно проговорила FOSS: просто контрибьютор с правом на PR — не manufacturer и не steward. Отвечает тот, кто публикует релизы и рулит проектом.
Если вы продаёте в ЕС десктоп, мобильное приложение, прошивку, SaaS с клиентским ПО или онпрем-агент — это уже не «юристы потом». Нужен канал «узнали, что бьют в дикой природе → за 24 часа ушло уведомление». Без него 12 сентября любой публичный 0-day превращается ещё и в регуляторный инцидент.
Источник: гайд Еврокомиссии · CRA, дедлайн 11 сентября
#CyberResilienceAct #EU #Compliance #AppSec #ProductSecurity
❤2🔥2😁1🙏1
Media is too big
VIEW IN TELEGRAM
Зачем агенту заново писать то, что уже работает?
У команды уже есть готовые функции, модули и микросервисы. Если научить ИИ-агента использовать их, ему придётся меньше генерировать с нуля. А это напрямую связано с расходом токенов и предсказуемостью результата.
Дмитрий Старов, директор департамента «Инструменты и технологии разработки» компании «Диасофт», рассказывает, как этот подход применяют в компании.
Цель — получать нужный результат на более доступных моделях, в том числе развёрнутых на собственных мощностях. Для этого настраивают всю систему вокруг агента: спецификации, правила разработки и использование готовых компонентов платформы.
За ключевыми стандартами при этом следит человек. Агент получает понятные ограничения и готовые инструменты для выполнения задачи.
В ролике — о зависимости от новых моделей, стоимости генерации и том, как организовать работу ИИ вокруг уже накопленного инженерного опыта.
▶️ Смотреть полную дискуссию
Удалось ли вам перейти на более простую модель без потери нужного качества? Что пришлось изменить?
У команды уже есть готовые функции, модули и микросервисы. Если научить ИИ-агента использовать их, ему придётся меньше генерировать с нуля. А это напрямую связано с расходом токенов и предсказуемостью результата.
Дмитрий Старов, директор департамента «Инструменты и технологии разработки» компании «Диасофт», рассказывает, как этот подход применяют в компании.
Цель — получать нужный результат на более доступных моделях, в том числе развёрнутых на собственных мощностях. Для этого настраивают всю систему вокруг агента: спецификации, правила разработки и использование готовых компонентов платформы.
За ключевыми стандартами при этом следит человек. Агент получает понятные ограничения и готовые инструменты для выполнения задачи.
В ролике — о зависимости от новых моделей, стоимости генерации и том, как организовать работу ИИ вокруг уже накопленного инженерного опыта.
▶️ Смотреть полную дискуссию
Удалось ли вам перейти на более простую модель без потери нужного качества? Что пришлось изменить?
❤5🔥4😁2💯1
Media is too big
VIEW IN TELEGRAM
Ваш следующий конкурент может начинать с одного разработчика и ИИ
У крупного поставщика ПО есть платформа, отлаженная разработка и доверие заказчиков. Кажется, такую позицию трудно поколебать.
Дмитрий Старов, директор департамента «Инструменты и технологии разработки» компании «Диасофт», предупреждает: новые возможности автоматизации могут открыть ниши для стартапов и даже одиночек. Небольшой проект способен вырасти в продукт, который заинтересует крупного заказчика — и появится в одном тендере с привычными лидерами рынка.
В корпоративном сегменте по-прежнему важны стабильность и ответственность. Но считать свою платформу защитой от любой будущей конкуренции опасно.
Дмитрий предлагает постоянно исследовать новые технологии, в том числе за пределами корпоративного ПО, и выделять для этого команды с сильными ИИ-моделями и современными инструментами.
▶️ Смотреть полную дискуссию
Вы уже видите небольшие команды с ИИ, способные конкурировать с крупными поставщиками ПО?
У крупного поставщика ПО есть платформа, отлаженная разработка и доверие заказчиков. Кажется, такую позицию трудно поколебать.
Дмитрий Старов, директор департамента «Инструменты и технологии разработки» компании «Диасофт», предупреждает: новые возможности автоматизации могут открыть ниши для стартапов и даже одиночек. Небольшой проект способен вырасти в продукт, который заинтересует крупного заказчика — и появится в одном тендере с привычными лидерами рынка.
В корпоративном сегменте по-прежнему важны стабильность и ответственность. Но считать свою платформу защитой от любой будущей конкуренции опасно.
Дмитрий предлагает постоянно исследовать новые технологии, в том числе за пределами корпоративного ПО, и выделять для этого команды с сильными ИИ-моделями и современными инструментами.
▶️ Смотреть полную дискуссию
Вы уже видите небольшие команды с ИИ, способные конкурировать с крупными поставщиками ПО?
🔥5❤2👍2👏2
Срочный репортаж про новые способности мозга мухи. Пока вы отдыхали разработчики научили мозг дрозофилы водить самолет (с посадкой пока не очень), играть в игры, думскроллить новости и чокаться алкоголем. Один шаг до человека!
🤔3😁2🤣1