morana.log
79 subscribers
54 photos
101 links
Нейросети на заказ без рекламного тумана. Делаем ИИ под задачу бизнеса — от завода до банка: computer vision, edge-инференс, реалтайм. Разбираем, что ИИ даёт делу, чужие факапы и где хайп. Понятно инженеру и директору.

morana-labs.com
Download Telegram
За 2025 год антифрод-системы российских банков отбили 134 млн мошеннических операций на 13,9 трлн ₽ (обзор ЦБ, февраль 2026). До мошенников дошло 29,3 млрд — около двух рублей с каждой тысячи, на которую они замахнулись.

Каждый перевод прогоняется через модель, у которой миллисекунды на решение: сумма, время, география, устройство, получатель. С 1 января 2026 у банков двенадцать официальных признаков подозрительной операции. Среди новых — смена телефона в онлайн-банке за 48 часов до перевода и перевод самому себе по СБП свыше 200 тыс. ₽ с выводом денег в течение суток.

Если получатель числится в базе ЦБ о мошеннических счетах, банк обязан заморозить перевод на два дня — даже когда клиент настаивает. Проигнорировал базу и провёл платёж — возмещает клиенту всю сумму.

Мошенникам достаются всё меньшие суммы: средний чек одного хищения за год упал с 22 900 до 18 600 рублей.

📡 Подписаться · morana.log
🌐 morana-labs.com
ИИ-агент за 10–50 млн рублей — реальные цифры из корпоративных запусков. Средний бизнес читает их и закрывает тему. Зря: столько стоит запуск в корпорации, где согласования, комитеты и стыковка с легаси съедают больше, чем сама разработка.

Наши вилки для тех, кто не Сбер: агент на конструкторе — 50–200 тыс. ₽ и 1–3 недели, пилот заказного — 700 тыс. – 1 млн, рабочий агент с интеграциями — 1,2–2,5 млн, мультиагентный контур — от 3 млн. Самая тяжёлая статья везде — интеграции, 40–60% сметы. Токены — расходник за несколько тысяч в месяц.

Из чего складывается каждая строка сметы и на чём корпоративный чек раздувается втрое — в полном разборе на сайте: честный прайс на ИИ-агента.

📡 Подписаться · morana.log
🌐 morana-labs.com
ИИ-ускоритель упирается не в логику-кристалл. Узкое место — память на нём, стек HBM.

HBM — башня DRAM-кристаллов в одном корпусе с GPU; кормит вычислитель на скорости, которую обычная память не держит. По заявлению SK Hynix, HBM на 2026 законтрактован, новые контракты — под поставку 2027. Samsung и SK Hynix предупреждают: дефицит продлится минимум до 2027, пока не выйдут на объём новые фабы.

Узкое место — сборка стека. Переход с 12 слоёв на 16 тяжелее, чем с 8 на 12: пластины утоняют сильнее, чтобы уложиться в высоту корпуса. Чем выше башня, тем ниже выход годных — это yield wall.

Второй эффект: DRAM-пластины перекидывают на маржинальный HBM, выпуск обычной памяти сжимается, серверная DDR5 дорожает следом. Под давлением каждый сервер, а не только стойки с ускорителями.

Для тех, кто закупает железо: HBM-память ведёт себя как сырьё с бронью на годы вперёд — её закладывают в план заранее, иначе к нужному сроку не достать.

📡 Подписаться · morana.log
🌐 morana-labs.com
В августе 2020 алгоритм понизил 39% экзаменационных оценок британских выпускников — около 280 тысяч результатов. Через четыре дня правительство его отменило.

Экзамены A-level — британский аналог ЕГЭ — отменил ковид, оценки считала модель регулятора Ofqual. Для классов от 15 человек она игнорировала оценку учителя: в расчёт шли только ранжирование учеников по предмету и распределение оценок школы за 2017–2019.

Классам до пяти человек — типичным для частных школ — модель оставляла оценку учителя как есть. Доля высших баллов у частных школ выросла на 4,7 процентного пункта, у государственных — примерно на 2. По данным UCAS, около 15 тысяч абитуриентов потеряли места в вузах первого выбора.

16 августа школьники вышли к парламенту с лозунгом «F*** the algorithm», 17-го Ofqual вернул оценки учителей. Мест в медвузах — набор квотирует государство — на всех, кому вернули баллы, не хватило, и правительству пришлось снимать лимит.

📡 Подписаться · morana.log
🌐 morana-labs.com
Если ИИ-агенту дали три права — читать приватные данные, принимать недоверенный вход и отправлять что-то наружу — утечка данных становится вопросом времени.

Это lethal trifecta, формулировка Саймона Уиллисона. Prompt injection срабатывает, когда инструкция, спрятанная в недоверенном тексте, читается моделью как команда оператора: LLM не отделяет инструкции от данных. Это свойство архитектуры, патчем не закрывается; гардрейлы с перехватом ~95% в безопасности читаются как провал.

Отсюда фильтр Meta — Agents Rule of Two: без человека в контуре агенту в одной сессии давать максимум два свойства из трёх — недоверенный вход, доступ к чувствительным системам, отправка данных вовне. Нужны все три — ставьте подтверждение человеком перед действием.

Meta сама оговаривается: правило снижает риск, но не закрывает все угрозы. Зато первый вопрос на ревью агента — «не выдали ли мы все три?» — отсекает большинство утечек ещё до прода.

📡 Подписаться · morana.log
🌐 morana-labs.com
С марта 2026 оплата лицом работает на всех станциях метро Петербурга — биометрический терминал стоит в каждом из 87 вестибюлей.

Москва включила Face Pay на всех станциях в октябре 2021: по данным Дептранса, к январю 2026 — 192 млн проходов по биометрии, около 54 млн из них за 2025 год. Там камера встроена в турникеты, в Питере — один терминал на вестибюль, на старте — порядка 2 тысяч пользователей в неделю. Проезд по лицу — 65 ₽, тариф Единой карты петербуржца, к ней привязывается биометрия.

Регистрация — через государственную Единую биометрическую систему, в приложении «Госуслуги Биометрия»: фото превращается в зашифрованный числовой вектор. Терминал считает вектор на месте и сравнивает с шаблоном из госсистемы; фото при проходе не сохраняется, из вектора его не восстановить.

Та же связка уже работает на кассах: по данным Сбера, за 2025 год — 195 млн биометрических платёжных операций на 154 млрд ₽.

📡 Подписаться · morana.log
🌐 morana-labs.com
🤬1
Google выложила DiffusionGemma — открытую (Apache 2.0) текстовую модель, которая денойзит блоки токенов параллельно вместо генерации по одному: каждый токен в блоке «видит» остальные.

По заявлению Google — до 4x выше throughput и 1000+ ток/с на одной H100. Цифры вендорские, но порядок понятен: кратно больше токенов в секунду на том же GPU — меньше GPU-часов на тот же объём генерации.

Редкий случай, когда вендор сам пишет про размен. Google прямо признаёт: общее качество вывода у DiffusionGemma ниже обычной Gemma 4, и для задач с высоким требованием к точности рекомендует стандартную модель. Это написано в их собственном анонсе.

Куда это ложится: классификация, извлечение полей, разметка — задачи, которые терпят шум и где важна пропускная способность. Туда, где считается каждое слово в ответе клиенту или в юридическом тексте, такую модель ставить рано.

📡 Подписаться · morana.log
🌐 morana-labs.com
15 января 2021 правительство Нидерландов ушло в отставку в полном составе — из-за алгоритма налоговой.

С 2013 года налоговая гоняла заявки на детские пособия через самообучающуюся риск-модель. Второе гражданство автоматически повышало оценку риска. Семьи с «высоким риском» записывали в мошенники и требовали вернуть пособия за годы — десятки тысяч евро с семьи, без внятных объяснений. Семьи банкротились и теряли жильё; органы опеки забрали больше 2000 детей. Изначально насчитали около 26 тысяч ложно обвинённых родителей, к 2025 году государство официально признало пострадавшими более 43 тысяч человек.

Регулятор по защите данных оштрафовал налоговую на €2,75 млн — из них ровно миллион за то, что модель учитывала гражданство как признак риска. Каждому признанному пострадавшим родителю гарантировано €30 тысяч компенсации; разбор дел и выплаты, которые планировали уложить в €500 млн, к 2025 году превысили €9 млрд.

📡 Подписаться · morana.log
🌐 morana-labs.com
FTC взыскала почти $1 млн с трёх маркетинговых фирм за «ИИ Active Listening», который ничего не слушал.

Cox Media Group и два агентства поменьше продавали сервис, который якобы в реальном времени слушает разговоры через микрофоны смарт-устройств и таргетирует по ним рекламу — с согласия пользователей. По версии FTC, прослушивания не было: фирмы перепродавали с наценкой email-списки от дата-брокеров, а клик по пользовательскому соглашению согласием на запись голоса не считается.

Расклад: CMG — $880 тыс., MindSift и 1010 Digital Works — по $25 тыс. Все трое — под 20-летним мониторингом FTC с запретом врать о свойствах рекламных услуг и сборе голосовых данных.

Это очередной кейс FTC против AI-washing, и свежие — про обещания вендоров другому бизнесу. Отсюда фильтр перед контрактом на «ИИ под ключ»: где живёт модель, на каких данных обучена, что конкретно она предсказывает или генерит. Пресс-релиз FTC от 21 мая 2026.

📡 Подписаться · morana.log
🌐 morana-labs.com
Детекторы ИИ-текста пометили как «написанные нейросетью» в среднем 61% сочинений живых людей — неносителей английского. Stanford-исследование в Patterns (2023): семь детекторов, 91 эссе TOEFL; 97,8% эссе хотя бы один принял за машинные.

Механика простая: у неносителей словарь беднее, текст ровнее, а детектор меряет предсказуемость — и записывает такие сочинения в машинные. На работах школьников-носителей из США они ошибались редко. Даже OpenAI, создатель ChatGPT, отключила свой детектор в июле 2023 «из-за низкой точности»: он распознавал 26% ИИ-текстов.

Turnitin заявляет менее 1% ложных срабатываний на документ — и то лишь для работ с долей ИИ-текста выше 20%. Университет Vanderbilt пересчитал: при 75 тысячах работ в год это сотни ложно обвинённых — и отключил детектор. В июле 2025 омбудсмен по жалобам студентов Англии и Уэльса признал: показания детектора сами по себе — недостаточное доказательство для наказания.

📡 Подписаться · morana.log
🌐 morana-labs.com
В мае 2026 в России зарегистрировали топологию тензорного чиплета для ускорения ИИ — в заголовках это звучит как «отечественный ИИ-чип». Зарегистрирована именно топология: схема расположения слоёв на кристалле, маска для будущего производства. Это интеллектуальная собственность, а не работающий кремний.

Правообладатель — государство в лице Фонда перспективных исследований. Техпроцесс — 28 нм, компоновка чиплетная. Тот же принцип используют AMD и NVIDIA, но паритета он не даёт: топовые ИИ-ускорители едут на 4–5 нм, 28 нм отстаёт на несколько поколений.

Серийные 28 нм внутри страны Минпромторг ожидает не ранее 2027 года — печатать её в кремнии пока негде. Назначение, как сообщает CNews, двойное: оборонка плюс гражданка — IoT, видеонаблюдение, телеком.

Между регистрацией и серийным ускорителем в стойке — годы и доступ к фабрикам. Это вопрос сроков и денег, в честной формулировке так и звучит — не «у нас уже есть свой ИИ-чип».

📡 Подписаться · morana.log
🌐 morana-labs.com
За повторную утечку персональных данных компания в России рискует штрафом до 500 млн ₽. Первый реальный штраф по новым нормам — 400 тысяч.

С 30 мая 2025 действует 420-ФЗ: первая утечка обычных персданных стоит 3–15 млн ₽ в зависимости от объёма, биометрии — до 20 млн; повторная — оборотный штраф, то есть 1–3% годовой выручки: минимум 20–25 млн в зависимости от типа данных, максимум 500 млн. За торговлю слитыми базами и «пробив» — уголовная статья 272.1 УК, до 10 лет.

Практика пока догоняет букву. За весь 2025 год за утечки оштрафованы шесть организаций, суммарно на 570 тысяч ₽ — ещё по старым нормам. В марте 2026 арбитраж впервые применил новые: детская онлайн-школа Ukids за слитую базу примерно в 500 тысяч строк получила вместо положенных 10–15 млн — 400 тысяч, со скидкой за статус микропредприятия; решение сейчас обжалуется. Оборотных штрафов к весне 2026 не назначено ни одного.

📡 Подписаться · morana.log
🌐 morana-labs.com
🤔1
«Допущено FDA» и «клинически проверено» — разные вещи, и свежие данные показывают, насколько.

Исследование в JAMA Network Open (11 июня 2026) разобрало 903 ИИ-медустройства с разрешением FDA. Отозвали 43 — около 5%. Медиана от выхода на рынок до отзыва — ~15 месяцев: дефект всплывал спустя год с лишним эксплуатации.

Среди 218 устройств без исследования клинической эффективности в заявке отозвали 7,8%, среди 505 с исследованиями — 2,6%, примерно втрое реже. Это ассоциация, доказанной причинности тут нет.

Около 97% выходят на рынок через 510(k) — разрешение по «существенной эквивалентности» уже одобренному аналогу, без обязательных проспективных испытаний на людях. Лидер причин отзыва — проблемы эксплуатации и софтверные дефекты: такое вылезает уже в работе у врача, а не на стенде.

Сертификат FDA говорит о допуске на рынок, про поведение модели на ваших пациентах он не говорит — это проверяется отдельно и на ваших данных.

📡 Подписаться · morana.log
🌐 morana-labs.com
👍2
Одна фактическая ошибка в рекламном ролике — и Google подешевела на $100 млрд за день.

6 февраля 2023 Google показала в промо-твите новый чат-бот Bard. На вопрос про телескоп James Webb бот ответил, что тот «сделал самые первые снимки планеты за пределами Солнечной системы». Астрономы поправили: первый снимок экзопланеты получил ещё в 2004 году телескоп VLT. 8 февраля Reuters вышел с разбором за несколько часов до презентации Google в Париже — акции Alphabet закрыли день на минус 7,7%, потеряв около $100 млрд стоимости.

Днём ранее Microsoft показала новый Bing на технологии ChatGPT, и анонс Bard собирали в спешке — сотрудники Google потом называли его поспешным и проваленным. Похоже, никто не сверил единственный проверяемый факт из собственной рекламы.

Генеративный чат-бот выдаёт правдоподобный текст с полной уверенностью — это свойство технологии. Фактчек перед публикацией остаётся ручной работой и в 2026-м.

📡 Подписаться · morana.log
🌐 morana-labs.com
На демо Tesla робот Optimus перед падением вскинул руки к лицу — жестом человека, срывающего VR-шлем. Шлема на нём не было: по разбору Electrek (декабрь 2025), машина повторила движение оператора, сорвавшего свой.

Телеоперация в гуманоидных демо — негласная норма. На «We, Robot» (октябрь 2024) барменов-Optimus вели удалённые операторы, ходили роботы сами; со сцены об этом не сказали, факт вскрыл Bloomberg. Домашний 1X NEO за $20 000 честнее: производитель пишет, что сложные задачи исполняет удалённый оператор. Но обозреватель The Wall Street Journal за день теста не увидела полностью автономных действий.

На пекинском полумарафоне гуманоидов в апреле 2026 из 47 финишировавших команд автономно шли 18, остальные 29 — на дистанционном управлении.

Ходьба и равновесие к 2026-му решены честно: роботы учатся им сами, обучением с подкреплением в симуляции. Автономные руки в незнакомой квартире — задача, которую пока не решил никто.

📡 Подписаться · morana.log
🌐 morana-labs.com
🔥2
Проверить, есть ли ваша биометрия в госсистеме, можно за минуту: Госуслуги → Профиль → «Биометрия». Там видно тип записи и срок действия.

В ЕБС — Единой биометрической системе — лежат зашифрованные образцы: фото лица и запись голоса, отдельно от ФИО. Банкам и сервисам наружу уходит только вектор — числовой шаблон. К апрелю 2026, по данным правительства, биометрию сами сдали около 10 млн человек; ещё десятки миллионов образцов в 2023-м передали банки по схеме «уведомили за 30 дней, молчание — согласие». Банковские образцы действуют два года.

Удалить её можно кнопкой в том же разделе в любой момент. Запретить будущий сбор — заявлением в любом МФЦ. Отказ — не основание отказать в услуге (статья 13 закона 572-ФЗ).

Официальная позиция — «фото из вектора восстановить нельзя». Инженерная правда тоньше: пиксельно точную копию не собрать, но по вектору генерируется похожее лицо, способное обмануть ту же систему распознавания.

📡 Подписаться · morana.log
🌐 morana-labs.com
Официальный чат-бот мэрии Нью-Йорка советовал бизнесу нарушать закон. Отказывать жильцам с госсубсидией можно, забирать чаевые сотрудников можно, сыр, покусанный крысой, подавать можно — «оценив масштаб ущерба».

Бота MyCity запустили в октябре 2023 советником для малого бизнеса: около $600 тысяч на создание плюс $500 тысяч в год на поддержку. В марте 2024 расследование The Markup, THE CITY и Documented показало, что бот раз за разом отвечает вразрез с законом; тесты Associated Press днями позже добавили «можно уволить за жалобу на харассмент».

Мэр Эрик Адамс бота не выключил: «Только трусливые говорят — не работает, значит, бежим от этого». На сайт повесили плашку «бета-продукт». В феврале 2026 следующая администрация бота закрыла, назвав «функционально непригодным».

Ошибка архитектурная: генеративную модель посадили на юридические вопросы без сверки с базой норм. Проверка тезиса заняла два года и больше миллиона долларов.

📡 Подписаться · morana.log
🌐 morana-labs.com
«Чат-бот» стоит от нуля до трёх миллионов рублей — под одним словом продают четыре разных продукта.

Конструктор за 0–30 тысяч честно закрывает заявки, запись и FAQ по кнопкам; такое толковый школьник собирает за пару вечеров, поэтому мы за это и не берёмся. Потолок наступает, когда в дерево кнопок пытаются уложить живой диалог: шаг в сторону от сценария даёт «не понял вопрос», после 20–25 веток логику дерева в компании уже никто не помнит.

Заказной бот с LLM и RAG (модель отвечает по вашей базе знаний со ссылками на источники) стартует от 700 тысяч и оправдан при потоке от ~300 обращений в месяц: грамотный ассистент забирает 40–70% обращений, у Tele2 — 60%. Типовой проект окупается за 4–7 месяцев, в e-commerce — за 2–4.

Пять признаков, что бизнес перерос конструктор, вилки цен по всем четырём вариантам и формула окупаемости — в разборе: чат-бот за 30 тысяч или за 700.

📡 Подписаться · morana.log
🌐 morana-labs.com
🔥3
Госдума приняла в первом чтении законопроект №1271570-8: большие ИИ-модели — от 1 млрд параметров — делят на «суверенные» и «национальные».

«Суверенная» — это российское юрлицо, полностью воспроизводимый цикл обучения и данные в ЦОД, которые стоят в РФ и принадлежат российским компаниям. Отдельным пунктом — подтверждение соответствия «традиционным российским духовно-нравственным ценностям»; как его проверять, решит правительство. «Национальная» мягче: зарубежные компоненты допустимы, но только под открытой лицензией.

Взамен — доступ к данным федеральных информсистем для обучения. Правила к ноябрю готовят Минцифры, ФСБ и ФСТЭК.

Тем, кто строит или закупает ИИ, ко второму чтению стоит следить за порогом: профильный комитет признал, что правовое содержание критерия «1 млрд параметров» не раскрыто. По текущей редакции закон вступает с 1 сентября 2026-го, требования к моделям — с 1 марта 2027 года.

📡 Подписаться · morana.log
🌐 morana-labs.com
Сбер ужал флагманский GigaChat: новый 3.5 Ultra — 432 млрд параметров вместо 700, веса открыты под MIT.

Внутри MoE: из 432 млрд на каждом токене считают только 28 млрд активных — экономика инференса упирается в эту цифру. Внимание гибридное: MLA оставлен каждым четвёртым слоем, остальные три — линейный GatedDeltaNet. KV-кэш на токен в 4 раза меньше, в ту же память влезает вдвое больше контекста, throughput растёт примерно на 20%. Две MTP-головы ускоряют greedy decoding в 2,2 раза. Обучение целиком в FP8. По замерам самого Сбера base-432B обходит прежний base-700B, сильнее всего в коде и агентных сценариях.

Для закрытых контуров это рабочий вариант: MIT снимает лицензионные согласования, веса GigaChat3.5-432B-A28B лежат на HuggingFace и GitVerse, модель ставится on-prem там, где данные нельзя выпускать за периметр. Независимых замеров пока нет — веса в открытом доступе с 6 июля.

📡 Подписаться · morana.log
🌐 morana-labs.com
👍3👎1🤔1
Закупщик на 50 000 SKU тратит 5–7 часов из восьми на ручную сводку остатков, прайсов полутора десятков поставщиков и лимитов выкупа.

Прошлые ИИ-пилоты выдавали «список рекомендаций», а человек всё равно перебивал его в 1С руками — двойная работа. Так 95% корпоративных GenAI-пилотов и не доезжают до P&L (MIT, 2025).

Работает агент с правом записи: система собирает черновик «Заказ поставщику» в базе, закупщик открывает, проверяет и жмёт «Провести». Один клик вместо часов сведения.

Деньги считает детерминированный код — партии, кратность, пороги выкупа воспроизводимы до копейки, LLM к деньгам не подпускают. Нейросети оставляют только текст: кривой прайс из Excel, письмо поставщика в свободной форме. Сам контур живёт рядом с боевой 1С через OData/HTTP, конфигурацию не трогаем.

Слой записи заказа обратно в 1С — то, чего не было в провалившихся подходах, и рабочий пилот на нём собирается за 2–3 недели. Разбор целиком — как ИИ-агент встраивается в кастомную 1С.

📡 Подписаться · morana.log
🌐 morana-labs.com
🔥3