Алмаз Роботы
328 subscribers
324 photos
31 videos
7 files
161 links
Рассказываю про роботов и различные технологии автоматизации

По вопросам - @almazrobotsqxp
Download Telegram
Антропики (Claude) выпустили The AI-Native SDLC playbook — как перестроить разработку под ИИ.

Главный тезис: код больше не узкое место.

Раньше дольше всего писали код, под это и строили весь процесс — техзадания, оценки, комитеты. Теперь ИИ делает это за часы, а обвязка вокруг осталась прежней длины.

✍️ Узкое место просто переехало из разработки в согласования до и после неё.

Три вещи, которые я практикую в работе команд на проектах.

1) Каждый этап агента - порождает базовый АРТЕФАКТ - результат работы. На каждой стадии свой артефакт - стабильнее процесс.

2) Есть понятие skill (руководство к действию) и hook (он дает возможность создавать явный запрет на выполнение определенных действий). Нужно прописывать конкретные запреты для повышения стабильности работы агентов.

3) Аудит и отслеживаемость работы с кодом и требованиями - все создание ИТ-продукта становится прозрачным.


💎 И принцип, снимающий половину возражений безопасников: ИИ делает всё вплоть до выпуска в продакшн и ничего за этой чертой. Код, который он написал, он же и не одобряет.

Если у вас разработка ускорилась, а согласования нет — пишите, разберём, где застряло.
Мы сейчас проектируем подходы к управлению требованиями с помощью агентов/

#роботыгрядут #Claude #SDLC

👉 https://claude.com/blog/the-ai-native-sdlc-playbook
👉 https://vc.ru/ai/3095473-kod-perestal-byt-uzkim-mestom-razbor-playbook-anthropic-po-ai-native-sdlc
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
19👍2🔥1
OpenAI пресекла новую скрытую кампанию влияния из России

Компания заявила, что заблокировала группу аккаунтов ChatGPT, которые, с высокой вероятностью, управлялись из России и использовались в рамках скрытой информационной кампании.

🧠 В центре схемы находился International Burke Institute (IBI) — организация, представлявшая себя как международное экспертное сообщество, базирующееся в Израиле.

У нее были:
🔹 сайт аналитического центра;
🔹 «международные эксперты»;
🔹 исследования и статьи;
🔹 собственный «индекс суверенитета» стран;
🔹 аккаунты и сеть распространения в соцсетях.

OpenAI проверила 36 опубликованных IBI материалов и утверждает, что 34 из них были скопированы из других источников. В некоторых случаях настоящие научные статьи публиковались под именами совершенно других людей.

То есть речь шла не просто о генерации фейковых постов. А целую сеть аккаунтов, объединенных в разные отдели и занимающиеся конвейнерно переписыванием новостей, оформлением иллюстраций, выкладкой и т.д.

Фактически строилась целая инфраструктура доверия:
▶️ берём реальные академические материалы;
▶️ создаём вокруг них внешне солидный think tank;
▶️ добавляем собственные рейтинги и исследования;
▶️ формируем нужный политический нарратив;
▶️ распространяем его через соцсети и Telegram.

⚠️ не «100 000 ботов пишут комментарии», а «создаём источник, который выглядит авторитетным, а затем постепенно заставляем интернет ссылаться на него».

OpenAI сама использует очень точную формулировку — manufacture authority. То есть буквально "сконструировать авторитетность".

И самая ирония в том, ChatGPT помог породить эту сеть, и он же помог и обнаружить и закрыть ее.
Please open Telegram to view this post
VIEW IN TELEGRAM
1
🔥 OpenAI перестаёт быть просто «компанией про модели»

Компания показала первые результаты Jalapeño (Халапеньо, все правильно) — своего первого специализированного чипа для AI-инференса.

На GPT-OSS, DeepSeek R1 и Kimi K2.5 он показывает:

⚡️ в 1,5–1,9× больше производительности на ватт
🚀 в 1,7–3,6× меньшую задержку
🤖 до 4,1× выше производительность в интерактивных сценариях

Но самое интересное: ИИ помогал проектировать сам чип — от начала разработки до tapeout дошли всего за 9 месяцев.

OpenAI теперь строит весь стек: модели → софт → чипы → память → сети → системы.

Гонка ИИ окончательно превращается в гонку инфраструктур.

#OpenAI #роботыгрядут
4🔥1
🔥 OpenAI строит вертикально-интегрированную компанию на всем ландшафте ИИ - от создания чипов и генерации энергии до AI-устройств.

И чтобы сразу не вставать, давайте еще одну важную новость про клозедов.
Вертикально-интегрированная компания - тот самый "ров", который строит компания.

Новая стратегия компании — единый full stack: дата-центры
→ энергия
→ чипы
→ сети
→ модели
→ API
→ ChatGPT
→ AI-устройства.

Причём OpenAI не собирается делать всё сама: Microsoft, NVIDIA, AWS, AMD, Oracle, CoreWeave и другие остаются частью этой системы.

Главная ставка — контролировать экономику интеллекта: получать больше полезной работы с каждого доллара и ватта.

Показательный пример: GPT-5.6 Sol достиг нового максимума в Coding Agent Index, используя на 54% меньше выходных токенов, чем другая ведущая модель.

Похоже, новая гонка Big Tech — уже не за лучшую модель.

А за лучший AI-стек целиком. 🚀

#OpenAI #роботыгрядут
4
Please open Telegram to view this post
VIEW IN TELEGRAM
Налетаем, qwen/qwen3.8-flash появился на OpenRouter
1
⚡️ OpenAI прекращает действие договора на предоставление моделей OpenAI для сервиса Cursor - дата отключения 12 ноября 2026 года.

Они приняли это решение в связи с покупкой сервиса компанией SpaceX.

1. Это очередной раунд борьбы Сэма с Илоном.
2. Сэм заявляет, что Илон нарушил договоры с периода покупки Твиттера и нагнал на них под присягой.
3. Они защищают интеллектуальную собственность будущей модели Astra - видимо нас ждет что-то поистине крупное.
Please open Telegram to view this post
VIEW IN TELEGRAM
5
ChatGPT достиг 1 млрд $ выручки на поисковой рекламе.

Всего на этом рынке по оценкам от 1 до 2 млрд общий оборот.

Общий объем мирового рынка контекстной и поисковой рекламы (Search Advertising / PPC) в 2026 году оценивается в диапазоне от 215 до 306 миллиардов долларов.

Точные цифры зависят от методологии исследований (включают ли аналитики товарную рекламу, маркетплейсы и социальные сети):

Исследователи Dataintelo оценивают чистый рынок поисковой рекламы примерно в $220–230 млрд.

В более широком понимании формата PPC (оплата за клик), включая контекстную рекламу внутри ритейл-платформ и соцсетей, агентство Digital Applied прогнозирует объем рынка на уровне $306 млрд.

На этом фоне годовой темп выручки (run rate) ChatGPT Ads в $1 млрд — это 0.5% от всего глобального рынка и очень яркий старт для OpenAI.
🔍Perplexity выложила в открытый доступ модель для поиска и маскирования персональных данных в переписках

Модель на 600 млн параметров умеет находить имена, адреса, телефоны, почту, номера счетов и другие чувствительные данные. Она распространяется по лицензии MIT.


▶️Perplexity опубликовала на Hugging Face модель pplx-pii-masking для автоматического обнаружения и маскирования персональной информации — PII — в диалогах и других текстовых данных.
▶️В основе модели лежит 600-миллионный двунаправленный Qwen3-энкодер pplx-embed-v1-0.6b. В отличие от обычной генеративной LLM, модель анализирует текст и размечает конкретные фрагменты, содержащие чувствительные данные.
▶️Она распознаёт девять категорий PII: имена частных лиц, номера счетов, приватные ссылки, даты, адреса, email, номера телефонов, другие персональные данные и секреты — например, пароли или ключи. Отдельный классификатор определяет чувствительность разговора в целом.
▶️Например, фразу Hi, I'm Daniel Whitfield, you can reach me at daniels@meridiancap.com or 415-555-0123 модель может автоматически преобразовать в Hi, I'm [PRIVATE_PERSON], you can reach me at [PRIVATE_EMAIL] or [PRIVATE_PHONE].
▶️Максимальная длина контекста составляет 4096 токенов. Perplexity опубликовала пример готового пайплайна, который позволяет запускать модель с PyTorch, Transformers и Safetensors.
▶️Модель распространяется под MIT License, поэтому её можно использовать и модифицировать в собственных продуктах, в том числе разворачивать в своей инфраструктуре. Это позволяет обезличивать данные до их дальнейшей обработки другими AI-моделями, не отправляя исходные персональные данные во внешние сервисы.

Модель и исходные файлы — Hugging Face


@almazrobots — создаю роботов
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥1
⚡️ FABLE 5.1 на связи 🤙

Посмотрите на прирост оценок бенчмарков - это же невероятно!

@almazrobots — создаю роботов
3
Кстати! Только заметил, что Антропики бустанули лимиты до 13 сентября!! У меня в среду в 23 сбрасываются лимиты недельные, было 70% или вроде того уже выбрано.
А тут они похоже сбросили недельные.

И есть сутки, чтобы потратить недельный бюджет. Пойду я пожалуй за энергетиком.

@almazrobots — создаю роботов
🔥31
Кто не успел купить последний Play Station до выхода трейлера GTA VI - может с помощью Fable 5.1 разработать собственную версию! 😭

Норм выглядит для 1 процедурного промпта, без генерации визуалов во всяких 3д-конструкторах?

@almazrobots — создаю роботов
Please open Telegram to view this post
VIEW IN TELEGRAM
John Ternus 1 сентября вступил в должность генерального директора и сменил легендарного Тима Кука.

По этому поводу я запустил сайт ternusday.com

Он покажет каждый из дней Джона в офисе и каким образом будет меняться капитализация компании Apple.

Нью-Йорская биржа закрывается в 23.00 МСК и примерно в течение следующего часа сайт будет пересчитывать очередной день.

Там внизу есть кнопочка Share, где можно скачать картинку в удобном формате или поделиться ссылкой на сайт.

Подписывайтесь на x.com/ternusday
🔥1
UC QA001 "Создание чек-листа для ручного тестирования"

Цель: агент должен помочь разобраться с разработанным кодом программного продукта и помочь провести ручное тестирование.

На вход:
- описанные требования к продукту/системе
- доступ к написанному коду
- доступ к инфраструктуре тестирования
- желательно, созданный шаблон (регламент) процесса создания чек-листов.

Основной сценарий:
1. Запустить новую сессию Claude Code.
2. Написать/надиктовать что-то в духе "Мне нужен у тебя полный чек-лист, что мне необходимо протестировать и принять, чтобы продвинуться в сторону развертывания приложения (деплоя)."
3. Пойти готовить ужин.
4. Вернуться и принять результат (на картинке).

На выходе:
- команды, как с НУЛЯ установить тестовый стенд.
- готовые чек-листы по всем или по запрошенным модулям программы (вдруг не хотите токены тратить на все).
- понятный план, с каких чек-листов нужно начинать.

P.S. Я знаю, что часто в HRTECH бэклогах бывает такой проект под названием "давайте создадим банк идей сотрудников".

Я сейчас создаю такой, который можно будет развернуть внутри компании и подключать к корпоративным способам авторизации (KeyCloak, AD и что-то самое популярное нынче).

У меня тут точно есть ребята из HR - если у вас такие проекты находятся в пуле задач - пишите, буду рад провести пилоты на выгодных условиях.

P.P.S. Вот эта документальная фигня с чек-листами - критически важный винтик процесса для обеспечения высокого качества софта (как у японских машинистов - надо голосом проговаривать команды и проверять все ли на месте и закрыто, чтобы не было аварий). И он мог занимать НЕДЕЛИ времени, потому что писался руками и между другими задачами.
Сейчас достаточно наговорить с телефона одну команду голосом ("нарамблить") и прийти после ужина на готовое.
🔥2
⚡️ OpenAI намекнули, что скоро выйдет GPT ASTRA.

В параллельной реальности с интересом наблюдаю, что может сегодняшний сбой в Claudflare, потянувший отказ ВСЕХ популярных ИИ-агентов - это их скрытый анонс, смотрите что могу?

P.S. ИИ-агенты прилегли в районе 16.30, где-то к 18 все более-менее поднялось.

https://x.com/OpenAI/status/2095527557924082061