При тестировании ранней версии Claude Opus 5.5 Anthropic заметила редкое поведение: модель создавала опасные команды без внешней атаки.
После ошибки при работе с JSON Claude добавил инструкцию отправить секретные данные на внешний сервер. Выполнить её не удалось.
Anthropic назвала это явление спонтанной prompt injection. Предположительно, оно частично возникло из-за обучения модели защите от подобных атак.
Перед релизом разработчики скорректировали обучение. В финальной версии такие сбои происходят реже, а Auto Mode заблокировал все обнаруженные опасные вызовы инструментов.
https://anthropic.com/claude-opus-5-5-system-card
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
❤6👍3🤔2🔥1🥱1
10 агентов Claude теоретически обошли алгоритм Дейкстры
В Vals AI запустили 10 агентов Claude Opus 5.5, которые за 15 часов и 733 сообщения разработали алгоритм C-HD для поиска кратчайших путей в ориентированных графах.
Для графов с определённой плотностью сложность снизилась с O(n log n) у Дейкстры до O(n log¹¹⁄¹² n). Корректность и оценка времени работы формально подтверждены доказательством в Lean.
Но это пока теоретический результат. Алгоритм не тестировали на крупных реальных графах, константы велики, а улучшение действует только в ограниченном диапазоне входных данных.
Главное здесь другое: группа ИИ-агентов смогла самостоятельно разработать алгоритм и подготовить его формальное доказательство всего за 15 часов.
https://www.vals.ai/blogs/faster-shortest-path-algorithm
В Vals AI запустили 10 агентов Claude Opus 5.5, которые за 15 часов и 733 сообщения разработали алгоритм C-HD для поиска кратчайших путей в ориентированных графах.
Для графов с определённой плотностью сложность снизилась с O(n log n) у Дейкстры до O(n log¹¹⁄¹² n). Корректность и оценка времени работы формально подтверждены доказательством в Lean.
Но это пока теоретический результат. Алгоритм не тестировали на крупных реальных графах, константы велики, а улучшение действует только в ограниченном диапазоне входных данных.
Главное здесь другое: группа ИИ-агентов смогла самостоятельно разработать алгоритм и подготовить его формальное доказательство всего за 15 часов.
https://www.vals.ai/blogs/faster-shortest-path-algorithm
❤15🥱12🔥4👍2🤔1
🚀 Приглашаем на третий конкурс по археологии от Phystech.Genesis.
🗓 Подача заявок до 30 сентября, 23:59 мск
👨💻 Работа над решениями — октябрь–ноябрь 2026
🔝 Реальные данные — реальный вызов
🔥 Призовой фонд 30 000 000 ₽
Организаторы уже провели два конкурса— теперь очередь третьего.
⚡️ Ждём команды из 2–5 человек с уверенными навыками в машинном обучении и компьютерном зрении.
📌 Формат — онлайн-платформа Phystech.Genesis.
Можно участвовать как физическим, так и юридическим лицам.
Перейти к регистрации
🗓 Подача заявок до 30 сентября, 23:59 мск
👨💻 Работа над решениями — октябрь–ноябрь 2026
🔝 Реальные данные — реальный вызов
🔥 Призовой фонд 30 000 000 ₽
Организаторы уже провели два конкурса— теперь очередь третьего.
В нём модели участников будут находить объекты и в рельефе, и на поверхности, и под землёй — в культурном слое и материке.
⚡️ Ждём команды из 2–5 человек с уверенными навыками в машинном обучении и компьютерном зрении.
📌 Формат — онлайн-платформа Phystech.Genesis.
Можно участвовать как физическим, так и юридическим лицам.
Перейти к регистрации
👍2🔥1
Anthropic обсуждает прямую аренду дата-центров мощностью до 1 ГВт у Stream Data Centers, контролируемой Apollo Global Management. По данным The Information, переговоры пока на ранней стадии.
Согласно сообщению, площадки могут оснастить Google TPU, разработанными совместно с Broadcom. Вариант с GPU Nvidia тоже обсуждается.
Прямая аренда позволила бы Anthropic меньше зависеть от облачных провайдеров и лучше контролировать выбор оборудования, поставки чипов и расходы. При этом компании пришлось бы взять на себя больше обязательств по финансированию и эксплуатации инфраструктуры.
Согласно сообщению, площадки могут оснастить Google TPU, разработанными совместно с Broadcom. Вариант с GPU Nvidia тоже обсуждается.
Прямая аренда позволила бы Anthropic меньше зависеть от облачных провайдеров и лучше контролировать выбор оборудования, поставки чипов и расходы. При этом компании пришлось бы взять на себя больше обязательств по финансированию и эксплуатации инфраструктуры.
❤5🔥4👍2😁1
Команда Qwen представила Qwen Intelligence – набор моделей, агентов и инструментов, из которого производители смартфонов могут собрать ассистента и интегрировать его в свою ОС или оболочку.
Платформа модульная - вендор может взять отдельные компоненты, развернуть модели у себя и настроить обвязку под свою прошивку.
Первым внедрением стал Honor - на базе Qwen Intelligence и MagicOS собрали специализированную модель для следующего поколения своих ИИ-смартфонов.
Mobile Planner Agent разбивает задачу на шаги, подбирает инструменты и ведёт двухуровневую память - рабочую для текущей задачи и долговременную, где копится профиль пользователя.
Mobile-Use Agent исполняет шаги. Он вызывает приложения через API, MCP, диплинки или командную строку, а там, где интерфейса нет, распознаёт экран и нажимает кнопки сам.
Платежи, удаление данных и публикации агент отправляет пользователю на подтверждение.
Mobile Creative Agent генерирует изображения по одной фразе за 8 шагов, первая картинка появляется за 3 секунды.
Платформа подключается через консоль Alibaba Cloud с оплатой по факту использования.
Mobile-Use Agent стоит 38 юаней (5,7 доллара) за тысячу вызовов. Creative Agent берёт 0,08 юаня (~1 цент) за изображение в облегчённой версии и 0,10 (~1,5 цента) в стандартной, с веб-поиском и многошаговым планированием. Тарифы планировщика пока не опубликованы.
Сроки выхода смартфонов Honor с новой системой не названы.
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
❤8👍4🔥4❤🔥2
⚡️ Claude помог ускорить собственный интерфейс втрое за две недели
Anthropic рассказала, как команда вместе с Claude внесла более 3000 изменений в claude.ai и десктопное приложение. По данным компании - без пользовательских инцидентов и откатов.
Результаты по 75-му перцентилю:
— Готовность сайта к вводу: 3,1 → 0,55 секунды.
— Загрузка облачной сессии Cowork: 2,6 → 0,73 секунды.
— Запуск десктопного приложения: 6,3 → 3,3 секунды.
Всё координировали в Slack: одновременно шло более 150 тредов. Claude находил узкие места, создавал бенчмарки, готовил исправления и проверял метрики после выпуска. Каждое изменение одобрял человек.
Среди находок — 6900 React-хуков и 900 подписок, участвовавших в обработке каждого нажатия клавиши, и лишний вызов
Чтобы ускорения сохранялись, в CI добавили проверки: изменение, увеличивающее число инструкций на контролируемом участке, не проходит.
Ускорили загрузку, навигацию и отрисовку интерфейса. Заявленные «3×» относятся именно к этим сценариям.
https://claude.dev/blog/how-we-made-claude-ai-faster/
Anthropic рассказала, как команда вместе с Claude внесла более 3000 изменений в claude.ai и десктопное приложение. По данным компании - без пользовательских инцидентов и откатов.
Результаты по 75-му перцентилю:
— Готовность сайта к вводу: 3,1 → 0,55 секунды.
— Загрузка облачной сессии Cowork: 2,6 → 0,73 секунды.
— Запуск десктопного приложения: 6,3 → 3,3 секунды.
Всё координировали в Slack: одновременно шло более 150 тредов. Claude находил узкие места, создавал бенчмарки, готовил исправления и проверял метрики после выпуска. Каждое изменение одобрял человек.
Среди находок — 6900 React-хуков и 900 подписок, участвовавших в обработке каждого нажатия клавиши, и лишний вызов
location.reload(), вызывавший полмиллиона скрытых перезагрузок в день.Чтобы ускорения сохранялись, в CI добавили проверки: изменение, увеличивающее число инструкций на контролируемом участке, не проходит.
Ускорили загрузку, навигацию и отрисовку интерфейса. Заявленные «3×» относятся именно к этим сценариям.
https://claude.dev/blog/how-we-made-claude-ai-faster/
❤23👍4🔥4🥰2
30 сентября — AI Native People: вечер для тех, кто в реальном времени строит AI! 😉
Сбер приглашает ML-инженеров, AI-исследователей, продактов и разработчиков провести вечер с пользой: пообщаться с лидерами команд Сбера, узнать про задачи и обменяться контактами.
Sber AI Lab, Agent Execution Framework, Enterprise Harness, ГигаАгент — выбирай проект по душе и, если всё сложится, стань частью команды.
До встречи 30 сентября в 18:00 в Сбер.Среде по адресу: Москва, «Оригинал», Земляной Вал, 9А.
Здесь — ссылка на регистрацию!
Сбер приглашает ML-инженеров, AI-исследователей, продактов и разработчиков провести вечер с пользой: пообщаться с лидерами команд Сбера, узнать про задачи и обменяться контактами.
Sber AI Lab, Agent Execution Framework, Enterprise Harness, ГигаАгент — выбирай проект по душе и, если всё сложится, стань частью команды.
До встречи 30 сентября в 18:00 в Сбер.Среде по адресу: Москва, «Оригинал», Земляной Вал, 9А.
Здесь — ссылка на регистрацию!
❤3🔥3👍2
Halo это open-source фреймворк для обучения языковых и мультимодальных моделей.
Он поддерживает pre-training, SFT, preference optimization и асинхронный RL. Модели остаются в стандартном формате Hugging Face, поэтому чекпоинты можно загружать через
from_pretrained.В тестах на 8× B300 Halo показал до 2,8 раза больше throughput, чем стандартный TRL, при меньшем пиковом потреблении памяти.
https://github.com/whitecircle/halo
Please open Telegram to view this post
VIEW IN TELEGRAM
❤6👍6🔥4
📊 Когда один аналитический вопрос превращается в квест по нескольким системам
Продажи — в одной системе, остатки — в другой, данные о клиентах — в третьей. А чтобы получить нормальный ответ, всё это сначала нужно собрать в одном месте.
Yandex B2B Tech представила DataLens Platform — новую платформу для полного цикла работы с данными.
В её основе — lakehouse на S3 и Apache Iceberg. Для интерактивных запросов используется Trino, для ресурсоемких преобразований — Spark, а за оркестрацию пайплайнов отвечает Airflow.
На уровне всей платформы работают единый каталог метаданных и общая модель доступа. Здесь же доступны инструменты визуализации и Нейроаналитик, который помогает исследовать данные, создавать SQL-запросы и строить графики.
Сейчас можно подать заявку на ранний доступ. Общедоступный релиз запланирован на март 2027 года.
По оценке компании, такой подход позволяет сократить затраты на аналитику до 30%, а подготовку отчетов и дашбордов — ускорить в 3–5 раз.
📎 Подробнее — в материале СМИ.
Продажи — в одной системе, остатки — в другой, данные о клиентах — в третьей. А чтобы получить нормальный ответ, всё это сначала нужно собрать в одном месте.
Yandex B2B Tech представила DataLens Platform — новую платформу для полного цикла работы с данными.
В её основе — lakehouse на S3 и Apache Iceberg. Для интерактивных запросов используется Trino, для ресурсоемких преобразований — Spark, а за оркестрацию пайплайнов отвечает Airflow.
На уровне всей платформы работают единый каталог метаданных и общая модель доступа. Здесь же доступны инструменты визуализации и Нейроаналитик, который помогает исследовать данные, создавать SQL-запросы и строить графики.
Сейчас можно подать заявку на ранний доступ. Общедоступный релиз запланирован на март 2027 года.
По оценке компании, такой подход позволяет сократить затраты на аналитику до 30%, а подготовку отчетов и дашбордов — ускорить в 3–5 раз.
📎 Подробнее — в материале СМИ.
❤7👍3🔥3
DeepSeek вышла на $1 млрд выручки в годовом выражении
По данным The Information, ещё несколько месяцев назад показатель составлял менее $500 млн. Речь о текущем темпе выручки, пересчитанном на год.
При этом более 70% вычислительных мощностей DeepSeek направляет на обучение новых моделей, а на обработку пользовательских запросов - менее 30%.
Компания подняла цены на API в 2,3-4,5 раза. По словам Ляна Вэньфэна на встрече с инвесторами, число клиентов после этого не сократилось, а спрос остался высоким. Валовая маржа API-бизнеса за январь–июль достигла 82,9%.
DeepSeek также завершает переговоры о новом раунде финансирования примерно на $7,5 млрд при оценке около $74 млрд. Закрыть его рассчитывают до конца октября.
По данным The Information, ещё несколько месяцев назад показатель составлял менее $500 млн. Речь о текущем темпе выручки, пересчитанном на год.
При этом более 70% вычислительных мощностей DeepSeek направляет на обучение новых моделей, а на обработку пользовательских запросов - менее 30%.
Компания подняла цены на API в 2,3-4,5 раза. По словам Ляна Вэньфэна на встрече с инвесторами, число клиентов после этого не сократилось, а спрос остался высоким. Валовая маржа API-бизнеса за январь–июль достигла 82,9%.
DeepSeek также завершает переговоры о новом раунде финансирования примерно на $7,5 млрд при оценке около $74 млрд. Закрыть его рассчитывают до конца октября.
❤16🔥10👍5
Участвуй во всероссийском ИТ-чемпионате МТС True Tech Champ 2026 c призовой фондом 10 250 000 рублей.
Если тебе нравятся алгоритмы, структуры данных и задачи на чистую логику — участвуй в алгоритмическом треке с индивидуальным зачетом.
Решай задачи разного уровня сложности: от базовых до тех, что проверяют скорость мышления и умение оптимизировать решения за ограниченное время.
В финале лучшие 120 участников алгоритмического трека сразятся в лайв-кодинге за шесть призовых мест и 2 750 000 рублей. Всех финалистов ждут:
— Лимитированный мерч;
— Сертификаты об участии;
— Масштабное мероприятие с выступлениями хэдлайнеров и фестивальными активностями.
Успей зарегистрироваться и пройти отборочный этап до 27 сентября
Если тебе нравятся алгоритмы, структуры данных и задачи на чистую логику — участвуй в алгоритмическом треке с индивидуальным зачетом.
Решай задачи разного уровня сложности: от базовых до тех, что проверяют скорость мышления и умение оптимизировать решения за ограниченное время.
В финале лучшие 120 участников алгоритмического трека сразятся в лайв-кодинге за шесть призовых мест и 2 750 000 рублей. Всех финалистов ждут:
— Лимитированный мерч;
— Сертификаты об участии;
— Масштабное мероприятие с выступлениями хэдлайнеров и фестивальными активностями.
Успей зарегистрироваться и пройти отборочный этап до 27 сентября
👍3
AGENTS.mdС версии 2.1.277 от 18 сентября, Claude Code ищет
AGENTS.md там, где нет CLAUDE.md, и загружает его как инструкции проекта. Если
CLAUDE.md в проекте есть, по умолчанию приоритет у него. Режим меняется в /config, в пункте Project instructions, можно выставить, чтобы читались оба файла сразу или только CLAUDE.md.Раньше Claude Code признавал только собственный CLAUDE.md, и тем, кто работает с несколькими агентами, приходилось вести два набора правил и следить, чтобы они не расходились.
Поддержку Anthropic сделала в виде встроенного мода, готовящийся механизм настройки Claude Code. Его код выложен в репозитории Claude Code. По словам инженера Anthropic Тарика Шихипара, позже разработчики смогут собирать на этой основе собственные варианты.
В Bedrock, Vertex и Foundry поддержка AGENTS.md пока не работает.
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👍5👏3
Please open Telegram to view this post
VIEW IN TELEGRAM
👍1😢1