Data Secrets

Сооснователь Anthropic Джек Кларк утверждает, что само-развивающийся ИИ с 60% вероятностью появится уже к концу 2028 года

Другими словами, по его мнению, ИИ системы совсем скоро смогут рекурсивно создавать и улучшать самих себя.

Статья: importai.substack.com/p/import-ai-455-automating-ai-research

Это не просто догадка: его оценка основана в большей степени на анализе прогресса на бенчмарках.

Например, на CORE-bench, где нужно имплементировать научные статьи (а из подобной работы и рождается основной прогресс в AI рисерче), агенты уже выбивают >95%. Или MLE-bench, где нужно решать ML-задачи с Kaggle и обучать модели для конкретных задач, – решен на 65%.

Параллельно растет продолжительность задач, которые модели могут выполнять автономно + количество индустриальных проектов, где ИИ уже неплохо выполняет какие-то крупные задачи AI-инжиниринга, типа проектирования чипов.

Учитывая темпы развития, совсем скоро есть шанс перейти к тому, что автор называет «end-to-end автоматизацией». ИИ перестанет быть инструментом для отдельных задач, и будет сам ставить цели, дизайнить эксперименты и действовать. Короче говоря, возьмет на себя R&D полностью.

Мне трудно осознать масштаб происходящего. Я делюсь этим, потому что, трезво проанализировав данные, пришел к выводу: то, что десятилетиями казалось научной фантастикой, становится реальностью. Вероятно, мы на пороге фундаментальных перемен, к которым общество может быть попросту не готово.

2❤95👍34😁24🤔20🔥1010🗿9🦄4👌1

18.9K views07:27

Data Secrets

Дмитрий Ушанов - новый руководитель AI-центра Т-Банка. В команде он уже более 2,5 лет: пришёл на позицию Head of ML и отвечал за сквозное внедрение машинного обучения в продукты компании.

За это время Дмитрий вместе с командой дообучил и запустил семейство open-source LLM моделей, адаптированных для русского языка, улучшил ML-скоринг в системе антифрода и усилил рекомендации и поиск в разделе «Шопинг».

Теперь команда сосредоточится на создании общей AI-инфраструктуры и построении внутренней LLM-платформы — чтобы любой сотрудник Компании мог создавать новые инструменты на единой технологической базе.

Вторая ключевая задача — разработка внешних AI-продуктов, включая AI-ассистентов, которые будут работать и за пределами экосистемы компании, и предназначаться не только её клиентам.

В компании считают, что ИИ — это не отдельная функция, а способ работать. Желаем Дмитрию успехов на новой позиции.

2❤107👍64🗿61😁23🤨18🔥6🤔4🤯111

18K views08:06

Data Secrets

Мы?

😁352🔥34❤22💯11🤔9👍721

18.3K views09:51

Data Secrets

Маск пообещал сделать Альтмана и Брокмана «самыми ненавидимыми людьми в Америке»

Так он ответил Брокману после того как тот накануне суда предложил ему взаимный отказ от претензий:

К концу этой недели вы с Сэмом станете самыми ненавидимыми людьми в Америке. Если вы будете настаивать, так и случится.

Это произошло в личной переписке за несколько дней до суда. А теперь OpenAI приобщают эту переписку к делу в федеральном суде. Их юристы используют ее как доказательство того, что преследования Маска сводятся к личной обиде на Альтмана и Брокмана, и он организует масштабную публичную компанию против них, а не просто суд.

166😁32🤩21❤16🔥4👍2🍓2🤓1🦄1

17.7K views10:56

Data Secrets

This media is not supported in your browser

VIEW IN TELEGRAM

Wildberries & Russ проведет Inside AI Meetup 20 мая в Москве и онлайн

Будут реальные кейсы:
— Высоконагруженная модерация с векторным поиском
— AIOps-подходы к управлению ML-сервисами
— Практики построения RAG-систем
— Тонкости реранкинга
— Реальные этапы запуска LLM-продуктов и еще многое другое.

Среди спикеров эксперты Wildberries & Russ, MWS, Avito, Сбера, Альфа-Банка, red_mad_robot.

Советуем ивент для senior ML/AI инженеров, MLE, DS, инженеров платформ и для всех, кто строит или масштабирует AI-системы в продакшене.

Регистрация и прочие подробности — по ссылке. Приглашайте коллег.

🗿48❤10🤔9😁8👍3🔥3🤯3👨‍💻1

17K views15:02

Data Secrets

Создатели SWE-bench представили новый бенчмарк по программированию, на котором абсолютно все современные модели выбивают ровно 0%

Он называется ProgramBench, и суть его проста: агент получает только скомпилированный исполняемый бинарник и документацию, и его задача – спроектировать код, который при сборке будет полностью соответствовать поведению исходного файла (без доступа к Интернету).

При этом агент должен самостоятельно определиться с архитектурой и выбрать структуру проекта. Собственно, здесь сложности и начинаются: LLM хорошо умеют писать плоский код в одном файле, а вот с многофайловыми проектами, где нужна низкоуровневая логика, работают плохо.

Итог: даже результат Claude Opus 4.7 и GPT-5.4 – это полный ноль.

Кажется, у нас новый претендент на звание самого интересного бенчмарка.

https://programbench.com/

🔥313😁104👍51❤21🗿12🕊2🤝1

18.2K viewsedited 20:22

Data Secrets

0:43

This media is not supported in your browser

VIEW IN TELEGRAM

Калистеника от Boston Dynamics

Новое вирусное видео робота Atlas они выложили с подписью:

Балансировать коммерческие цели и исследования в робототехнике непросто, но с Atlas мы заставляем это работать.

Кстати, вполне возможно, что экземпляр на видео уже работает но основе Gemini Robotics от Google. Компании заключили партнерство в начале года, и теперь совместно работают над новым поколением гуманоидов.

🔥132❤32🤯208😁5👍4👏4

15.6K viewsedited 07:29

Data Secrets

14 мая Газпромбанк.Тех проведет технологическую конференцию ГПБ КОНФ!

На одной площадке встретятся представители ИТ, инноваций, науки и обсудят, как сегодня запускать и масштабировать сложные решения в финтехе.

Что ждет участников?

Два трека программы:
- Как Акселератор Газпромбанк.Тех становится агентом технологических изменений
- Какие инженерные решения создаются внутри банка

Реальные кейсы:
- Как стартапу зайти в пилот с крупным банком
- Что отличает «демо» от промышленного внедрения
- Какие требования по безопасности, данным и масштабированию у корпоративного заказчика

А еще нетворкинг по делу: возможность пообщаться с командами акселератора и экспертами банка и презентовать свои проекты.

Когда: 14 мая 2026 в 12:00
Где: Москва, Конгресс-центр Connect

Регистрация открыта по ссылке

Реклама. Рекламодатель «Газпромбанк» (Акционерное общество)
ИНН: 7744001497

🗿21❤8😁6🔥5🤯5⚡3👍3🤨2

13.6K views08:54

Стартап Subquadratic анонсировал языковую модель SubQ с контекстным окном 12М токенов

Это не все: она также выдает невероятную скорость в 150 токенов/сек, обгоняет Claude Opus 4.6 на SWE-bench, и при этом ее стоимость составляет 5% от стоимости Opus (прочитайте это снова).

Секрет SubQ, как говорят создатели, в архитектуре. А точнее, в использовании нового вида механизма внимания – sub-quadratic sparse-attention. Идея в том, чтобы вычислять внимание только по разреженному набору наиболее важных связей, а не по всей матрице целиком.

Метод позволяет достичь линейной (!!!) вычислительной сложности относительно длины контекста и на длинных контекстных окнах достигает ускорения в 52 раза относительно FlashAttention.

Звучит как полный прорыв в экономике инференса. Но, как обычно, есть нюанс: пока все эти громкие заявления живут только на словах.

Проект находится в закрытой бете, техрепорта нет, доступов нет. Пока выложили только небольшой блог и разбор их механизма внимания.

Посмотрим, что из этого выйдет

😁13677🤯46❤19⚡10🤔8👍3🤩2👨‍💻1

14.9K views10:52

Data Secrets

Nvidia и один из крупнейших застройщиков США PulteGroup в сотрудничестве со стартапом Span будут устанавливать мини-датацентры на стены новых домов

Чего только не придумаешь, когда нужен компьют для ИИ. Кто-то предлагает строить датацентры в космосе, а вот в стартапе Span придумали концепцию распределенного дата‑центра, расбросанного по тысячам жилых домов.

В партнерстве с Nvidia и PulteGroup они прямо сейчас тестируют XFRA – небольшие вычислительные узлы, которые размещаются снаружи домов и состоят из ~ 16 GPU Blackwell. Умный электрощит Span следит, сколько энергии потребляет дом, и остаточную свободную мощность отдает XFRA на ИИ-нагрузки.

При этом владелец будет получать огромную скидку на тарифы электричества (и, вероятно, платить даже меньше, чем без XFRA) + дополнительный доход.

Фишка в том, что установить много таких ящичков – быстрее и дешевле, чем строить огромный датацентр (по расчетам Span, примерно в 5-6 раз). Так что идея неплохая, не считая рисков, стоимости обслуживания и, конечно, необходимости сложной инфры под все это дело.

К 2027 году Span с этим проектом планирует выйти на гигаваттный масштаб.

👍129👏26🔥17😁11❤9🤯7😎621

15K views13:11

Data Secrets

DeepSeek ведет переговоры о первом раунде внешнего финансирования

Компания планирует привлечь $3–4 млрд при оценке до $50 млрд, как сообщает Reuters.

Правда, большинство денег, скорее всего, все равно вложит государство. А точнее, Китайский национальный фонд искусственного интеллекта. Кроме того, принять участие в раунде может Tencent Holdings.

Напоминаем, что DeepSeek ранее отказывался от внешних инвестиций, но теперь, судя по всему, меняет стратегию.

❤66👍24🔥14😁7

13K views14:20

Data Secrets

0:36

This media is not supported in your browser

VIEW IN TELEGRAM

Yandex ML Challenge — новое соревнование с задачами по ИИ и финалом на Young Con 2026

Кого ждем:
Студентов, выпускников и учеников 11-х классов — тех, кто любит решать соревнования по машинному обучению

Что нужно знать:
На длинном онлайн-туре вас ждут 3 задачи: CV (компьютерное зрение), LLM (большие языковые модели) и RL (обучение с подкреплением).
Регистрируйтесь сейчас и приступайте к задачам 21 мая в 16:00 мск

Таймлайн:
С 21 по 31 мая — длинный онлайн-тур, где определим топ-100 финалистов с самым высоким суммарным рейтингом

25 июня состоится очный финал на Young Con 2026: масштабном фестивале о технологиях и старте карьеры в IT

Победителю соревнования достанется приз в размере 1 млн рублей.
А топ-15 финалистов получат набор умных устройств от Яндекса.

Регистрация открыта

🗿31😁24👍7🤯3❤2🔥1

12.4K views15:02

Data Secrets

0:09

This media is not supported in your browser

VIEW IN TELEGRAM

Gemma-4 теперь умеет предсказывать токены не по одному, а партиями

Google только что выпустили Multi-Token Prediction (MTP) драфтеры. Это штука, которая позволяет Gemma-4 предсказывать сразу несколько токенов вперед.

Обычно LLM генерируют строго по одному токену за шаг, и это одна из главных проблем архитектуры трансформеров, потому что работает медленно.

Что сделали Google:

– Они взяли еще одну модель, крошечную, обучили ее на задаче multi-token prediction, и поставили на роль drafter. Называется так, потому что эта модель пишет черновики, то есть пытается угадать действия большой модели на несколько токенов вперед.

– Батч черновых токенов проверяет основная модель. Фишка в том, что на проверку нужен всего один проход (вместо нескольких, если бы модель генерировала все эти токены сама).

– Если в черновой последовательности попадается ошибка, то: (1) этот токен заменяется на тот, который большая модель считает верным; (2) проверка прерывается и дальше драфтер предсказывает новую партию с этого места.

Например, мы сгенерировали 5 черновых токенов. Три перых совпало, четвертый заменили. Всего сэкономили три прохода большой модели.

Итог: MTP ускоряет генерацию примерно в 3 раза вообще без потерь в качестве. Все драфтеры выложили, так что уже можно попробовать погенерить что-нибудь в таком режиме.

blog.google/innovation-and-ai/technology/developers-tools/multi-token-prediction-gemma-4/

5👍164🔥61❤22🤔6🤯5😁3

14.5K views16:58

Data Secrets

Anthropic 🤝 SpaceX

Компании Дарио Амодеи и Илона Маска только что объявили о крупном партнерстве.

SpaceXAI предоставит Anthropic доступ ко всей вычислительной мощности дата-центра Colossus 1 в Мемфисе. Это примерно 300 мегаватт вычислительных мощностей или 220к GPU.

Это одна из крупнейших инфраструктурных договоренностей в секторе на данный момент.

В честь закрытия сделки Anthropic уже: удвоили 5-часовые лимиты для платных подписок; полностью убрали сокращение лимитов в пиковые часы (ура!); и повысили лимиты на Opus в API, включая RPM, TPM и квоты. Дальше обещают больше.

Сумма сделки не разглашается.

🔥48❤16👍7🤯5👏2

2.54K views07:57

About

Blog

Apps

Platform