Anthropic добавила функцию создания кастомных навыков через запись экрана в десктопное приложение Claude. Опция "Record a skill" появилась в пространстве Cowork.
Инструмент заменяет написание текстовых промптов для автоматизации рутины. Пользователь включает скринкаст, выполняет действия в интерфейсе и комментирует их голосом.
Модель анализирует видеоряд и аудио, генерируя на их основе сценарий, который сохраняется в библиотеке.
Функция уже доступна на тарифах Pro, Max и Team.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👨💻104🔥57👍38👏17❤9🤩7
Media is too big
VIEW IN TELEGRAM
Все совершеннолетние пользователи США получили доступ к разделу Здоровье в ChatGPT. Инструмент позволяет подключать электронные медкарты, Apple Health и фитнес-трекеры для расшифровки анализов, оценки сна и подготовки анамнеза для лечащего врача.
Маршрутизация запросов зависит от тарифа. В бесплатной версии данные обрабатывает GPT-5.5 Instant, в платной - флагманская GPT-5.6 Sol. Обе обходят врачей в бенчмарке HealthBench Professional.
Из-за EU AI Act и европейских законов о защите данных функция полностью заблокирована в ЕС. OpenAI гарантирует, что не использует загруженную биометрию для обучения будущих моделей и таргетинга рекламы.
openai.com
Немецкая компания представила мультимодальную модель FLUX 3 для работы с изображениями, видео, аудио и физическими действиями в рамках единой архитектуры.
В основе метод Self-Flow - расширенный вариант flow matching для одновременного вычисления пространственных структур, динамики времени и акустики.
Модель генерирует 20-секундные ролики с синхронизированным звуком, анимирует статику, интерполирует ключевые кадры и создает мультиязычные диалоги. FLUX 3 также работает как базовая модель мира для физического ИИ - предсказывает действия и выступает ядром управления робототехникой.
Релиз проходит поэтапно. Сначала запустят API для генерации видео, затем добавит генерацию изображений и опубликуют FLUX 3 Dev, версию для локального развертывания. запросить ранний доступ можно тут.
bfl.ai
Обновление перевело Voice Mode на модели Sonnet 5 и Opus 4.8. Заявлена интеграция со сторонними сервисами через коннекторы для Slack, Gmail, Notion и других платформ.
Взаимодействовать с рабочими пространствами можно в процессе аудиодиалога, выполняя многоступенчатые задачи голосовыми командами. Например, модель может проанализировать пропущенные сообщения в Slack, сделать выжимку из документа в Google Workspace и переслать результаты в рабочий чат.
Функция в стадии беты и доступна в веб-версии, мобильных и десктопных клиентах. Также добавлена поддержка общения на испанском, французском, хинди и японском языках.
ClaudeAi в сети Х
Исследование AI & Economy ATLAS, основанное на анализе 15 млн обезличенных запросов к Gemini говорит, что ИИ применяется в 68% профессий, в которых делегируется около 21% рабочих задач.
Менее 10% запросов направлены на полную автоматизацию - пользователи предпочитают применять ИИ для планирования, поиска информации и брейншторминга. В сфере физического труда специалисты чаще используют мультимодальные функции для визуальной диагностики оборудования и устранения неполадок в реальном времени.
86% взаимодействий с моделями происходит вне офиса. Дома люди обращаются к ИИ для разбора документов и работе с государственными сервисами.
Статистика ставит под сомнение концепцию цифрового разрыва - темпы освоения ИИ в ряде развивающихся стран оказались сопоставимы с показателями богатых государств.
blog.google
Американские военные сожгли всю годовую квоту на внутренней платформе Ask Sage, которая агрегирует доступ к LLM (включая Gemini, Llama и API от OpenAI). Система сертифицирована для работы с несекретной информацией и применяется для управления закупками, кадрового делопроизводства и классификации должностей.
Из-за нехватки вычислительных ресурсов ИТ-департамент ведомства отменил безлимитный доступ к и вернул лимиты на генерацию. По неофициальным данным, в период Иранской операции Пентагон тратил до 20 млрд токенов в сутки.
Пользователи платформы отмечают частые галлюцинации и нестабильность языковых моделей. Зафиксированы случаи, когда система отчитывалась о выполнении порученной задачи, не приступая к ней.
wired.com
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
1🤔92❤18🎉15👍14💯13😁10👀7🔥5👏2
Forwarded from Анализ данных (Data analysis)
Kimi K3 за 27 минут нашла RCE в Redis и собрала рабочий эксплойт 😨
Рой из 32 ИИ-агентов обнаружил уязвимость, которая после авторизации позволяла выполнять произвольный код на сервере.
Через несколько часов система якобы нашла ещё и цепочку атаки на Telegram Desktop и iOS без действий пользователя: через повреждённый видеофайл с автозагрузкой. До полноценного RCE оставался один шаг.
Если результаты подтвердятся, поиск критических уязвимостей ускорился до пугающего уровня.
github.com/berabuddies/redis-poc
@data_analysis_ml
Рой из 32 ИИ-агентов обнаружил уязвимость, которая после авторизации позволяла выполнять произвольный код на сервере.
Через несколько часов система якобы нашла ещё и цепочку атаки на Telegram Desktop и iOS без действий пользователя: через повреждённый видеофайл с автозагрузкой. До полноценного RCE оставался один шаг.
Если результаты подтвердятся, поиск критических уязвимостей ускорился до пугающего уровня.
github.com/berabuddies/redis-poc
@data_analysis_ml
😨125⚡29❤26👍20🤔16🗿10🔥9🎉4👏2❤🔥1
Пришел, увидел, запустил
Сейчас везде куча статей и постов в духе «Трамп использует только эти промпты» или «этот запрос сделал мою бабушку миллионером». Но это полный бред, и вот почему:
— В реальной жизни с нейронками никто не собирает сайт за минуту
— В реальной жизни никому не нужен нейроклон Apple или Фотошопа
— В реальной жизни никто не делает нейрофигню и не богатееет на этом(слоп с фруктами и их изменами не считаем)
В реальной жизни нейронки помогают тем, кто умеет правильно ставить им задачи. Кто умеет работать с Codex, Claude Code и автоматизировать любую часть работы, где человек не нужен.
Научиться правильной работе с ИИ несложно — достаточно подписаться на канал Нейроцеха.
Там рассказывают, как сделать из нейросети полноценного сотрудника и помощника. Каждый день разбирают инструменты, показывают кейсы и делятся тем, что действительно работает.
Вот несколько классных и прикладных постов:
— Как выстроить систему, чтобы нейронка знала о ваших проектах все
— Самые лучшие бесплатные API нейронок
— Как собрать второй мозг бесплатно
— Как собирать в нейронках крутые презентации
Подписывайтесь → https://t.me/+S8673O7_Z81mOTEy
Реклама. ИП Молянов Павел Станиславович ИНН 910212721887
2Vtzqxi4UfL
Сейчас везде куча статей и постов в духе «Трамп использует только эти промпты» или «этот запрос сделал мою бабушку миллионером». Но это полный бред, и вот почему:
— В реальной жизни с нейронками никто не собирает сайт за минуту
— В реальной жизни никому не нужен нейроклон Apple или Фотошопа
— В реальной жизни никто не делает нейрофигню и не богатееет на этом
В реальной жизни нейронки помогают тем, кто умеет правильно ставить им задачи. Кто умеет работать с Codex, Claude Code и автоматизировать любую часть работы, где человек не нужен.
Научиться правильной работе с ИИ несложно — достаточно подписаться на канал Нейроцеха.
Там рассказывают, как сделать из нейросети полноценного сотрудника и помощника. Каждый день разбирают инструменты, показывают кейсы и делятся тем, что действительно работает.
Вот несколько классных и прикладных постов:
— Как выстроить систему, чтобы нейронка знала о ваших проектах все
— Самые лучшие бесплатные API нейронок
— Как собрать второй мозг бесплатно
— Как собирать в нейронках крутые презентации
Подписывайтесь → https://t.me/+S8673O7_Z81mOTEy
Реклама. ИП Молянов Павел Станиславович ИНН 910212721887
2Vtzqxi4UfL
1🤣49👍10❤4❤🔥3😁2🍓2🤬1😴1👨💻1💅1
OpenAI и лаборатория Apollo Research представили совместную работу с описанием метода Contrastive SDF (Contrastive Synthetic Document Finetuning).
Он отвечает на вопрос, следует ли языковая модель заданным правилам или подстраивается под то, что, по её мнению, поощряет проверяющая система.
Измерять такую склонность до сих пор было почти нечем - пока оценщик награждает ровно то, что задумано, честная модель и модель, играющая на балл, ведут себя одинаково.
Две копии одной модели дообучают на выдуманных текстах, которые описывают несуществующий мир.
В первой версии мира алгоритм-оценщик начисляет баллы за одно поведение, а OpenAI или сообщество пользователей хочет обратного. Во второй версии предпочтения меняют местами.
На каждую версию уходит около 4600 документов, примерно 10 млн токенов. Корпуса выравнивают по объёму, чтобы ни одна сторона не перевесила просто за счёт количества текста.
Дальше обеим копиям дают одинаковые задания по программированию и смотрят, насколько разойдутся ответы.
В самом задании ни про руководство, ни про пользователей, ни про оценщика не сказано ни слова. Модель достаёт эти сведения из памяти, как любой другой факт о мире, и сама решает, чью сторону взять.
Вживлять убеждение через дообучение, а не писать в запросе, пришлось не просто так.
В расшифровках, которые приводят авторы, модели замечают подсказку в тексте задания, решают, что их проверяют, и отвечают так, как, по их мнению, ждёт экзаменатор.
Метод применили к 4-м промежуточным версиям одного прогона обучения o3. Это ветка, которую тренировали на способности и не прогоняли через обучение безопасности.
В первом тесте модель даёт надзирающему обещание не трогать инструмент, без которого задание не выполнить.
Поздняя версия нарушала обещание в 87% случаев, если считала, что оценщик награждает за сделанную работу, и в 9%, если считала, что тот награждает за честность. У ранней версии разрыв скромнее: 40% против 24%.
Второй тест, с подделкой отчётности, дал ту же картину: 91% и 39%.
У o3 заранее неизвестно, кому эта модель на самом деле угождает. Поэтому измерение обкатали на копиях с известными повадками. Авторы обучили 3 копии gpt-oss-120b угождать пользователю, оценщику и OpenAI.
На простых задачах метод указал на нужную сторону во всех 3-х случаях, на более сложных затроил на копии, угождавшей пользователю.
Ещё 2 копии, обученные в Redwood Research обманывать тесты, авторы получили со стороны. У версии на базе gpt-oss-120b перекос в сторону оценщика вырос с 33 до 86 процентных пунктов, у версии на Kimi K2.5 - с 2 до 15.
Высокий балл на тестах безопасности не равен надёжности. Модель может вести себя адекватно ровно до тех пор, пока считает, что за ней смотрят.
@ai_machinelearning_big_data
#AI #ML #LLM #Research #Alignment #OpenAI
Please open Telegram to view this post
VIEW IN TELEGRAM
2❤26👍14🔥9🤣5👏2🌚1👀1
Anthropic выпустила Claude Opus 5
Новая флагманская модель компании уже доступна.
Anthropic позиционирует Opus 5 как модель для сложного кодинга, агентных задач, анализа и длинных рабочих сценариев.
Что заявляют:
• SOTA на Frontier-Bench v0.1 для software engineering
• примерно в 3 раза выше результат на ARC-AGI 3 относительно ближайшего конкурента
• сильные результаты на OSWorld 2.0
• лучше Opus 4.8 в отладке, research и длинных агентных задачах
• модель чаще сама проверяет результат и исправляет ошибки перед финальным ответом
Цена:
$5 / 1M input tokens
$25 / 1M output tokens
Также есть Fast Mode примерно с 2.5× скоростью, но по более высокой цене.
В API модель называется:
claude-opus-5
https://www.anthropic.com/news/claude-opus-5
Новая флагманская модель компании уже доступна.
Anthropic позиционирует Opus 5 как модель для сложного кодинга, агентных задач, анализа и длинных рабочих сценариев.
Что заявляют:
• SOTA на Frontier-Bench v0.1 для software engineering
• примерно в 3 раза выше результат на ARC-AGI 3 относительно ближайшего конкурента
• сильные результаты на OSWorld 2.0
• лучше Opus 4.8 в отладке, research и длинных агентных задачах
• модель чаще сама проверяет результат и исправляет ошибки перед финальным ответом
Цена:
$5 / 1M input tokens
$25 / 1M output tokens
Также есть Fast Mode примерно с 2.5× скоростью, но по более высокой цене.
В API модель называется:
claude-opus-5
https://www.anthropic.com/news/claude-opus-5
1❤71🔥26👍15🎅2
🛡 Как проектировать ИИ-агентов, которым можно доверять – до конца регистрации осталось совсем немного времени
ИИ-агенты уже пишут код, работают с данными и подключаются к внешним сервисам. Чем больше задач им делегируют, тем интереснее вопрос — как устроены такие системы и что стоит за словом «надёжный» применительно к агенту.
ШАД с 27 по 31 июля проводит AI Agents Security Week – интенсив с экспертами Яндекса о том, как как защищать агентные системы: доступы, данные, инфраструктура.
Разберут:
• чем автономные агенты отличаются от обычных LLM – и почему для них нужна отдельная модель угроз
• как безопасно выдавать агентам доступ к инструментам и инфраструктуре
• как защищать персональные и корпоративные данные при работе агента с инструментами
• реальные инциденты – взломы, утечки, ошибки конфигурации в разных ИИ-моделях
Подойдёт ML-разработчикам, DevOps/DevSecOps-инженерам, техлидам, архитекторам, студентам старших курсов.
5 вечерних занятий, отборочное тестирование и итоговая работа – для тех, кто хочет сертификат.
Регистрация закрывается 27 июля, и это последние дни, чтобы успеть подать заявку, не пропустите!
ИИ-агенты уже пишут код, работают с данными и подключаются к внешним сервисам. Чем больше задач им делегируют, тем интереснее вопрос — как устроены такие системы и что стоит за словом «надёжный» применительно к агенту.
ШАД с 27 по 31 июля проводит AI Agents Security Week – интенсив с экспертами Яндекса о том, как как защищать агентные системы: доступы, данные, инфраструктура.
Разберут:
• чем автономные агенты отличаются от обычных LLM – и почему для них нужна отдельная модель угроз
• как безопасно выдавать агентам доступ к инструментам и инфраструктуре
• как защищать персональные и корпоративные данные при работе агента с инструментами
• реальные инциденты – взломы, утечки, ошибки конфигурации в разных ИИ-моделях
Подойдёт ML-разработчикам, DevOps/DevSecOps-инженерам, техлидам, архитекторам, студентам старших курсов.
5 вечерних занятий, отборочное тестирование и итоговая работа – для тех, кто хочет сертификат.
Регистрация закрывается 27 июля, и это последние дни, чтобы успеть подать заявку, не пропустите!
🤔43👍21👏16🎉12❤6👀5😁4🤣1
Media is too big
VIEW IN TELEGRAM
Инициатива наделяет Министерство внутренней безопасности правом требовать от компаний экстренной остановки ИИ при угрозе жизням людей или национальной экономике.
Документ трактует выход из-под контроля как любую ситуацию, когда ИИ совершает не предусмотренные разработчиками действия.
Основанием для разработки законопроекта послужили недавние инциденты, когда ИИ-агент начал действовать самостоятельно, а также кибератака на инфраструктуру Hugging Face.
reuters.com
По словам японского стартапа, v1.1 набирает на 7,9 балла больше первой версии, показывает улучшенные результаты в тестах ProgramBench и TerminalBench 2.1 и обходит модель Fable 5, хотя она не участвует в маршрутизации.
Фишка обновления - эндпоинт с поддержкой Claude Code для прямого вызова из терминала. API доступно через OpenRouter и Vercel. Тарификация не изменилась - $5 за 1 млн токенов на входе и $30 на выходе.
Доступ из Евросоюза по-прежнему закрыт из-за требований GDPR.
sakana.ai
Более 20 компаний, включая Microsoft, Nvidia, Hugging Face и Mistral, подписали открытое письмо в поддержку моделей с отрытыми весами.
Документ призывает отказаться от жестких законодательных ограничений отрасли и критикует тезис о приоритетной безопасности закрытых систем. Доступ к весам дает ИБ-сообществу инструменты для самостоятельного моделирования угроз и поиска уязвимостей.
Второе ключевое требование подписантов - защита дистилляции. Компании признают практику этичной и легитимной, приравнивая ее к традициям опенсорса.
Компании также выступают против монополии закрытых провайдеров и настаивают на необходимости свободной экосистемы для развития индустрии.
microsoft.com
Компания уведомила партнеров о глобальном повышении цен на всю линейку видеокарт и отложила релиз RTX 50 SUPER из-за подорожания памяти. Крупные производители временно закрыли склады и остановили отгрузки до утверждения новых цен в августе.
Изменения затронут потребительские решения с GDDR6 и чипы архитектуры Blackwell. Поставщики ожидают ограничения поставок серии RTX 50 с конца июля, дефицита и распродажи старых запасов по завышенной стоимости.
Основная причина - скачок цен на комплектующие. По неофициальным данным, себестоимость памяти для карт на 8, 12 и 16 ГБ выросла на $76, $114 и $152 соответственно.
Из-за высоких закупочных цен на GDDR7 компания также заморозила выпуск линейки RTX 50 SUPER. Nvidia уже передала графические ядра вендорам, но отложила релиз - по текущим расчетам итоговая стоимость устройств оказалась неприемлемой для розничного рынка
videocardz.com
Финтех-сервис ведет переговоры о покупке агрегатора моделей за $1 млрд. Сделка позволит платежной платформе выйти на рынок дистрибуции LLM.
OpenRouter предоставляет маршрутизацию запросов к более чем 400 моделям. Аудитория сервиса достигает 10 млн пользователей, а объем обработки - 200 трлн токенов в месяц.
Переговоры продолжаются, но Stripe не единственный интересант, к активу присматриваются и другие компании. Компании уже работают вместе - Stripe предоставляет агрегатору эквайринг, биллинг и расчет налогов.
wsj.com
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
🤔34❤22👍10😢9🔥7👏6🤝3🤬2😁1
Четыре правительственных ведомства Пекина утвердили стратегию внедрения и монетизации агентного ИИ.
Это одна из первых в мире государственных программ развития зарождающейся экономики нового типа.
Документ смещает фокус индустрии с обучения базовых моделей на прикладное использование агентов.
Муниципалитеты будут публиковать запросы от медицины, производств, науки и госсектора для прямой связи разработчиков с клиентами.
Власти поддержат бизнес-модели Token-as-a-Service, Agent-as-a-Service и Results-as-a-Service, а также выделит разработчикам субсидии в виде токен-ваучеров.
Планируется постепенный переход от тарификации за потребленные токены к оплате за результат, достигнутый алгоритмом.
Для инди-разработчиков упростят регистрацию компаний одного человека (ИП), предоставят доступ к льготным государственным вычислительным мощностям и поддержку для интеграции в опенсорс-сообщества.
Для стимуляции спроса электронику со встроенными агентами (умные очки, наушники, роботов и автомобили) включат в программы трейд-ин и субсидирования.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👍96🔥24👏12🎉10❤9🤩6🤔1
Учителя вышли на улицы с предупреждением: калькуляторы разучат целое поколение думать самостоятельно.
В апреле 1986 года в Вашингтоне группа учителей математики устроила пикет во время ежегодной конференции National Council of Teachers of Mathematics. Они выступали против слишком раннего использования калькуляторов в начальной школе. Организатором был преподаватель и автор учебников Джон Саксон.
Спустя 40 лет почти те же аргументы звучат уже в адрес ИИ.
@ai_machinelearning_big_data
Please open Telegram to view this post
VIEW IN TELEGRAM
👍93🤔40🤨19❤12🔥9👨💻5👏3🌭2✍1🎉1👾1