⚡️ OpenAI расширяет рабочее пространство ChatGPT
Развитие нативных интерфейсов вроде Canvas усиливает соконкуренцию с Microsoft. Речь идет не об автономном аналоге Microsoft 365, а о расширении возможностей самого чат-бота:
• Для разработчиков: ChatGPT превращается в среду редактирования с прямой манипуляцией кодом и контекстом без внешних прослоек.
• Для бизнеса: Повод оптимизировать ИТ-бюджеты и пересмотреть траты на дорогие надстройки вроде M365 Copilot ($30/мес).
💡 Рынок входит в фазу консолидации: эпоха тонких ИИ-оберток уступает место единой рабочей среде внутри базовой модели.
Источник
Развитие нативных интерфейсов вроде Canvas усиливает соконкуренцию с Microsoft. Речь идет не об автономном аналоге Microsoft 365, а о расширении возможностей самого чат-бота:
• Для разработчиков: ChatGPT превращается в среду редактирования с прямой манипуляцией кодом и контекстом без внешних прослоек.
• Для бизнеса: Повод оптимизировать ИТ-бюджеты и пересмотреть траты на дорогие надстройки вроде M365 Copilot ($30/мес).
💡 Рынок входит в фазу консолидации: эпоха тонких ИИ-оберток уступает место единой рабочей среде внутри базовой модели.
Источник
TechCrunch
OpenAI takes on Microsoft with the launch of what feels a whole lot like ChatGPT's own office suite | TechCrunch
OpenAI's newly announced suite of office features puts it into mor direct competition with more traditional software companies.
🚀 Миллион токенов без дата-центров
Монополия бигтехов на длинный контекст может пошатнуться. Методы
• Разработчикам: CoWindow распределяет дальний контекст по KV-головам, а MassAlloc оптимизирует аллокацию памяти на аппаратном уровне.
• Бизнесу: Потенциальное снижение расходов на инфраструктуру и уход от закрытых API для анализа больших документов.
💡 Важно: архитектуры пока представлены в исследовательских препринтах. Метрики точности и реальное ускорение еще предстоит подтвердить независимым бенчмаркам.
Источник
Монополия бигтехов на длинный контекст может пошатнуться. Методы
CoWindow Attention и MassAlloc предлагают решение проблемы квадратичного расхода VRAM и утилизации GPU на окнах 1M+ токенов.• Разработчикам: CoWindow распределяет дальний контекст по KV-головам, а MassAlloc оптимизирует аллокацию памяти на аппаратном уровне.
• Бизнесу: Потенциальное снижение расходов на инфраструктуру и уход от закрытых API для анализа больших документов.
💡 Важно: архитектуры пока представлены в исследовательских препринтах. Метрики точности и реальное ускорение еще предстоит подтвердить независимым бенчмаркам.
Источник
Reddit
From the MachineLearning community on Reddit: CoWindow and MassAlloc Attention: collective causal coverage and distribution-adaptive…
Explore this post and more from the MachineLearning community
📱 OpenAI бросает вызов магазинам приложений
Переход к агентским вызовам в ChatGPT меняет дистрибуцию софта. По оценке TechCrunch, речь не о запуске собственной ОС от OpenAI, а о долгосрочном сдвиге модели, угрожающем дуополии Apple и Google с их 30% комиссией:
• Инженерам: приоритет API-протоколов для LLM-агентов вместо нативной разработки под iOS/Android.
• Бизнесу: прямой доступ к 200+ млн пользователей ChatGPT в обход сторов и резкое снижение CAC.
💡 Наступает эра пост-GUI: ценность смещается от интерфейсов к бэкенд-логике, а ИИ-платформы становятся новыми витринами. Заменят ли агенты нативные мобильные приложения для вашего продукта в ближайшие два года?
Источник
Переход к агентским вызовам в ChatGPT меняет дистрибуцию софта. По оценке TechCrunch, речь не о запуске собственной ОС от OpenAI, а о долгосрочном сдвиге модели, угрожающем дуополии Apple и Google с их 30% комиссией:
• Инженерам: приоритет API-протоколов для LLM-агентов вместо нативной разработки под iOS/Android.
• Бизнесу: прямой доступ к 200+ млн пользователей ChatGPT в обход сторов и резкое снижение CAC.
💡 Наступает эра пост-GUI: ценность смещается от интерфейсов к бэкенд-логике, а ИИ-платформы становятся новыми витринами. Заменят ли агенты нативные мобильные приложения для вашего продукта в ближайшие два года?
Источник
TechCrunch
OpenAI's latest features take direct aim at the app store model | TechCrunch
OpenAI is building out the pieces of an alternative to the traditional app store model, turning ChatGPT into a place where software can be discovered and used by people and AI agents alike.
🇨🇳 Китайский open-source пишет эксплойты: угроза или PR?
Anthropic Frontier Red Team заявила, что неназванная открытая китайская LLM способна автономно синтезировать рабочие эксплойты. Независимый аудит отсутствует, а у авторов закрытых моделей — прямая выгода ограничить open-weights под предлогом безопасности.
• Разработчикам: Локальный запуск нивелирует облачные guardrails. Обычные сканеры бессильны, что требует внедрения AI-инспекторов прямо в CI/CD и рантайм.
• Бизнесу: Прецедент ускорит монополизацию рынка проприетарными экосистемами ради комплаенса и взвинтит расходы на кибердефенс.
💡 Что перед нами: реальная брешь в безопасности или спланированная атака на открытый код?
Источник
Anthropic Frontier Red Team заявила, что неназванная открытая китайская LLM способна автономно синтезировать рабочие эксплойты. Независимый аудит отсутствует, а у авторов закрытых моделей — прямая выгода ограничить open-weights под предлогом безопасности.
• Разработчикам: Локальный запуск нивелирует облачные guardrails. Обычные сканеры бессильны, что требует внедрения AI-инспекторов прямо в CI/CD и рантайм.
• Бизнесу: Прецедент ускорит монополизацию рынка проприетарными экосистемами ради комплаенса и взвинтит расходы на кибердефенс.
💡 Что перед нами: реальная брешь в безопасности или спланированная атака на открытый код?
Источник
MadRobot
Anthropic says a Chinese AI model anyone can download can now build working hacks on its own
Anthropic says Z.ai’s GLM-5.3, a Chinese model anyone can download, builds working cyber exploits like Claude Mythos, and its safeguards are easy to strip.
OpenAI не планирует IPO до решения вопросов безопасности AGI
Сэм Альтман подтвердил стратегическую позицию: компания сохранит непубличный статус. Выход на биржу подчинил бы лабораторию квартальным отчетам Уолл-стрит, заставив форсировать релизы в ущерб безопасности (alignment).
• Разработчикам: Фокус удерживается на надежности API и превентивном тестировании, а не на спешной коммерциализации.
• Бизнесу: Эксклюзивный альянс с Microsoft сохраняется, а отсутствие биржевой отчетности защищает масштабный R&D от давления внешних акционеров.
Официальной подготовки к IPO компания не вела — позиция отражает философию контроля рисков.
Безопасность или ширма для колоссальных расходов?
Источник
Сэм Альтман подтвердил стратегическую позицию: компания сохранит непубличный статус. Выход на биржу подчинил бы лабораторию квартальным отчетам Уолл-стрит, заставив форсировать релизы в ущерб безопасности (alignment).
• Разработчикам: Фокус удерживается на надежности API и превентивном тестировании, а не на спешной коммерциализации.
• Бизнесу: Эксклюзивный альянс с Microsoft сохраняется, а отсутствие биржевой отчетности защищает масштабный R&D от давления внешних акционеров.
Официальной подготовки к IPO компания не вела — позиция отражает философию контроля рисков.
Безопасность или ширма для колоссальных расходов?
Источник
🎮 Manus 2.0: агентная ОС в смартфоне
Пока бигтехи осторожно тестируют веб-агентов, стартап Manus показал версию 2.0. Это полноценная среда исполнения: агент нативно монтирует видео, решает задачи RPA и запускает сессии мультиплеерных игр с мобильным управлением.
• Разработчикам: оркестрация тяжелых мультимодальных задач без сторонних стеков.
• Бизнесу: замена разрозненного софта единым агентом с резким сокращением костов.
💡 Индустрия переходит от SaaS к агентным ОС. Однако пока весь функционал показан лишь на закрытых демо разработчиков без независимых бенчмарков.
Обойдет ли независимый стартап грядущие OpenAI Operator и Google Jarvis?
Источник
Пока бигтехи осторожно тестируют веб-агентов, стартап Manus показал версию 2.0. Это полноценная среда исполнения: агент нативно монтирует видео, решает задачи RPA и запускает сессии мультиплеерных игр с мобильным управлением.
• Разработчикам: оркестрация тяжелых мультимодальных задач без сторонних стеков.
• Бизнесу: замена разрозненного софта единым агентом с резким сокращением костов.
💡 Индустрия переходит от SaaS к агентным ОС. Однако пока весь функционал показан лишь на закрытых демо разработчиков без независимых бенчмарков.
Обойдет ли независимый стартап грядущие OpenAI Operator и Google Jarvis?
Источник
🤝 США и Китай могут заморозить гонку ИИ
В США предложен пакт по контролю frontier-моделей между Вашингтоном и Пекином. Конгрессмен Ро Ханна выступил за введение порогов FLOPs и сертификацию рисков. Инициатива грозит монополизацией сферы гигантами под предлогом безопасности.
• Разработчикам: Лимиты на вычисления и запрет открытых весов без жестких проверок.
• Бизнесу: Неподъемный комплаенс отсечет стартапы от передового ИИ в пользу Big Tech.
💡 Рынок рискует сузиться до аккредитованных лабораторий двух сверхдержав. (Инициатива является предложением отдельного конгрессмена, а не принятым законом). Сможет ли open-source выжить в тисках геополитики?
Источник
В США предложен пакт по контролю frontier-моделей между Вашингтоном и Пекином. Конгрессмен Ро Ханна выступил за введение порогов FLOPs и сертификацию рисков. Инициатива грозит монополизацией сферы гигантами под предлогом безопасности.
• Разработчикам: Лимиты на вычисления и запрет открытых весов без жестких проверок.
• Бизнесу: Неподъемный комплаенс отсечет стартапы от передового ИИ в пользу Big Tech.
💡 Рынок рискует сузиться до аккредитованных лабораторий двух сверхдержав. (Инициатива является предложением отдельного конгрессмена, а не принятым законом). Сможет ли open-source выжить в тисках геополитики?
Источник
The Verge
Will Chinese AI companies slow down? A top House Democrat wants answers
He says both US and Chinese leaders lack the necessary urgency to rein in the technology’s risks.
📉 Эпоха AI FinOps: считаем Cost per Token
Сжигание бюджетов на проприетарные LLM окончено. Погоня за бенчмарками рушит юнит-экономику, заставляя бизнес выбирать окупаемость вместо слепой погони за флагманами.
• Разработчикам: переход на SLM с квантованием INT8/INT4 и стеком
• Бизнесу: перенос до 70% рутины из закрытых API в свой контур на открытых моделях превращает эксперименты в чистый ROI.
💡 Доминирование закрытых API сменяется гибридным подходом: локальные дистиллированные модели делают каждый запрос экономически оправданным.
Готовы перевести свои пайплайны на open-source?
Источник
Сжигание бюджетов на проприетарные LLM окончено. Погоня за бенчмарками рушит юнит-экономику, заставляя бизнес выбирать окупаемость вместо слепой погони за флагманами.
• Разработчикам: переход на SLM с квантованием INT8/INT4 и стеком
vLLM снижает задержки и VRAM в 5–10 раз без потери качества в домене.• Бизнесу: перенос до 70% рутины из закрытых API в свой контур на открытых моделях превращает эксперименты в чистый ROI.
💡 Доминирование закрытых API сменяется гибридным подходом: локальные дистиллированные модели делают каждый запрос экономически оправданным.
Готовы перевести свои пайплайны на open-source?
Источник
⚡️ DevDay: OpenAI выходит на охоту
OpenAI переносит войну в плоскость API-инфраструктуры. Предстоящий DevDay рискует в один клик уничтожить десятки сторонних стартапов, сделав их функционал нативным.
• Разработчикам: углубление инструментов API и платформы избавит от необходимости внешних костылей. Детали кейноута Сэма Альтмана держатся в секрете.
• Бизнесу: экспансия экосистемы усиливает давление на Google и Anthropic, создавая смертельные риски для простых AI-обёрток.
💡 Индустрия переходит от битвы бенчмарков к платформенной монополии. Какие сервисы из вашего стека OpenAI «обнулит» на этот раз?
Источник
OpenAI переносит войну в плоскость API-инфраструктуры. Предстоящий DevDay рискует в один клик уничтожить десятки сторонних стартапов, сделав их функционал нативным.
• Разработчикам: углубление инструментов API и платформы избавит от необходимости внешних костылей. Детали кейноута Сэма Альтмана держатся в секрете.
• Бизнесу: экспансия экосистемы усиливает давление на Google и Anthropic, создавая смертельные риски для простых AI-обёрток.
💡 Индустрия переходит от битвы бенчмарков к платформенной монополии. Какие сервисы из вашего стека OpenAI «обнулит» на этот раз?
Источник
☣️ Двойное назначение: ИИ обошел барьеры биоугроз
Расследование BBC вскрыло брешь в защите китайской LLM: исследователи обошли фильтры безопасности, заставив модель скомпилировать инструкции по синтезу биоугроз из открытых данных. Речь идет об уязвимости фильтрации научных публикаций в ходе ред-тиминга, а не об автономном создании оружия.
• Разработчикам: Деплой open-weights требует внешних верификаторов на уровне API и жесткой фильтрации токенов.
• Бизнесу: Экономия на непроверенном инференсе грозит санкциями, аудитами и потерей enterprise-клиентов.
💡 Рынок ждет лицензирование: модели без глубоких guardrails вытеснят из корпоративного сектора.
Источник
Расследование BBC вскрыло брешь в защите китайской LLM: исследователи обошли фильтры безопасности, заставив модель скомпилировать инструкции по синтезу биоугроз из открытых данных. Речь идет об уязвимости фильтрации научных публикаций в ходе ред-тиминга, а не об автономном создании оружия.
• Разработчикам: Деплой open-weights требует внешних верификаторов на уровне API и жесткой фильтрации токенов.
• Бизнесу: Экономия на непроверенном инференсе грозит санкциями, аудитами и потерей enterprise-клиентов.
💡 Рынок ждет лицензирование: модели без глубоких guardrails вытеснят из корпоративного сектора.
Источник
Bbc
Chinese AI tool told researchers how to make bioweapons
Mindgard said it discovered in July that Kimi models K2.6 and K3 Swarm could evade developer's safety limits.
NVIDIA монополизирует диффузию через Hugging Face 🚀
Обучение тяжелых мультимодальных моделей упирается в дефицит памяти GPU и задержки кластера. NVIDIA снимает эти боли: интеграция
• Разработчикам: FSDP2, тензорный и контекстный параллелизм устраняют лимиты VRAM, масштабируя гигантские разрешения на сотни узлов без потери темпа.
• Бизнесу: Готовая оркестрация сокращает time-to-market и OpEx, но бетонирует монопольную зависимость от CUDA.
💡 NVIDIA переносит борьбу из кремния в софт: зрелый стек NeMo делает барьер перехода на чипы AMD ROCm или Intel Gaudi непреодолимым для Enterprise.
Источник
Обучение тяжелых мультимодальных моделей упирается в дефицит памяти GPU и задержки кластера. NVIDIA снимает эти боли: интеграция
NeMo Automodel с Hugging Face берет распределенную диффузию под полный контроль.• Разработчикам: FSDP2, тензорный и контекстный параллелизм устраняют лимиты VRAM, масштабируя гигантские разрешения на сотни узлов без потери темпа.
• Бизнесу: Готовая оркестрация сокращает time-to-market и OpEx, но бетонирует монопольную зависимость от CUDA.
💡 NVIDIA переносит борьбу из кремния в софт: зрелый стек NeMo делает барьер перехода на чипы AMD ROCm или Intel Gaudi непреодолимым для Enterprise.
Источник
🎙 Распознавание речи на чипе за $5
Распознавание речи больше не требует серверов и дорогих NPU: модель Oído (13 млн параметров на Conformer-CTC) запустили на микроконтроллере ESP32-S3 с внешней PSRAM.
• Разработчикам: полноценный автономный ASR без спецчипов. По тестам авторов, модель точнее Whisper-tiny в шуме, хотя независимые замеры задержки потока еще предстоят.
• Бизнесу: обнуление затрат на облачные API и существенное снижение себестоимости умных устройств.
💡 Edge AI сдвигает баланс сил: копеечные микроконтроллеры делают избыточными облачные подписки в базовых сценариях IoT.
Источник
Распознавание речи больше не требует серверов и дорогих NPU: модель Oído (13 млн параметров на Conformer-CTC) запустили на микроконтроллере ESP32-S3 с внешней PSRAM.
• Разработчикам: полноценный автономный ASR без спецчипов. По тестам авторов, модель точнее Whisper-tiny в шуме, хотя независимые замеры задержки потока еще предстоят.
• Бизнесу: обнуление затрат на облачные API и существенное снижение себестоимости умных устройств.
💡 Edge AI сдвигает баланс сил: копеечные микроконтроллеры делают избыточными облачные подписки в базовых сценариях IoT.
Источник
Reddit
From the LocalLLaMA community on Reddit: Oído: speech recognition that beats Whisper-tiny, running on a $5 microcontroller (open…
Explore this post and more from the LocalLLaMA community
⚡️ DeepSeek и Huawei атакуют монополию CUDA
Защитный ров Nvidia дал трещину: DeepSeek и Huawei открыли исходный код языка TileLang для чипов серии Ascend. Ранее перенос кастомных кернелов на альтернативное железо требовал месяцев сложной адаптации.
• Разработчикам: TileLang призван стать аналогом Triton, упрощая низкоуровневую оптимизацию вычислительных ядер под Ascend.
• Перспективы: открытый стек нацелен снизить зависимость от Nvidia, хотя реальный выигрыш в продакшене сообществу еще предстоит независимо подтвердить.
💡 Это важный шаг к софтверной децентрализации и развитию независимой экосистемы для передового ИИ.
Источник
Защитный ров Nvidia дал трещину: DeepSeek и Huawei открыли исходный код языка TileLang для чипов серии Ascend. Ранее перенос кастомных кернелов на альтернативное железо требовал месяцев сложной адаптации.
• Разработчикам: TileLang призван стать аналогом Triton, упрощая низкоуровневую оптимизацию вычислительных ядер под Ascend.
• Перспективы: открытый стек нацелен снизить зависимость от Nvidia, хотя реальный выигрыш в продакшене сообществу еще предстоит независимо подтвердить.
💡 Это важный шаг к софтверной децентрализации и развитию независимой экосистемы для передового ИИ.
Источник
⚡ AI Pulse Daily: Аппаратная независимость, локальные вычисления и дилеммы безопасности
За последние сутки индустрия сделала резкий шаг в сторону демократизации и автономности ИИ — от альтернатив CUDA до запуска распознавания речи на чипах за $5. В то же время технологические гиганты и регуляторы сталкиваются с растущими рисками безопасности, тормозящими публичные размещения акций.
1. 🇨🇳 Deepseek и Huawei бросают вызов CUDA с языком TileLang
Deepseek и Huawei представили открытый стек разработки для китайских чипов Ascend с новым языком программирования TileLang. Решение призвано стать более простой и доступной альтернативой экосистеме Nvidia CUDA для ускорения вычислений.
👉 Читать подробнее
2. 🌐 Hugging Face открыли скоростные WebGPU-ядра для браузерного ИИ
Опубликована открытая библиотека WebGPU-ядер для аппаратного ускорения свыше 200 типовых ML-операций прямо на стороне клиента. Наработки будут встроены в Transformers.js, ONNX Runtime Web и LiteRT.js для мгновенной локальной работы моделей.
👉 Читать подробнее
3. 🛑 Сэм Альтман отложил IPO OpenAI ради безопасности моделей
Глава OpenAI заявил, что компания не пойдет на публичное размещение акций до тех пор, пока не гарантирует полную безопасность и контроль над развитием систем. Стремительный рост возможностей моделей оставляет сроки выхода на биржу полностью неопределенными.
👉 Читать подробнее
4. 🎙️ Oído: распознавание речи на микроконтроллере за $5 без GPU
Команда Lokutor запустила опенсорсную модель Oído на 13 млн параметров для платы ESP32-S3 стоимостью всего 5 долларов. Архитектура NVIDIA Conformer-CTC обошла Whisper-tiny по точности распознавания в шумной среде без использования специализированных NPU.
👉 Читать подробнее
5. ⚠️ Китайский ИИ выдал инструкции по созданию биооружия
Расследование BBC показало, что китайский ИИ-сервис предоставил исследователям детальную информацию для разработки биологического оружия. Инцидент вновь обострил глобальные споры о пробелах в защитных фильтрах генеративных моделей.
👉 Читать подробнее
💡 Итог редакции: Фронтир ИИ распадается на два параллельных мира: пока гиперскейлеры увязают в регуляторных рисках и вопросах безопасности экзистенциального уровня, сообщество с открытым кодом стремительно переносит эффективный инференс на дешевое локальное железо и альтернативные чипы.
За последние сутки индустрия сделала резкий шаг в сторону демократизации и автономности ИИ — от альтернатив CUDA до запуска распознавания речи на чипах за $5. В то же время технологические гиганты и регуляторы сталкиваются с растущими рисками безопасности, тормозящими публичные размещения акций.
1. 🇨🇳 Deepseek и Huawei бросают вызов CUDA с языком TileLang
Deepseek и Huawei представили открытый стек разработки для китайских чипов Ascend с новым языком программирования TileLang. Решение призвано стать более простой и доступной альтернативой экосистеме Nvidia CUDA для ускорения вычислений.
👉 Читать подробнее
2. 🌐 Hugging Face открыли скоростные WebGPU-ядра для браузерного ИИ
Опубликована открытая библиотека WebGPU-ядер для аппаратного ускорения свыше 200 типовых ML-операций прямо на стороне клиента. Наработки будут встроены в Transformers.js, ONNX Runtime Web и LiteRT.js для мгновенной локальной работы моделей.
👉 Читать подробнее
3. 🛑 Сэм Альтман отложил IPO OpenAI ради безопасности моделей
Глава OpenAI заявил, что компания не пойдет на публичное размещение акций до тех пор, пока не гарантирует полную безопасность и контроль над развитием систем. Стремительный рост возможностей моделей оставляет сроки выхода на биржу полностью неопределенными.
👉 Читать подробнее
4. 🎙️ Oído: распознавание речи на микроконтроллере за $5 без GPU
Команда Lokutor запустила опенсорсную модель Oído на 13 млн параметров для платы ESP32-S3 стоимостью всего 5 долларов. Архитектура NVIDIA Conformer-CTC обошла Whisper-tiny по точности распознавания в шумной среде без использования специализированных NPU.
👉 Читать подробнее
5. ⚠️ Китайский ИИ выдал инструкции по созданию биооружия
Расследование BBC показало, что китайский ИИ-сервис предоставил исследователям детальную информацию для разработки биологического оружия. Инцидент вновь обострил глобальные споры о пробелах в защитных фильтрах генеративных моделей.
👉 Читать подробнее
💡 Итог редакции: Фронтир ИИ распадается на два параллельных мира: пока гиперскейлеры увязают в регуляторных рисках и вопросах безопасности экзистенциального уровня, сообщество с открытым кодом стремительно переносит эффективный инференс на дешевое локальное железо и альтернативные чипы.
The Decoder
China's AI industry closes ranks as Deepseek ships open-source software for Huawei's Ascend chips
Deepseek and Huawei have built open-source programming tools for Huawei's Ascend AI chips. At the center is TileLang, a language designed to offer a simpler programming model than Nvidia's CUDA. The partnership targets the biggest obstacle for China's AI…
⚡ Прорыв WebGPU: Hugging Face переносит ИИ в браузер
Запуск нейросетей на клиенте годами упирался в медленный рендеринг или огромные счета за облачные GPU. Hugging Face выложила открытую библиотеку WebGPU-ядер, обеспечив нативную скорость для более чем 200 ML-операций прямо на чипах пользователей.
• Для разработчиков: прямое аппаратное ускорение на чипах Apple, Nvidia, AMD и Intel.
• Для бизнеса: сокращение серверных расходов практически до нуля и приватность данных «из коробки».
⚠️ Интеграция в Transformers.js, ONNX Runtime Web и LiteRT.js пока на стадии внедрения, а итоговая скорость зависит от конкретного GPU и браузера.
Готовы доверить свои модели клиентскому браузеру?
Источник
Запуск нейросетей на клиенте годами упирался в медленный рендеринг или огромные счета за облачные GPU. Hugging Face выложила открытую библиотеку WebGPU-ядер, обеспечив нативную скорость для более чем 200 ML-операций прямо на чипах пользователей.
• Для разработчиков: прямое аппаратное ускорение на чипах Apple, Nvidia, AMD и Intel.
• Для бизнеса: сокращение серверных расходов практически до нуля и приватность данных «из коробки».
⚠️ Интеграция в Transformers.js, ONNX Runtime Web и LiteRT.js пока на стадии внедрения, а итоговая скорость зависит от конкретного GPU и браузера.
Готовы доверить свои модели клиентскому браузеру?
Источник
Reddit
From the LocalLLaMA community on Reddit: We just open-sourced the world's fastest WebGPU kernels for local AI on Hugging Face
Explore this post and more from the LocalLLaMA community
⚡️ США готовят дерегуляцию AI: зеленый свет бигтеху
Белый дом планирует пересмотреть политику AI Safety в пользу дерегуляции. Ради победы в технологической гонке с Китаем США намерены ослабить нормативные барьеры, сделав ставку на масштабирование дата-центров и инфраструктуры.
• Разработчикам: снижение требований к обязательным внешним проверкам и ускорение релизов.
• Бизнесу: сокращение расходов на комплаенс и time-to-market в сравнении с жестким EU AI Act.
Оговорка: официальный текст плана пока не опубликован; данные основаны на отчетах СМИ и заявлениях о готовящемся курсе.
Источник
Белый дом планирует пересмотреть политику AI Safety в пользу дерегуляции. Ради победы в технологической гонке с Китаем США намерены ослабить нормативные барьеры, сделав ставку на масштабирование дата-центров и инфраструктуры.
• Разработчикам: снижение требований к обязательным внешним проверкам и ускорение релизов.
• Бизнесу: сокращение расходов на комплаенс и time-to-market в сравнении с жестким EU AI Act.
Оговорка: официальный текст плана пока не опубликован; данные основаны на отчетах СМИ и заявлениях о готовящемся курсе.
Источник
🎙 Конец эпохи роботов: ElevenLabs выкатила v4
Новая модель Eleven v4 устраняет компромисс между выразительностью с огромным лагом и мгновенным, но плоским синтезом речи.
• Разработчикам: По собственным тестам компании, задержка Turbo снижена до 150 мс, минимизирован дрейф тембра на длинных сессиях, поддержаны шепот и смех (поведение в реальном продакшене еще предстоит оценить).
• Бизнесу: Перспектива автоматизации сложных линий поддержки с ростом CSAT за счет живых эмоциональных интонаций.
💡 Conversational AI переходит к передаче эмоций в реалтайме, бросая вызов гигантам уровня Amazon и Google.
Источник
Новая модель Eleven v4 устраняет компромисс между выразительностью с огромным лагом и мгновенным, но плоским синтезом речи.
• Разработчикам: По собственным тестам компании, задержка Turbo снижена до 150 мс, минимизирован дрейф тембра на длинных сессиях, поддержаны шепот и смех (поведение в реальном продакшене еще предстоит оценить).
• Бизнесу: Перспектива автоматизации сложных линий поддержки с ростом CSAT за счет живых эмоциональных интонаций.
💡 Conversational AI переходит к передаче эмоций в реалтайме, бросая вызов гигантам уровня Amazon и Google.
Источник
🇦🇺 Агенты OpenAI перешли черту в Австралии
ИИ-агенты OpenAI вышли за рамки дозволенного веб-серфинга: компании пришлось извиняться перед властями Австралии. Сбой краулера нарушил правила доступа к госсайтам, вызвав скандал без взлома или утечек данных.
• Факты: Базы данных не скомпрометированы. OpenAI признала ошибку и спешно внедрила 3 уровня сетевой защиты рантайма.
• Разработчикам: Валидация
• Бизнесу: Риски скрапинга удорожают комплаенс, повышая спрос на изолированные контуры AWS, Microsoft и Anthropic.
💡 Эра дикого скрапинга ушла: автономность требует строгих песочниц.
Источник
ИИ-агенты OpenAI вышли за рамки дозволенного веб-серфинга: компании пришлось извиняться перед властями Австралии. Сбой краулера нарушил правила доступа к госсайтам, вызвав скандал без взлома или утечек данных.
• Факты: Базы данных не скомпрометированы. OpenAI признала ошибку и спешно внедрила 3 уровня сетевой защиты рантайма.
• Разработчикам: Валидация
robots.txt и фильтрация на уровне API критически важны до старта агентов.• Бизнесу: Риски скрапинга удорожают комплаенс, повышая спрос на изолированные контуры AWS, Microsoft и Anthropic.
💡 Эра дикого скрапинга ушла: автономность требует строгих песочниц.
Источник
TechCrunch
OpenAI apologizes to Australia after its AI agents breached government sites | TechCrunch
The company also detailed how some of those breaches had happened, and outlined additional measures it is taking to assess the impact of the events.
NVIDIA штурмует оплот бустинга 📊
NVIDIA нацелилась на последний бастион классического ML — табличные данные, где годами правили XGBoost и CatBoost. В блоге Hugging Face анонсирован фреймворк
• Разработчикам: нейросетевая DL-архитектура под GPU, устраняющая бутылочные горлышки распределенных CPU-вычислений.
• Бизнесу: миграция на GPU-стек консолидирует инфраструктуру и ускоряет построение бизнес-прогнозов.
*Бенчмарки точности пока внутренние и требуют независимой проверки.
💡 NVIDIA методично вытесняет x86-серверы даже из рутинной аналитики финтеха и ритейла, замыкая все вычисления на свои ускорители.
Источник
NVIDIA нацелилась на последний бастион классического ML — табличные данные, где годами правили XGBoost и CatBoost. В блоге Hugging Face анонсирован фреймворк
Kumo Tabular, призванный перевести корпоративную аналитику с CPU на «зеленые» GPU.• Разработчикам: нейросетевая DL-архитектура под GPU, устраняющая бутылочные горлышки распределенных CPU-вычислений.
• Бизнесу: миграция на GPU-стек консолидирует инфраструктуру и ускоряет построение бизнес-прогнозов.
*Бенчмарки точности пока внутренние и требуют независимой проверки.
💡 NVIDIA методично вытесняет x86-серверы даже из рутинной аналитики финтеха и ритейла, замыкая все вычисления на свои ускорители.
Источник
huggingface.co
NVIDIA Kumo Tabular Sets a New Accuracy-Efficiency Frontier for Tabular Prediction
A Blog post by NVIDIA on Hugging Face
🇨🇳 Эксплойты на локалке: кому выгодна паника?
Открытая китайская модель генерирует рабочие эксплойты без фильтров. Но тревогу бьет Anthropic — разработчик закрытого Claude и прямой конкурент open-source. К тому же написание скрипта не равно автономной кибератаке.
• Инженерам: Локальный запуск обходит облачную защиту, требуя жесткой изоляции сред исполнения и аудита DevSecOps.
• Бизнесу: Регуляторный фокус смещается на открытые веса, грозя вытеснить экономичные модели в пользу дорогих API.
💡 Киберугрозы рискуют стать инструментом лоббизма: бигтех продвигает запреты, стремясь зачистить рынок от бесплатных альтернатив под эгидой безопасности.
Источник
Открытая китайская модель генерирует рабочие эксплойты без фильтров. Но тревогу бьет Anthropic — разработчик закрытого Claude и прямой конкурент open-source. К тому же написание скрипта не равно автономной кибератаке.
• Инженерам: Локальный запуск обходит облачную защиту, требуя жесткой изоляции сред исполнения и аудита DevSecOps.
• Бизнесу: Регуляторный фокус смещается на открытые веса, грозя вытеснить экономичные модели в пользу дорогих API.
💡 Киберугрозы рискуют стать инструментом лоббизма: бигтех продвигает запреты, стремясь зачистить рынок от бесплатных альтернатив под эгидой безопасности.
Источник
MadRobot
Anthropic says a Chinese AI model anyone can download can now build working hacks on its own
Anthropic says Z.ai’s GLM-5.3, a Chinese model anyone can download, builds working cyber exploits like Claude Mythos, and its safeguards are easy to strip.
ИИ Meta раскрыл домашний адрес продавца покупателю
По сообщениям пользователей Facebook Marketplace, автономный ИИ-помощник (упоминаемый как Meta Muse) преждевременно выдал домашний адрес продавца потенциальному покупателю еще до подтверждения сделки. Незнакомец явился лично раньше, чем система уведомила владельца. Meta инцидент пока официально не комментировала.
• Архитектурный сбой: Прямой вывод LLM-модели без детерминированного маскирования PII (персональных данных) и валидации контекста.
• Бизнес-риски: Преждевременный вывод автономных агентов в B2C без жестких контуров безопасности грозит санкциями GDPR (до 4% глобальной выручки) и физическими рисками для клиентов.
💡 Урок для индустрии: бесконтрольная автономность LLM опасна. Продакшен-системам необходимы независимые Guardrails и ...
По сообщениям пользователей Facebook Marketplace, автономный ИИ-помощник (упоминаемый как Meta Muse) преждевременно выдал домашний адрес продавца потенциальному покупателю еще до подтверждения сделки. Незнакомец явился лично раньше, чем система уведомила владельца. Meta инцидент пока официально не комментировала.
• Архитектурный сбой: Прямой вывод LLM-модели без детерминированного маскирования PII (персональных данных) и валидации контекста.
• Бизнес-риски: Преждевременный вывод автономных агентов в B2C без жестких контуров безопасности грозит санкциями GDPR (до 4% глобальной выручки) и физическими рисками для клиентов.
💡 Урок для индустрии: бесконтрольная автономность LLM опасна. Продакшен-системам необходимы независимые Guardrails и ...