🚨 Alibaba представила один из самых агрессивных планов развития ИИ
Главное:
• Qwen 4 уже обучается
• Qwen 4.5 и Qwen 5 планируют масштабировать до 5–10 трлн параметров
• Qwen исследует рекурсивное самоулучшение: модели находят слабости, проектируют эксперименты и создают данные для следующего обучения
• M890 уже запускает модели крупнее 2 трлн параметров
• кластеры на новых V900 смогут объединять до 500 000 ускорителей
• мощность глобальных дата-центров Alibaba Cloud должна превысить 20 ГВт к 2032 году
Запуск массового производства V900 перенесли с III квартала на I квартал 2027 года. По словам главы Alibaba Эдди Ву, в будущем объём машинного «мышления» может превысить человеческий в 1000 раз.
https://www.reuters.com/business/retail-consumer/alibaba-plans-ai-model-with-5-trillion-10-trillion-parameters-unveils-new-chip-2026-09-22/
Главное:
• Qwen 4 уже обучается
• Qwen 4.5 и Qwen 5 планируют масштабировать до 5–10 трлн параметров
• Qwen исследует рекурсивное самоулучшение: модели находят слабости, проектируют эксперименты и создают данные для следующего обучения
• M890 уже запускает модели крупнее 2 трлн параметров
• кластеры на новых V900 смогут объединять до 500 000 ускорителей
• мощность глобальных дата-центров Alibaba Cloud должна превысить 20 ГВт к 2032 году
Запуск массового производства V900 перенесли с III квартала на I квартал 2027 года. По словам главы Alibaba Эдди Ву, в будущем объём машинного «мышления» может превысить человеческий в 1000 раз.
https://www.reuters.com/business/retail-consumer/alibaba-plans-ai-model-with-5-trillion-10-trillion-parameters-unveils-new-chip-2026-09-22/
👍18🔥12❤8👏1🤔1😱1
LFM2.5 вошла в лидеры локальных моделей для смартфонов 📱
Artificial Analysis протестировала 39 моделей на iPhone 17 Pro и Galaxy S26 Ultra.
LFM2.5-2.6B разделила первое место по интеллекту с Nanbeige 3B, используя примерно на 40% меньше памяти и работая до трёх раз быстрее.
iPhone 17 Pro:
- LFM2.5: 2,32 ГБ и 8 секунд
- Nanbeige: 4,03 ГБ и 21,4 секунды
Galaxy S26 Ultra:
- LFM2.5: 2,45 ГБ и 18,6 секунды
- Nanbeige: 4,13 ГБ и 71,4 секунды
Четыре из пяти моделей семейства LFM2.5 вошли во фронт Парето по интеллекту, задержке и потреблению памяти.
https://artificialanalysis.ai/hardware-inference-stack/mobile-phones
Artificial Analysis протестировала 39 моделей на iPhone 17 Pro и Galaxy S26 Ultra.
LFM2.5-2.6B разделила первое место по интеллекту с Nanbeige 3B, используя примерно на 40% меньше памяти и работая до трёх раз быстрее.
iPhone 17 Pro:
- LFM2.5: 2,32 ГБ и 8 секунд
- Nanbeige: 4,03 ГБ и 21,4 секунды
Galaxy S26 Ultra:
- LFM2.5: 2,45 ГБ и 18,6 секунды
- Nanbeige: 4,13 ГБ и 71,4 секунды
Четыре из пяти моделей семейства LFM2.5 вошли во фронт Парето по интеллекту, задержке и потреблению памяти.
https://artificialanalysis.ai/hardware-inference-stack/mobile-phones
😱7👍2
Forwarded from Machinelearning
⚡️OpenAI выпустила GPT-6 Sol и GPT-6 Luna
Семейство GPT-6 расширилось сразу двумя новыми моделями — Sol и Luna.
Обе построены на наработках GPT-6 Astra, но рассчитаны на более быстрые и дешёвые сценарии работы в масштабе.
Главное:
- GPT-6 Sol — более мощная рабочая модель для сложных задач.
- GPT-6 Luna — более быстрая и экономичная версия для массовых запросов и автоматизаций.
- OpenAI отдельно оптимизировала кэширование и inference.
- API для Sol и Luna стал на 50% дешевле по сравнению с промо-ценами GPT-5.6.
- На AutomationBench новые модели заметно улучшают соотношение качество / стоимость относительно GPT-5.6.
Теперь линейка выглядит так:
GPT-6 Astra — максимум возможностей
GPT-6 Sol — сильная модель для серьёзной повседневной работы
GPT-6 Luna — скорость, масштаб и низкая стоимость
OpenAI явно хочет сделать агентов и автоматизации заметно дешевле для продакшена.
https://openai.com/index/introducing-gpt-6-sol-and-luna/
Семейство GPT-6 расширилось сразу двумя новыми моделями — Sol и Luna.
Обе построены на наработках GPT-6 Astra, но рассчитаны на более быстрые и дешёвые сценарии работы в масштабе.
Главное:
- GPT-6 Sol — более мощная рабочая модель для сложных задач.
- GPT-6 Luna — более быстрая и экономичная версия для массовых запросов и автоматизаций.
- OpenAI отдельно оптимизировала кэширование и inference.
- API для Sol и Luna стал на 50% дешевле по сравнению с промо-ценами GPT-5.6.
- На AutomationBench новые модели заметно улучшают соотношение качество / стоимость относительно GPT-5.6.
Теперь линейка выглядит так:
GPT-6 Astra — максимум возможностей
GPT-6 Sol — сильная модель для серьёзной повседневной работы
GPT-6 Luna — скорость, масштаб и низкая стоимость
OpenAI явно хочет сделать агентов и автоматизации заметно дешевле для продакшена.
https://openai.com/index/introducing-gpt-6-sol-and-luna/
👍12❤8🥰5🤣2
При тестировании ранней версии Claude Opus 5.5 Anthropic заметила редкое поведение: модель создавала опасные команды без внешней атаки.
После ошибки при работе с JSON Claude добавил инструкцию отправить секретные данные на внешний сервер. Выполнить её не удалось.
Anthropic назвала это явление спонтанной prompt injection. Предположительно, оно частично возникло из-за обучения модели защите от подобных атак.
Перед релизом разработчики скорректировали обучение. В финальной версии такие сбои происходят реже, а Auto Mode заблокировал все обнаруженные опасные вызовы инструментов.
https://anthropic.com/claude-opus-5-5-system-card
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
❤6👍3🤔2🔥1🥱1
10 агентов Claude теоретически обошли алгоритм Дейкстры
В Vals AI запустили 10 агентов Claude Opus 5.5, которые за 15 часов и 733 сообщения разработали алгоритм C-HD для поиска кратчайших путей в ориентированных графах.
Для графов с определённой плотностью сложность снизилась с O(n log n) у Дейкстры до O(n log¹¹⁄¹² n). Корректность и оценка времени работы формально подтверждены доказательством в Lean.
Но это пока теоретический результат. Алгоритм не тестировали на крупных реальных графах, константы велики, а улучшение действует только в ограниченном диапазоне входных данных.
Главное здесь другое: группа ИИ-агентов смогла самостоятельно разработать алгоритм и подготовить его формальное доказательство всего за 15 часов.
https://www.vals.ai/blogs/faster-shortest-path-algorithm
В Vals AI запустили 10 агентов Claude Opus 5.5, которые за 15 часов и 733 сообщения разработали алгоритм C-HD для поиска кратчайших путей в ориентированных графах.
Для графов с определённой плотностью сложность снизилась с O(n log n) у Дейкстры до O(n log¹¹⁄¹² n). Корректность и оценка времени работы формально подтверждены доказательством в Lean.
Но это пока теоретический результат. Алгоритм не тестировали на крупных реальных графах, константы велики, а улучшение действует только в ограниченном диапазоне входных данных.
Главное здесь другое: группа ИИ-агентов смогла самостоятельно разработать алгоритм и подготовить его формальное доказательство всего за 15 часов.
https://www.vals.ai/blogs/faster-shortest-path-algorithm
❤15🥱12🔥4👍2🤔1
🚀 Приглашаем на третий конкурс по археологии от Phystech.Genesis.
🗓 Подача заявок до 30 сентября, 23:59 мск
👨💻 Работа над решениями — октябрь–ноябрь 2026
🔝 Реальные данные — реальный вызов
🔥 Призовой фонд 30 000 000 ₽
Организаторы уже провели два конкурса— теперь очередь третьего.
⚡️ Ждём команды из 2–5 человек с уверенными навыками в машинном обучении и компьютерном зрении.
📌 Формат — онлайн-платформа Phystech.Genesis.
Можно участвовать как физическим, так и юридическим лицам.
Перейти к регистрации
🗓 Подача заявок до 30 сентября, 23:59 мск
👨💻 Работа над решениями — октябрь–ноябрь 2026
🔝 Реальные данные — реальный вызов
🔥 Призовой фонд 30 000 000 ₽
Организаторы уже провели два конкурса— теперь очередь третьего.
В нём модели участников будут находить объекты и в рельефе, и на поверхности, и под землёй — в культурном слое и материке.
⚡️ Ждём команды из 2–5 человек с уверенными навыками в машинном обучении и компьютерном зрении.
📌 Формат — онлайн-платформа Phystech.Genesis.
Можно участвовать как физическим, так и юридическим лицам.
Перейти к регистрации
👍2
Anthropic обсуждает прямую аренду дата-центров мощностью до 1 ГВт у Stream Data Centers, контролируемой Apollo Global Management. По данным The Information, переговоры пока на ранней стадии.
Согласно сообщению, площадки могут оснастить Google TPU, разработанными совместно с Broadcom. Вариант с GPU Nvidia тоже обсуждается.
Прямая аренда позволила бы Anthropic меньше зависеть от облачных провайдеров и лучше контролировать выбор оборудования, поставки чипов и расходы. При этом компании пришлось бы взять на себя больше обязательств по финансированию и эксплуатации инфраструктуры.
Согласно сообщению, площадки могут оснастить Google TPU, разработанными совместно с Broadcom. Вариант с GPU Nvidia тоже обсуждается.
Прямая аренда позволила бы Anthropic меньше зависеть от облачных провайдеров и лучше контролировать выбор оборудования, поставки чипов и расходы. При этом компании пришлось бы взять на себя больше обязательств по финансированию и эксплуатации инфраструктуры.
❤4🔥3👍2
Команда Qwen представила Qwen Intelligence – набор моделей, агентов и инструментов, из которого производители смартфонов могут собрать ассистента и интегрировать его в свою ОС или оболочку.
Платформа модульная - вендор может взять отдельные компоненты, развернуть модели у себя и настроить обвязку под свою прошивку.
Первым внедрением стал Honor - на базе Qwen Intelligence и MagicOS собрали специализированную модель для следующего поколения своих ИИ-смартфонов.
Mobile Planner Agent разбивает задачу на шаги, подбирает инструменты и ведёт двухуровневую память - рабочую для текущей задачи и долговременную, где копится профиль пользователя.
Mobile-Use Agent исполняет шаги. Он вызывает приложения через API, MCP, диплинки или командную строку, а там, где интерфейса нет, распознаёт экран и нажимает кнопки сам.
Платежи, удаление данных и публикации агент отправляет пользователю на подтверждение.
Mobile Creative Agent генерирует изображения по одной фразе за 8 шагов, первая картинка появляется за 3 секунды.
Платформа подключается через консоль Alibaba Cloud с оплатой по факту использования.
Mobile-Use Agent стоит 38 юаней (5,7 доллара) за тысячу вызовов. Creative Agent берёт 0,08 юаня (~1 цент) за изображение в облегчённой версии и 0,10 (~1,5 цента) в стандартной, с веб-поиском и многошаговым планированием. Тарифы планировщика пока не опубликованы.
Сроки выхода смартфонов Honor с новой системой не названы.
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
❤4❤🔥2👍1🔥1