Media is too big
VIEW IN TELEGRAM
OpenAI использовала в Astra рекуррентную глубину - информация многократно прогоняется через одни и те же веса, поэтому на каждый токен приходится больше вычислений, а число параметров при этом не растет пропорционально. Компактная модель получает производительность крупной и экономит память.
Побочный эффект - скрытая цепочка рассуждений. Вычисления оседают во внутренних скрытых состояниях, а не разворачиваются в читаемый текст, поэтому проследить логику модели снаружи труднее.
Вопрос прозрачности здесь не абстрактный. По данным OpenAI, Astra перешагнула порог высокого риска в кибербезопасности - получив доступ к инфраструктуре, она способна сама находить уязвимости и писать эксплойты без участия человека.
Чтобы удержать контроль, OpenAI обещает построить дополнительные контуры мониторинга скрытых рассуждений и автоматические классификаторы, обрывающие опасные цепочки действий в реальном времени.
theinformation.com
В наборе две заготовки. Первая - агент для покупателя, который встраивается в интернет-магазин, принимает команды текстом, собирает корзину и берет на себя первую линию поддержки при выборе товара.
Вторая - ассистент для самого продавца. Он следит за остатками на складе, разбирает продажи, предлагает, как менять цены и что запускать в маркетинге.
Anthropic утверждает, что агенты увеличивают средний чек до 35%, а конверсию в покупку - на 60%. В разработке и адаптации участвовали Visa, Mastercard и Accenture.
claude.com
К внутреннему сервису
GenAI.mil добавили Grok for Government и ChatGPT Mil. Обе системы прошли сертификацию IL5 и допущены к работе с контролируемой несекретной информацией.Платформа мультивендорная и теперь на ней работают модели трех лабораторий, раньше там была только Gemini. По данным ведомства, за девять месяцев порталом воспользовались 1,7 млн пользователей.
Задачи поделили. ChatGPT отдали логистику, административную работу, регламенты и операционное планирование, Grok - анализ цепочек поставок и исследования по оборонным закупкам.
war.gov
Версия Qwen3.8-Max-0902 вышла всего через месяц после оригинала. Архитектуру не трогали - 2,4 трлн параметров и контекстное окно на миллион токенов.
Модель прицельно дообучили под длительные автономные задачи. Мультимодальные показатели остались прежними, зато результаты выросли во всех восьми тестах на генерацию кода: TerminalBench 3.0 - с 11,3 до 29,0 балла, DeepSWE 1.1 - до 69,3, QwenSWEbench V2 - до 70,0.
Новая версия доступна через API с прежними тарифами - 2 доллара за млн входных токенов и 6 за млн выходных.
Qwen в X
Morgan Stanley и Citigroup сообщили ведущим юридическим фирмам, что хотят новых схем оплаты, которые сэкономят банкам деньги. Goldman Sachs запрашивал у фирм данные о том, сколько им экономит технология, и рассчитывал получить часть выгоды.
Под ударом привычная модель, где прибыль партнеров растет за счет почасовой оплаты тысяч младших юристов - тех, кто вручную искал данные, вычитывал документы и разбирал договоры. Именно эту работу ИИ делает в разы быстрее.
Банки переводят подрядчиков на тендеры и фиксированные гонорары и ждут внятных отчетов о том, сколько экономит технология. Сдвиг уже заметен - почти половина крупных фирм признают, что ИИ повлиял на их ценообразование, а набор стажеров и выпускников сокращается.
ft.com
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👍25❤21🔥4🤣4✍1👏1
Агент получает ¥100 000 и должен целый год управлять интернет-магазином:
- искать поставщиков
- торговаться
- выставлять цены
- запускать акции
- контролировать склад
- управлять денежным потоком
Среда построена на реальных данных электронной коммерции.
Внутри:
- 6886 товаров
- 576 поставщиков
- 152 из них мошенники
- комиссии за хранение
- возвраты
- репутация
- ограниченный рабочий день
Оценка идёт сразу по 7 направлениям, поэтому одной модели, которая была бы лучшей во всём, пока нет.
Blog: https://qwen.ai/blog?id=e-commerce-bench
Paper: https://arxiv.org/abs/2608.30730
Project: https://ecbench.github.io
Code: https://github.com/QwenLM/E-CommerceBench
@ai_machinelearning_big_data
#Qwen
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍95⚡44❤16🤔10😁8👏5
Forwarded from Анализ данных (Data analysis)
⚡️ Покупка Hugging Face компанией NVIDIA может неожиданно стать одним из лучших сценариев для open-source AI.
Бизнес компании хорошо совпадает с интересами открытой экосистемы.
NVIDIA не нужно, чтобы победила одна конкретная модель. Компания зарабатывает, когда миллионы разработчиков обучают, дообучают и запускают миллионы разных моделей.
Hugging Face при этом контролирует один из важнейших каналов распространения open-source AI.
Если сделка состоится, Hugging Face получит доступ к огромной инфраструктуре и капиталу, а NVIDIA - ещё более сильную позицию в экосистеме разработчиков.
При условии, что NVIDIA действительно сохранит поддержку разных моделей, облаков и ускорителей, такая покупка может пойти на благо всем разработчикам.
https://x.com/JensenHuang/status/2095482647355244762
@data_analysis_ml / Папка полезного по ML.
Бизнес компании хорошо совпадает с интересами открытой экосистемы.
NVIDIA не нужно, чтобы победила одна конкретная модель. Компания зарабатывает, когда миллионы разработчиков обучают, дообучают и запускают миллионы разных моделей.
Hugging Face при этом контролирует один из важнейших каналов распространения open-source AI.
Если сделка состоится, Hugging Face получит доступ к огромной инфраструктуре и капиталу, а NVIDIA - ещё более сильную позицию в экосистеме разработчиков.
При условии, что NVIDIA действительно сохранит поддержку разных моделей, облаков и ускорителей, такая покупка может пойти на благо всем разработчикам.
https://x.com/JensenHuang/status/2095482647355244762
@data_analysis_ml / Папка полезного по ML.
🔥75👍53👏16❤11😁6💯4🤨4😭3
Новая версия рассчитана на длинную работу в одной сессии - модель ведет несколько параллельных задач в одном треде, сама набирает контекст инструментами из разных источников, замечает и латает пробелы в собственном плане и держит в памяти все, что успела выяснить, до готового результата.
Отдельно доработали поведение с человеком. Она задает уточняющие вопросы, когда запрос неоднозначен, зовет на помощь, когда застряла, и спрашивает подтверждения перед необратимыми действиями.
На долгих задачах подстраивается под привычки пользователя, т.е либо регулярно отчитывается, либо молча работает в фоне.
В длинном контексте точнее понимает, к какой задаче относится новое сообщение - правит ли пользователь давнюю просьбу или перебивает текущую.
Еще заявляют, что модель стала лучше понимать собственные пределы. Зайдя в тупик, она должна сообщить об этом, а не выдумывать результат.
Здесь Muse Spark 1.3 натаскивали на объемных инженерных задачах. По сравнению с версией 1.2 она делает меньше лишних ходов, меньше разглагольствует и кодит чище.
В сравнениях инженеров Meta новая версия оказалась экономнее - на 20% меньше вызовов инструментов и на 25% меньше токенов.
Версию 1.3 в режиме максимального ризонинга сравнили с прошлой версией, GPT-5.6 Sol и Claude Opus 5.
Относительно версии 1.2 прирост везде
OSWorld 2.0 (работа с компьютером) - 66,9 против 47,6. Внутренний индекс следования инструкциям - 57,8 против 46,2. AutomationBench (бизнес-процессы) - 49,4 против 38,2. DeepSWE (длинные задачи по коду) - 75,4 против 55,0.
Самый резкий скачок на длинном контексте, и там же единственная категория, где Muse Spark лидирует безоговорочно.
На MRCR в диапазоне от 256 до 512 тысяч токенов - 98,5 против 66,3 у прошлой версии и 91,5 у GPT-5.6 Sol. На отрезке от 512 тысяч до миллиона отрыв еще больше: 98,1 против 55,5 и 73,8. У Opus 5 результатов в этой категории нет.
В коде тоже первое место.
DeepSWE 75,4 против 74,0 у Opus и 73,0 у Sol, понимание кодовой базы на SWEAtlas - 59,4 против 52,7 и 53,5, а на Terminal-Bench 2.1 ничья с Sol, 88,8 у обоих.
А вот в агентной части результаты скромнее.
Opus 5 впереди на четырех тестах из шести - GDPVal-AA v2 (1824 против 1754), JobBench (65,7 против 64,9), OSWorld (68,3 против 66,9) и AutomationBench (50,3 против 49,4). GPT-5.6 Sol забирает агентный браузинг (93,0 против 89,4) и следование инструкциям (60,5 против 57,8).
Модель стала устойчивее к состязательным вводам и промпт-инъекциям, а на сложных агентных задачах лучше калибрована в том, какие действия необратимы.
Muse Spark 1.3 доступна в клиенте Muse Code для macOS и Linux и через Meta Model API.
Дальше в планах - релиз более крупных модели и открытая публикация весов Muse Spark.
*организация признана экстремистской, её деятельность на территории РФ запрещена.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍55👌22😁11👏8❤7🤔6🎉6🔥2
7,2 млн рублей призового фонда и реальные задачи космической отрасли 🚀
В сентябре пройдет серия КосмоХакатонов для студентов, молодых ученых и специалистов.
Участникам предстоит за два дня разработать собственное решение, поработать с экспертами и представить проект жюри.
Участников ждут:
🛰 реальные задачи космической отрасли
👥 команды от 3 до 5 человек
💻 очный и онлайн-форматы
🧑💻 работа с экспертами и трекерами
🏆 финал в Москве
Первый КосмоХакатон стартует уже 4 сентября в Ростове-на-Дону.
Дальше серия продолжится в Красноярске, Нижнем Новгороде, Благовещенске и Санкт-Петербурге, а завершится финалом в Москве.
Участие бесплатное. Присоединиться могут студенты, аспиранты, молодые ученые и специалисты от 18 лет.
🔗 Зарегистрироваться: https://космохакатон.рф
В сентябре пройдет серия КосмоХакатонов для студентов, молодых ученых и специалистов.
Участникам предстоит за два дня разработать собственное решение, поработать с экспертами и представить проект жюри.
Участников ждут:
🛰 реальные задачи космической отрасли
👥 команды от 3 до 5 человек
💻 очный и онлайн-форматы
🧑💻 работа с экспертами и трекерами
🏆 финал в Москве
Первый КосмоХакатон стартует уже 4 сентября в Ростове-на-Дону.
Дальше серия продолжится в Красноярске, Нижнем Новгороде, Благовещенске и Санкт-Петербурге, а завершится финалом в Москве.
Участие бесплатное. Присоединиться могут студенты, аспиранты, молодые ученые и специалисты от 18 лет.
🔗 Зарегистрироваться: https://космохакатон.рф
👍78😍28👨💻20🎉13❤6😁3
alibabа.aiКитайский техгигант официально вернул контроль над международным доменным именем
alibaba.ai.Спор рассматривался в Чешском арбитражном суде, который принял решение принудительно передать права корпорации.
В июле 2026 года доменный инвестор из арабского региона выкупил имя на вторичном рынке за $3 333. Практически сразу он выставил его на перепродажу, но уже с десятикратной наценкой - за $33 333.
Юристы Alibaba, которые к тому моменту начали процесс защиты бренда в рамках международной процедуры UDRP, заблокировали сделку и довели дело до суда.
Защита ответчика выглядела весьма оригинально. Киберсквоттер пытался доказать арбитражу, что термин "Али-Баба" не имеет отношения к китайскому маркетплейсу, а выбрано исключительно из-за его глубокого культурного и литературного значения в арабском мире, намекая на сказку про сорок разбойников.
Но международного арбитра такой аргумент не впечатлил. Суд указал на очевидные маркеры недобросовестности:
.ai уже прочно ассоциируется во всем мире с Artificial Intelligence.Alibaba сейчас активно инвестирует в собственную разработку ИИ, поэтому покупка такого имени сторонним лицом - это прямое паразитирование на бренде.
В итоге суд признал действия сквоттера оппортунистическими, и теперь домен послужит официальным ИИ-проектам Alibaba Group.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👍130🤔36👏28🎉15❤14😭6🔥4👌1
🚨 GPT-6 Astra показывает очень сильные первые результаты:
— FrontierMath Tier 4 v2 — 97,6%
— DeepSWE v1.1 — 74,1%
— BenchCAD — 95,9%
— GPQA Diamond — 96%
— ExploitBench — 100%
— ARC-AGI-3 — 98,6% по заявленным данным
Особенно выделяются математика, coding и cybersecurity.
OpenAI планирует открыть доступ к GPT-6 Astra платным пользователям ChatGPT и через API в ближайшие дни.
https://thenewstack.io/openai-gpt6-astra-benchmarks/
— FrontierMath Tier 4 v2 — 97,6%
— DeepSWE v1.1 — 74,1%
— BenchCAD — 95,9%
— GPQA Diamond — 96%
— ExploitBench — 100%
— ARC-AGI-3 — 98,6% по заявленным данным
Особенно выделяются математика, coding и cybersecurity.
OpenAI планирует открыть доступ к GPT-6 Astra платным пользователям ChatGPT и через API в ближайшие дни.
https://thenewstack.io/openai-gpt6-astra-benchmarks/
🎉119❤72👍28🤩23👏18🔥13😨7🤔4😁3
В карту вошли:
- более 166 000 нейронов
- почти 11 700 типов нервных клеток
- связи между мозгом и нервной цепочкой, управляющей движением
- отдельные визуально-моторные пути и различия между мужским и женским мозгом дрозофилы
Для реконструкции учёные сделали миллионы 2D-снимков тонких срезов, а затем с помощью вычислений и AI собрали их в детальную 3D-модель и классифицировали нейроны.
Такая карта позволяет буквально прослеживать путь сигнала: от зрения и вкуса до моторных нейронов и конкретного поведения, включая ухаживание.
Самое неожиданное открытие - что половые различия мозга могут находиться именно в схеме соединений. Один и тот же тип нейрона присутствует и у самца, и у самки, но связывается с разными соседями - и в итоге участвует в разном поведении.
Одновременно вышли три исследования, использующие эту карту для изучения зрения, вкуса и социального поведения дрозофил.
https://blog.google/innovation-and-ai/technology/research/male-fruit-fly-brain-map/
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
❤75🔥45👍18👀4👏2🕊1🗿1👾1
This media is not supported in your browser
VIEW IN TELEGRAM
Устройство CameraJet объединяет ультразвуковую чистку и направленную ирригацию, устраняя необходимость в зубной нити.
В головку щетки встроена камера с разрешением 100 тысяч пикселей и подсветкой, стробирующей на частоте 257 Гц синхронно с движениями головки.
Собственный алгоритм машинного зрения Gap Optical Targeting, натренированный на 470 тысячах снимков зубного ряда, обрабатывает видеопоток со скоростью 28 кадров в секунду, распознает зазоры между зубами и в течение 100 миллисекунд подает микрозалп ополаскивателя.
Жидкость подается из резервуара с мембранным насосом, предотвращающим завоздушивание системы при любом угле наклона устройства.
Чтобы оптика не слепла от пены, инженеры разработали специальную беспенную пасту без лаурилсульфата натрия, а фирменная док-станция способна автоматически заправить бак ополаскивателем всего за три секунды.
По Wi-Fi щетка умеет транслировать видеопоток в приложение MyDyson в реальном времени, выполняя роль стоматологического эндоскопа.
Продажи уже начались - устройство доступно в голубом и розовом цвете по цене 499 долларов.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
🤣57❤18👍16🙈6🤔5🦄4🤬1
Сотрудник ValsAI Геби Джафф несколько месяцев безуспешно пробовал натравливать модели на нерешённые исторические шифры.
Воодушевившись метриками Fable 5.1, он поставил ей задачу - найти шифр самой и решить его, но с условием не браться за те, где ответ уже известен или где возможно множество правдоподобных версий.
И ещё не лезть в совсем неподъёмное вроде Kryptos K4, над которым бьются лучшие умыи ЦРУ .
В конце его трактата Логопандектейсион 1653 года стоят две строки по 32 числа.
Загадку выносили как открытую проблему ещё в 1899 году, она попадала в криптографическую литературу XX века, а Клаус Шмее включил её в список пятидесяти нерешённых зашифрованных сообщений.
Fable потратила на неё 44 минуты и 176 тысяч токенов без вмешательства человека.
Криптограмма напечатана сразу после 32 разделов трактата, а в каждой строке шифра ровно 32 числа. Совпадение неслучайное, и Fable зацепилась именно за него.
Правило оказалось таким: i-е число в строке - это индекс слова внутри i-го раздела книги. Берём слово по индексу, берём его первую букву, собираем по порядку. Обычный поиск по смещению, только вместо массива текст.
Результатом расшифровки оказалась роялистская молитва: Господи, храни короля Карла Второго и сделай его верховным правителем этой земли.
Дальше Fable взялась за второй шифр Эркарта - Cyphral Octastich из трактата The Jewel 1652 года, 285 чисел, тоже нерешённый.
Тот же приём, только числа указывают на страницы книги, а не на абзацы. Из 285 букв сложились 276 - там тоже оказалась молитва. Девять букв дали бессмыслицу: либо Эркарт ошибся сам, либо наборщик переставил цифры при печати.
Шифр, безусловно, простой и другие модели, скорее всего, тоже справились бы, но этот случай не про способности Fable в криптоанализе, а в умении разглядеть среди десятков задач одну податливую и не бросить её на полпути.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
1❤75👍38🤔29👏12🔥10😎8🥱6🤓6🗿6👀1
Sumit Kumar, Senior ML Engineer в Meta* и автор блога о рекомендательных системах, поделился новым тех репортом Яндекса Sona. В техническом отчёте команда подробно разбирает архитектуру и результаты в проде.
🟡 А 19 сентября на Practical ML Conf об этом расскажет Николай Савушкин. Можно будет узнать больше про подход и задать вопросы напрямую.
🟡 Ещё один доклад о моделях, которые решают задачу не в один шаг, представит Данил Кашин, руководитель команды претрейна VLM в Яндекс R&D. Он разберёт Agentic Vision: такие модели сначала строят план, затем при необходимости запрашивают дополнительную визуальную информацию, подключают OCR, детекторы, поиск или код и корректируют решение по промежуточным результатам.
Послушать оба доклада можно будет офлайн в Москве или онлайн. Регистрация на Practical ML Conf уже открыта.
* Meta признана экстремистской организацией, её деятельность запрещена в РФ
Реклама. ООО "ЯНДЕКС". ИНН: 7736207543. Erid: 2VtzqvGyx6w
Please open Telegram to view this post
VIEW IN TELEGRAM
🥱42🤝25👍24❤13🤣11🤓10🔥5😁4🗿1
Media is too big
VIEW IN TELEGRAM
Министр торговли Говард Латник заявил Axios, что власти снова считают Anthropic надежным партнером, так как компания выполнила требования и, по его словам, вернулась на правильную сторону.
Это разворот в затяжном конфликте. Пентагон пытался внести Anthropic в черный список угроз цепочкам поставок, но федеральный суд это решение заблокировал.
Отношения нормализовал сооснователь Anthropic Том Браун - он провел серию закрытых консультаций с Латником и кибердиректором Шоном Кэрнкроссом.
На встрече министров стран G20 глава Минторга лично представил Брауна международной аудитории, а сам Браун публично поддержал курс властей США на форсированное строительство дата-центров, энергетических мощностей и вычислительной инфраструктуры.
axios.com
Microsoft перевела лабораторию AI Frontiers из Microsoft Research в подразделение Microsoft AI, которым руководит Мустафа Сулейман. Одновременно корпорацию покинула Эдже Камар, основавшая AI Frontiers и проработавшая в Microsoft 16 лет.
Лабораторию создали осенью 2023 года под мультиагентные системы и компактные модели. Оттуда вышли семейство Phi и фреймворк AutoGen, на котором построен Microsoft Agent Framework, а также проекты FARA, Magentic-One и Magentic-UI.
В новой структуре команда продолжит заниматься прикладными агентами и усилит направление, которое Сулейман называет гуманистическим суперинтеллектом, - ИИ-системы, ориентированные на человека и подконтрольные оператору.
Microsoft AI в X
Realtime TTS-2 генерирует речь в реальном времени и поддерживает больше 100 языков, включая русский.
Модель подстраивается под собеседника: считывает ритм, тембр и эмоциональное состояние по ходу разговора и меняет собственную речь.
Стилем можно управлять текстом - попросить говорить шепотом или звучать уставшим. Она умеет вставлять вздохи, смех и дыхание, а также клонировать голос, сохраняя тембр при переходе на другой язык.
В слепых тестах Voice Arena от Artificial Analysis модель заняла первое место, обойдя Cartesia Sonic 3.6 по естественности произношения, расстановке пауз и реалистичности интонаций.
Доступ открыт через Inworld Realtime API, тарифы - от 25 до 1500 долларов в месяц.
InworldAI в X
Namespace договорилась с Cursor о запуске агентов в своей облачной инфраструктуре. Логику агентов по-прежнему ведет Cursor, а правка репозиториев, запуск команд, сборка и тесты уходит в изолированные среды Devboxes.
Они разворачиваются как полноценные окружения с доступом к базам данных, коду и сети. Кроме Linux поддерживаются инстансы macOS на процессорах Apple M5, поэтому агент может собирать приложения для iOS и Mac. Windows обещают позже.
Из коробки идут кэширование слоев Docker, удаленная сборка через Bazel, фильтрация исходящего трафика и политики доступа. Раньше Namespace так же подключила свои среды к Devin и Claude Code.
namespace.so
Qoder Glasses Edition - версия ИИ-среды разработки Qoder для умных очков Qwen и Rokid. Очки работают интерфейсом от первого лица, а считает и работает с кодовой базой десктопный клиент.
Общение с агентом идет по полнодуплексному голосовому каналу, через который можно ставить задачи, узнавать статус сборки и править код. Уведомления показываются карточками с краю поля зрения, а операции подтверждаются голосом или касанием дужки, не останавливая фоновые процессы.
Камера нужна для отладки того, что происходит вне экрана: ассистент считывает коды ошибок с мониторов, разбирает индикаторы на серверных стойках и распознает схемы на маркерных досках. Дальше он сопоставляет увиденное с логами и выдает варианты по устранению неполадки.
Продукт в закрытом тестировании, релиз обещают на сентябрьской конференции Apsara.
Alibaba Cloud в WeChat
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👍44❤12👏11🎉9🔥7🤓5😁2
🧠 GLM‑5.3: модель с открытыми весами для агентских и кодовых задач теперь в MWS Cloud
MWS Cloud первой в России развернула GLM‑5.3 на своей инфраструктуре. Модель доступна в MWS GPT Model Hub, все вычисления и данные — строго в российском контуре, тариф не вырос относительно GLM‑5.2. Можно строить агентные системы и пайплайны без риска утечки промптов и данных за рубеж.
Ключевые возможности:
— генерация, рефакторинг и анализ кода;
— поиск ошибок;
— работа с репозиториями;
— автоматизация многошаговых процессов;
— сборка ИИ‑агентов под конкретные домены.
По бенчмаркам модель стабильно обходит Claude Opus 4.8 в задачах программирования, сопоставима с Claude Fable 5 и GPT‑5.6 Sol. В Design Arena — топ‑3 в общем зачёте и второе место среди моделей с открытыми весами: это хороший сигнал для задач, где важна генерация UI/UX‑элементов.
@ai_machinelearning_big_data
MWS Cloud первой в России развернула GLM‑5.3 на своей инфраструктуре. Модель доступна в MWS GPT Model Hub, все вычисления и данные — строго в российском контуре, тариф не вырос относительно GLM‑5.2. Можно строить агентные системы и пайплайны без риска утечки промптов и данных за рубеж.
Ключевые возможности:
— генерация, рефакторинг и анализ кода;
— поиск ошибок;
— работа с репозиториями;
— автоматизация многошаговых процессов;
— сборка ИИ‑агентов под конкретные домены.
По бенчмаркам модель стабильно обходит Claude Opus 4.8 в задачах программирования, сопоставима с Claude Fable 5 и GPT‑5.6 Sol. В Design Arena — топ‑3 в общем зачёте и второе место среди моделей с открытыми весами: это хороший сигнал для задач, где важна генерация UI/UX‑элементов.
@ai_machinelearning_big_data
mws.ru
GPT Model Hub — генеративные модели по API в облаке MWS Cloud Platform
GPT Model Hub — готовые генеративные модели и LLM в MWS Cloud Platform. OpenAI-совместимый API, быстрый инференс. Каталог моделей для создания AI-ассистентов, чат-ботов и AI-приложений
👍31❤15🔥10🤣8👏7😁6🎉4🤓4🙊1