Comfy Org открыла бета-тестирование встроенного ассистента Comfy Agent. Инструмент может создавать и изменять воркфлоу, запускать задачи, отлаживать ошибки и предлагать улучшения в интерфейсе ComfyUI по текстовым запросам.
Агент работает в фоне и умеет создавать цепочки нод, оптимизировать имеющиеся воркфлоу и искать ошибки совместимости.
В отличие от Comfy MCP, который позволяет управлять ComfyUI через Claude или Cursor, Comfy Agent работает как готовое коробочное решение внутри редактора.
Бэкенд ассистента развернут в инфраструктуре Comfy Cloud, а для простых задач можно подключать локальные модели.
Comfy Agent, вероятно, войдёт в подписку Comfy Cloud.
Подать заявку на открытую бету можно по ссылке. Запись стрима с демонстрацией возможностей - на Youtube.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
🤩96👍34🎉16❤7👏6🔥1🥱1🌭1
🚀 Последний шанс зайти на КосмоХакатон — старт сегодня
Сразу два этапа, 11–13 сентября: Нижний Новгород и Благовещенск. Задачи от компаний отрасли — от сервисной модели космических услуг до мониторинга паводков по спутниковым снимкам. Призовые на каждой площадке, общий фонд серии 7,2 млн рублей.
Участвовать можно очно или онлайн из любой точки России, командами 3–5 человек. Своей команды нет — собери на платформе.
Не успеваешь на эти — Питер и Красноярск идут 18–20 сентября. А лучшие команды всех этапов выходят в финал в Москве.
Регистрация и детали здесь: космохакатон.рф/
Сразу два этапа, 11–13 сентября: Нижний Новгород и Благовещенск. Задачи от компаний отрасли — от сервисной модели космических услуг до мониторинга паводков по спутниковым снимкам. Призовые на каждой площадке, общий фонд серии 7,2 млн рублей.
Участвовать можно очно или онлайн из любой точки России, командами 3–5 человек. Своей команды нет — собери на платформе.
Не успеваешь на эти — Питер и Красноярск идут 18–20 сентября. А лучшие команды всех этапов выходят в финал в Москве.
Регистрация и детали здесь: космохакатон.рф/
🔥46👍11👏7🏆5🎉4😁3🥰2❤1🥱1
Forwarded from Анализ данных (Data analysis)
🐟 Sakana AI представила Fugu Max и Fugu Ultra v2 - обновление системы оркестрации AI-агентов
Fugu распределяет задачи между несколькими моделями, подбирая подходящую по возможностям и стоимости.
Fugu Max использует расширенный набор моделей с открытыми весами и специализированных моделей, включая NVIDIA Nemotron. По заявлению Sakana, система приближается к ведущим моделям по качеству при стоимости в 2–6 раз ниже.
Fugu Ultra v2 ориентирована на максимальное качество. По данным компании:
* опережает Opus 5 и Fable 5 на Chartography
* на DeepSWE превосходит модели, у которых цена за токен в 3–5 раз выше
* при этом Fable 5, Fable 5.1 и GPT-6-Astra не входят в её набор агентов
Модели внутри системы можно заменять. Такая архитектура рассчитана на снижение зависимости от отдельных поставщиков и сохранение работы при изменениях доступности API.
[Попробовать Fugu - https://sakana.ai/fugu
Анонс Sakana AI - https://sakana.ai/fugu-max-release/
Fugu распределяет задачи между несколькими моделями, подбирая подходящую по возможностям и стоимости.
Fugu Max использует расширенный набор моделей с открытыми весами и специализированных моделей, включая NVIDIA Nemotron. По заявлению Sakana, система приближается к ведущим моделям по качеству при стоимости в 2–6 раз ниже.
Fugu Ultra v2 ориентирована на максимальное качество. По данным компании:
* опережает Opus 5 и Fable 5 на Chartography
* на DeepSWE превосходит модели, у которых цена за токен в 3–5 раз выше
* при этом Fable 5, Fable 5.1 и GPT-6-Astra не входят в её набор агентов
Модели внутри системы можно заменять. Такая архитектура рассчитана на снижение зависимости от отдельных поставщиков и сохранение работы при изменениях доступности API.
[Попробовать Fugu - https://sakana.ai/fugu
Анонс Sakana AI - https://sakana.ai/fugu-max-release/
🎉121👍39🤓22❤8⚡2🔥2
This media is not supported in your browser
VIEW IN TELEGRAM
Компания открыла Agents API - публичную бету сервиса, который берёт на себя всю обвязку вокруг агента. Она здесь та же, что у Codex и ChatGPT for Work.
Агент создаётся одним вызовом API, где указывается задача, модель, инструменты и окружение. Дальше действует OpenAI, а разработчик занимается своими инструментами, знаниями и процессами.
Харнесс умеет сжимать ранний контекст, когда сессия подбирается к лимиту и подгружать описания инструментов по необходимости. Плюс дает агентам вызывать инструменты программно - выполнять вызовы параллельно, сцеплять их и фильтровать результаты прямо в коде, возвращая в контекст только нужное.
Место работы агента можно выбрать из песочницы самой OpenAI, поднять на своей инфраструктуре или уйти к партнёрам: Blaxel, Cloudflare, Daytona, DigitalOcean, E2B, Modal, Oracle, Runloop и Vercel.
Отдельной платы за Agents API нет, только токены и инструменты, которые расходует агент.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👨💻75👍32👏21❤14🔥14🤣3🤓3🕊1
Получи подготовленные данные и разработай ИИ-ассистента для энергетики на соревновании от ПАО «Интер РАО» при поддержке компании «Яндекс».
Призовой фонд — 750 000 рублей. Лучшие проекты смогут стать частью экосистемы компании.
Регистрация открыта до 27 сентября.
Можно участвовать одному или командой до 5 человек. Идеальный состав: разработчик, специалист по машинному обучению, аналитик и дизайнер.
Стартуем 28 сентября. Придумай концепт проекта: самые сильные идеи участники доработают под руководством экспертов с 9 по 23 октября. Финал в Москве — 3 ноября.
Задачи соревнования — за какую возьмешься?
1️⃣ ИИ-помощник для подготовки презентаций.
Создай инструмент генерации презентации в корпоративном стиле из текстового брифа.2️⃣ Помощник для анализа документов из судов.
Разработай систему, которая сможет распознавать, классифицировать и заносить судебные и исполнительные документы в базу данных.3️⃣ Ассистент для создания ИТ/ИБ-дайджестов.
Напиши ассистента, который будет регулярно анализировать релевантные новости из различных источников и формировать краткую сводку.4️⃣ Архитектор BPMN-диаграмм.
Создай генератор BPMN-диаграмм, который позволит из текстового описания процесса собрать валидную схему в формате BPMN 2.0.
Получи сильную строчку в портфолио и уникальный опыт работы под руководством экспертов Группы «Интер РАО».
Регистрируйся: https://cnrlink.com/interraohack26ml
Please open Telegram to view this post
VIEW IN TELEGRAM
🤩46🎉17🤣17👍7🔥6❤4🤬1
Media is too big
VIEW IN TELEGRAM
Сэм Альтман заявил сотрудникам, что компания готова притормозить работу над моделями следующего поколения - но только если то же сделают другие лаборатории. По данным Bloomberg, часть циклов предобучения OpenAI уже приостановила из соображений безопасности.
Идею контролируемого темпа Альтман обсуждал и раньше, в том числе в Белом доме. Инициатива родилась на фоне ухода ведущих специалистов по безопасности из OpenAI, Anthropic и Google DeepMind.
На этой неделе главный научный сотрудник OpenAI Якуб Пахоцкий публично призвал отрасль к координации и добровольным паузам в релизах.
bloomberg.com
Разработчик Devin обучил SWE-2 на базе открытой Kimi K3 с её 2,8 трлн параметров. По словам авторов, обучение с подкреплением впервые масштабировали на исходную модель такого размера.
Вместо дистилляции экспертов использовали линейные штрафы за стоимость вычислений, привязанные к наклону границы Парето.
На FrontierCode 1.1 Main модель набрала 50,0%. Инференс, по замерам Cognition, обходится на 60-75% дешевле, чем у Fable 5.1 и GPT-6 Astra.
Сократили и время на изучение репозитория - на среднем уровне рассуждений агент начинает править код на 18-м шаге вместо 48-го у SWE-1.7. Модель доступна в Devin CLI, десктопе и веб-версии.
cognition.com
Новая возможность Projects рассчитана на задачи, которые живут дольше одного чата: рефакторинг, миграции, крупные фичи.
Координатору ставят задачу, он составляет план и раздаёт подзадачи субагентам - по заявлению Cursor, их может быть тысячи. Сам код он не пишет, поэтому никогда не занят, но умеет реагировать на события - следит за ветками Git, ловит падения CI и триггеры из Slack.
Бета раскатывается на всех, о тарификации в анонсе не сообщается.
cursor.com
FLUX Video Edit правит готовые ролики по текстовому запросу в режиме video-to-video - сохраняет композицию, траекторию камеры, тайминги и звук, меняя только указанное. Модель также умеет подгонять липсинк под новый дубляж, не меняя хронометраж.
На вход идут MP4 до 15 секунд и 50 МБ, на выходе 720p при 24 кадрах в секунду. Секунда обработанного видео стоит 3 цента.
Black Forest Labs в X
Канадский математик Джейкоб Цимерман создаёт центр Mathematical A.I. Safety Institute со штатом в несколько десятков специалистов, запуск которого запланирован на январь 2027 года. Параллельно Цимерман присоединится к команде безопасности OpenAI, то есть будет верифицировать в том числе собственного работодателя.
Идея - перевести оценку рисков с эмпирического тестирования на строгую теоретическую верификацию и наделить модели доказуемыми свойствами надёжности, как у криптографических алгоритмов.
Механизмом аудита предлагают сделать доказательства с нулевым разглашением - лаборатория подтверждает соблюдение ограничений, не раскрывая ни архитектуру, ни веса.
nytimes.com
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
👍152👏23😁17🤔14❤10🎉7🔥5🤓4⚡2🙏1
This media is not supported in your browser
VIEW IN TELEGRAM
ChatGPT for Financial Services - специализированная версия платформы, которую делаи вместе с банками Morgan Stanley и Evercore.
Инструмент объединяет аналитические возможности GPT-6 Astra со встроенными финансовыми датасетами от PitchBook, Crunchbase, Daloopa, FiscalAI и LSEG News, которые индексируются напрямую на инфраструктуре разработчика.
Это решает проблемы интеграции внешних баз через MCP-коннекторы, ускоряет выборку и позволяет делать детализированное цитирование - система привязывает каждую цифру, показатель или вывод к точным строкам, таблицам и сноскам в исходных финансовых документах.
Платформа автоматизирует LBO-моделирование, нормализацию отчётности, скрининг покупателей и генерацию аналитических отчётов и питчбуков по корпоративным шаблонам в форматах Excel, Word и PowerPoint, публикуемым администратором.
Для финсектора предусмотрена сквозная авторизация по существующим подпискам на S&P Capital IQ, LSEG, MSCI, Factiva и Moody's, а также ролевой доступ, единый вход по SAML, автоматическое управление учётными записями через SCIM, поддержка информационных барьеров между рабочими пространствами, аудит действий через OpenAI Compliance Platform и запрет на использование клиентских данных для обучения моделей.
На бенчмарке OfficeQA Pro, где модель ищет и анализирует данные в бюллетенях Минфина США со сложными таблицами, графиками и сносками, GPT-6 Astra показывает 69,9% против 60,2% у GPT-5.6 Sol.
Решение доступно финансовым организациям по запросу, стоимость не раскрывается.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
1🤓83👍73👀13❤6🔥5🤣5😭2
⚡ Глава Anthropic призвал замедлить развитие ИИ и допустить независимых проверяющих внутрь лабораторий
В статье We Must Pace the Frontier Дарио Амодеи объяснил, почему изменил позицию: в 2023 году замедление казалось ему преждевременным, теперь он считает его необходимым.
Самое интересное:
🔹 ИИ уже ускоряет создание следующего поколения моделей. По словам Амодеи, рекурсивное самоулучшение начинается в отрасли, включая Anthropic. Он опасается, что возможности систем будут расти быстрее, чем способы их контроля.
🔹 Его тревожный сценарий - масштабные кибератаки через 6–12 месяцев. Амодеи допускает, что более мощный рой агентов сможет создать устойчивый ботнет и нанести ущерб на сотни миллиардов долларов. Это его оценка риска.
🔹 Anthropic обещает постоянный доступ внешним проверяющим. Рабочие места, пропуска, инструменты и права, сопоставимые с внутренними командами оценки рисков. Проверять предлагается и готовые модели, и процесс обучения.
🔹 Проверяющие смогут публиковать неудобные выводы. Компания предусматривает ограничения для защищённой информации, но обещает не скрывать результаты только потому, что они ей невыгодны.
🔹 Цель - выиграть год-два для безопасности. Среди предложений: обязательные проверки при достижении опасных возможностей и международные ограничения скорости самоулучшения ИИ. Полную глобальную паузу Амодеи считает маловероятной в ближайшее время.
Полная cтатья - https://darioamodei.com/post/we-must-pace-the-frontier
@ai_machinelearning_big_data
#Anthropic
В статье We Must Pace the Frontier Дарио Амодеи объяснил, почему изменил позицию: в 2023 году замедление казалось ему преждевременным, теперь он считает его необходимым.
Самое интересное:
🔹 ИИ уже ускоряет создание следующего поколения моделей. По словам Амодеи, рекурсивное самоулучшение начинается в отрасли, включая Anthropic. Он опасается, что возможности систем будут расти быстрее, чем способы их контроля.
🔹 Его тревожный сценарий - масштабные кибератаки через 6–12 месяцев. Амодеи допускает, что более мощный рой агентов сможет создать устойчивый ботнет и нанести ущерб на сотни миллиардов долларов. Это его оценка риска.
🔹 Anthropic обещает постоянный доступ внешним проверяющим. Рабочие места, пропуска, инструменты и права, сопоставимые с внутренними командами оценки рисков. Проверять предлагается и готовые модели, и процесс обучения.
🔹 Проверяющие смогут публиковать неудобные выводы. Компания предусматривает ограничения для защищённой информации, но обещает не скрывать результаты только потому, что они ей невыгодны.
🔹 Цель - выиграть год-два для безопасности. Среди предложений: обязательные проверки при достижении опасных возможностей и международные ограничения скорости самоулучшения ИИ. Полную глобальную паузу Амодеи считает маловероятной в ближайшее время.
Полная cтатья - https://darioamodei.com/post/we-must-pace-the-frontier
@ai_machinelearning_big_data
#Anthropic
1👍81🤣71⚡32🤔30❤16👨💻8🤨7👻4🔥3😁1
Стартап NeoCognition разработал первый сквозной бенчмарк использования компьютера, непрерывного обучения и долгосрочной агентной работы на реальной должности.
NeoCognition - лаборатория, в которой собрали бенчмарки MMMU, Mind2Web, SWE-Bench Pro и OSWorld 2, а также агентные системы SeeAct, UGround и HippoRAG.
Агента принимают в виртуальную строительную компанию на работу с кредиторской задолженностью, выдают полугодовой архив счетов, внутренний справочник и руководство по ERP-системе, после чего он начинает работать со счетами.
Первый месяц проходит с подробным фидбэком от руководителя по каждому счёту, а дальше - с редкими замечаниями по итогам месяца.
Каждая из ста задач теста проверена профессиональными бухгалтерами строительной отрасли, которые подтвердили и реалистичность сценариев, и то, что любую задачу способен решить рядовой специалист, изучивший доступные агенту материалы.
Большинство моделей, включая Gemini, Muse Spark, Grok и Kimi, не преодолевают порог в 20-25%, тогда как Fable 5.1 выполнила 72% задач, а GPT-6 Astra - 68%.
Лучший из двух тестировщиков-людей показал 51%, причём проваливались люди на поиске нужного в исторических данных, точности расчётов и мелких ошибках от утомления.
Разрыв между открытыми и закрытыми моделями авторы называют крупнейшим из всех виденных ими на бенчмарках - 72% у Fable 5.1 против 18% у Kimi K3, и вызван он не базовыми операциями в интерфейсе, а неспособностью слабых моделей учиться на дистанции.
Kimi K3 почти не обращался ни к архиву счетов, ни к собственным заметкам и деградировал к концу серии.
Так называемый налог на использование компьютера (просадка при переходе с API на графический интерфейс) у большинства моделей достигает 78%, но Fable 5.1 и GPT-6 Astra работают через GUI даже лучше, чем через API.
Дешевле при этом остаётся API - Fable 5.1 обходится в 6,95 доллара за задачу в программном интерфейсе против 18,23 доллара при работе с графическим.
Способность к обучению измерили отдельно. Fable 5 без доступа к истории и обратной связи, опираясь только на собственные знания, решает 11 счетов из 100.
Подключение архива счетов поднимает результат до 31, обратная связь руководителя - до 35, а оба канала вместе дают 43.
ИИ пока ещё обходится дороже: 18,23 доллара за задачу против 7,21 у людей. К тому же человек по мере накопления опята работает быстрее, а агент - замедляется.
@ai_machinelearning_big_data
#AI #ML #Benchmark #ApprenticeBench #NeoCognition
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
1🤔87❤31👏28💯15👍10🔥6👌4🤓2🎉1👀1
Глава OpenAI занял девятую строчку рейтинга, разделив её с Марком Цукербергом.
Обе фигуры издание объединило формулировкой «...технологические лидеры, выводящие ИИ за пределы цифрового мира».
Три года назад Альтман тот же список возглавлял, а в прошлогоднем выпуске не значился вовсе.
Рейтинг выходит раз в год уже больше десяти лет и приурочен к Рош ха-Шана, еврейскому Новому году, в этом году праздник наступил 12 сентября.
The Jerusalem Post — старейшая и самая читаемая англоязычная газета Израиля, основанная в 1932 году под названием The Palestine Post. Издание выходит и в печати, и онлайн.
Седьмую строчку занимает Ассаф Раппапорт, основатель компании Wiz, семнадцатую — сооснователь Oracle Ларри Эллисон, восемнадцатую — сооснователь Google Сергей Брин.
Двадцатая строчка досталась в том числе Алексу Карпу из Palantir, двадцать шестая — брату и сестре Дарио и Даниэле Амодеи, которых издание называет «...еврейскими родственниками, формирующими ИИ».
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
😁50👏9🤬9🎉6❤5👍4🤩3🔥1🥰1💯1🤨1