О, меня забанил Антропик. Интересно с чего это. Подпишусь на большую подписку у ChatGPT, а вот подписываться ли на Антропик с другого эккаунта - подумаю... свет клином не сошелся
Привык, конечно, к Клоду. Но может, пришло время экспериментов..
Выйти из зоны комфорта..
Выйти из зоны комфорта..
Forwarded from эйай ньюз
У Сбера вышел Kandinsky 6.0 Image Pro.
Главный апдейт тут в editing. В side-by-side модель сравнивают с Flux 2 Max и GPT Image 1.5, причём оценивают конкретные вещи: как правка встраивается в сцену, сохраняются ли стиль, геометрия, лицо, фон и локальная консистентность. Именно на этом обычно сыпятся image editing модели.
По скорости тоже прирост: больше 40% к прошлой версии за счёт MoE, распараллеливания инференса и оптимизации внимания.
Самая интересная часть — Image RAG. Модель подтягивает релевантные изображения в контекст и точнее попадает в специфические штуки, которые в обычной генерации легко превращаются во «что-то примерно славянское».
Из кейсов: удаление объектов и надписей, замена предметов с сохранением стиля, стилизация с сохранением лица, реставрация архивных фото, интерьеры по плану и фасады одним промтом.
Анонс
@ai_newz
Главный апдейт тут в editing. В side-by-side модель сравнивают с Flux 2 Max и GPT Image 1.5, причём оценивают конкретные вещи: как правка встраивается в сцену, сохраняются ли стиль, геометрия, лицо, фон и локальная консистентность. Именно на этом обычно сыпятся image editing модели.
По скорости тоже прирост: больше 40% к прошлой версии за счёт MoE, распараллеливания инференса и оптимизации внимания.
Самая интересная часть — Image RAG. Модель подтягивает релевантные изображения в контекст и точнее попадает в специфические штуки, которые в обычной генерации легко превращаются во «что-то примерно славянское».
Из кейсов: удаление объектов и надписей, замена предметов с сохранением стиля, стилизация с сохранением лица, реставрация архивных фото, интерьеры по плану и фасады одним промтом.
Анонс
@ai_newz
В связи с баном от Антропика встает вопрос - что дальше. Подписчики хотят, чтобы потестил локальные модели - я тоже хочу, но жду выхода Mac Studio M5 Ultra. Должны выпустить в июне, но могут и отложить из-за дефицита памяти. Но вообще, предложения интересные по железу есть..
Очень интересная тема - пытался сделать что-то похожее, но как у вайбкодеров принято, остановился на полпути. Файловая система с графами и RAG
https://x.com/supermemory/status/2049330931564208249?s=46
https://x.com/supermemory/status/2049330931564208249?s=46
X (formerly Twitter)
supermemory (@supermemory) on X
Introducing SMFS: The new Supermemory Filesystem.
Supermemory did Memory.
And then RAG, and then extractors and connectors.
Now, we also have a new filesystem primitive: https://t.co/Lqmlwmd5hS
Supermemory did Memory.
And then RAG, and then extractors and connectors.
Now, we also have a new filesystem primitive: https://t.co/Lqmlwmd5hS
Forwarded from Анализ данных (Data analysis)
32 тысячи звёзд на GitHub всего за 10 часов!
Терминал Warp открыли в open-source.
Это одна из самых заметных agentic development environment: терминалом уже пользуются больше 1 млн разработчиков по всему миру. Теперь проект хотят развивать быстрее за счёт комьюнити, внешних контрибьюторов и прозрачной разработки.
open-source-релиз стал возможен при поддержке OpenAI, которые выступили главным спонсором проекта.
Реакция комьюнити мощная: репозиторий за несколько часов собрал уже 30+ тысяч звёзд на GitHub.
И, конечно же, он написан на Rust.
https://github.com/warpdotdev/warp
Терминал Warp открыли в open-source.
Это одна из самых заметных agentic development environment: терминалом уже пользуются больше 1 млн разработчиков по всему миру. Теперь проект хотят развивать быстрее за счёт комьюнити, внешних контрибьюторов и прозрачной разработки.
open-source-релиз стал возможен при поддержке OpenAI, которые выступили главным спонсором проекта.
Реакция комьюнити мощная: репозиторий за несколько часов собрал уже 30+ тысяч звёзд на GitHub.
И, конечно же, он написан на Rust.
https://github.com/warpdotdev/warp
10Т параметров для модели - это сильно. Погружаюсь в то, как надо общаться с chatGPT
https://t.me/data_secrets/9138
https://t.me/data_secrets/9138
Telegram
Data Secrets
Китайский исследователь создал специальный бенчмарк, с помощью которого можно оценить количество параметров в любой модели
Как мы знаем, закрытые лаборатории не раскрывают количество параметров своих моделей. Есть стандартный метод оценки через экономику…
Как мы знаем, закрытые лаборатории не раскрывают количество параметров своих моделей. Есть стандартный метод оценки через экономику…
Forwarded from Machinelearning
This media is not supported in your browser
VIEW IN TELEGRAM
Японская Sakana AI показала KAME - систему, которая может заметно изменить голосовых ассистентов. Работу уже приняли на ICASSP 2026, и идея там очень простая: ИИ должен не сначала долго думать, а потом говорить, а думать прямо во время разговора.
Сейчас у голосовых моделей есть неприятный компромисс. Быстрые speech-to-speech системы отвечают почти мгновенно, но часто звучат поверхностно. А если подключить мощную языковую модель, ответ становится умнее, но появляется пауза, которая ломает живой диалог.
KAME пытается убрать этот выбор между скоростью и качеством.
Авторы взяли за основу то, как говорят люди. Мы редко строим идеальную фразу целиком перед тем как ее сказать. Обычно начинаем говорить, а мысль уточняется уже по ходу предложения. Sakana AI перенесла этот принцип в архитектуру голосового ИИ.
Система работает в два потока. Лёгкая речевая модель сразу начинает отвечать, чтобы не было неловкой задержки. А параллельно большая языковая модель думает глубже и в реальном времени подмешивает более сильные варианты в речь. Получается, что ассистент не просто выдаёт готовую реплику после паузы, а ведёт разговор и дорабатывает мысль на лету.
Отдельно интересно, что бэкенд можно менять. Нужна логика - подключаешь Claude. Нужна скорость - берёшь Gemini Flash. Нужен другой стиль ответа - ставишь GPT. При этом сам голосовой слой не приходится пересобирать.
В экспериментах разные модели показали себя по-разному: Claude лучше справлялся с задачами на рассуждение, GPT сильнее выглядел в гуманитарных вопросах. То есть движок можно выбирать под конкретный сценарий, а не пытаться одной моделью закрыть всё.
KAME уже выложили на Hugging Face. Это идея из статьи, а штука, которую можно проверить руками.
Если подход взлетит, голосовые ассистенты станут гораздо ближе к нормальному разговору: без долгих пауз, но и без ощущения, что модель просто быстро болтает ни о чём.
Blog: https://pub.sakana.ai/kame/
Paper: https://arxiv.org/abs/2510.02327
@ai_machinelearning_big_data
#sakana
Please open Telegram to view this post
VIEW IN TELEGRAM
В продолжение темы исследования, о котором писал выше - как и чувствовалось, Опус 4.7 - более компактная и "глупая" модель, чем Опус-4.6. И токенов жрет в 1,5 раза больше. Возвращайтесь на 4.6, кто работает с Клодом. Интересная история с размером Хайку - очень маленькая модель тоже. И глупая. Не используйте Хайку, лучше - Соннет. Антропик, очевидно, экономит как может.
У Google, судя по всему, все неплохо заточено на ресерч.и работу с длинным контекстом. То есть модель не для программирования, а для исследований. Запомним. Лучшие китайцы - на уровне Соннета, но и это неплохо. Жить можно. Первый раз за долгое время статью научную посмотрел.
У Google, судя по всему, все неплохо заточено на ресерч.и работу с длинным контекстом. То есть модель не для программирования, а для исследований. Запомним. Лучшие китайцы - на уровне Соннета, но и это неплохо. Жить можно. Первый раз за долгое время статью научную посмотрел.
Tencent представила микромодельку-переводчика на 1,8B параметров (ставится на телефон, в квантах - 440Mb памяти), которая обгоняет переводчик от Google
GitHub
GitHub - Tencent/AngelSlim: Model compression toolkit engineered for enhanced usability, comprehensiveness, and efficiency.
Model compression toolkit engineered for enhanced usability, comprehensiveness, and efficiency. - Tencent/AngelSlim
Из новостей - Mistral вчера выпустил модельку на 128B, но думаю, что эта тема пройдет незамеченной. Вообще, 5 баксов, которые я потратил на апи Мистраля кажутся мне пока самой неудачной инвестицией в ИИ
Глядя на размер топовых моделей в 5-10Т параметров, понимаешь, что такое локально не запустишь никогда.. немного грустно от этого
В продолжение темы моделей - есть такая контора FactoryAI, которая запускает неплохих агентов Droids. Она провела исследование, какие модели лучше делают ревью кода.
И здесь тоже новые модели Антропика и OpenAI уступают старым! Лучшая модель - GPT 5.2 (интересно, что в кодексе старые модели доступны, похоже что не случайно..)
Видимо, какое-то плато не так далеко, и опенсорсные модели не так далеко от него
И здесь тоже новые модели Антропика и OpenAI уступают старым! Лучшая модель - GPT 5.2 (интересно, что в кодексе старые модели доступны, похоже что не случайно..)
Видимо, какое-то плато не так далеко, и опенсорсные модели не так далеко от него
X (formerly Twitter)
Factory (@FactoryAI) on X
Read our full analysis here: https://t.co/l30oDzIXbJ
И завершая на сегодня с моделями - в маленьком (до 30В) размере обратите внимание на новые модели от IBM - Granite, и NVIDIA - Nemotron. Может быть интересно, не квеном единым, что называется
Forwarded from Tips AI | IT & AI
Media is too big
VIEW IN TELEGRAM
Зацепило расширение Chromex — парень интегрировал Codex в Chrome, который работает через подписку ChatGPT.
Всё потому что, в Codex CLI есть локальный интерфейс app-server, вот через него любое приложение может подключаться к Codex и использовать его как сервис.
Сам Codex CLI логинится через ChatGPT, поэтому работает через твою подписку, а не через API.
Вот и получился Codex в браузере:
• Чат с открытыми вкладками и скриншотами
• Разбор YouTube, статей, PDF, научных статей
• Генерация изображений
• Голосовой ввод
Так что, можете попробовать Chromex или разобрать этот исходный код с gpt 5.5 и построить что-то свое.
@tips_ai #tools
Всё потому что, в Codex CLI есть локальный интерфейс app-server, вот через него любое приложение может подключаться к Codex и использовать его как сервис.
Сам Codex CLI логинится через ChatGPT, поэтому работает через твою подписку, а не через API.
Вот и получился Codex в браузере:
• Чат с открытыми вкладками и скриншотами
• Разбор YouTube, статей, PDF, научных статей
• Генерация изображений
• Голосовой ввод
Так что, можете попробовать Chromex или разобрать этот исходный код с gpt 5.5 и построить что-то свое.
@tips_ai #tools
Мне такой 👆функционал теперь особо интересен. У Клода похожее есть, но работает не через Claude code - и это нехорошо. А здесь память у сессий будет общая, можно в рамках проекта работать с браузером - отлично
Пересаживаюсь с Claude на GPT - пришлось переписывать промпты, так как агенты работают по-разному. Де-факто делаю рефакторизацию всей документации по агентам. Это, в общем-то неплохо, полезно иногда делать, но работы много, надо сотню файлов отсмотреть
Ну что, мой бан со стороны Claude был первым звоночком. Брата Клод тоже забанил - моя гипотеза в том, что отрубают русских, которые жрут много токенов. Русских - потому что не жалко. А по части токенов - мы им только убытки доставляем, интенсивно потребляя подписку. Компьюта на своих не хватает. Может, конечно, айпишники там общие были, но сомневаюсь, думаю, вопрос, как всегда, про баблос.
Так что все, кто пользуется Клодом, очень рекомендую уже сейчас сохранить свои проекты, диалоги, что было ценного. И лучше работайте в локальном Claude code, а не в приложении или веб версии - чтобы сохранить локально все свои промпты, исследования и пр.
Так что все, кто пользуется Клодом, очень рекомендую уже сейчас сохранить свои проекты, диалоги, что было ценного. И лучше работайте в локальном Claude code, а не в приложении или веб версии - чтобы сохранить локально все свои промпты, исследования и пр.
Forwarded from Tips AI | IT & AI
В Codex CLI добавили /goal
Это официальная версия Ralph loop, когда агент крутится в цикле и не выходит, пока не решит задачу полностью.
Наверное помните, Anthropic добавлял это плагином ещё в декабре.
Про команду /goal:
• /goal <задача> запускает цикл Plan > Execute > Test > Refine, не останавливается, пока цель не достигнута
• Можно создавать, ставить на паузу, возобновлять, сбрасывать
• Состояние живёт между сессиями
Включить можно одной командой:
Или руками в
Пока только в CLI, десктоп ещё не подвезли. Заодно сделали /side, когда можно задавать вопросы агенту пока он работает, не прерывая.
@tips_ai #news
Это официальная версия Ralph loop, когда агент крутится в цикле и не выходит, пока не решит задачу полностью.
Наверное помните, Anthropic добавлял это плагином ещё в декабре.
Про команду /goal:
• /goal <задача> запускает цикл Plan > Execute > Test > Refine, не останавливается, пока цель не достигнута
• Можно создавать, ставить на паузу, возобновлять, сбрасывать
• Состояние живёт между сессиями
Включить можно одной командой:
codex features enable goalsИли руками в
~/.codex/config.toml: [features]
goals = trueПока только в CLI, десктоп ещё не подвезли. Заодно сделали /side, когда можно задавать вопросы агенту пока он работает, не прерывая.
@tips_ai #news