Forwarded from Анализ данных (Data analysis)
По данным команды, серия ориентирована на coding и agentic-задачи и показывает сильные результаты во всех размерных классах. Модели на 0,9B, 3,7B и 7B заявлены как новые SOTA для своего масштаба.
IFM выпустили веса, но и код, обучающие данные и рецепты обучения.
Launch: https://ifm.ai/k2/
Tech blog: https://ifm.ai/blog/k2
Hugging Face: https://huggingface.co/collections/IFM/k2-horizon
Please open Telegram to view this post
VIEW IN TELEGRAM
О чем еще знает OpenAI? Стоит ли удивляться, что Суцкевер занялся Superintelligence.. кстати, ждем от него чего-то интересного в сентябре..
Telegram
Denis Sexy IT 🤖
Помните, я (и все в мире) пару раз писал про агентов OpenAI, которые выбрались из песочницы и взломали Huggingface? Так вот, Reuters раскопал более ранний эпизод: ещё в мае - июне агенты нашли почти мёртвую немецкую вики, которой 25 лет, и устроили там себе…
Горшочек, не вари.. только астру раскатали, фейбл еще тепленький..
Telegram
Анализ данных (Data analysis)
Утекли предполагаемые бенчмарки Gemini 4 - цифры выглядят безумно 🤯
В сети разошлась таблица с прогнозируемыми результатами Gemini 4:
- 99,9%+ — ARC-AGI-3
- 99,1% — FrontierMath Tier 4 v2
- 72,8% — Terminal-Bench Science 0.1
- 70,2% — HealthBench Professional…
В сети разошлась таблица с прогнозируемыми результатами Gemini 4:
- 99,9%+ — ARC-AGI-3
- 99,1% — FrontierMath Tier 4 v2
- 72,8% — Terminal-Bench Science 0.1
- 70,2% — HealthBench Professional…
На пару дней выпал в реальный мир. Теперь отхожу от трейла и возвращаюсь к вайбкодингу. И попутно разбираюсь с белыми списками - вчера вообще цифровой детокс был
Прикольно. Астра в кодексе знает, сколько у нее осталось токенов, и ставя задачу, вы можете ей сказать - работай пока не достигнешь 25% или не решишь задачу..
И говорят, что Астра на малых усилия дешевле Сол на больших - в этом плане использовать Сол, когда есть Астра, смысла нет.
И говорят, что Астра на малых усилия дешевле Сол на больших - в этом плане использовать Сол, когда есть Астра, смысла нет.
Forwarded from Вайб-кодинг
ChatGPT Work теперь может подхватывать то, что делает ваш стиль письма именно вашим.
Любимые фразы. Ваш очень специфичный способ заканчивать сообщения. Ваши особенности с заглавными и строчными буквами.
Можно подключить инструменты, которыми вы пользуетесь каждый день, например Gmail, Google Drive, Slack и SharePoint, и ChatGPT Work будет учиться вашему стилю по письмам, сообщениям и файлам, а затем использовать его во всём, что вы будете писать дальше.
Для начала откройте chatgpt.com/?surface=w... в веб-версии. Также это можно настроить через Settings → Personalization → Writing style.
После настройки ваш стиль будет применяться ко всем сообщениям в ChatGPT Work как в веб-версии, так и на мобильных устройствах.
Функция доступна в веб-версии на всех платных тарифах, где есть доступ к ChatGPT Work.
Любимые фразы. Ваш очень специфичный способ заканчивать сообщения. Ваши особенности с заглавными и строчными буквами.
Можно подключить инструменты, которыми вы пользуетесь каждый день, например Gmail, Google Drive, Slack и SharePoint, и ChatGPT Work будет учиться вашему стилю по письмам, сообщениям и файлам, а затем использовать его во всём, что вы будете писать дальше.
Для начала откройте chatgpt.com/?surface=w... в веб-версии. Также это можно настроить через Settings → Personalization → Writing style.
После настройки ваш стиль будет применяться ко всем сообщениям в ChatGPT Work как в веб-версии, так и на мобильных устройствах.
Функция доступна в веб-версии на всех платных тарифах, где есть доступ к ChatGPT Work.
И прошлый DeepSeek Flash был хорош. Поэтому надежды на обновленную модель большие, особенно, учитывая возможность ее локального запуска
Telegram
Вайб-кодинг
DeepSeek объявила о начале внутреннего тестирования новой модели.
Компания сообщила, что начала тестировать промежуточную версию V4.1 Flash.
DeepSeek V4.1 Flash получила новую архитектуру, встроенную мультимодальность, стала мощнее и быстрее, а стоимость…
Компания сообщила, что начала тестировать промежуточную версию V4.1 Flash.
DeepSeek V4.1 Flash получила новую архитектуру, встроенную мультимодальность, стала мощнее и быстрее, а стоимость…
Вставлю свои пять копеек - в тему скандального решения проблемы тысячелетия. Еще в последнем видео с Лексом Фридманом на ютьюбе Теренс Тао рассказывал про ожидание именно такого решения для уравнений Навье-Стокса. То есть цель была ясна, живые ученые к ней продвинулись, а нейронки дожали формальное решение. Выглядит все так.
В этой истории тяжело не поверить в то, что ChatGPT не читал промптов исследователей. Вряд ли стоит этому удивляться.
А скандал - ну чего не сделаешь, чтобы сорвать IPO Антропику.. и так его сдвинули, а с такими новостями о возможностях новых моделей у OpenAI нужны какие-то свежие козыри. Ждем
В этой истории тяжело не поверить в то, что ChatGPT не читал промптов исследователей. Вряд ли стоит этому удивляться.
А скандал - ну чего не сделаешь, чтобы сорвать IPO Антропику.. и так его сдвинули, а с такими новостями о возможностях новых моделей у OpenAI нужны какие-то свежие козыри. Ждем
О да. Если нужно не программировать, а лопатить с нейронкой тексты или еще что-то рутинное делать - это лучший вариант. Конечно, есть еще флеш модели от Qwen и GLM, но что-то подсказывает, что DeepSeek их сделает..
https://t.me/vibecoding_tg/3824
https://t.me/vibecoding_tg/3824
Telegram
Вайб-кодинг
DeepSeek снижает цены. Максимальное снижение — 60%.
Согласно уведомлению об изменении тарифов, с 10 сентября, DeepSeek изменит стоимость API для серии Flash.
Цены в непиковые часы за 1 млн токенов:
Ввод при промахе кэша: $0,23 → $0,15, снижение примерно…
Согласно уведомлению об изменении тарифов, с 10 сентября, DeepSeek изменит стоимость API для серии Flash.
Цены в непиковые часы за 1 млн токенов:
Ввод при промахе кэша: $0,23 → $0,15, снижение примерно…
Мой кло сказал, что skill годный, стоит поставить
Telegram
AI да парень! / Sergei Notevskii
show-me skill
Тут немного завирусился skill от humanlayer – show-me.
Суть – помочь пользователю понять diff'ы с помощью кратких диаграмм, псевдокода или HTML.
Я попробовал, мне понравилось, рекомендую и вам!
Установить:
npx skills add humanlayer/skills…
Тут немного завирусился skill от humanlayer – show-me.
Суть – помочь пользователю понять diff'ы с помощью кратких диаграмм, псевдокода или HTML.
Я попробовал, мне понравилось, рекомендую и вам!
Установить:
npx skills add humanlayer/skills…
Forwarded from Федор
ChatGPT Images 2.5: OpenAI ускорила генерацию и сделала правки заметно точнее
Новая версия уже раскатывается для пользователей ChatGPT, ChatGPT Work и Codex. Главное изменение — работа с референсами и серийными правками: модель лучше сохраняет персонажа, композицию и детали между итерациями, а латентность, по данным OpenAI, снижена до 50% против Images 2.0.
Для практической работы появились Sketch (можно набросать схему прямо в ChatGPT), шаблоны для постеров и мерча, комментарии на конкретных участках картинки и шаринг промпта вместе с результатом.
В API вышли две модели: GPT‑Image‑2.5 Flare — основной быстрый вариант, и Sunburst для более детальных, но медленных creative-задач. Это особенно полезно для генерации брендовых вариаций, карточек товаров, UI-концептов и аккуратного редактирования исходных изображений без пересборки всего кадра.
Ограничения: цифры качества и скорости — заявления вендора; релиз ещё раскатывается. Для генераций сохраняются фильтры безопасности, C2PA-метаданные и невидимая маркировка.
Анонс OpenAI · цены API
Новая версия уже раскатывается для пользователей ChatGPT, ChatGPT Work и Codex. Главное изменение — работа с референсами и серийными правками: модель лучше сохраняет персонажа, композицию и детали между итерациями, а латентность, по данным OpenAI, снижена до 50% против Images 2.0.
Для практической работы появились Sketch (можно набросать схему прямо в ChatGPT), шаблоны для постеров и мерча, комментарии на конкретных участках картинки и шаринг промпта вместе с результатом.
В API вышли две модели: GPT‑Image‑2.5 Flare — основной быстрый вариант, и Sunburst для более детальных, но медленных creative-задач. Это особенно полезно для генерации брендовых вариаций, карточек товаров, UI-концептов и аккуратного редактирования исходных изображений без пересборки всего кадра.
Ограничения: цифры качества и скорости — заявления вендора; релиз ещё раскатывается. Для генераций сохраняются фильтры безопасности, C2PA-метаданные и невидимая маркировка.
Анонс OpenAI · цены API
OpenAI
Introducing ChatGPT Images 2.5
ChatGPT Images 2.5 helps turn your ideas, sketches, and reference photos into more personalized, polished images that better reflect your ideas.
Установил себе OpenClaw 2.0. По ощущениям, стал писать лучше. А может это модельки от OpenAI стали лучше. Можете оценить ☝️
И это небольшая и очень дешевая модель. Уверен - будет суперхитом
Telegram
Data Secrets
⚡️ Только что вышел DeepSeek-V4.1-Flash
Многие бенчмарки на уровне Opus 5 и Sol (обратите внимание на DeepSWE). Учитывая, что это модель Flash, самая маленькая из семейства, очень даже круто.
По поводу внутренностей:
– 552В MoE
– Новая асимметричная…
Многие бенчмарки на уровне Opus 5 и Sol (обратите внимание на DeepSWE). Учитывая, что это модель Flash, самая маленькая из семейства, очень даже круто.
По поводу внутренностей:
– 552В MoE
– Новая асимметричная…
OpenAI и правда закрыла подписку на $200. Младшие подписки пока доступны. Оправдывают высоким спросом на Астру. Какой бы ни был скандал, интерес публики он разогревает хорошо (я про решение задачи тысячелетия).
И говорят, это не последняя решенная задача.
И говорят, это не последняя решенная задача.
Telegram
Data Secrets
По всей сети уже распространился слух, что OpenAI решили еще один или даже два миллениума
Первая задача – гипотеза Ходжа, вторая – гипотеза Берча-Свиннертона-Дайера. Про последнюю говорят, что ее могли также решить в Anthropic.
По поводу Ходжа (вероятнее…
Первая задача – гипотеза Ходжа, вторая – гипотеза Берча-Свиннертона-Дайера. Про последнюю говорят, что ее могли также решить в Anthropic.
По поводу Ходжа (вероятнее…
Модель на уровне прошлого DeepSeek Flash или слегка похуже. Веса в 8битном кванте требуют 450гб памяти. Цены пока нет, но такая модель без ризонинга стоит 96/289 руб за 1 млн токенов. Дорого, но если припрет, госконторы цену осилят.
Telegram
Machine learning Interview
Сбер представил GigaChat 3.5 Reasoning — флагманскую модель с режимом рассуждений
Новая версия умеет последовательно решать сложные задачи. Сначала разбирает их на этапы и выстраивает план. Затем проверяет промежуточные результаты и исправляет ошибки.
…
Новая версия умеет последовательно решать сложные задачи. Сначала разбирает их на этапы и выстраивает план. Затем проверяет промежуточные результаты и исправляет ошибки.
…
Ну, кстати, и Яндекс тоже работает. Модель отлично ищет на русском языке. Пусть модели и не такие хайповые, как GPT, но они дадут результат - главное, что есть люди, которые умеют их делать. Будет компьют, будут модель не хуже, чем у китайцев.
Telegram
Love. Death. Transformers.
вообще удивительно, sparsity 1:70, MoE t5, ul2 рецепт и метрики на уровне 4-8b qwen3.5(на русском) и это релизит яндекс
hf
hf