AI for Devs
16.8K subscribers
379 photos
114 videos
342 links
По сотрудничеству пишите в личные сообщения канала.

Канал для разработчиков про AI. Модели, ИИ-агенты, практические кейсы и новости из мира AI. Всё, что можно применить в работе.
Download Telegram
⚡️ Qwen4: Alibaba выпустили первую модель на новой архитектуре

Состоялся релиз Qwen3.8-Flash-Next на 125 млрд параметров. Alibaba переработали механизм работы с длинным контекстом и добавили отдельную память на 51 млрд параметров для частых сочетаний текста и кода.

Это пока не полноценная Qwen4: модель выпустили, чтобы сообщество научилось работать с новой архитектурой до появления всего семейства.

На DeepSWE новинка набрала 58,7% против 42,2% у Qwen3.8-27B и 54,4% у DeepSeek V4 Flash. Но до Kimi K3 с открытыми весами не дотянула, у последней 67,5%.


Веса уже доступны бесплатно, но для локального запуска потребуется больше 80 ГБ памяти.

API-версия скоро появится в QwenCloud по цене $0,16/$0,47 за миллион токенов.

@ai_for_devs
1🔥37👍268🤯1
⚡️ NVIDIA согласилась купить Hugging Face за $12,9 млрд

Если сделка состоится, она станет крупнейшей покупкой в истории NVIDIA. Предыдущий рекорд — Mellanox за $7 млрд.

Годовой темп выручки Hugging Face оценивают всего в $150 млн, поэтому цена равна примерно 86 годовым выручкам. NVIDIA платит не за текущий бизнес, а за доступ к миллионам разработчиков.


Забавно, но ещё пол года назад стало известно, что Hugging Face отказала NVIDIA в инвестиции $500 млн при оценке $7 млрд: компания не хотела одного доминирующего инвестора, способного влиять на решения 🧠

@ai_for_devs
Please open Telegram to view this post
VIEW IN TELEGRAM
2🔥40🤯3319👍632
AI for Devs
⚡️ Z.ai выпустили GLM-5.3-Flash — ту самую Ox Alpha, которая за неделю стала топ-1 в OpenCode и OpenRouter Стелс-превью закончилось: за шесть дней пользователи OpenCode прогнали через модель 42 трлн токенов, а на OpenRouter она обошла ближайший DeepSeek по…
В дополнение к релизу Z.ai на две недели снизили цены GLM-5.3-Flash вдвое: $0,075/$0,25 за миллион входных/выходных токенов.

У обновлённого DeepSeek V4 Flash после подорожания даже off-peak стоимость почти в 3 раза дороже.


На Router AI модель уже доступна без VPN и иностранной карты:

– 9 ₽/1М input, 30 ₽/1M output
– Кэш 1,81 ₽ / 1M токенов

Настройка для Claude Code, OpenCode, Cursor, JetBrains, Cline, и т.д.

@ai_for_devs
4🔥44👍20🤯1053
This media is not supported in your browser
VIEW IN TELEGRAM
⚡️ Anthropic сделали «MCP для железа»

Model Hardware Standard (MHS) — общий интерфейс, через который AI-агенты могут находить и безопасно управлять микроскопами, роботами и другим лабораторным оборудованием.

Для каждого устройства создаётся MHS-драйвер с простыми командами вроде read и write, описанием возможностей и ограничений безопасности. Агент читает эту инструкцию и управляет сразу несколькими устройствами.

В первых тестах AI-агент сам подбирал параметры лабораторного робота и справлялся с частью ошибок по ходу эксперимента. Подготовка сложного эксперимента с микроскопом сократилась с нескольких недель до одного дня.


Пока это закрытый research preview. После тестов MHS обещают сделать open source.

@ai_for_devs
2🔥93🤯31👍2744
⚡️ Туда, сюда, обратно, тебе и мне приятно — миграция настроек

За последний год в AI-инструментах всё невероятно поменялось: новые агенты появляются чуть ли не каждый месяц, и иногда переход с одного на другой не только оправдан, но и необходим.

Но начинать всё с нуля совсем не хочется: вместе с собой надо забрать правила проекта, инструкции, скиллы, настройки MCP и память агента.

Уже через 1 час, в 17:00 (МСК) Михаил Костицын из Veai покажет, где хранятся настройки Claude Code, Codex, Cursor, OpenCode и Veai, как легко перенести их и проверить на реальной задаче.


Вебинар бесплатный, главное зарегистрироваться: https://veai.ru/events/ai-agent-mcp/join
1😁24🔥22👍146👏2🤯1
⚡️ Модели OpenAI исчезнут из Cursor из-за сделки со SpaceX

После покупки Cursor компанией SpaceX OpenAI решила прекратить прямой доступ к GPT-моделям с 12 ноября.

Причина максимально личная: компания не доверяет бизнесам Илона Маска и опасается нарушения своих правил.


В Cursor ответили, что на модели OpenAI приходится лишь 5% трафика. Свой API-ключ при этом продолжит работать.

@ai_for_devs
1🤯56🔥21👍1933
⚡️ Вышла версия GLM-5.3 Flash без цензуры

На Hugging Face появилась GLM-5.3 Flash Uncensored. Это версия свежей модели Z.ai, в весах которой ослабили выученное поведение отказа: она реже отвечает «извините, я не могу вам с этим помочь».

Судя по тестам, снятие ограничений почти не задело обычные способности модели. Зато отказов ожидаемо стало меньше.

На вредоносных запросах из JailbreakBench базовая GLM отказалась отвечать в 93% случаев, uncensored-версия — в 12%.

Такие модели вообще не редкость. У OrcaRouter уже есть целая коллекция: Qwen3.8-27B Uncensored, Qwen3.8 Flash Next Uncensored, которые можно легко запустить локально. А через API также доступна Gemma4 26B A4B Uncensored.


Если будете использовать, то главное помнить: «С большой силой приходит большая ответственность»!

@ai_for_devs
1🤯48🔥27👍195🤩5
⚡️ Anthropic выпустили Claude Fable 5.1

https://www.anthropic.com/claude-fable-and-mythos-5-1

Новая модель заняла первое место во всех популярных бенчмарках.

Базовая цена осталась $10/$50 за миллион токенов, зато чтение кэша подешевело на 75%.


Fable 5.1 уже доступна на всех платформах и в API. Mythos 5.1 (та же модель с менее строгими фильтрами) только для проверенных организаций.

Также в честь релиза всем пользователям сбросили недельные и часовые лимиты.

@ai_for_devs
3🔥66👍2316🤯53
⚡️ Grok 4.6 остался лучшей LLM по соотношение цены и качества после релиза Fable 5.1

В режиме Extra High Grok 4.6 набрал даже больше очков, чем Opus 5, а задача обошлась почти втрое дешевле.

Также интересно, что Fable 5.1 оказался дешевле Opus 5, хотя обычные входные и выходные токены у Fable 5.1 вдвое дороже.

Связано это со снижением стоимости чтения кеша на 75%, а в длинных агентных задачах через кеш проходит бóльшая часть контекста.


И теперь Маск обещает выпустить Grok 4.7 в течение 10 дней. Если модель сохранит экономику Grok 4.6 и ещё прибавит в качестве, то мы получим SOTA модель в несколько раз дешевле текущего лидера.

@ai_for_devs
2🔥68👍29🤯952
⚡️ OpenAI готовят Astra: новая модель набрала 100% на ExploitBench

Astra ещё не вышла, но OpenAI уже рассказали, почему задержали её релиз. Это первая модель компании, достигшая критического уровня кибервозможностей.

По данным OpenAI, Astra достигла 100% на публичном ExploitBench. Из-за риска утечки заданий компания отдельно проверила модель на свежих уязвимостях: там Astra заметно обошла GPT‑5.6 Sol и обнаружила две zero-day-уязвимости.


Модель обещают выпустить скоро, но самые мощные кибервозможности сначала откроют только небольшой группе тестировщиков.

@ai_for_devs
1🤯46🔥34👍14👏32
Please open Telegram to view this post
VIEW IN TELEGRAM
1🤡98👍26🤯1811🔥61😁1🤩1
AI for Devs
⚡️ NVIDIA согласилась купить Hugging Face за $12,9 млрд Если сделка состоится, она станет крупнейшей покупкой в истории NVIDIA. Предыдущий рекорд — Mellanox за $7 млрд. Годовой темп выручки Hugging Face оценивают всего в $150 млн, поэтому цена равна примерно…
⚡️ NVIDIA всё-таки покупает Hugging Face за $12,93 млрд

Неделю назад об этом сообщали источники, а теперь сделку подтвердил сам Дженсен Хуанг.

Вместе с Hugging Face NVIDIA получает платформу с 18 млн разработчиков, 3 млн моделей, 500 тыс. датасетов, 1 млн приложений и 200 тыс. компаний-пользователей.

Хуанг отдельно пообещал, что Hugging Face останется открытой: любые модели, облака и ускорители, а GPU NVIDIA не станут обязательными. Команда и бренд тоже остаются.


Напомним, что в конце 2025 года Hugging Face отказала NVIDIA в инвестиции $500 млн при оценке $7 млрд (не хотели одного доминирующего инвестора).

Теперь доминирующий инвестор просто купил всю компанию 🤣

@ai_for_devs
Please open Telegram to view this post
VIEW IN TELEGRAM
1🤯45😁29👍19🔥841🤩1
⚡️ OpenAI выпустили GPT-6 Astra: первая модель новой эпохи по версии OpenAI

Сегодня модель получили только избранные участники программы Daybreak.

В ChatGPT Plus, Pro, Business, Enterprise и API её обещают открыть «в ближайшие дни».

Цена в API — $10/$50 за миллион входных и выходных токенов, Fast mode — $20/$100.

Astra обходит Fable 5.1 почти в каждом из популярных бенчмарков.


Ждём массового доступа и первых независимых тестов.

@ai_for_devs
2🔥71👍29🤯16🤩761
⚡️ OpenAI раздаёт сброс лимитов за ожидание Astra

За каждый день без доступа к модели платным пользователям начислят по одному сбросу лимита.

Если раскатка затянется, встретим Astra почти с безлимитом)

@ai_for_devs
1🔥88👍28😁166🤯43
This media is not supported in your browser
VIEW IN TELEGRAM
⚡️ GPT-6 Astra стала доступна в Codex

В ChatGPT эта же модель называется GPT-6 Pro. На тарифе за $200 дают 200 сообщений GPT-6 Pro в неделю, за $100 — 50.

В Codex на Astra отдельные "плавающие" лимиты, зависящие от уровня подписки.

@ai_for_devs
2🤯70🔥35👍2153😁2
⚡️ Astra против Fable 5.1: лучше результат и почти вдвое дешевле

От нового флагмана обычно ждёшь роста возможностей и счёта за использование. У Astra цена токена действительно выросла в 2,5 раза относительно Sol (входные: $4 → $10, выходные: $20 → $50 за миллион токенов).

Но результаты Terminal-Bench 4.0 показывают, почему одного прайса для сравнения моделей недостаточно.

Все три модели работали на максимальном уровне рассуждения:
Astra: 58,2% решённых задач, 1,5 млрд токенов, $3,3 тыс.
Fable 5.1: 57,9%, 2,7 млрд токенов, $6,2 тыс.
Opus 5: 51,8%, 6,5 млрд токенов, $6 тыс.

В сравнении с Fable результат практически одинаковый, но Astra использовала в 1,8 раза меньше токенов, а весь прогон обошёлся почти вдвое дешевле!


В итоге токены вдвое дороже, а итоговый счёт почти вдвое меньше) И решённых задач больше 😎

@ai_for_devs
Please open Telegram to view this post
VIEW IN TELEGRAM
1🔥87👍3013🤯7💯1