Департамент Разработки
1.55K subscribers
661 photos
44 videos
524 links
Департамент Разработки — комьюнити про эффективную разработку и всё, что рядом.
Здесь встречаются разработчики, архитекторы, автоматизаторы и просто любопытные умы. Мы рассказываем последние новости индустрии, делимся инсайдами и кейсами от разработчиков.
Download Telegram
304 млрд параметров на одной AMD MI300X: рабочий стек выложили на GitHub

Разработчик Райан Чжоу опубликовал конфигурацию для запуска DeepSeek-V4-Flash-0731 на одном ускорителе AMD MI300X.

Веса занимают 156,67 ГиБ из 192 ГБ HBM3. Без дополнительного квантования и выгрузки весов в оперативную память автор получил 168,6 токена в секунду в одном потоке и 542 токена в секунду суммарно при восьми одновременных запросах. Контекст в 256K проверен на практике.

Секрет не только в объёме памяти MI300X. В репозитории есть патчи для AMD FP8 FNUZ, MoE-маршрутизации, speculative verification и гибридного KV-кэша: 20 ГБ на GPU плюс 96 ГиБ в RAM.

Цифры опубликованы автором сборки и пока не являются независимым бенчмарком. Кроме того, потребуется около 235 ГиБ системной памяти, 500 ГБ диска и несколько патчей, ещё не попавших в upstream.

Тем не менее это один из самых наглядных рецептов запуска огромной MoE-модели без стойки NVIDIA GPU.

Конфигурация, патчи и таблица результатов

#deepseek #amd #mi300x #llm #opensource
❤3👍3🔥2👏1
JetBrains принесла интеллект IntelliJ в VS Code и Cursor

JetBrains открыла предварительный доступ к расширению Java and Kotlin Intelligence. Оно подключает технологии IntelliJ IDEA к VS Code и совместимым редакторам, включая Cursor, через Language Server Protocol.

Внутри: автодополнение, навигация, анализ кода, рефакторинги, отладка через DAP и поддержка Maven, Gradle, Bazel и крупных монорепозиториев. Работают Java-, Kotlin- и смешанные проекты.

Пока preview бесплатен, но после его завершения Java-функции потребуют подписку IntelliJ IDEA Ultimate. Чистый Kotlin LSP останется бесплатным и открытым под Apache 2.0. В тестовой версии также рекомендуют отключить пересекающиеся Java-расширения Red Hat и Oracle.

Стратегически новость любопытнее самого плагина: IDE превращается в отделяемый backend. Разработчик может сохранить интерфейс Cursor или VS Code, но заменить его механизм анализа кода на JetBrains.

Анонс и инструкция по установке

#jetbrains #vscode #cursor #java #kotlin
❤5👍2🙏2🔥1👏1
Cloudflare открыла исходники своей «операционной системы» для AI-агентов

Сразу уточним: Cloudflare OS не является новой ОС с ядром и драйверами. Это браузерное рабочее пространство, в котором агент получает корпоративный контекст, запускает код и собирает документы, таблицы, презентации, приложения и повторяемые процессы.
У каждого приложения может быть собственная SQLite-база в Durable Objects, а сгенерированный код исполняется в изолированных V8-средах Dynamic Workers.

Модели подключаются через AI Gateway, включая сторонних провайдеров и собственные конфигурации.
Доступы выдаются через Gatekeepers. Новый агент или приложение стартует без прав, после чего получает разрешения на конкретные ресурсы.

Платформа отслеживает, к каким данным обращался агент, и умеет повторно проверять доступ при последующих запусках.

Cloudflare утверждает, что с мая системой ежедневно пользуются тысячи её сотрудников. Код открыт и разворачивается в собственном аккаунте, хотя архитектура ожидаемо тесно связана с инфраструктурой Cloudflare.

Исходный код, архитектура и демонстрация Cloudflare OS

#cloudflare #aiagents #opensource #serverless #developers
❤4🔥3😁2🙏2🤯1
Джефф Дин ушёл из Google после 27 лет. Его следующая ставка — автоматизация научного метода

Джефф Дин и Санджай Гемават запускают независимую public benefit corporation Discovery Loop. Google станет её первым инвестором и облачным партнёром.

К ним присоединились Куок Ле и Ориол Виньялс. За плечами команды MapReduce, Bigtable, Spanner, TensorFlow, TPU, seq2seq, AlphaCode и другие технологии, на которых держится значительная часть современной ML-индустрии.

Discovery Loop хочет автоматизировать весь экспериментальный цикл: сформулировать гипотезу, написать реализацию, запустить эксперимент, изучить результат и предложить следующую итерацию. Причём не последовательно, а тысячами параллельных веток. Первым полигоном станет сама разработка систем машинного обучения.

Главный вопрос проекта находится за пределами красивой схемы. В софте можно быстро повторить десять тысяч экспериментов, а в физике, биологии и производстве каждый прогон ограничен временем, оборудованием, безопасностью и стоимостью материалов. Если команда научится замыкать этот разрыв, это может оказаться важнее очередного увеличения LLM.

Discovery Loop · сообщение Google о запуске

#discoveryloop #jeffdean #research #machinelearning #google
❤6👍2👏2
Rust официально принял политику по LLM для основного репозитория

Пять команд (compiler, libs, types, rustdoc, bootstrap) приняли политику использования LLM в rust-lang/rust.
Коротко: можно использовать для вопросов, анализа, ревью, подсказок.

Нельзя — создавать основной контент (комменты, документацию, диагностики) без жёстких ограничений. LLM-код можно, но только с disclosure, тестами и повышенными требованиями. Если больше половины PR за шесть недель будут LLM-сгенерированными — мержи таких PR временно останавливают.

Это не бан AI. Это попытка сохранить понимание кода людьми и не превратить репозиторий в свалку низкокачественных диффов.

Источник: blog.rust-lang.org/inside-rust/2026/08/05/rust-langrust-is-adopting-an-llm-policy

#RustLang #LLM #OpenSource #AIAgents
😁5👨‍💻3👍2
Спор «IDE или редактор» можно закрывать

JetBrains выпустила Java and Kotlin Intelligence для VS Code и Cursor. Теперь идеальный «лёгкий редактор» устроен так:
VS Code показывает интерфейс.

Внутри сидит Cursor. Мозг IntelliJ через LSP анализирует Java и Kotlin, выполняет рефакторинги и разбирается с Maven, Gradle и Bazel. Рядом уже ждёт AI-агент.

Осталось установить Vim keybindings, 47 тем оформления и расширение для контроля расширений. После этого можно с чистой совестью рассказывать коллегам, что полноценные IDE слишком тяжёлые.

Preview пока бесплатный. После его завершения IntelliJ-функции для Java потребуют подписку IDEA Ultimate. Чистый Kotlin LSP останется бесплатным.

Официальный анонс JetBrains · реакция разработчиков

Сколько расширений нужно установить, прежде чем VS Code юридически становится IntelliJ?

#jetbrains #vscode #cursor #java #programmerhumor
❤2
Видеокарта на 6,5 FPS вызвала восторг. Её спроектировал один энтузиаст

Разработчик Понгсагон Вичит получил из производства TinyGPU v2.0 — самостоятельно спроектированный графический чип с открытым исходным кодом. И настоящий кремниевый ASIC действительно заработал.
Характеристики звучат как обзор видеокарты из очень тяжёлого 1997 года: разрешение 320 × 240, палитра из 16 цветов, до 1000 треугольников и примерно 6,5 кадра в секунду при максимальной сложности сцены.

Зато внутри есть собственная растеризация, трансформация и освещение геометрии, Z-буфер, отсечение невидимых граней и текстурирование. Модель на экране можно вращать с помощью контроллера от SNES.

Даже количество транзисторов получилось по-настоящему инженерным: страница Tiny Tapeout указывает около 200 тысяч, а репозиторий разработчика — около 240 тысяч. Подробного подсчёта автор не опубликовал, поэтому честный диапазон именно такой.
Это единственный релиз GPU, где 6,5 FPS вызывают аплодисменты, а не 600 комментариев с требованием исправить драйвер.

Исходники на Verilog опубликованы под Apache 2.0.

Теперь ждём первый вопрос в Issues: «Когда поддержка Cyberpunk 2077?»

Репозиторий TinyGPU v2.0
страница изготовленного чипа Tiny Tapeout
репортаж Tom’s Hardware

#tinygpu #opensource #verilog #gpu #программирование
❤4👍2😁1👌1
DynamoDB теперь умеет нативный vector search

AWS сегодня выкатил GA native vector search прямо в DynamoDB. Эмбеддинги лежат рядом с обычными данными.

Поиск по сходству — single-digit миллисекунды, recall 99%+, масштабируется до триллионов векторов. Без отдельного vector DB, без синхронизации, без серверов.

Поддерживает Euclidean, Cosine, Dot product, до 4096 измерений, inline filtering. Идеально для agent memory, RAG, рекомендаций и всего, где раньше приходилось городить Zero-ETL в OpenSearch.

Многие уже шутят, что можно удалять половину пайплайнов синхронизации.

Источник: aws.amazon.com/blogs/aws/amazon-dynamodb-now-supports-real-time-vector-search-at-any-scale

#DynamoDB #VectorSearch #AWS #AIAgents
❤3👍1🔥1
Автомобиль списали. RTX 5060 Ti — нет

К китайскому мастеру по ремонту Brother Zhang попала новая AX Gaming RTX 5060 Ti, которую почти сложило пополам. По словам автора видео, видеокарта находилась в автомобиле, серьёзно повреждённом при ударе сзади. Владелец не пострадал.

Кулер, бэкплейт и крепление выглядели безнадёжно. Но производитель использовал короткую печатную плату: основной изгиб пришёлся на пустую часть системы охлаждения, а GPU и большая часть PCB уцелели.
Карта включилась, однако при установке драйвера компьютер уходил в чёрный экран. Мастер снял и заново припаял ближайший к месту изгиба чип памяти. Этого оказалось достаточно.

Погнутый радиатор выпрямили, сверху стяжками прикрепили два 120-миллиметровых вентилятора. После ремонта карта определилась со всеми 8 ГБ памяти, прогрелась всего до 67 °C и показала 98,9% стабильности в цикле 3DMark.

У страховщика теперь две строки:

Автомобиль — тотал.
Видеокарта — нужен новый кулер.

Оригинальное видео ремонта
разбор Tom’s Hardware
независимое описание VideoCardz

#rtx5060ti #видеокарта #ремонт #pcbuilding #железо
❤4😁3🙏3
Meta выпустила Muse Glimmer — 30B open-weights модель, которая реально бегает локально на одной потребительской видеокарте

Meta наконец-то вернулась в open-source с нормальной агентной моделью. Muse Glimmer 30B (Apache 2.0) специально заточена под локальных агентов, tool calling и кодинг.

После 4-bit квантизации влезает в 20–24 ГБ VRAM и работает на MacBook M4/M5 или RTX 5090 без облака. На MCP Atlas и SWE-Bench Pro обгоняет Gemma-4 31B и Qwen3.6-27B. Можно уже тянуть с Hugging Face и гонять в Ollama / llama.cpp.

Кто-то уже пишет, что это первый «настоящий» локальный coding-агент, который не тормозит.

Источник

#AI #OpenSource #LocalLLM #CodingAgents
👍3👏3🔥2❤1
Claude Code переключает auto mode по умолчанию с 14 августа

Anthropic официально сделала auto mode дефолтом для Pro/Max/Team. Раньше Claude спрашивал разрешение на каждый чих Теперь сам решает, что можно, а что нет — и, по их тестам, ловит опасные команды лучше людей (89 % vs 13,6 %). Внутри Anthropic почти все уже давно сидят только на auto. С 14-го это станет нормой для большинства.

Кто-то радуется, кто-то уже пишет правила hard-deny. Будет весело.

Источник

#ClaudeCode #AIAgents #DevTools
❤3🔥3👏2😁1🤝1
Docker Sandboxes — теперь можно спокойно давать агентам полный YOLO-режим

На HN вчера взорвалось: Docker выкатил (и активно продвигает) Sandboxes на microVM. Агент получает свой собственный Docker-демон, файловую систему и сеть. Хост остаётся нетронутым. Поддерживаются Claude Code, Codex, Copilot CLI, OpenCode и т.д. Можно запускать sbx run claude и уходить пить кофе, не боясь, что агент снесёт .ssh или зальёт секреты.

Это именно то, чего не хватало для нормальной автономной работы агентов локально.

Источник

#Docker #AIAgents #Security #DevOps
❤5🙏3🔥2
В tl;dv нашли дыру: 181 000+ записей встреч с AI-ноуттейкером лежали открытыми

Исследователь выложил: из-за отсутствия tenant isolation в Firestore любой залогиненный пользователь мог читать метаданные и (частично) записи чужих митингов. 181 874 записи, 84 тысячи пользователей, куча живых Google Meet / Teams сессий, куда можно было просто зайти по conference ID. Дыра была известна с января, до сих пор не закрыта полностью.

Ещё один аргумент «не пишите в митинге то, что потом стыдно будет прочитать».

Источник
#Security #AI #Privacy #Meetings
❤4
Netflix рассказал, как они масштабировали real-time карту зависимостей тысяч микросервисов

Service Topology — живая карта того, кто от кого зависит. Переписали пайплайн: три стадии, backpressure в Kafka вместо дропа записей, вместо gRPC — Server-Sent Events. Теперь обновляется почти в реальном времени даже при миллионах flow-записей в секунду.

Классический Netflix-уровень: когда обычные observability-инструменты уже не тянут, они просто пишут свою систему.

Источник

#Netflix #Microservices #Observability #Architecture
❤4👍2🔥1
Отменяем подписку на ChatGPT? SpaceXAI выкатили данные по Grok 4.6.

Маск не зря отдал $60 млрд за Cursor. Судя по бенчмаркам, новая модель Grok 4.6 идет ноздря в ноздрю с GPT-5.6 Sol и Claude Fable 5, а в ряде тестов даже обходит их.

Но главная киллер-фича — это не просто текстовый генератор. Параллельно SpaceXAI запускает Grok Bot — рой «всегда включенных» ИИ-агентов. Вы один раз показываете свой воркфлоу, а бот запоминает рутину, дебажит и коммитит 24/7 прямо на вашей машине, вообще не требуя API. Агенты окончательно выходят за рамки прототипов и идут в продакшен.
Кто сейчас ваш мейн для написания кода? 👇

❤️ Claude
😂 GPT
😘 Grok (дадим шанс)
🙈 Пишу руками (press F)

#AI #AIAgents #AIcoding

Kod.ru
🤝3❤1👍1🙈1😘1
Mistral запатентовала «code implemented tool calls»

На HN и X вчера активно обсуждали: у Mistral вышел патент на способ, когда LLM генерирует код, который инкапсулирует tool calls, выполняется в sandbox и умеет паузить/резюмить.

Многие считают, что это слишком общее и уже давно используется всеми. Другие — что теперь будет интересный prior art баттл.

В любом случае тема tool calling и агентов снова на первом плане.

Источник

#Mistral #AI #Patents #ToolCalling
❤4
SpaceX закрыла сделку по Cursor за $60 млрд

Да, именно так. Cursor теперь часть SpaceX. Сделка закрылась 14 августа, акции Anysphere конвертировали в примерно 390 миллионов акций SpaceX.

Для разработчиков это значит одно: самый популярный AI-coding агент получает доступ к «самому большому флоту GPU в мире» (их формулировка). Cursor уже писали, что теперь будут строить модели, которые раньше просто не тянули по железу.

Кто-то радуется, кто-то уже считает, сколько будет стоить подписка через полгода. А кто-то просто открывает Cursor и думает: «Ну, теперь точно не отключат».

Источник: TechCrunch

#AI #Cursor #SpaceX #CodingAgents #DeveloperNews
😁4❤2🙏2
Qwen3.8-27B вышел в открытый доступ. И он реально хорош в коде.

Alibaba выложила веса 14 августа. 27B параметров, нативная мультимодальность, Apache 2.0, контекст 262K (можно растянуть до миллиона). По их цифрам обходит предыдущий Qwen3.7-Plus и уверенно держится на уровне дорогих закрытых моделей в реальных coding-задачах.

Главное — можно гонять локально на нормальной видеокарте. Не «в теории», а прямо сейчас. Уже появились первые отзывы людей, которые закинули его в Cursor/Continue и получили рабочие PR.

Кто ещё сомневался в open-weight моделях среднего размера — сейчас самое время перепроверить.

Источник: Hugging Face / официальный релиз Qwen

#Qwen #OpenSourceAI #LLM #LocalAI #Coding
🔥4👍1🤝1
DeepSeek выложил Harness. И там «всё — плагин».

13–14 августа DeepSeek открыл исходники своего агентного рантайма под MIT. Модель, инструменты, сессии, песочница, цикл агента, UI — всё плагины. Можно выкинуть любой кусок и поставить свой, не трогая ядро.

Репозиторий за пару дней набрал десятки тысяч звёзд. Уже есть пресеты: полный, минимальный (только shell + редактор), code-mode и creator. Есть даже мосты к Claude Code и Codex.

Если вы строите своих агентов и устали от жёстких фреймворков — это один из самых интересных вариантов прямо сейчас.

Источник: GitHub DeepSeek Harness

#DeepSeek #AgentHarness #OpenSource #AIAgents
👍3🔥1🤝1
Claude теперь помечает весь сгенерированный текст. И нет, это не скрытые символы или метаданные.

Anthropic выкатили невидимые водяные знаки для всех моделей, запущенных после 2 августа 2026 года (привет новым требованиям EU AI Act). Под капотом — модифицированный метод SynthID-Text от Google DeepMind.

Как это работает? При генерации текста LLM обычно выбирает следующее слово с долей случайности. Теперь этот "рандом" диктуется специальным криптографическим ключом. Образуется уникальный математический паттерн прямо в выборе слов, который нельзя увидеть глазом, но можно распознать через API.

Главное для разработчиков: ваш сгенерированный код в безопасности. Там, где синтаксис требует точного ответа (например, 2+2=4 или специфичный API-вызов), система не вмешивается, чтобы не сломать логику. Водяной знак может проявиться разве что в текстовых комментариях к коду.

Как думаете, скоро научатся обходить такую маркировку?

🙈 Да, прогонят текст через другую LLM
😍 Нет, паттерн зашит слишком глубоко
😝 Вообще без разницы

#AI #LLM #GenAI #cybersecurity

Anthropic Blog
❤5👍2🔥2