Про AI: Лучшие cтатьи и исследования
1.7K subscribers
565 photos
1 video
730 links
Качественные AI переводы лучших англоязычных статей и исследований про AI.
Нашли интересную статью для перевода? Пришлите нашему боту: @ai_longreads_bot
Download Telegram
Модель и effort в Claude Code: знать больше или стараться сильнее

Claude Code даёт два параметра, которые оба вроде бы «улучшают ответ»: модель и уровень effort (*усилий*). Но что именно каждый из них меняет в результате — и как понять, нужно ли переключать модель или достаточно поменять уровень усилий?

Читать статью
👍5
Непрерывное обучение для агентов

Как команда Replit целый год применяла непрерывное обучение (continual learning) к своему агенту — не через обновление весов модели, а на уровнях harness и контекста: майнинг production-трейсов, бенчмарк ViBench, A/B-тесты, кластеризация трейсов и цикл самоулучшения агента.

Читать статью
О чём говорят в AI-индустрии прямо сейчас:

lopopolo/harness-engineering
Антология, полевое руководство и контекстный бандл для агентов по разработке систем тестирования (harness engineering).

xiejunjie524/handdraw-story-video
Инструмент для превращения нарисованных от руки иллюстраций в видео с постепенной отрисовкой и раскрашиванием с помощью HyperFrames.

Icex0/wp2shell-poc
Реализация цепочки уязвимостей (CVE-2026-63030 и CVE-2026-60137) для получения полного удаленного выполнения кода (RCE).

Gheat1/tuistore
Магазин приложений с текстовым интерфейсом (TUI) для поиска и быстрой установки сотен терминальных утилит.

jlnsrk/GLM-5.2-colibri-int4
Подготовленные веса для colibrì — движка на чистом C, предназначенного для запуска модели GLM-5.

SeanJ1ang/design-judge-skills
Набор навыков для ИИ-агентов, помогающий в исследовании, оценке и подготовке заявок на дизайнерские премии.

OpenBMB/MiniCPM-Robot
Быстрый и эффективный ИИ-мозг для роботов, обеспечивающий инференс непосредственно на устройстве.

tetsuo-ai/voice_clone_lab
Инструмент для клонирования голоса и локальной генерации речи на базе пайплайна fine-tuning для Qwen3-TTS.

sanjayragavendra/MecchaChameleon-AutoPaintTool
Инструмент для мгновенного камуфляжа, который автоматически определяет цвет поверхности и перекрашивает объект в Meccha Chameleon.

MirilAI/Miril-Drone-2B-1
Открытая мультимодальная модель для гражданских дронов, позволяющая им анализировать окружение и взаимодействовать с помощью речи.
🔥1
Как выбрать GPT-5.6 Sol, Terra или Luna в Codex

Разбор трёх моделей GPT-5.6 в Codex: чем отличаются Sol, Terra и Luna, когда действительно нужен режим Ultra и как формулировать промпты, чтобы у агента была понятная финишная черта.

Читать статью
2
Самоуправляемая компания

Инженеры Replit за полгода почти утроили объём кода — при этом время ревью, откаты и инциденты не выросли. Основатель компании Amjad Masad рассказывает, как агенты, вплетённые в саму ткань организации, превращают исполнителей в директоров.

Читать статью
GLM 5.2 научили видеть: зрение через MLP на 50M параметров

Исследователи добавили GLM 5.2 поддержку изображений, обучив всего лишь двухслойный MLP на 50 млн параметров — и получили качество на уровне Claude 4.5 Haiku в MMMU-Pro, не затронув текстовые способности модели.

Читать статью
👍1🔥1
Почему мы отказались от SDK

Команда отказалась от клиентских SDK Stripe, WorkOS и Slack в пользу прямых вызовов REST API через собственную обёртку HttpBaseClient — потому что AI изменил кривую стоимости интеграции, а SDK скрывают именно те детали, которые нужны агентам для отладки.

Читать статью
Что нового в мире AI — дайджест с GitHub, Reddit и Hugging Face:

goutoujunshi: ИИ-советник по отношениям
Инструмент на базе Codex для анализа отношений и разработки стратегий поведения, использующий базу знаний по психологии, праву и социологии.

Agent-Execution-Partnership: Контроль действий ИИ-агентов
Открытая платформа управления, обеспечивающая авторизацию, наблюдаемость и верификацию каждого действия ИИ-агента в процессе работы.

Laguna-S-2.1 от poolside
Новая версия модели Laguna-S-2.1 от команды poolside опубликована на Hugging Face.

PM-Sniper
Репозиторий проекта PM-Sniper от разработчика AdelanSoulX доступен на GitHub.

adelan-support
Официальный репозиторий технической поддержки для инструментов экосистемы Adelan.

Лаборатория для тестирования RCE в fastjson
Docker-среда и эксплойт для исследования уязвимости удаленного выполнения кода (RCE) в библиотеке fastjson версий 1.2.66–1.2.83.

Qwen3-Omni-30B-A3B-Instruct-AWQ-4bit
Квантованная 4-битная версия модели Qwen3-Omni-30B, оптимизированная для эффективного инференса.

Intern-S2-Preview-397B
Превью-версия масштабной языковой модели Intern-S2 с 397 миллиардами параметров от команды InternLM.

ArtiFixer от NVIDIA
NVIDIA представила новую модель ArtiFixer, разместив веса на платформе Hugging Face.

TiRex-2: Прогнозирование временных рядов
Модель для многомерного прогнозирования в режиме zero-shot, не требующая дообучения или fine-tuning на пользовательских данных.
🔥1
Контролируйте идеи, а не код

antirez объясняет, почему в эпоху LLM чтение сгенерированного кода стало неоптимальным занятием: гораздо важнее владеть идеями и дизайном софта, заниматься QA и описывать замысел на человеческом языке. Он честно признаёт, что сам всё ещё вычитывает код Redis — но считает это данью уважения к пользователям, а не полезной работой.

Читать статью
🔥1
Острые тезисы о памяти в AI

Разбор ключевых вопросов, вокруг которых спорят те, кто строит системы памяти для AI-агентов, с прогнозами по каждому: где место стартапам за пределами лабораторий, стоит ли работать в пространстве весов или токенов, и правда ли память — это просто задача поиска.

Читать статью
Собеседования инженеров в эпоху ИИ: уроки года перестройки

Coinbase перестроил процесс технических собеседований после того, как больше половины кода в компании стало генерироваться ИИ. Рассказ о трёх фазах этой работы: что изменили, что показали данные и что до сих пор остаётся нерешённым.

Читать статью
👍1