Модель и effort в Claude Code: знать больше или стараться сильнее
Claude Code даёт два параметра, которые оба вроде бы «улучшают ответ»: модель и уровень effort (*усилий*). Но что именно каждый из них меняет в результате — и как понять, нужно ли переключать модель или достаточно поменять уровень усилий?
Читать статью
Claude Code даёт два параметра, которые оба вроде бы «улучшают ответ»: модель и уровень effort (*усилий*). Но что именно каждый из них меняет в результате — и как понять, нужно ли переключать модель или достаточно поменять уровень усилий?
Читать статью
👍5
Непрерывное обучение для агентов
Как команда Replit целый год применяла непрерывное обучение (continual learning) к своему агенту — не через обновление весов модели, а на уровнях harness и контекста: майнинг production-трейсов, бенчмарк ViBench, A/B-тесты, кластеризация трейсов и цикл самоулучшения агента.
Читать статью
Как команда Replit целый год применяла непрерывное обучение (continual learning) к своему агенту — не через обновление весов модели, а на уровнях harness и контекста: майнинг production-трейсов, бенчмарк ViBench, A/B-тесты, кластеризация трейсов и цикл самоулучшения агента.
Читать статью
О чём говорят в AI-индустрии прямо сейчас:
lopopolo/harness-engineering
Антология, полевое руководство и контекстный бандл для агентов по разработке систем тестирования (harness engineering).
xiejunjie524/handdraw-story-video
Инструмент для превращения нарисованных от руки иллюстраций в видео с постепенной отрисовкой и раскрашиванием с помощью HyperFrames.
Icex0/wp2shell-poc
Реализация цепочки уязвимостей (CVE-2026-63030 и CVE-2026-60137) для получения полного удаленного выполнения кода (RCE).
Gheat1/tuistore
Магазин приложений с текстовым интерфейсом (TUI) для поиска и быстрой установки сотен терминальных утилит.
jlnsrk/GLM-5.2-colibri-int4
Подготовленные веса для colibrì — движка на чистом C, предназначенного для запуска модели GLM-5.
SeanJ1ang/design-judge-skills
Набор навыков для ИИ-агентов, помогающий в исследовании, оценке и подготовке заявок на дизайнерские премии.
OpenBMB/MiniCPM-Robot
Быстрый и эффективный ИИ-мозг для роботов, обеспечивающий инференс непосредственно на устройстве.
tetsuo-ai/voice_clone_lab
Инструмент для клонирования голоса и локальной генерации речи на базе пайплайна fine-tuning для Qwen3-TTS.
sanjayragavendra/MecchaChameleon-AutoPaintTool
Инструмент для мгновенного камуфляжа, который автоматически определяет цвет поверхности и перекрашивает объект в Meccha Chameleon.
MirilAI/Miril-Drone-2B-1
Открытая мультимодальная модель для гражданских дронов, позволяющая им анализировать окружение и взаимодействовать с помощью речи.
lopopolo/harness-engineering
Антология, полевое руководство и контекстный бандл для агентов по разработке систем тестирования (harness engineering).
xiejunjie524/handdraw-story-video
Инструмент для превращения нарисованных от руки иллюстраций в видео с постепенной отрисовкой и раскрашиванием с помощью HyperFrames.
Icex0/wp2shell-poc
Реализация цепочки уязвимостей (CVE-2026-63030 и CVE-2026-60137) для получения полного удаленного выполнения кода (RCE).
Gheat1/tuistore
Магазин приложений с текстовым интерфейсом (TUI) для поиска и быстрой установки сотен терминальных утилит.
jlnsrk/GLM-5.2-colibri-int4
Подготовленные веса для colibrì — движка на чистом C, предназначенного для запуска модели GLM-5.
SeanJ1ang/design-judge-skills
Набор навыков для ИИ-агентов, помогающий в исследовании, оценке и подготовке заявок на дизайнерские премии.
OpenBMB/MiniCPM-Robot
Быстрый и эффективный ИИ-мозг для роботов, обеспечивающий инференс непосредственно на устройстве.
tetsuo-ai/voice_clone_lab
Инструмент для клонирования голоса и локальной генерации речи на базе пайплайна fine-tuning для Qwen3-TTS.
sanjayragavendra/MecchaChameleon-AutoPaintTool
Инструмент для мгновенного камуфляжа, который автоматически определяет цвет поверхности и перекрашивает объект в Meccha Chameleon.
MirilAI/Miril-Drone-2B-1
Открытая мультимодальная модель для гражданских дронов, позволяющая им анализировать окружение и взаимодействовать с помощью речи.
GitHub
GitHub - lopopolo/harness-engineering: 🐎 Ryan Lopopolo’s anthology, field guide, and agent context bundle for harness engineering
🐎 Ryan Lopopolo’s anthology, field guide, and agent context bundle for harness engineering - lopopolo/harness-engineering
🔥1
Как выбрать GPT-5.6 Sol, Terra или Luna в Codex
Разбор трёх моделей GPT-5.6 в Codex: чем отличаются Sol, Terra и Luna, когда действительно нужен режим Ultra и как формулировать промпты, чтобы у агента была понятная финишная черта.
Читать статью
Разбор трёх моделей GPT-5.6 в Codex: чем отличаются Sol, Terra и Luna, когда действительно нужен режим Ultra и как формулировать промпты, чтобы у агента была понятная финишная черта.
Читать статью
❤2
Самоуправляемая компания
Инженеры Replit за полгода почти утроили объём кода — при этом время ревью, откаты и инциденты не выросли. Основатель компании Amjad Masad рассказывает, как агенты, вплетённые в саму ткань организации, превращают исполнителей в директоров.
Читать статью
Инженеры Replit за полгода почти утроили объём кода — при этом время ревью, откаты и инциденты не выросли. Основатель компании Amjad Masad рассказывает, как агенты, вплетённые в саму ткань организации, превращают исполнителей в директоров.
Читать статью
GLM 5.2 научили видеть: зрение через MLP на 50M параметров
Исследователи добавили GLM 5.2 поддержку изображений, обучив всего лишь двухслойный MLP на 50 млн параметров — и получили качество на уровне Claude 4.5 Haiku в MMMU-Pro, не затронув текстовые способности модели.
Читать статью
Исследователи добавили GLM 5.2 поддержку изображений, обучив всего лишь двухслойный MLP на 50 млн параметров — и получили качество на уровне Claude 4.5 Haiku в MMMU-Pro, не затронув текстовые способности модели.
Читать статью
👍1🔥1
Почему мы отказались от SDK
Команда отказалась от клиентских SDK Stripe, WorkOS и Slack в пользу прямых вызовов REST API через собственную обёртку HttpBaseClient — потому что AI изменил кривую стоимости интеграции, а SDK скрывают именно те детали, которые нужны агентам для отладки.
Читать статью
Команда отказалась от клиентских SDK Stripe, WorkOS и Slack в пользу прямых вызовов REST API через собственную обёртку HttpBaseClient — потому что AI изменил кривую стоимости интеграции, а SDK скрывают именно те детали, которые нужны агентам для отладки.
Читать статью
Что нового в мире AI — дайджест с GitHub, Reddit и Hugging Face:
goutoujunshi: ИИ-советник по отношениям
Инструмент на базе Codex для анализа отношений и разработки стратегий поведения, использующий базу знаний по психологии, праву и социологии.
Agent-Execution-Partnership: Контроль действий ИИ-агентов
Открытая платформа управления, обеспечивающая авторизацию, наблюдаемость и верификацию каждого действия ИИ-агента в процессе работы.
Laguna-S-2.1 от poolside
Новая версия модели Laguna-S-2.1 от команды poolside опубликована на Hugging Face.
PM-Sniper
Репозиторий проекта PM-Sniper от разработчика AdelanSoulX доступен на GitHub.
adelan-support
Официальный репозиторий технической поддержки для инструментов экосистемы Adelan.
Лаборатория для тестирования RCE в fastjson
Docker-среда и эксплойт для исследования уязвимости удаленного выполнения кода (RCE) в библиотеке fastjson версий 1.2.66–1.2.83.
Qwen3-Omni-30B-A3B-Instruct-AWQ-4bit
Квантованная 4-битная версия модели Qwen3-Omni-30B, оптимизированная для эффективного инференса.
Intern-S2-Preview-397B
Превью-версия масштабной языковой модели Intern-S2 с 397 миллиардами параметров от команды InternLM.
ArtiFixer от NVIDIA
NVIDIA представила новую модель ArtiFixer, разместив веса на платформе Hugging Face.
TiRex-2: Прогнозирование временных рядов
Модель для многомерного прогнозирования в режиме zero-shot, не требующая дообучения или fine-tuning на пользовательских данных.
goutoujunshi: ИИ-советник по отношениям
Инструмент на базе Codex для анализа отношений и разработки стратегий поведения, использующий базу знаний по психологии, праву и социологии.
Agent-Execution-Partnership: Контроль действий ИИ-агентов
Открытая платформа управления, обеспечивающая авторизацию, наблюдаемость и верификацию каждого действия ИИ-агента в процессе работы.
Laguna-S-2.1 от poolside
Новая версия модели Laguna-S-2.1 от команды poolside опубликована на Hugging Face.
PM-Sniper
Репозиторий проекта PM-Sniper от разработчика AdelanSoulX доступен на GitHub.
adelan-support
Официальный репозиторий технической поддержки для инструментов экосистемы Adelan.
Лаборатория для тестирования RCE в fastjson
Docker-среда и эксплойт для исследования уязвимости удаленного выполнения кода (RCE) в библиотеке fastjson версий 1.2.66–1.2.83.
Qwen3-Omni-30B-A3B-Instruct-AWQ-4bit
Квантованная 4-битная версия модели Qwen3-Omni-30B, оптимизированная для эффективного инференса.
Intern-S2-Preview-397B
Превью-версия масштабной языковой модели Intern-S2 с 397 миллиардами параметров от команды InternLM.
ArtiFixer от NVIDIA
NVIDIA представила новую модель ArtiFixer, разместив веса на платформе Hugging Face.
TiRex-2: Прогнозирование временных рядов
Модель для многомерного прогнозирования в режиме zero-shot, не требующая дообучения или fine-tuning на пользовательских данных.
GitHub
GitHub - powerycy/goutoujunshi: 一个先接住情绪、再分析关系并给出可执行策略的 Codex 恋爱军师,内置心理、法律、社会、人文、哲学、婚姻家庭与性学知识库,支持多元关系。
一个先接住情绪、再分析关系并给出可执行策略的 Codex 恋爱军师,内置心理、法律、社会、人文、哲学、婚姻家庭与性学知识库,支持多元关系。 - powerycy/goutoujunshi
🔥1
Контролируйте идеи, а не код
antirez объясняет, почему в эпоху LLM чтение сгенерированного кода стало неоптимальным занятием: гораздо важнее владеть идеями и дизайном софта, заниматься QA и описывать замысел на человеческом языке. Он честно признаёт, что сам всё ещё вычитывает код Redis — но считает это данью уважения к пользователям, а не полезной работой.
Читать статью
antirez объясняет, почему в эпоху LLM чтение сгенерированного кода стало неоптимальным занятием: гораздо важнее владеть идеями и дизайном софта, заниматься QA и описывать замысел на человеческом языке. Он честно признаёт, что сам всё ещё вычитывает код Redis — но считает это данью уважения к пользователям, а не полезной работой.
Читать статью
🔥1
Острые тезисы о памяти в AI
Разбор ключевых вопросов, вокруг которых спорят те, кто строит системы памяти для AI-агентов, с прогнозами по каждому: где место стартапам за пределами лабораторий, стоит ли работать в пространстве весов или токенов, и правда ли память — это просто задача поиска.
Читать статью
Разбор ключевых вопросов, вокруг которых спорят те, кто строит системы памяти для AI-агентов, с прогнозами по каждому: где место стартапам за пределами лабораторий, стоит ли работать в пространстве весов или токенов, и правда ли память — это просто задача поиска.
Читать статью
Собеседования инженеров в эпоху ИИ: уроки года перестройки
Coinbase перестроил процесс технических собеседований после того, как больше половины кода в компании стало генерироваться ИИ. Рассказ о трёх фазах этой работы: что изменили, что показали данные и что до сих пор остаётся нерешённым.
Читать статью
Coinbase перестроил процесс технических собеседований после того, как больше половины кода в компании стало генерироваться ИИ. Рассказ о трёх фазах этой работы: что изменили, что показали данные и что до сих пор остаётся нерешённым.
Читать статью
👍1