Недавно ребята из Anthropic выложили свое старое тестовое задание – «оптимизировать вычислительное ядро под специализированную архитектуру, имея на руках симулятор». Интересный проект сразу с нескольких точек зрения.
Во-первых, это просто классное тестовое задание. Инфровое, к тому же.
Во-вторых, это хороший пример герметичной системы и четко специфицированной цели с измеряемой метрикой – «минимизировать количество аппаратных циклов». Baseline: 147734 цикла.
И, наконец, это демонстрация реальных возможностей агентов сегодня. Квалифицированный программист, потратив время и погрузившись в задачу – 2262 цикла, плюс понимание куда можно копать дальше. Запущенный им агент, за вечер – 1333 цикла. Лучший на сегодня результат, полученный в публичном соревновании – 1001 цикл.
– @pgregory
Во-первых, это просто классное тестовое задание. Инфровое, к тому же.
Во-вторых, это хороший пример герметичной системы и четко специфицированной цели с измеряемой метрикой – «минимизировать количество аппаратных циклов». Baseline: 147734 цикла.
И, наконец, это демонстрация реальных возможностей агентов сегодня. Квалифицированный программист, потратив время и погрузившись в задачу – 2262 цикла, плюс понимание куда можно копать дальше. Запущенный им агент, за вечер – 1333 цикла. Лучший на сегодня результат, полученный в публичном соревновании – 1001 цикл.
– @pgregory
GitHub
GitHub - anthropics/original_performance_takehome: Anthropic's original performance take-home, now open for you to try!
Anthropic's original performance take-home, now open for you to try! - anthropics/original_performance_takehome
🔥9🤔2☃1🤩1🎅1🎄1
Друзья, микро-анонс – в пятницу в 14:30 буду рассказывать про software defined fuzzing на ТБ Форуме. Детали доклада спойлерить не буду – но должно получиться интересно и с упором на практику.
https://www.tbforum.ru/2026/program/rbpo-mk
– @pgregory
https://www.tbforum.ru/2026/program/rbpo-mk
– @pgregory
🔥5👍2☃1🎅1🎄1
Сегодня технический запуск CoreInfra AI Hub.
На круг друзей мы анонсируем наш сервис для доступа к фронтирным моделям и кодинг-агентам.
Механика супер простая:
создание кабинета в один клик, токен доступа уже готов, осталось пополнить баланс и начинать работать.
На текущий момент мы ограничились поддержкой Codex. Claude Code coming soon.
Разобраться супер просто, мы подготовили персонифицированную инструкцию.
Заходите познакомиться с сервисом и оставляйте фидбек.
https://hub.coreinfra.ai
Команда CoreInfra.
На круг друзей мы анонсируем наш сервис для доступа к фронтирным моделям и кодинг-агентам.
Механика супер простая:
создание кабинета в один клик, токен доступа уже готов, осталось пополнить баланс и начинать работать.
На текущий момент мы ограничились поддержкой Codex. Claude Code coming soon.
Разобраться супер просто, мы подготовили персонифицированную инструкцию.
Заходите познакомиться с сервисом и оставляйте фидбек.
https://hub.coreinfra.ai
Команда CoreInfra.
🎉12🔥5☃1🎅1🎄1
Я достаточно давно перестал пользоваться ChatGPT в интерфейсе веб-чата. Нет минусов использовать Codex и Claude Code для всего, а не только для программирования.
С использованием агента флоу получается очень простым: у меня есть директория, где я веду различные ресерчи в отдельных подпапках, делаю markdown документы, туда я могу накидать скриншотов, скинуть PDF-документ со счетом и т.д. В общем, пользуюсь всеми преимуществами локального окружения.
Это позволяет получить лучший результат по сравнению с веб-чатом, но и накладывает необходимость думать над harness. Какие есть инструменты у агента, как он ими может управлять, правильно ли все структурировано. Агенты хорошо справляются при one-shot, а чтобы повысить шанс на это, нужно подготовленное окружение с настроенными тулами и проработанный
Главное, что я получаю, это постепенное заполнение нужным контекстом и накопительный эффект. Я постепенно улучшаю обвязку, мои ресерчи становятся более структурированы, тулы становятся более удобными для агентов, а время на формулирование вопроса и задание рамок снижается.
Когда это длительный проект, то я работаю над ним, как над кодом, включая версионирование в git.
Если задуматься, то любой ресерч очень похож на работу с кодом. Нужно сформулировать проблему, сделать спецификацию на результат, продумать, как валидировать. Ничего не напоминает?
Everything is code, agent is the new computer.
– @tthread
С использованием агента флоу получается очень простым: у меня есть директория, где я веду различные ресерчи в отдельных подпапках, делаю markdown документы, туда я могу накидать скриншотов, скинуть PDF-документ со счетом и т.д. В общем, пользуюсь всеми преимуществами локального окружения.
Это позволяет получить лучший результат по сравнению с веб-чатом, но и накладывает необходимость думать над harness. Какие есть инструменты у агента, как он ими может управлять, правильно ли все структурировано. Агенты хорошо справляются при one-shot, а чтобы повысить шанс на это, нужно подготовленное окружение с настроенными тулами и проработанный
AGENTS.md который задает фрейм.Главное, что я получаю, это постепенное заполнение нужным контекстом и накопительный эффект. Я постепенно улучшаю обвязку, мои ресерчи становятся более структурированы, тулы становятся более удобными для агентов, а время на формулирование вопроса и задание рамок снижается.
Когда это длительный проект, то я работаю над ним, как над кодом, включая версионирование в git.
Если задуматься, то любой ресерч очень похож на работу с кодом. Нужно сформулировать проблему, сделать спецификацию на результат, продумать, как валидировать. Ничего не напоминает?
Everything is code, agent is the new computer.
– @tthread
🔥3🤔3☃1❤1👍1🎅1🎄1
Мега годный тред в X. Пост от Криса Латтнера (создатель LLVM, Clang, Swift) про Claude C Compiler.
И детальный write-up в статье от автора:
https://www.modular.com/blog/the-claude-c-compiler-what-it-reveals-about-the-future-of-software
И детальный write-up в статье от автора:
https://www.modular.com/blog/the-claude-c-compiler-what-it-reveals-about-the-future-of-software
❤2☃1👀1🎅1🎄1
Сегодня рассказываю про небольшую, но важную часть в CoreInfra AI Hub.
Главный инструмент управления ограниченным ресурсом — не делать вредного и не делать лишнего. Поэтому ко всем фичам мы подходим максимально внимательно, с точки зрения того, что мы даем пользователю и что требуем взамен.
Регистрация и авторизация — мы решили не подключать авторизацию Яндекс или Гугл потому что это не нужно, мы не хотим передавать информацию о наших пользователях третьей стороне, не хотим трекать и следить за пользователем, поэтому нет и трекеров, нет и сторонней авторизации.
Регистрация проходит через proof of work и не требует от пользователя никаких данных, нужно только нажать на кнопку. Для того чтобы авторизоваться на другом устройстве и сохранить доступ к профилю — достаточно пройти по ссылке или QR коду в созданном аккаунте.
Keep it simple.
– @tthread
Главный инструмент управления ограниченным ресурсом — не делать вредного и не делать лишнего. Поэтому ко всем фичам мы подходим максимально внимательно, с точки зрения того, что мы даем пользователю и что требуем взамен.
Регистрация и авторизация — мы решили не подключать авторизацию Яндекс или Гугл потому что это не нужно, мы не хотим передавать информацию о наших пользователях третьей стороне, не хотим трекать и следить за пользователем, поэтому нет и трекеров, нет и сторонней авторизации.
Регистрация проходит через proof of work и не требует от пользователя никаких данных, нужно только нажать на кнопку. Для того чтобы авторизоваться на другом устройстве и сохранить доступ к профилю — достаточно пройти по ссылке или QR коду в созданном аккаунте.
Keep it simple.
– @tthread
👍11❤3🎄2☃1🤩1🏆1🦄1
Модель оплаты, поговорим про деньги и как начать пользоваться AI Hub для программирования.
Подписка и pay as you go отличается для сервиса, кто зарабатывает деньги и для пользователя, который этим сервисом пользуется.
Сложно сказать, что однозначно лучше для обоих сторон, у каждого метода оплаты есть свои преимущества, как для одной, так и для другой стороны.
Для бизнеса подписка означает регулярные гарантированные платежи и позволяет более прогнозируемо считать ARR и другие финансовые метрики. Для пользователя — это способ установить порог трат, психологически для него комфортный и позволяет за счет неравномерности использования между пользователями иметь более выгодную цену.
Pay as you go более прозрачный для обоих сторон, поэтому мы решили с него начать. Этот способ максимально понятен, как для компаний так и для частных пользователей: не нужно платить за тех, кто не использует, не нужно платить когда ты не используешь.
Сейчас наша модель очень простая, пользователь пополняет баланс и деньги списываются по мере использования. Закинул и используешь.
Подписка это оптимизация, у нас будут появляться подписочные и комбинированные тарифы, но сейчас начинаем с простого и понятно для всех способа.
Напомню, что создать аккаунт можно в один клик по ссылке https://hub.coreinfra.ai
PS:
Это принцип, которого мы придерживаемся — даем то, что можем гарантировать.
- @tthread
Подписка и pay as you go отличается для сервиса, кто зарабатывает деньги и для пользователя, который этим сервисом пользуется.
Сложно сказать, что однозначно лучше для обоих сторон, у каждого метода оплаты есть свои преимущества, как для одной, так и для другой стороны.
Для бизнеса подписка означает регулярные гарантированные платежи и позволяет более прогнозируемо считать ARR и другие финансовые метрики. Для пользователя — это способ установить порог трат, психологически для него комфортный и позволяет за счет неравномерности использования между пользователями иметь более выгодную цену.
Pay as you go более прозрачный для обоих сторон, поэтому мы решили с него начать. Этот способ максимально понятен, как для компаний так и для частных пользователей: не нужно платить за тех, кто не использует, не нужно платить когда ты не используешь.
Сейчас наша модель очень простая, пользователь пополняет баланс и деньги списываются по мере использования. Закинул и используешь.
Подписка это оптимизация, у нас будут появляться подписочные и комбинированные тарифы, но сейчас начинаем с простого и понятно для всех способа.
Напомню, что создать аккаунт можно в один клик по ссылке https://hub.coreinfra.ai
PS:
Это принцип, которого мы придерживаемся — даем то, что можем гарантировать.
- @tthread
👍4🔥3☃1🎅1🎄1
ecrts04_tlsf.pdf
153.2 KB
Давно не скидывали клевых статей, надо это дело исправить. Встречайте: Two-Level Segregated Fit аллокатор.
Гарантирует O(1) аллокации/деаллокации (подходит для RTOS), простой и быстрый код, низкая фрагментация.
Бонус: похожий алгоритм, но для распределения произвольных ресурсов, например GPU буферов – хранит метаданные отдельно: https://github.com/sebbbi/OffsetAllocator
– @pgregory
Гарантирует O(1) аллокации/деаллокации (подходит для RTOS), простой и быстрый код, низкая фрагментация.
Бонус: похожий алгоритм, но для распределения произвольных ресурсов, например GPU буферов – хранит метаданные отдельно: https://github.com/sebbbi/OffsetAllocator
– @pgregory
🔥4👍2☃1🎅1🎄1
Хотите быть как Кнут, и использовать Claude Code + Opus 4.6?
Мы можем помочь – но только со второй частью :-) С сегодняшнего дня мы поддерживаем Claude Code в нашем хабе, вместе со всеми моделями Anthropic.
Регистрация в один клик, персональная инструкция для настройки агента, оплата через СБП, работа без VPN – все это теперь и для самого популярного кодинг-агента в мире.
https://hub.coreinfra.ai
Мы можем помочь – но только со второй частью :-) С сегодняшнего дня мы поддерживаем Claude Code в нашем хабе, вместе со всеми моделями Anthropic.
Регистрация в один клик, персональная инструкция для настройки агента, оплата через СБП, работа без VPN – все это теперь и для самого популярного кодинг-агента в мире.
https://hub.coreinfra.ai
🔥14🎅4🎄3😎2☃1😁1🎉1
“For a pseudo-random forest of identity-preserving reference modules, a pseudo-random stream of semantic items, and a pseudo-random schedule of host input chunking and external readiness events, the native F2 runtime is observationally equivalent to a simple identity model and always reaches quiescence under a bounded poll budget.”
Проектирую тесты вместе с GPT-5.4.
Вайбкодинг бывает разный. Делайте хороший вайбкодинг, плохой не делайте.
– @pgregory
💯4🎄2⚡1☃1😁1🤣1🎅1
Пятница – лучшее время для анонса классного проекта, с которым можно поиграться на выходных.
Скромно считаю, что уже сейчас это лучшая библиотека для property-based тестирования на Rust.
https://github.com/flyingmutant/chaos_theory
– @pgregory
chaos_theory – это библиотека одновременно и для классического property-based тестирования, и для структурного фаззинга. А также open-source ядро нашего программируемого полносистемного фаззера CoreInfra AT1, который мы уже несколько раз упоминали в постах и выступлениях.Скромно считаю, что уже сейчас это лучшая библиотека для property-based тестирования на Rust.
https://github.com/flyingmutant/chaos_theory
– @pgregory
GitHub
GitHub - flyingmutant/chaos_theory: chaos_theory is a modern Rust property-based testing and structure-aware fuzzing library
chaos_theory is a modern Rust property-based testing and structure-aware fuzzing library - flyingmutant/chaos_theory
🔥10🎄4☃3🤔3🎅3
Forwarded from Обучаем Камни
У Claude Code новая фича. Умный инит. Claude.md, hooks, skills и что-то еще генерит.
https://x.com/trq212/status/2035799806640115806
https://youtu.be/llwTBpPqo9A
https://x.com/trq212/status/2035799806640115806
https://youtu.be/llwTBpPqo9A
🔥5☃1👀1🎅1🎄1