Нечасто появляется новая модель программирования, и тем более редко она появляется и становится успешной. Нужно зафиксировать – тайлы за короткое время победили как модель программирования ядер:
• Triton (OpenAI)
• Pallas (Google, вероятно Anthropic тоже)
• TileLang (в т.ч. DeepSeek v4)
• И даже NVIDIA уже в игре, включая новый IR
CUDA – слишком низкий уровень; тензоры – слишком высокий, а тайлы (прямоугольнички с данными) – самое то: можно достаточно хорошо контролировать локальность данных, параллелизм, memory traffic и отображение на железо, при этом работая в рамках аккуратной абстракции.
– @pgregory
• Triton (OpenAI)
• Pallas (Google, вероятно Anthropic тоже)
• TileLang (в т.ч. DeepSeek v4)
• И даже NVIDIA уже в игре, включая новый IR
CUDA – слишком низкий уровень; тензоры – слишком высокий, а тайлы (прямоугольнички с данными) – самое то: можно достаточно хорошо контролировать локальность данных, параллелизм, memory traffic и отображение на железо, при этом работая в рамках аккуратной абстракции.
– @pgregory
🔥3👨💻1
Продолжаем добрую традицию пятничных анонсов.
Если вы используете несколько агентов или делите один хаб с командой, вам наверняка хотелось больше контроля.
Теперь можно:
— создавать api-токены
— отзывать их
— давать им понятные имена.
К примеру, я разделил codex и claude по разным ключам. По крайней мере это красиво.
Создать аккаунт в один клик и начать использовать топовые кодинг-агенты можно по ссылке: https://hub.coreinfra.ai/register
– @razmser
Если вы используете несколько агентов или делите один хаб с командой, вам наверняка хотелось больше контроля.
Теперь можно:
— создавать api-токены
— отзывать их
— давать им понятные имена.
К примеру, я разделил codex и claude по разным ключам. По крайней мере это красиво.
Создать аккаунт в один клик и начать использовать топовые кодинг-агенты можно по ссылке: https://hub.coreinfra.ai/register
– @razmser
👍6🔥4🤩2
Forwarded from Обучаем Камни
Базовая инструкция гпт
https://github.com/openai/codex/blob/66b0781502be5de3b1909525c987643b9e5e407d/codex-rs/models-manager/models.json#L55
Never talk about goblins, gremlins, raccoons, trolls, ogres, pigeons, or other animals or creatures unless it is absolutely and unambiguously relevant to the user's query.
https://github.com/openai/codex/blob/66b0781502be5de3b1909525c987643b9e5e407d/codex-rs/models-manager/models.json#L55
GitHub
codex/codex-rs/models-manager/models.json at 66b0781502be5de3b1909525c987643b9e5e407d · openai/codex
Lightweight coding agent that runs in your terminal - openai/codex
😁2❤1🔥1💯1
В процессе эксплуатации новой GPT-5.5 наткнулись на то, что де-факто цена ее использования выросла более чем в 2 раза. Если посчитать стоимость 1М входных токенов с учетом кэширования, то получается рост в 4.5 раза.
Корень этой проблемы до конца не ясен. С одной стороны начиная с GPT-5.5 отказались от in-memory кэша. С другой стороны некоторые утверждают, что с другими harness подобных проблем нет.
– @razmser
Корень этой проблемы до конца не ясен. С одной стороны начиная с GPT-5.5 отказались от in-memory кэша. С другой стороны некоторые утверждают, что с другими harness подобных проблем нет.
– @razmser
🤔3🤨2❤1😁1🤯1😱1😭1
This media is not supported in your browser
VIEW IN TELEGRAM
Логин по паролю должен умереть. Серьезно, у этой технологии такой багаж проблем, что починить это просто невозможно. Нужно придумать хороший пароль, запомнить/сохранить его, быть внимательным, чтобы не ввести на неправильном сайте.
Мы не хотим использовать то, что уже сломано. Есть ли альтернативы? Да – passkey.
Под капотом passkey обычная схема с public/private ключами. При этом, как правило, private ключ хранится прямо в специализированной железке компьютера. Выглядит так, что вы прикладываете палец к TouchID, а сайт с помощью WebAuthn может определить, что вы обладаете private частью ключа. Все просто и безопасно.
Уже сейчас можно добавить passkey на странице аккаунта и начать пользоваться.
– @nik_myxo
Мы не хотим использовать то, что уже сломано. Есть ли альтернативы? Да – passkey.
Под капотом passkey обычная схема с public/private ключами. При этом, как правило, private ключ хранится прямо в специализированной железке компьютера. Выглядит так, что вы прикладываете палец к TouchID, а сайт с помощью WebAuthn может определить, что вы обладаете private частью ключа. Все просто и безопасно.
Уже сейчас можно добавить passkey на странице аккаунта и начать пользоваться.
– @nik_myxo
🔥10👍4💯4❤2👎2😁1🆒1
В прошлый раз я писал об особенностях кэширования разными моделями.
Сегодня мы запустили страницу статистики. И теперь вы сами сможете посчитать что-нибудь интересное, прямо в хабе.
Для максимальной гибкости, мы используем WASM DuckDB со всей его мощью.
А для простоты сделали небольшой конструктор запросов, чтобы всё это можно было собрать без знания SQL.
На скриншоте пример топа моделей по токенам.
– @razmser
Сегодня мы запустили страницу статистики. И теперь вы сами сможете посчитать что-нибудь интересное, прямо в хабе.
Для максимальной гибкости, мы используем WASM DuckDB со всей его мощью.
А для простоты сделали небольшой конструктор запросов, чтобы всё это можно было собрать без знания SQL.
На скриншоте пример топа моделей по токенам.
– @razmser
🔥9❤3👍3👀1
Вчера DuckDB выкатили Quack – клиент-серверный протокол для DuckDB.
Забавный тайминг: мы только запустили страницу статистики на WASM DuckDB в браузере =)
Мы на это переезжать не собираемся. Для нас важное свойство текущего подхода – локальность, данные считаются прямо в браузере пользователя, без отдельного OLAP сервера, без лишней инфраструктуры и очень изолированно. Пользователь получает физически только к своему кусочку данных без возможности сделать неправильный селект на бекенде. Чем меньше обязательных движущихся частей, тем лучше.
Но это не отменяет того, что фича топ. Ребята пишут про small-write workload, возможность remote-access и другие фичи. В общем DuckDB становится распределенной системой без дополнительных обвязок в виде DuckLake.
Исторически DuckDB был максимально embedded: положил рядом с приложением, читаешь parquet/csv/json, считаешь локально. Теперь появляется режим, где DuckDB-инстансы собираются в полноценную распределенную базу данных.
Больше можно прочитать у них в анонсе:
https://duckdb.org/2026/05/12/quack-remote-protocol
– @tthread
Забавный тайминг: мы только запустили страницу статистики на WASM DuckDB в браузере =)
Мы на это переезжать не собираемся. Для нас важное свойство текущего подхода – локальность, данные считаются прямо в браузере пользователя, без отдельного OLAP сервера, без лишней инфраструктуры и очень изолированно. Пользователь получает физически только к своему кусочку данных без возможности сделать неправильный селект на бекенде. Чем меньше обязательных движущихся частей, тем лучше.
Но это не отменяет того, что фича топ. Ребята пишут про small-write workload, возможность remote-access и другие фичи. В общем DuckDB становится распределенной системой без дополнительных обвязок в виде DuckLake.
Исторически DuckDB был максимально embedded: положил рядом с приложением, читаешь parquet/csv/json, считаешь локально. Теперь появляется режим, где DuckDB-инстансы собираются в полноценную распределенную базу данных.
Больше можно прочитать у них в анонсе:
https://duckdb.org/2026/05/12/quack-remote-protocol
– @tthread
❤4👍2🔥2
Хроника прекрасного.
1. Anthropic покупает Bun.
Bun – альтернативный JS runtime/testrunner/bundler/package manager, на котором вероятно работает Сlaude Сode.
https://www.anthropic.com/news/anthropic-acquires-bun-as-claude-code-reaches-usd1b-milestone
2. 5 мая замечена ветка в публичном репозитории claude/phase-a-port.
Внутри – порт Bun с Zig на Rust и подробный porting guide.
HN взрывается:
https://news.ycombinator.com/item?id=48016880
Автор Bun приходит в комментарии и говорит: спокойно, это эксперимент, код не работает, cargo check показывает 16 тысяч ошибок, есть большой шанс, что всё это выкинут.
3. Через несколько дней появляется апдейт: экспериментальный Rust-порт уже проходит 99.8% тестов на Linux x64.
https://news.ycombinator.com/item?id=48073680
4. 14 мая PR Rewrite Bun in Rust мержится в main.
6755 коммитов.
В описании все колосится: тесты проходят на всех платформах, бинарь стал меньше на 3-8 MB, бенчмарки от нейтральных до более быстрых, а главное memory bugs не пройдут.
https://news.ycombinator.com/item?id=48132488
5. Следующий PR удаляет старые .zig файлы, а GitHub Actions редактирует PR, меняяя ему заголовок на ai slop и добавляет дисклеймер:
этот PR был помечен как AI slop, описание обновлено, чтобы не вводить ревьюеров в заблуждение.
https://github.com/oven-sh/bun/pull/30680
Занавес.
– материал @pgregory, редакция @tthread
1. Anthropic покупает Bun.
Bun – альтернативный JS runtime/testrunner/bundler/package manager, на котором вероятно работает Сlaude Сode.
https://www.anthropic.com/news/anthropic-acquires-bun-as-claude-code-reaches-usd1b-milestone
2. 5 мая замечена ветка в публичном репозитории claude/phase-a-port.
Внутри – порт Bun с Zig на Rust и подробный porting guide.
HN взрывается:
https://news.ycombinator.com/item?id=48016880
Автор Bun приходит в комментарии и говорит: спокойно, это эксперимент, код не работает, cargo check показывает 16 тысяч ошибок, есть большой шанс, что всё это выкинут.
3. Через несколько дней появляется апдейт: экспериментальный Rust-порт уже проходит 99.8% тестов на Linux x64.
https://news.ycombinator.com/item?id=48073680
4. 14 мая PR Rewrite Bun in Rust мержится в main.
6755 коммитов.
В описании все колосится: тесты проходят на всех платформах, бинарь стал меньше на 3-8 MB, бенчмарки от нейтральных до более быстрых, а главное memory bugs не пройдут.
https://news.ycombinator.com/item?id=48132488
5. Следующий PR удаляет старые .zig файлы, а GitHub Actions редактирует PR, меняяя ему заголовок на ai slop и добавляет дисклеймер:
этот PR был помечен как AI slop, описание обновлено, чтобы не вводить ревьюеров в заблуждение.
https://github.com/oven-sh/bun/pull/30680
Занавес.
– материал @pgregory, редакция @tthread
😁10❤5😭1
а вы кстати видели, что на сайте работают vim-like команды для создания хаба?
создал хаб с клавиатуры, настроил кодинг агентов и кайфуешь. теперь не страшен даунтайм клодика, можно свичнуться на кодекс или наоборот)
впереди выходные, пополняйте свои хабы и делайте прикольные проекты ❤️
PS: для олдфагов есть и привычный интерфейс https://hub.coreinfra.ai/register
– @tthread
создал хаб с клавиатуры, настроил кодинг агентов и кайфуешь. теперь не страшен даунтайм клодика, можно свичнуться на кодекс или наоборот)
впереди выходные, пополняйте свои хабы и делайте прикольные проекты ❤️
PS: для олдфагов есть и привычный интерфейс https://hub.coreinfra.ai/register
– @tthread
👍4❤2😭1
Очень инетерсные новости о Zulip и команде Kandra Labs. Основатель Tim Abbot написал пост, что он присоединяется к Anthropic, а компания переходит новому фонду Zulip Foundation. Здесь очень интересная "обратная" параллель с покупкой Slack в 2011 году Salesforce, когда он поменял фокус с мессенджера на функциию апсейла других продуктов Salesforce.
Это интересно по двум причинам, с одной стороны Zulip очень крутой продукт, который мы self-hosted используем для общения внутри CoreInfra и здорово видеть, как основатели борются за чистоту продукта и свободу от торговли данными, рекламы и апсейла платной функциональности. С другой – видно интерес AI компаний к инструментам для организации и структурирования информации и общения.
AI as a communication tool тейк в некотором смысле очевидный, но также очевидно, что интерфейс личного чата это некоторое временное явление и будет большой поиск новой формы и структуры для многих продуктов.
В этом смысле AI выступает технологией анлока с одной стороны, а с другой толкает на поиск новой структуры. Даже без AI при интенсивной переписке чаты проваливаются и невозможно ничего найти.
В итоге это главный смысл компьютеров: организация доступа к информации с прикрученным к нему компьютом, буквально алгоритмы и структуры данных.
– @tthread
Это интересно по двум причинам, с одной стороны Zulip очень крутой продукт, который мы self-hosted используем для общения внутри CoreInfra и здорово видеть, как основатели борются за чистоту продукта и свободу от торговли данными, рекламы и апсейла платной функциональности. С другой – видно интерес AI компаний к инструментам для организации и структурирования информации и общения.
AI as a communication tool тейк в некотором смысле очевидный, но также очевидно, что интерфейс личного чата это некоторое временное явление и будет большой поиск новой формы и структуры для многих продуктов.
В этом смысле AI выступает технологией анлока с одной стороны, а с другой толкает на поиск новой структуры. Даже без AI при интенсивной переписке чаты проваливаются и невозможно ничего найти.
В итоге это главный смысл компьютеров: организация доступа к информации с прикрученным к нему компьютом, буквально алгоритмы и структуры данных.
– @tthread
👀4👍2🔥1
Anthropic сделали дефолтом fast режим для Opus. Очень интересно будет наблюдать реакцию за этим сегодня в обсуждениях, и так не дешевый опус в Fast режиме дороже в 6 раз.
В нашем хабе сейчас это отключено без возможности включить.
Как думаете, сделать явную настройку включить с отключенным флагом по дефолту?
– @tthread
В нашем хабе сейчас это отключено без возможности включить.
Как думаете, сделать явную настройку включить с отключенным флагом по дефолту?
– @tthread
😁6👏1
https://www.anthropic.com/news/claude-opus-4-8
Вышел новый Опус, теперь это дефолтная модель для клода.
Из интересного, помимо растущего swe-bench-pro, подешевел fast режим. Теперь он стоит x2 от базового прайса против x6 раньше.
– @tthread
Вышел новый Опус, теперь это дефолтная модель для клода.
Из интересного, помимо растущего swe-bench-pro, подешевел fast режим. Теперь он стоит x2 от базового прайса против x6 раньше.
– @tthread
🔥5❤1👏1
Вести с полей: второй день пытаюсь заставить GPT-5.5 xhigh решить довольно сложную но ограниченную задачу с хорошим E2E проптестом – научиться делать offload модулей нашего агентского рантайма в браузер, используя вебсокеты для коммуникации.
Безуспешно :-(
Вот как сам кодекс суммаризирует ситуацию:
Opus, посмотрим что можешь ты.
– @pgregory
Безуспешно :-(
Вот как сам кодекс суммаризирует ситуацию:
• We are trying to implement a remote execution adapter for a deterministic async streaming system: conceptually, it should just mirror a small local poll-style protocol over a socket and preserve the same observable behavior. The problem is unusually well-scoped: there is a strong end-to-end property test, failures are reproducible, and the desired architecture is simple enough to describe as an explicit state machine. Yet after a lot of agentic coding effort, progress stalls because the implementation keeps drifting into local patches around symptoms: wakeups, progress notifications, child calls, output buffering, trace visibility. My current read is that this is a good example of where coding agents are weak: when the bug is not in one line, but in the absence of a crisp ownership model. The test keeps exposing that the real task is not “fix this failure”, but “make the protocol have one obvious source of truth”; without that, the loop becomes high-effort whack-a-mole.
Opus, посмотрим что можешь ты.
– @pgregory
❤3🤷♂3🔥2
Opus 4.8:
Тоже не справился, но гораздо структурнее подошел к отладке (кодекс, как его не проси, не мог перестать исправлять мелочи, каждый раз надеясь, что "точно последний фикс") – и докопался до принципиальной проблемы (несовместимость асинхронного offload с не-асинхронным древообразным исполнением).
Что хочу отметить? Во-первых, очень удобно иметь доступ сразу к нескольким фронтирным моделям. Во-вторых, забавно наблюдать, что модели, несмотря на весь огромный прогресс, все еще вообще не понимают происходящего – а только симулируют понимание. На легких задачах одно с другим легко спутать.
– @pgregory
Hangs are vanquished now—
one cursor, two racing minds:
the tree won't hold still.
Тоже не справился, но гораздо структурнее подошел к отладке (кодекс, как его не проси, не мог перестать исправлять мелочи, каждый раз надеясь, что "точно последний фикс") – и докопался до принципиальной проблемы (несовместимость асинхронного offload с не-асинхронным древообразным исполнением).
Что хочу отметить? Во-первых, очень удобно иметь доступ сразу к нескольким фронтирным моделям. Во-вторых, забавно наблюдать, что модели, несмотря на весь огромный прогресс, все еще вообще не понимают происходящего – а только симулируют понимание. На легких задачах одно с другим легко спутать.
– @pgregory
💯6👍2
Рассказали о команде CoreInfra на своем сайте, а также откуда взялся тейк AI x Verification -> Future.
https://coreinfra.ru/team
https://coreinfra.ru/team
❤4🔥4👏2
Наткнулся на забавный интерактив, где иллюстрируется, как менялись важные цифры в жизни системного программиста.
А какие цифры должен знать программист в 2026 году?
Проверьте себя, вы в порядок попадаете? Хороший вопрос на собеседовании =)
https://colin-scott.github.io/personal_website/research/interactive_latency.html
– @tthread
А какие цифры должен знать программист в 2026 году?
Проверьте себя, вы в порядок попадаете? Хороший вопрос на собеседовании =)
https://colin-scott.github.io/personal_website/research/interactive_latency.html
– @tthread
🤩6😁3