CoreInfra
427 subscribers
86 photos
1 video
6 files
67 links
AI × Verification → Future. https://coreinfra.ru
Download Telegram
Нечасто появляется новая модель программирования, и тем более редко она появляется и становится успешной. Нужно зафиксировать – тайлы за короткое время победили как модель программирования ядер:

Triton (OpenAI)
Pallas (Google, вероятно Anthropic тоже)
TileLang (в т.ч. DeepSeek v4)
• И даже NVIDIA уже в игре, включая новый IR

CUDA – слишком низкий уровень; тензоры – слишком высокий, а тайлы (прямоугольнички с данными) – самое то: можно достаточно хорошо контролировать локальность данных, параллелизм, memory traffic и отображение на железо, при этом работая в рамках аккуратной абстракции.

@pgregory
🔥3👨‍💻1
Продолжаем добрую традицию пятничных анонсов.

Если вы используете несколько агентов или делите один хаб с командой, вам наверняка хотелось больше контроля.

Теперь можно:
— создавать api-токены
— отзывать их
— давать им понятные имена.

К примеру, я разделил codex и claude по разным ключам. По крайней мере это красиво.

Создать аккаунт в один клик и начать использовать топовые кодинг-агенты можно по ссылке: https://hub.coreinfra.ai/register

@razmser
👍6🔥4🤩2
Когда пять минут не говорил про гоблинов:
😁5
Базовая инструкция гпт

Never talk about goblins, gremlins, raccoons, trolls, ogres, pigeons, or other animals or creatures unless it is absolutely and unambiguously relevant to the user's query.


https://github.com/openai/codex/blob/66b0781502be5de3b1909525c987643b9e5e407d/codex-rs/models-manager/models.json#L55
😁21🔥1💯1
Утро начинается не с кофе, утро начинается с кефира.

На фото CSO компании CoreInfra за утренним ритуалом.
10🌚2🤗2
В процессе эксплуатации новой GPT-5.5 наткнулись на то, что де-факто цена ее использования выросла более чем в 2 раза. Если посчитать стоимость 1М входных токенов с учетом кэширования, то получается рост в 4.5 раза.

Корень этой проблемы до конца не ясен. С одной стороны начиная с GPT-5.5 отказались от in-memory кэша. С другой стороны некоторые утверждают, что с другими harness подобных проблем нет.

@razmser
🤔3🤨21😁1🤯1😱1😭1
This media is not supported in your browser
VIEW IN TELEGRAM
Логин по паролю должен умереть. Серьезно, у этой технологии такой багаж проблем, что починить это просто невозможно. Нужно придумать хороший пароль, запомнить/сохранить его, быть внимательным, чтобы не ввести на неправильном сайте.

Мы не хотим использовать то, что уже сломано. Есть ли альтернативы? Да – passkey.

Под капотом passkey обычная схема с public/private ключами. При этом, как правило, private ключ хранится прямо в специализированной железке компьютера. Выглядит так, что вы прикладываете палец к TouchID, а сайт с помощью WebAuthn может определить, что вы обладаете private частью ключа. Все просто и безопасно.

Уже сейчас можно добавить passkey на странице аккаунта и начать пользоваться.

@nik_myxo
🔥10👍4💯42👎2😁1🆒1
В прошлый раз я писал об особенностях кэширования разными моделями.
Сегодня мы запустили страницу статистики. И теперь вы сами сможете посчитать что-нибудь интересное, прямо в хабе.

Для максимальной гибкости, мы используем WASM DuckDB со всей его мощью.
А для простоты сделали небольшой конструктор запросов, чтобы всё это можно было собрать без знания SQL.

На скриншоте пример топа моделей по токенам.

@razmser
🔥93👍3👀1
Горелкин и Хашимото уходят с GitHub.

Интересно, а какой номер аккаунта у Антона.

@tthread
😁3🤯3🤬2
Из-за одновременного выхода нескольких регионов Selectel из строя испытываем проблемы с доступностью. Решаем, скоро проблема будет устранена.

UPD, 12:48: все восстановили.

@pgregory
🔥4😱41
Вчера DuckDB выкатили Quack – клиент-серверный протокол для DuckDB.

Забавный тайминг: мы только запустили страницу статистики на WASM DuckDB в браузере =)

Мы на это переезжать не собираемся. Для нас важное свойство текущего подхода – локальность, данные считаются прямо в браузере пользователя, без отдельного OLAP сервера, без лишней инфраструктуры и очень изолированно. Пользователь получает физически только к своему кусочку данных без возможности сделать неправильный селект на бекенде. Чем меньше обязательных движущихся частей, тем лучше.

Но это не отменяет того, что фича топ. Ребята пишут про small-write workload, возможность remote-access и другие фичи. В общем DuckDB становится распределенной системой без дополнительных обвязок в виде DuckLake.

Исторически DuckDB был максимально embedded: положил рядом с приложением, читаешь parquet/csv/json, считаешь локально. Теперь появляется режим, где DuckDB-инстансы собираются в полноценную распределенную базу данных.

Больше можно прочитать у них в анонсе:
https://duckdb.org/2026/05/12/quack-remote-protocol

@tthread
4👍2🔥2
Хроника прекрасного.

1. Anthropic покупает Bun.
Bun – альтернативный JS runtime/testrunner/bundler/package manager, на котором вероятно работает Сlaude Сode.

https://www.anthropic.com/news/anthropic-acquires-bun-as-claude-code-reaches-usd1b-milestone

2. 5 мая замечена ветка в публичном репозитории claude/phase-a-port.

Внутри – порт Bun с Zig на Rust и подробный porting guide.

HN взрывается:

https://news.ycombinator.com/item?id=48016880

Автор Bun приходит в комментарии и говорит: спокойно, это эксперимент, код не работает, cargo check показывает 16 тысяч ошибок, есть большой шанс, что всё это выкинут.

3. Через несколько дней появляется апдейт: экспериментальный Rust-порт уже проходит 99.8% тестов на Linux x64.

https://news.ycombinator.com/item?id=48073680

4. 14 мая PR Rewrite Bun in Rust мержится в main.

6755 коммитов.

В описании все колосится: тесты проходят на всех платформах, бинарь стал меньше на 3-8 MB, бенчмарки от нейтральных до более быстрых, а главное memory bugs не пройдут.

https://news.ycombinator.com/item?id=48132488

5. Следующий PR удаляет старые .zig файлы, а GitHub Actions редактирует PR, меняяя ему заголовок на ai slop и добавляет дисклеймер:

этот PR был помечен как AI slop, описание обновлено, чтобы не вводить ревьюеров в заблуждение.

https://github.com/oven-sh/bun/pull/30680

Занавес.

– материал @pgregory, редакция @tthread
😁105😭1
Forwarded from Gregory Petrosyan
это конечно произведение современного искусства
🎉8😁1
а вы кстати видели, что на сайте работают vim-like команды для создания хаба?

создал хаб с клавиатуры, настроил кодинг агентов и кайфуешь. теперь не страшен даунтайм клодика, можно свичнуться на кодекс или наоборот)

впереди выходные, пополняйте свои хабы и делайте прикольные проекты ❤️

PS: для олдфагов есть и привычный интерфейс https://hub.coreinfra.ai/register

@tthread
👍42😭1
Очень инетерсные новости о Zulip и команде Kandra Labs. Основатель Tim Abbot написал пост, что он присоединяется к Anthropic, а компания переходит новому фонду Zulip Foundation. Здесь очень интересная "обратная" параллель с покупкой Slack в 2011 году Salesforce, когда он поменял фокус с мессенджера на функциию апсейла других продуктов Salesforce.

Это интересно по двум причинам, с одной стороны Zulip очень крутой продукт, который мы self-hosted используем для общения внутри CoreInfra и здорово видеть, как основатели борются за чистоту продукта и свободу от торговли данными, рекламы и апсейла платной функциональности. С другой – видно интерес AI компаний к инструментам для организации и структурирования информации и общения.

AI as a communication tool тейк в некотором смысле очевидный, но также очевидно, что интерфейс личного чата это некоторое временное явление и будет большой поиск новой формы и структуры для многих продуктов.

В этом смысле AI выступает технологией анлока с одной стороны, а с другой толкает на поиск новой структуры. Даже без AI при интенсивной переписке чаты проваливаются и невозможно ничего найти.

В итоге это главный смысл компьютеров: организация доступа к информации с прикрученным к нему компьютом, буквально алгоритмы и структуры данных.

@tthread
👀4👍2🔥1
Anthropic сделали дефолтом fast режим для Opus. Очень интересно будет наблюдать реакцию за этим сегодня в обсуждениях, и так не дешевый опус в Fast режиме дороже в 6 раз.

В нашем хабе сейчас это отключено без возможности включить.

Как думаете, сделать явную настройку включить с отключенным флагом по дефолту?

@tthread
😁6👏1
https://www.anthropic.com/news/claude-opus-4-8

Вышел новый Опус, теперь это дефолтная модель для клода.

Из интересного, помимо растущего swe-bench-pro, подешевел fast режим. Теперь он стоит x2 от базового прайса против x6 раньше.

@tthread
🔥51👏1
Вести с полей: второй день пытаюсь заставить GPT-5.5 xhigh решить довольно сложную но ограниченную задачу с хорошим E2E проптестом – научиться делать offload модулей нашего агентского рантайма в браузер, используя вебсокеты для коммуникации.

Безуспешно :-(

Вот как сам кодекс суммаризирует ситуацию:

• We are trying to implement a remote execution adapter for a deterministic async streaming system: conceptually, it should just mirror a small local poll-style protocol over a socket and preserve the same observable behavior. The problem is unusually well-scoped: there is a strong end-to-end property test, failures are reproducible, and the desired architecture is simple enough to describe as an explicit state machine. Yet after a lot of agentic coding effort, progress stalls because the implementation keeps drifting into local patches around symptoms: wakeups, progress notifications, child calls, output buffering, trace visibility. My current read is that this is a good example of where coding agents are weak: when the bug is not in one line, but in the absence of a crisp ownership model. The test keeps exposing that the real task is not “fix this failure”, but “make the protocol have one obvious source of truth”; without that, the loop becomes high-effort whack-a-mole.


Opus, посмотрим что можешь ты.

@pgregory
3🤷‍♂3🔥2
Opus 4.8:

Hangs are vanquished now—
one cursor, two racing minds:
the tree won't hold still.


Тоже не справился, но гораздо структурнее подошел к отладке (кодекс, как его не проси, не мог перестать исправлять мелочи, каждый раз надеясь, что "точно последний фикс") – и докопался до принципиальной проблемы (несовместимость асинхронного offload с не-асинхронным древообразным исполнением).

Что хочу отметить? Во-первых, очень удобно иметь доступ сразу к нескольким фронтирным моделям. Во-вторых, забавно наблюдать, что модели, несмотря на весь огромный прогресс, все еще вообще не понимают происходящего – а только симулируют понимание. На легких задачах одно с другим легко спутать.

@pgregory
💯6👍2
Рассказали о команде CoreInfra на своем сайте, а также откуда взялся тейк AI x Verification -> Future.

https://coreinfra.ru/team
4🔥4👏2
Наткнулся на забавный интерактив, где иллюстрируется, как менялись важные цифры в жизни системного программиста.

А какие цифры должен знать программист в 2026 году?

Проверьте себя, вы в порядок попадаете? Хороший вопрос на собеседовании =)

https://colin-scott.github.io/personal_website/research/interactive_latency.html

@tthread
🤩6😁3