KertexNotes
26 subscribers
24 photos
1 video
86 links
Всё, что может быть интересно не только мне
Download Telegram
Ребята из Voltropy сделали LCM - полезный инструмент для улучшения работы LLM с длинными контекстами.

Вместо того чтобы просить модель кратко пересказать весь предыдущий диалог своими словами и выкидывать все подробности для очистки контекстного окна, они предлагают эти подробности сохранять в виде дерева.

Корнем дерева является самый общий пересказ. От него можно спуститься по пересказам всё более мелких кусков до точных копий сообщений из исходного чата.

Чтобы нейросеть могла достать из контекстного архива то, что ей нужно, ей предоставляются инструменты вроде lcm_grep для поиска исходных сообщений и lcm_expand для спуска на более низкий уровень обобщения.

Этот подход уже внедрили в openclaw, ждём когда и остальные агентные системы подтянутся.

#ai #code
👍1
Пробую платный deep research в perplexity.ai. Нравится. Такой let me google that for you, только дружелюбный 🙃

Результаты можно скачать pdfкой. Умеет смотреть, что на картинке или в приложенных файлах.

Накопал себе материалов для пет-проектов, вероятность, что хоть какой-нибудь из них когда-нибудь воплотится серьёзно повысилась 😁

#ai
🔥2👍1
Дошли руки сравнить qwen3.5 35b и 122b.

Сравнивал на своей рабочей задаче, которая хороша тем, что она крайне нишевая и к ней нет готовых ответов в интернете.

Менее квантизованая модель заметно умнее, но, естественно, и заметно медленнее. В итоге оставлю обе, старые qwen3-next-coder, qwen3-vl и gpt-oss:120b удалил.

#ai #code
👍2
В перплексити есть режим "learn step by step". Решил подтянуть английскую грамматику с его помощью.

В принципе, неплохо. Прикольно, что можно не просто давать ответ, а объяснять почему ты так решил, и нейросеть может оценить ход рассуждений и обратить внимание на нюансы.

Из шероховатостей, по умолчанию, система сама решает какую нейросеть использовать, и они меняются по ходу диалога: тест может составить одна, а проверять его будет другая. Причём она может предлагать правильный вариант не предусмотренный заданием 😂

Скорее всего это решается просто ручным выбором нейросети на весь диалог. 🤔

#ai #education
👍1😁1
KertexNotes
Ожидания от обучения слепой печати: я буду быстрее печатать с меньшим количеством ошибок. Реальность: появляются мысли купить эргономическую клавиатуру 😂 Игрушку, кстати, рекомендую: за примерно 24 часа игры, растянутых на месяц, английскую раскладку я освоил…
Когда база слепой печати уже есть, прокачиваться дальше прикольно с TypInc.

Нужно продержаться 30 игровых дней-раундов, набирая всё больше и больше очков печатая тексты, и выбирая бонусы манипулирующие подсчётом. На удивление залипательно.

Особенно радует, что тексты не случайные, а выдержки из английской классики, которую раньше не читал. Получается, что пока играешь, прочитываешь демо версии известных книг, которые возможно захочется прочитать полностью. Ну и, как минимум, словарный запас можно расширить 😁

Часа за 3 получилось поднять скорость печати до 250 символов в минуту при 97.5% без ошибок.

#education #games
🔥2
Наткнулся на канал легенды хабра milfgard. Ссылка на пост с разбором Пушкина - 🔥
👍1
Forwarded from Красные пики (Serge Abdulmanov)
Как-то так получилось, что Пушкин вроде сделал русский язык русским. Поэтому он не только очень успешный дуэлянт с уровнем побед 96,5%, но и замечательный писатель.

Про то, что именно крутого сделал Пушкин, я как-то объяснял вот здесь в разборе "Пиковой дамы".

Но русский язык меняло очень много людей. И там было дофига этапов — тот же Чехов, например, в какой-то момент повыкидывал всё лишнее. Карамзин ещё до Пушкина избавился от мегапафоса и начал писать в разговорном стиле. И ещё принёс длинное тире и ё, ага. Державин дал инструменты, чтобы Пушкин выстрелил. Достоевский придумал, что автор — не главный в произведении, и кроме блогов появились другие жанры.

Если начать копаться, можно узнать много нового и интересного. Если это ещё сопоставить с мировыми событиями — ещё больше.

Мне хотелось разобраться, и пока я представлял, как это будет удобнее читать, мы взяли и запилили страницу, где можно поковыряться со всем этим:

https://awarness.ru/russian-lit/

От Ломоносова до Шнура и вообще.

Там можно просто почитать, как оно, а можно залипнуть минут на 20 в тесты, приколы и пасхалки. В разворачиваемых блоках пруфы и больше деталей, но можно и не разворачивать.

Чем больше я смотрю на так упакованные научные отчёты — с интерактивами, мини-играми и прочим — тем больше понимаю, что так что-то узнавать очень прикольно. И да, если хотите, чтобы мы сделали подобную страницу вам по вашей теме (например, если вы Росатом) — вот ещё пример для Айкадеми про нейросети.
🔥1
Когда зима достаточно снежная, весной может внезапно оказаться, что всё это время ты ходил прямо над лавочкой 😂

#joke
😁3
окей тут такое

модель на 4B параметров обогнала GPT-5 и Claude Sonnet 4.5 на Text-to-SQL и QA. четыре миллиарда. не четыреста, не сорок — четыре

статья "Learning to Self-Evolve" (2603.18620) — RL-фреймворк который учит модель улучшать собственный контекст прямо во время инференса. tree-guided evolution loop, если по-научному

что происходит: модель получает задачу, генерирует несколько вариантов контекста (промпт + подсказки + примеры), оценивает их, выбирает лучший и итерирует. по сути учится делать промпт-инжиниринг сама для себя

и вот эта крошечная модель обученная таким методом бьёт фронтирные модели которые в 100+ раз больше

мой тейк: мы слишком зациклились на скейлинге параметров. да, большие модели мощнее. но если маленькая модель умеет правильно думать о том КАК думать — она может компенсировать разницу в размере

это не первый такой сигнал. test-time compute scaling уже показывал себя в o1/o3, но тут другое — модель не просто "думает дольше", а активно перестраивает свой рабочий контекст

ощущение что через год мы будем запускать 7B модели которые решают задачи уровня GPT-5 просто за счёт умного self-prompting. звучит безумно но год назад и текущая ситуация звучала безумно

arxiv.org/abs/2603.18620
👍1
Случайно заглянул в спам папку в почте, а там уведомление о замене госномера дрона от росавиации, мог пропустить 😬

У них, кстати, оказывается, и канал в телеграме есть. 😁

В нём пишут, что таки да, нужно покупать глонас-трекер на все дроны от 250г. 😩 Сколько он, интересно, сам весит? 🤔

В общем, не забываем проверять спам хотя бы пару раз в месяц...

#fail #drones
👍1😢1
Настоящая причина блокировок telegram: это просто массовый курс повышения квалификации населения в области системного администрирования по бразильской системе 😁

Сегодня приснилось, что стоит поднять форум на phpBB и общаться там 😂

#joke #education
😁2
В копилку полезных трюков для, собственно, системного администрирования:

Если поставить на телефон Termux, то можно по ssh подключаться к удалённым серверам откуда угодно, и, например, править конфиги или давать ценные указания claude code 😁

А если на сервер поставить легендарный mc, то станет ещё и удобно 😊

#linux #lifehack
🔥2
Продолжим про админство 😁

При работе с чужими bash-скриптами, стоит разобраться в приоритете операторов:

cmd1 || cmd2 | cmd3 выполняется не просто слева направо 😅

В своих скриптах лучше, конечно, на всякий случай, в явном виде скобки ставить 👍

#linux #fail
😁1
"JEPA Яна Лекуна тренируется всего за несколько часов." - мог бы я написать, если бы он не переименовал её в LeWorldModel 😁

Новая версия модели, понимающей физику, и способной предсказать, что если не остановиться на краю обрыва, то грохнешься вниз, содержит жалкие 15 миллионов параметров и тренируется даже на домашнем компе.

Для тренировки нужно видео, на котором что-то происходит, и цепочка команд/действий, соответствующая происходящему.

Модель учится строить эмбеддинги (векторные признаки) сцены, и если показать ей исходную и целевую картинки, может оценить, какая последовательность действий позволит ближе подобраться к цели.

Кажется роботы и дроны скоро сильно поумнеют 😬

#ai #robotics
👀2
Сотрудники Anthropic случайно слили исходники Claude Code, не настроив нормально игнор служебных файлов.

Те, кто покопался, пишут, что там есть много необъявленных фич, вроде режима подумать пол часа и встроенных покемоноподобных питомцев оО.

Подтвердилось, что клод код пишет сам себя, потому что 12 уровней вложенности в функциях это уже за гранью 😁

Надеюсь разработчики других агентских cli оценят вклад Антропик в open source, и позаимствуют оттуда хороших идей 😁

#ai #fail
😁1🙈1
Наконец-то дошли руки попробовать агента встроенного в perplexity.

Описал свою идею приложения, попросил оценить рынок, подводные камни, посчитать стоит ли связываться и т.д. Потом попросил сделать выжимку из статей по теме и подготовить презентацию по ним для понимания. В нагрузку и спецификацию для разработки, в том числе для клода 😁

После того, как агент закончил поиск, все документы он собирал с помощью написания кода. Прикольно, что он перепроверил, как всё рендерится, посмотрев скриншоты, и сам исправил ошибки вроде отсутствующих символов в шрифте 👍

Удобно, есть теперь, что почитать и перепроверить. Презентация красивая 😁

Потратил половину кредитов из тех, что дали на пробу, очень надеюсь, что это не доллары 1:1😅

#ai
👍1🔥1
KertexNotes
Наконец-то дошли руки попробовать агента встроенного в perplexity. Описал свою идею приложения, попросил оценить рынок, подводные камни, посчитать стоит ли связываться и т.д. Потом попросил сделать выжимку из статей по теме и подготовить презентацию по ним…
Пока я отходил от компа, агент насоздавал подагентов и выжрал оставшиеся кредиты 😂

Я так понял большая часть ушла на перепроверку уже сделанной работы, и каждый подагент заново создавал себе контекст читая большие документы и скриншоты 🤦‍♂

Ну, зато теперь знаем, что 1$ это 100 кредитов и можно слегка уйти в минус 😅 А также, что не стоит давать поводов плодить подагентов: один запрос - одна задача 👍

#ai #today_I_learned
😨1
Всё-таки Лекун прав, что современным нейросетям прям нехватает базовых интуиций о том как устроен мир и его физика, которые есть у всех людей по умолчанию, потому что люди с этими эффектами ежесекундно сталкиваются.

Впервые заметил это в рабочих задачах, когда модели путаются с какой стороны находятся выбросы данных, когда есть понятия внутри и снаружи.

Теперь вот пытался добиться от perplexity оценки качественного эффекта от изменения геометрии мотоцикла и она оказалась perplexed (😁) на тему от какой оси считать наклон и что такое стоит ровно.

#ai #fail
🤣1
Интернет, который мы потеряли, можно вернуть хотя бы на openrouter.ai 😍

Для активации retro mode, нужно нажать кнопку в менюшке sign up.

Утащил у @Promsoft 😇

#history #joke