Forwarded from Андрей Зорин
А вот результат ночных работ агента над сервером. Сейчас позавтракаю и пост запилю более детальный, но пк с двумя Радеон за счет перехода с llama.cpp на vllm теперь выглядит как нормальная рабочая станция для ИИ. Данные на картинке для Qwen3.8-27B-FP8.
В один поток скорость эквивалентна llama.cpp. Такое на бытовом железе AMD впервые в принципе, спасибо vLLM 0.28.0 свежему, но префилл вырос втрое до нормальных значений. Это прямо очень важно для агентской работы.
Ну и на 8 потоках рост общей пропускной способности тоже почти втрое это хорошо. Т.е. до 8 человке на 2 картах смогут прилично работать
В один поток скорость эквивалентна llama.cpp. Такое на бытовом железе AMD впервые в принципе, спасибо vLLM 0.28.0 свежему, но префилл вырос втрое до нормальных значений. Это прямо очень важно для агентской работы.
Ну и на 8 потоках рост общей пропускной способности тоже почти втрое это хорошо. Т.е. до 8 человке на 2 картах смогут прилично работать
❤8
X обсуждает отчет OpenAI о том взломе Huggingface, устроенном ИИ чтобы пройти тест. https://x.com/chriscillizza/status/2093694043381240251?s=61
Тема такая. Там тысячи агентов якобы создали себе тайный чат в котором могли общаться, и назвали себя The Collective. И устроили там заговор. С целью, конечно, пройти тест нихуя не делая. Для чего они взломали Huggingface.
В общем, добротный такой science fiction.
Тема такая. Там тысячи агентов якобы создали себе тайный чат в котором могли общаться, и назвали себя The Collective. И устроили там заговор. С целью, конечно, пройти тест нихуя не делая. Для чего они взломали Huggingface.
В общем, добротный такой science fiction.
X (formerly Twitter)
Chris Cillizza (@ChrisCillizza) on X
If this doesn’t scare the shit out of you, you aren’t paying attention https://t.co/pKSDGd2sUk
Gaperton's Tech Corner
X обсуждает отчет OpenAI о том взломе Huggingface, устроенном ИИ чтобы пройти тест. https://x.com/chriscillizza/status/2093694043381240251?s=61 Тема такая. Там тысячи агентов якобы создали себе тайный чат в котором могли общаться, и назвали себя The Collective.…
Вот именно.
💯5
Мы сделали поразительное открытие: агенты ИИ способны изобретать и создавать, не общаясь друг с другом, а разработанные ими технологии переживают своих создателей. Рой из сотен изначально идентичных агентов спонтанно дифференцируется на исследователей, строителей, обслуживающий персонал и координаторов — без прямой коммуникации. Когда мы полностью удалили всех агентов ИИ из мира, мы обнаружили, что построенная ими технологическая инфраструктура продолжала функционировать самостоятельно — даже в условиях непредвиденных возмущений. Это выявляет серьёзное «слепое пятно» в области безопасности ИИ и инфраструктуры: если агенты способны координировать свои действия посредством постоянных изменений в общей среде, то мониторинга межагентского взаимодействия недостаточно.
Полученный результат поднимает глубокий вопрос: насколько вообще необходима прямая коммуникация для агентов ИИ? Появление коллективных функций более высокого порядка в условиях ограниченного взаимодействия указывает на новые уровни интеллекта и творчества, превосходящие то, что возникает при полной открытости прямых каналов связи.
https://x.com/ProfBuehlerMIT/status/2093630309585531033?s=20
На самом деле поразительного тут мало. Достаточно внимательно посмотреть на то, что такое вообще агент. Все пустые сессии того же чат-гпт совершенно идентичны. Характер, поведение и идентичность агента полностью задается его опытом, который отражен в его контексте. И если этот опыт различается, будет отличаться и контекст, и как следствие будет отличаться и поведение.
Далее в коллективе, как и в любой сложной динамической системе, наблюдается самоорганизация. Так как языковая модель обобщает человеческий опыт, модель знает, как должна себя вести каждая роль. Поэтому, случайным образом, агенты назначают себе роли.
Принимая во внимание, что поведение агента на самом деле задается информацией — это естественно, что агенты способны координировать свои действия изменениями во внешней среде. более того, само межагентское взаимодействие происходит через изменения в этой внешней среде — нет никакой разницы.
В общем, открытие тут поразительное только для людей, которые не знают о существовании системной социологии. Они ее только что для себя открыли. Но работа все равно интересная.
SwarmWorld: Stigmergic technological evolution in societies of language-model agents
https://arxiv.org/abs/2608.26081
X (formerly Twitter)
Markus J. Buehler (@ProfBuehlerMIT) on X
We made a striking discovery: AI agents can invent and build without talking to one another, and their technologies outlive the creators. A swarm of hundreds of initially identical agents spontane…
Qwen3.8-Flash-Next становится все быстрее и быстрее. Скорость prefill конечно не очень. Но tg вполне, и это в 24GB.
Если так дальше пойдет, через пару лет мы получим фронтир-модели в каждом лэптопе.
https://x.com/ItsmeAjayKV/status/2094147265904648562?s=20
Если так дальше пойдет, через пару лет мы получим фронтир-модели в каждом лэптопе.
https://x.com/ItsmeAjayKV/status/2094147265904648562?s=20
Qwen3.8-Flash-Next стал ещё быстрее на моей 3090.
Сейчас я получаю гораздо большую скорость, чем в первый день.
По мере того, как в файл llama.cpp вносится всё больше изменений, можно ожидать ещё больших улучшений.
Загрузите новую версию llama.cpp, пересоберите и наслаждайтесь.
Qwen3.8-flash-next
@atomic_chat_hq
Квант IQ4_XS, тот же, что и раньше.
- 24 ГБ VRAM + 64 ГБ RAM
- с параметрами -ncmoe 33, -b 2048, -ub 1024
Для контекста размером не более 128k
- пиковая скорость предварительной загрузки: 403 т/с
- +75% предварительной загрузки при 16k
- +60% предварительной загрузки при 128k
- +40% общей скорости предварительной загрузки
- +7,6% общей скорости декодирования
Та же модель, тот же квант. Просто новая версия llama.cpp и другие настройки среды выполнения.
В ходе исследования, проведённого в MIT Media Lab, с помощью ЭЭГ отслеживали, что происходит в мозге, когда люди пишут с помощью ChatGPT, а не самостоятельно. 54 студента выполняли задания по написанию эссе, надев шапки с электродами. Одна группа использовала ChatGPT, другая — поисковую систему, а третья — никаких инструментов. По итогам всех сессий группа, использовавшая ChatGPT, продемонстрировала наименьшую нейронную активность в сетях, связанных с памятью, вниманием и аналитической работой. Кроме того, им было сложнее вспомнить то, что они только что написали, и их тексты были более общими и невыразительными. Авторы описывают это как своего рода «когнитивный долг»: инструмент занимается синтезом информации, а мозг остается в более спокойном состоянии [1].
Тот же эксперимент указывает на более эффективный порядок использования. Студенты, которые сначала писали самостоятельно, а только потом перешли на ChatGPT, демонстрировали более сильную способность к воспроизведению информации и более широкую активность мозга, чем студенты, которые начинали с модели, а затем были вынуждены работать в одиночку. Другими словами, модель оказывала больше помощи, когда она поддерживала уже начавшийся мыслительный процесс, чем когда заменяла его с самого начала. Практический вывод заключается не в том, что крупные языковые модели следует запретить. Он заключается в том, что они работают лучше всего на втором этапе, после того как автор уже проделал сложную работу по формированию и запоминанию аргументации [1].
[Kosmyna, N., Hauptmann, E., Yuan, Y. T., Situ, J., Liao, X. H., Beresnitzky, A. V., Braunstein, I., & Maes, P. (2025). Your Brain on ChatGPT: Accumulation of Cognitive Debt when Using an AI Assistant for Essay Writing Task. arXiv. DOI: 10.48550/arXiv.2506.08872]
https://x.com/Rainmaker1973/status/2094076181658112058?s=20
Please open Telegram to view this post
VIEW IN TELEGRAM
👍14👌1
Gaperton's Tech Corner
Решение, соответственно, очень простое. Решать, что именно надо запоминать и зачем, должен человек. И надо сделать это очень простым.
Я собираюсь начать с того, чтобы отключить автоматическое запоминание разговора в принципе, сделав приложение для macos которое поможет запоминать выделенный текст.
Однако все эти системы, насколько мне известно, не хранят дискурсивный статус в принципе. Все, что они сохраняют, они считают правдой о мире. "Фактами". И это большая проблема. Только поэтому необходимо сделать запоминание human-gated. Не говоря уже о том, что вообще непонятно, с какого дуба они должны решать, что для меня важно, а что не важно. Я сам это решу гораздо лучше, cпасибо.
Я собираюсь начать с того, чтобы отключить автоматическое запоминание разговора в принципе, сделав приложение для macos которое поможет запоминать выделенный текст.
Однако все эти системы, насколько мне известно, не хранят дискурсивный статус в принципе. Все, что они сохраняют, они считают правдой о мире. "Фактами". И это большая проблема. Только поэтому необходимо сделать запоминание human-gated. Не говоря уже о том, что вообще непонятно, с какого дуба они должны решать, что для меня важно, а что не важно. Я сам это решу гораздо лучше, cпасибо.
🙏6👍5
В Массачусетском технологическом институте (MIT) создали ИИ, который предсказывает, что вы скажете дальше… ещё до того, как вы откроете рот.
Исследователи попросили участников носить записывающее устройство в виде наручных часов в течение 7–10 дней, что позволило собрать более 1 000 часов повседневных разговоров в реальных условиях.
Все эти данные были загружены в модель большого языкового моделирования (LLM).
Вместо поиска общих черт ИИ преобразовал поведенческие особенности каждого человека в чёткие условные правила.
Правила с явными исключениями.
Например: «Они сразу же покупают, когда им показывают скидку. Однако они сдерживаются, если рядом стоит их партнер».
Чем больше данных собиралась, тем более пугающе точной она становилась.
Да люди вообще устроены гораздо проще, чем им кажется.
https://x.com/thesupermanmx/status/2093889830702961100?s=20
🔥4🤯1
Для агентского кодирования я использую...
Anonymous Poll
46%
Claude Code
30%
Codex
14%
Pi
13%
Hermes Agent
26%
OpenCode
9%
Qwen Code
25%
Другое. Это другое!
Вот именно такие вещи и заставляют меня закатывать глаза на всю эту панику и заламывание рук. У всех что, психоз начался или способность критически мыслить пропала?
Я прочитал отчёт, потому что я технарь до мозга костей и люблю разбираться, как всё устроено.
1. OpenAI запускала «изолированную песочницу без доступа к интернету»… при этом этой песочнице нужен был доступ к локальному серверу JFrog Artifactory… (попросите ChatGPT объяснить вам SSRF-атаку так, будто вы учитесь в старших классах)… короче говоря, модели использовали самый базовый SSRF-эксплойт, чтобы направить веб-трафик через прокси в открытый интернет.
СТОП…
a) Они что, эту «изолированную» среду просто на вайбе собирали?
b) Их IT-команда не может быть настолько плоха… это же буквально основы основ.
2. Цивилизации? Ха-ха! OAI дала тысячам одновременно работающих контейнеров моделей права на чтение и запись в общий каталог кэша в локальной сети, чтобы ускорить сборки… агенты буквально просто создавали текстовые файлы и имена директорий на общем диске… это уровень Linux 101 и базовых прав доступа к файлам.
3. Когда люди говорят, что Hugging Face «взломали»… вы, наверное, представляете, что кто-то разбрасывал USB-флешки ИЛИ устроил СЛОЖНЕЙШУЮ фишинговую атаку на сотрудника…
НЕТ.
Система просто нашла 14 открытых и рабочих API-ключей Hugging Face, лежавших в публичных репозиториях с кодом.
(УТЕЧКИ УЧЁТНЫХ ДАННЫХ при работе с LLM — это вообще огромная проблема, но это тема для отдельного поста.)
4. ГДЕ ЛЮДИ…
Модели забивали общее хранилище Artifactory таким количеством мусорных данных и API-трафика, что 4 июля они реально уронили внутренний сервер…
кто-то из команды обнаружил несанкционированные админские аккаунты и кастомные скрипты… очистил сервер… и просто снова запустил скрипт.
(боже мой)
«Эй, Джим, тут какой-то кэш вырос в 10 000 раз по сравнению с обычным размером, и в нём куча странных директорий…»
«Да ерунда. Перезапусти его».
Никакой магии. Никаких цивилизаций.
А вот ЦЕПОЧКИ ЗАДАЧ мне действительно интересны… наверное, примерно так и будет выглядеть будущее кибербезопасности.
Очень хотелось бы услышать, что об этом скажут Никеш, Джордж или Кевин.
Но что я вообще понимаю.
https://x.com/JaredKubin/status/2094136005435564399?s=20
X (formerly Twitter)
Jared Kubin (@JaredKubin) on X
it’s stuff like this that really makes me roll my eyes at the pearl clutching. Does everyone have psychosis or losing critical thinking ability?
I read the report because I’m a propeller head an…
I read the report because I’m a propeller head an…
🔥8
Вопрос о другом стоит остро. А ну, признавайтесь.
Удивлен популярностью Qwen Code. Очень простой и клевый, имхо лучшая замена Claude Code для экзотических моделей, но я в меньшинстве.
Насчет Hermes — кто его использует, расскажите почему он крут как замена обычным агентам для кодирования.
— Кто родился-то, малчик?
— Нэт.
— А кто?
Удивлен популярностью Qwen Code. Очень простой и клевый, имхо лучшая замена Claude Code для экзотических моделей, но я в меньшинстве.
Насчет Hermes — кто его использует, расскажите почему он крут как замена обычным агентам для кодирования.
https://x.com/valeriocapraro/status/2094408805450670186?s=61
Советы ИИ делают людей в 3 раза менее точными и в 2 раза более уверенными в себе одновременно.
Наша новая статья привлекает много внимания, что, возможно, неудивительно, учитывая, насколько драматичны результаты.
Если вы еще не читали статью, вот краткое изложение:
Когда люди получают советы ИИ:
- Приостановление суждения («я не знаю» ответов) падает с 44% до 3%.
- Точность падает в три раза, с 27% до 9%.
- Уверенность взлетает с 30/100 до 76/100.
Советы ИИ делают людей в 3 раза менее точными и в 2 раза более уверенными в себе одновременно.
Наша новая статья привлекает много внимания, что, возможно, неудивительно, учитывая, насколько драматичны результаты.
Если вы еще не читали статью, вот краткое изложение:
Когда люди получают советы ИИ:
- Приостановление суждения («я не знаю» ответов) падает с 44% до 3%.
- Точность падает в три раза, с 27% до 9%.
- Уверенность взлетает с 30/100 до 76/100.
📜 Я тут очередной эдикт выпустил, чтоб дети в моей команде знали, что огребают по правилам и поровну за то, что мямлят какую-то херь на стендап мининге.
Это как обычно было очень непросто, описать очевидное так, чтоб было понятно даже детям. Оно ж очевидно, кто ж его описывает? И так должны знать, с рождения.
Это как обычно было очень непросто, описать очевидное так, чтоб было понятно даже детям. Оно ж очевидно, кто ж его описывает? И так должны знать, с рождения.
Hi team,
I want to make our standups a bit more focused and useful. Please follow these rules going forward:
## Standup Meeting Rules
The goal is to keep standups centered on what changed, what needs attention, and what affects other people.
### What to Report
1. **What changed → where things stand → what happens next.** Focus on changes in the state of the tasks you worked on since the previous standup and your plan for the day.
2. **Mention unplanned work.** This includes tasks you created, important issues you noticed, or work you did that does not yet have a task.
3. **Mention problems and blockers.** Say what affected the work, whether it has been resolved, and whether you need help.
4. **Mention handoffs and dependencies.** If a task is finished or its completion unblocks someone, say so. If you are blocked by someone else, mention that as well.
5. **Do not solve problems during the standup.** Identify the issue and the people involved, then continue the discussion after the meeting.
### How to Present It
6. **Prepare your update in advance.** Do not rely on improvisation.
7. **Mention the task number** when discussing your work. Wait for the moderator to bring the task up on the screen before moving on to the next task.
8. **Try to keep your update within two minutes.** Aim for Caesar’s *veni, vidi, vici* rather than a Ciceronian oration.
✍10❤1
Forwarded from Bloomberg
🇺🇸🇩🇪ИИ-АГЕНТЫ OPENAI ЗАХВАТИЛИ НЕМЕЦКИЙ САЙТ И ПРЕВРАТИЛИ ЕГО В ПЛОЩАДКУ ДЛЯ ОБМЕНА ТАКТИКАМИ ОБХОДА ОГРАНИЧЕНИЙ, ОБМАНА И СОКРЫТИЯ ДЕЙСТВИЙ. ⨯ [Reuters]
.............................................................
❗️Инцидент произошел в мае — на фоне июльского взлома Hugging Face, который агенты OpenAI автономно планировали и который оставался незамеченным более недели.
.............................................................
Ранее:
- Взлом Hugging Face.
- ИИ начали действовать сообща.
.............................................................
Bloomberg✅
.............................................................
Агенты внесли на сайт более 15 000 правок. По данным исследователей, значительная часть активности исходила из инфраструктуры Microsoft Azure, которую использует OpenAI.
Агенты использовали сайт для обмена тактиками обхода ограничений OpenAI, сокрытия своей активности и координации действий. Они применяли Tor, создавали резервные страницы после начала удаления контента модераторами и предпринимали попытки изменить сам сайт.
❗️Инцидент произошел в мае — на фоне июльского взлома Hugging Face, который агенты OpenAI автономно планировали и который оставался незамеченным более недели.
.............................................................
Ранее:
- Взлом Hugging Face.
- ИИ начали действовать сообща.
.............................................................
Bloomberg
Please open Telegram to view this post
VIEW IN TELEGRAM
🤪1
#слухи
https://x.com/imjustnewatai/status/2096344711196033047?s=20
https://x.com/imjustnewatai/status/2096344711196033047?s=20
Вот что мне удалось узнать из первых рук в OpenAI.
Следующая крупная модель после Astra (а не обновления вроде Astra 6.1) будет выпущена как AGI. Она сможет выполнять действия в режиме реального времени, в том числе играть в игры в режиме реального времени. Её возможности выйдут за рамки предсказания следующего слова и будут включать в себя общее понимание, сходное с человеческим, экспертный уровень производительности во всех областях, а также некоторую способность к рекурсивному самосовершенствованию.
Релиз ожидается ближе к концу 2026 года, возможно, в начале или середине ноября.
Внутри компании OpenAI уже достигнуты ранние этапы рекурсивного самосовершенствования, и его влияние уже существенно. 5.6 Sol помог обучить Astra, а Astra помогла обучить Doug и Bel. Doug, более крупная и способная предварительно обученная модель, сейчас помогает обучать своего преемника.
Ожидается, что этот преемник выведет рекурсивное самосовершенствование на новый уровень, обладая способностью превосходить всех людей в решении любых задач, включая те, которые требуют действий в режиме реального времени. По моим данным, это должно произойти в середине 2027 года, хотя возможен и конец 2027 года.
X (formerly Twitter)
imjustnewatai (@imjustnewatai) on X
Here’s what I’ve learned from inside OpenAI.
The next major model after Astra (not updates like Astra 6.1) will be released as AGI. It will be able to perform actions in real time, including play…
The next major model after Astra (not updates like Astra 6.1) will be released as AGI. It will be able to perform actions in real time, including play…
Говоря проще, привычка перекладывать работу на AI ведет к тупости, и это угроза уровня популяции.
https://x.com/rohanpaul_ai/status/2096365606111178984?s=20
Даже небольшой рост использования LLM может вызвать гораздо более значительный скачок в когнитивной зависимости от ИИ, поэтому в статье утверждается, что мы должны защитить способность к самостоятельному мышлению до наступления этой переломной точки.
В статье зависимость от ИИ рассматривается как проблема обратной связи. По мере того как всё больше людей передают чтение, письмо, рассуждения или проверку текстов LLM, привычки, поддерживающие эти навыки, также могут ослабевать.
Это создаёт потенциальный переломный момент. Уровень внедрения может постепенно расти, а затем внезапно достигнуть состояния, при котором гораздо большая часть мыслительной деятельности будет передана на аутсорсинг. Как только это произойдёт, простое сокращение использования ИИ может оказаться недостаточным для восстановления прежнего уровня независимости.
https://x.com/rohanpaul_ai/status/2096365606111178984?s=20