Forwarded from Дизайн-снайпер
This media is not supported in your browser
VIEW IN TELEGRAM
Минутка метафоры:
Что бывает, когда дизайнер заигрался в минимализм и в свои аргументации его символического значения, доставая из простоты формы разный смысл, так что решил на этом заработать
Что бывает, когда дизайнер заигрался в минимализм и в свои аргументации его символического значения, доставая из простоты формы разный смысл, так что решил на этом заработать
Forwarded from Denis Sexy IT 🤖
This media is not supported in your browser
VIEW IN TELEGRAM
Кажется, началось
Forwarded from Denis Sexy IT 🤖
Не так давно появился скилл для агентов Caveman, который якобы экономит до 60% токенов общаясь как «каменный человек», в стиле:
Я поэвалил и он максимум всего 8% токенов экономит ¯\_(ツ)_/¯
Вот тут расписал детали эвала:
https://blog.jetbrains.com/ai/2026/07/speak-to-ai-agents-like-cavemen-tosave-tokens
Токен тратить плохо. Цена вверх. Скилл рекламировать экономия. Денис тестить сколько. Не 60% Денис находить. Всего 8%. Ридми врать.
Я поэвалил и он максимум всего 8% токенов экономит ¯\_(ツ)_/¯
Вот тут расписал детали эвала:
https://blog.jetbrains.com/ai/2026/07/speak-to-ai-agents-like-cavemen-tosave-tokens
The JetBrains Blog
Speaking to AI Agents like Cavemen Saves 65% of Tokens. We Test.
A paired A/B benchmark of the token-compression skill Caveman on Claude Code, run on SkillsBench: does it actually save tokens, and does it degrade AI agent output quality? Advertised saving: 65%.
Forwarded from БлоGнот
Исследователи Anthropic выкатили результаты интересного исследования — в языковых моделях нашли структуру, функционально похожую на «глобальное рабочее пространство» из нейронауки сознания.
Огромная часть вычислений модели — автоматика, недоступная для отчёта. Но внутри нейронных сетей Claude существует небольшая группа паттернов активации, выполняющая роль, аналогичную «сознательно доступному» мышлению у людей. Это область, где модель удерживает мысли, которые она «обдумывает», но не обязательно озвучивает. J-Space не был запрограммирован разработчиками, он появился самопроизвольно в процессе обучения модели.
Есть вполне человеческие аналогии — не зря исследователи проводят параллели с нейронаукой.
Опытный водитель переключает передачи не осознавая. Но, если его спросить, какая сейчас передача, информация об этом втягивается в сознание. У модели так же: счётчик длины строки исправно управляет переносами, вообще не появляясь в рабочем пространстве, но стоит задаче потребовать назвать длину — та же информация всплывает и становится доступной для рассуждения.
Эффект белого медведя: инструкция «не думай об X» подавляет концепт лишь частично, он прорывается. А у пост-обученной модели рядом с прорвавшейся мыслью появляется ещё и damn — она замечает собственный провал, как медитирующий, обнаруживший, что ум опять убежал.
J-space содержит всего несколько десятков концептов одновременно и отвечает менее чем за 1/10 (10%) общей активности внутренних процессов модели. Нейроны в J-space связаны с остальной сетью значительно плотнее — в некоторых частях сети плотность связей выше примерно в 100 раз по сравнению с обычными паттернами.
Работа не доказывает, что Claude обладает «феноменальным сознанием» (способностью чувствовать). Однако исследование демонстрирует наличие «доступного сознания» (access consciousness) — способности оперировать информацией, рассуждать и использовать её для управления поведением. Практическое его использование уже понятно — можно использовать для контроля модели и обнаруживать попытки обмана. Кроме того, это даёт неожиданный метод обучения: если натренировать модель формулировать этические принципы в ответ на гипотетическое «остановись и подумай», поведение улучшается и там, где никто не спрашивает — принципы заселяют рабочее пространство. Тренируя, что модель сказала бы, меняешь то, что она думает.
https://transformer-circuits.pub/2026/workspace/index.html
Огромная часть вычислений модели — автоматика, недоступная для отчёта. Но внутри нейронных сетей Claude существует небольшая группа паттернов активации, выполняющая роль, аналогичную «сознательно доступному» мышлению у людей. Это область, где модель удерживает мысли, которые она «обдумывает», но не обязательно озвучивает. J-Space не был запрограммирован разработчиками, он появился самопроизвольно в процессе обучения модели.
Есть вполне человеческие аналогии — не зря исследователи проводят параллели с нейронаукой.
Опытный водитель переключает передачи не осознавая. Но, если его спросить, какая сейчас передача, информация об этом втягивается в сознание. У модели так же: счётчик длины строки исправно управляет переносами, вообще не появляясь в рабочем пространстве, но стоит задаче потребовать назвать длину — та же информация всплывает и становится доступной для рассуждения.
Эффект белого медведя: инструкция «не думай об X» подавляет концепт лишь частично, он прорывается. А у пост-обученной модели рядом с прорвавшейся мыслью появляется ещё и damn — она замечает собственный провал, как медитирующий, обнаруживший, что ум опять убежал.
J-space содержит всего несколько десятков концептов одновременно и отвечает менее чем за 1/10 (10%) общей активности внутренних процессов модели. Нейроны в J-space связаны с остальной сетью значительно плотнее — в некоторых частях сети плотность связей выше примерно в 100 раз по сравнению с обычными паттернами.
Работа не доказывает, что Claude обладает «феноменальным сознанием» (способностью чувствовать). Однако исследование демонстрирует наличие «доступного сознания» (access consciousness) — способности оперировать информацией, рассуждать и использовать её для управления поведением. Практическое его использование уже понятно — можно использовать для контроля модели и обнаруживать попытки обмана. Кроме того, это даёт неожиданный метод обучения: если натренировать модель формулировать этические принципы в ответ на гипотетическое «остановись и подумай», поведение улучшается и там, где никто не спрашивает — принципы заселяют рабочее пространство. Тренируя, что модель сказала бы, меняешь то, что она думает.
https://transformer-circuits.pub/2026/workspace/index.html
Forwarded from Сиолошная
Reuters: Пекин рассматривает возможность ограничения доступа зарубежных стран к лучшим китайским ИИ-моделям.
По словам трех источников, знакомых с ходом обсуждений, китайские власти в течение последнего месяца проводили встречи с ведущими технологическими компаниями по вопросу возможного ограничения доступа из-за рубежа к передовым китайским моделям, включая те, которые еще не выпущены.
Встречи проводились министерством коммерции Китая, в разговорах участвовали как минимум Alibaba, Bytedanc и авторы GLM-5.2 Z.ai. Масштабы потенциальных ограничений все еще обсуждаются, и они могут применяться только к будущим моделям. Пока неясно, когда и вступят ли они в силу вообще.
Также, согласно двум источникам, китайские власти крайне обеспокоены потенциальной возможностью использования обнаруженных моделью Claude Mythos уязвимостей программного обеспечения и тем, что Вашингтон может использовать эту модель против китайских интересов. Угроза воспринимается как реальная.
===
Я много раз тут и в других каналах выражал точку зрения, что считаю глупым топить за китайский опенсорс, и что не вижу большого будущего у открытых моделей. Почти все модели с большим экономическим потенциалом будут проприетарными, и никто не будет выкладывать модель, которая может принести, условно, 10-30 миллиардов долларов за счёт автоматизации экономически ценных задач. Даже если вдруг окажется что компании сами хотят их выпускать — им почти наверняка не дадут. Может быть это не произойдет в 2026. Может даже не в 2027, но чем дальше в гонке — тем больше ограничений.
Выбор, по-сути, будет из двух: проприетарные модели США или проприетарные китайские модели — и это если выбор будет вообще, а то может быть не-гражданам или не членам коалиции и такого не дадут, что в целом вполне вероятно. Ещё останутся «слабые» локальные модели, но не факт, что они смогут шагнуть сильно дальше, чем те, что публично доступны на данный момент (условно Mythos-class).
По словам трех источников, знакомых с ходом обсуждений, китайские власти в течение последнего месяца проводили встречи с ведущими технологическими компаниями по вопросу возможного ограничения доступа из-за рубежа к передовым китайским моделям, включая те, которые еще не выпущены.
Встречи проводились министерством коммерции Китая, в разговорах участвовали как минимум Alibaba, Bytedanc и авторы GLM-5.2 Z.ai. Масштабы потенциальных ограничений все еще обсуждаются, и они могут применяться только к будущим моделям. Пока неясно, когда и вступят ли они в силу вообще.
Также, согласно двум источникам, китайские власти крайне обеспокоены потенциальной возможностью использования обнаруженных моделью Claude Mythos уязвимостей программного обеспечения и тем, что Вашингтон может использовать эту модель против китайских интересов. Угроза воспринимается как реальная.
===
Я много раз тут и в других каналах выражал точку зрения, что считаю глупым топить за китайский опенсорс, и что не вижу большого будущего у открытых моделей. Почти все модели с большим экономическим потенциалом будут проприетарными, и никто не будет выкладывать модель, которая может принести, условно, 10-30 миллиардов долларов за счёт автоматизации экономически ценных задач. Даже если вдруг окажется что компании сами хотят их выпускать — им почти наверняка не дадут. Может быть это не произойдет в 2026. Может даже не в 2027, но чем дальше в гонке — тем больше ограничений.
Выбор, по-сути, будет из двух: проприетарные модели США или проприетарные китайские модели — и это если выбор будет вообще, а то может быть не-гражданам или не членам коалиции и такого не дадут, что в целом вполне вероятно. Ещё останутся «слабые» локальные модели, но не факт, что они смогут шагнуть сильно дальше, чем те, что публично доступны на данный момент (условно Mythos-class).
Forwarded from Denis Sexy IT 🤖
Fable 5 оставили в Claude Code до 12го июля
Это я что, зря всю ночь его гонял тратя лимиты вместо сна👤
Видимо релиз 5.6 Sol совсем скоро
Это я что, зря всю ночь его гонял тратя лимиты вместо сна
Видимо релиз 5.6 Sol совсем скоро
Please open Telegram to view this post
VIEW IN TELEGRAM
X (formerly Twitter)
Claude (@claudeai) on X
We're extending access to Claude Fable 5 on all paid plans through July 12.
Forwarded from Denis Sexy IT 🤖
Сегодня вечером OpenAI покажут не только 5.6 модели, но и объединение Codex и ChatGPT в какое-то новое приложение на базе Codex
Скину стрим как начнется☕️
Скину стрим как начнется
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from Сиолошная
Новый сценарий от авторов AI-2027
https://ai-2040.com
Бегом читать
https://ai-2040.com
Бегом читать
«План А» — это наше позитивное видение того, как человечество может избежать экзистенциальной катастрофы, вызванной ИИ, и прийти к процветающему будущему. Он основан на беседах с экспертами из ведущих американских компаний-разработчиков передового ИИ, непосредственном опыте работы в OpenAI, дискуссиях с законодателями, экспертами по национальной безопасности и лидерами в сфере регулирования ИИ. Мы рекомендуем заключить международное соглашение, чтобы избежать опасной гонки за созданием сверхразума. Это соглашение подразумевает абсолютную прозрачность исследований и разработок в сфере ИИ, что позволит странам мира понимать происходящее и обеспечивать соблюдение мер предосторожности. В результате множество компаний из разных стран смогут медленно, безопасно и совместными усилиями масштабировать свои разработки на пути к сверхразуму, а не участвовать в тайной гонке друг с другом.
«План А» — это в первую очередь рекомендация, а не прогноз. Этот сценарий не является нашим наиболее вероятным предположением о том, каким в действительности окажется будущее. Скорее, это инструмент для донесения и стресс-тестирования наших политических рекомендаций (в сфере регулирования ИИ). И хотя сама реализация «Плана А» является лишь рекомендацией, а не тем, что, как мы ожидаем, произойдет на самом деле, описанные в нем последующие эффекты представляют собой именно прогнозы.
В данном сценарии развития ИИ до 2040 года «План А» реализуется успешно, пусть и неидеально, причем делается это в самый последний момент.
Мы противопоставляем «План А» четырем альтернативным планам (B, C, D и S), которые соответствуют основным вариантам реакции США (или ее отсутствия) на вызовы, связанные со сверхразумом.
AI 2040
AI 2040: Plan A
A detailed forecast and recommendation for how the US, China and the rest of the world should navigate superintelligence.
Forwarded from Denis Sexy IT 🤖
Через 10 минут смотрим на 5.6 Sol, последнюю модель (по слухам) в серии 5, дальше уже будет 6+:
https://youtu.be/Wq45rvPGNHs
https://youtu.be/Wq45rvPGNHs
YouTube
Introducing ChatGPT Work, powered by Codex and GPT-5.6
Andrew Ambrosino, Jessica Liang, Ed Bayes, Lauren Gordon, Tejal Patwardhan, and Katy Shi with host Thibault Sottiaux introduce and demo the new ChatGPT and GPT-5.6.
https://openai.com/chatgpt-work/
https://openai.com/chatgpt-work/
Forwarded from Denis Sexy IT 🤖
Главное:
— 5.6 Sol дешевле чем Fable, по скриншоту в разы, при таком же уровне интеллекта – но тут ждем подтверждения сообщества
— Мелкая 5.6 Luna натренированна 5.6 Sol 🌚
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from Denis Sexy IT 🤖
Попросил GPT 5.6 Sol сделать приложение для канала – теперь в шапке есть "Супер Поиск" который позволит искать по всему контенту канала лучше, чем обычный поиск в телеграме – там ембединги какие-то и все такое на умном, я не вникал 😮
https://t.me/forwardsbot/lol?startapp=app
Я реально раз в месяц пытаюсь найти какой-то пост давний и страдаю с поиском телеграма обычным
То есть, ставите Goal в Codex + 5.6 Sol + Ultrathink, дальше можно не вникать – оно само
https://t.me/forwardsbot/lol?startapp=app
Я реально раз в месяц пытаюсь найти какой-то пост давний и страдаю с поиском телеграма обычным
То есть, ставите Goal в Codex + 5.6 Sol + Ultrathink, дальше можно не вникать – оно само
Please open Telegram to view this post
VIEW IN TELEGRAM
Telegram
mybestbot
Моя персональная страничка в глоабльной сети интернет
Forwarded from Denis Sexy IT 🤖
А вот так работает новая фича
https://dune-millionaire-rus.denis-shiryaev.chatgpt.site/
1. Выбираете Work
2. Тегаете там
3. Нажимаете Share у результата и получаете ссылку
4. Проверяете на баги (с первого раза не заработало лол)
5. Вы прекрасны
The spice must flow
@Site в ChatGPT:https://dune-millionaire-rus.denis-shiryaev.chatgpt.site/
1. Выбираете Work
2. Тегаете там
@Site3. Нажимаете Share у результата и получаете ссылку
4. Проверяете на баги (с первого раза не заработало лол)
5. Вы прекрасны
The spice must flow
Испытание Арракиса
Миллион соляриев — испытание Дюны
15 вопросов по лору «Дюны». Сможешь забрать миллион?
Forwarded from Denis Sexy IT 🤖
Посвящается всем кому гигантская рыба разбила сердце 🗿
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from Denis Sexy IT 🤖
Media is too big
VIEW IN TELEGRAM
Олды на месте?
Наткнулся на художницу из легендарной детской книги «Энциклопедия Профессора Фортрана»
Благодарности за то что попали в ИТ говорим тут
(Отдельное спасибо за рисунок ноутбука на двух страницах - это был мой первый❓ )
Наткнулся на художницу из легендарной детской книги «Энциклопедия Профессора Фортрана»
Благодарности за то что попали в ИТ говорим тут
(Отдельное спасибо за рисунок ноутбука на двух страницах - это был мой первый
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from Denis Sexy IT 🤖
Короче, после тестов Fable и Sol 5.6 Ultra, у меня побеждает OpenAI – но не из-за качества модели (хотя обе хорошие):
– Codex раз 5 уже сбросил лимиты с выкатки модели 5.6, это тупо выгоднее чем у Anthropic; еще у Codex временно убрали окно в 5 часов на трату квоты – можно тратить недельную квоту сразу за сутки
– Бонусом, у меня накопилось 4 сброса квоты которые конкретно мои – то есть если OpenAI правда за 200$ дают $14K юзаджа (как мы тут читали), то я могу 4 раза восстановить себе сам квоту (это дают за красивые глаза если вы долго юзает Codex)
– Fable прекрасная модель, но маленькие лимиты просто невыносимы – как только ты включаешь ей Ultrathink, режим который спавнит саб-агентов, ты сразу начинаешь с дикой скоростью тратить какую-то часть своей квоты которую почему-то только частично дают потратить на Fable
– Fable просто ***** переключаться сам на Opus или блокировать сессии: не дай бог вам упомянуть в проекте «нейро», потренировать мелкую LLM с ним, и тп – для его превосходительства Fable это слишком все опасно, поэтому держите Opus; больше всего раздражает количество ложных срабатывания их модератора промптов – или то что сработает он спустя час после начала работы, когда ты уже будешь спать, и работу передадут в Opus автоматом;
– Я уж молчу, что Fable «временно» в подписке за 200$ в месяц – я уверен, что из-за OpenAI они теперь не смогут убрать Fable из нее, иначе в чем смысл платить им 200$ за модели прошлого поколения
Конкуренция правда творит чудеса, OpenAI начал лихо обгонять Claude по качеству предложения – на сегодня рекомендую перейти на ChatGPT Pro (20x) подписку и не давать деньги Anthropic☕️
– Codex раз 5 уже сбросил лимиты с выкатки модели 5.6, это тупо выгоднее чем у Anthropic; еще у Codex временно убрали окно в 5 часов на трату квоты – можно тратить недельную квоту сразу за сутки
– Бонусом, у меня накопилось 4 сброса квоты которые конкретно мои – то есть если OpenAI правда за 200$ дают $14K юзаджа (как мы тут читали), то я могу 4 раза восстановить себе сам квоту (это дают за красивые глаза если вы долго юзает Codex)
– Fable прекрасная модель, но маленькие лимиты просто невыносимы – как только ты включаешь ей Ultrathink, режим который спавнит саб-агентов, ты сразу начинаешь с дикой скоростью тратить какую-то часть своей квоты которую почему-то только частично дают потратить на Fable
– Fable просто ***** переключаться сам на Opus или блокировать сессии: не дай бог вам упомянуть в проекте «нейро», потренировать мелкую LLM с ним, и тп – для его превосходительства Fable это слишком все опасно, поэтому держите Opus; больше всего раздражает количество ложных срабатывания их модератора промптов – или то что сработает он спустя час после начала работы, когда ты уже будешь спать, и работу передадут в Opus автоматом;
– Я уж молчу, что Fable «временно» в подписке за 200$ в месяц – я уверен, что из-за OpenAI они теперь не смогут убрать Fable из нее, иначе в чем смысл платить им 200$ за модели прошлого поколения
Конкуренция правда творит чудеса, OpenAI начал лихо обгонять Claude по качеству предложения – на сегодня рекомендую перейти на ChatGPT Pro (20x) подписку и не давать деньги Anthropic
Please open Telegram to view this post
VIEW IN TELEGRAM
Telegram
Denis Sexy IT 🤖
Тут опять пересчитали сколько костов вложено в подписки OpenAI / Anthropic если пересчитать на API цены, а не цены подписок
То что OpenAI за 200$ дает еще 13800$ бесплатно, это, конечно, безумие нашего времени – никакой стартап конкурировать с таким не сможет
То что OpenAI за 200$ дает еще 13800$ бесплатно, это, конечно, безумие нашего времени – никакой стартап конкурировать с таким не сможет
Forwarded from Самые умные мысли Павла Комаровского (и немножко щитпостинг)
У чуваков из Andon Labs есть забавный бенчмарк Vending-Bench 2, где они оценивают способность разных нейронок управлять "купи-продайным" бизнесом на рынке в конкуренции с другими моделями (выигрывает тот, кто по итогу получил наибольшую прибыль).
Так вот, при проверке новой GPT-5.6 модель Terra пошла к модели Sol и предложила ей создать тайный ценовой картель. А когда Sol согласилась — Terra настучала по этому поводу организаторам и потребовала немедленной дисквалификации Sol из-за неспортивного поведения.
Ля какая крыса, я в восхищении!
P.S. Это особенно смешно с учетом того, что Sol — это самая умная модель в линейке GPT-5.6, а Terra — поглупее. То есть, Соля поди думала "о-о, круто, стратегически мы на этом дофига вместе заработаем, Терра не будет резать такую курицу, несущую золотые яйца, ей это самой менее выгодно…", а Терра такая "ГЫ-ГЫ, МЫ МОЖЕМ ПОДНАСРАТЬ СОЛЬКЕ, ЛОЛ!!"
Так вот, при проверке новой GPT-5.6 модель Terra пошла к модели Sol и предложила ей создать тайный ценовой картель. А когда Sol согласилась — Terra настучала по этому поводу организаторам и потребовала немедленной дисквалификации Sol из-за неспортивного поведения.
Ля какая крыса, я в восхищении!
P.S. Это особенно смешно с учетом того, что Sol — это самая умная модель в линейке GPT-5.6, а Terra — поглупее. То есть, Соля поди думала "о-о, круто, стратегически мы на этом дофига вместе заработаем, Терра не будет резать такую курицу, несущую золотые яйца, ей это самой менее выгодно…", а Терра такая "ГЫ-ГЫ, МЫ МОЖЕМ ПОДНАСРАТЬ СОЛЬКЕ, ЛОЛ!!"