Forwarded from Denis Sexy IT 🤖
Помните я $30k дал GPT Pro в управление? Забыл написать что там уже x2 случилось 🌝
Это НЕ совет делать так же, я осознаю риски и готов все потерять
Это НЕ совет делать так же, я осознаю риски и готов все потерять
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from Data Secrets
Китайский исследователь создал специальный бенчмарк, с помощью которого можно оценить количество параметров в любой модели
Как мы знаем, закрытые лаборатории не раскрывают количество параметров своих моделей. Есть стандартный метод оценки через экономику инференса, но он дает погрешность в 2× и более из-за неизвестных деталей об инфре.
Так вот: позавчера на архиве появилась статья, в которой автор предлагает принципиально иной подход, через оценку количества знаний модели. Речь именно о знании фактов, а не интеллекте в целом, потому что способность к рассуждению можно дистиллировать и сжимать в меньшие модели, а фактические знания – нет, они ограничены энтропией Шеннона.
Методология такая: автор создал бенчмарк из 1400 фактических вопросов, разбитых на 7 уровней редкости, от широко известных фактов до крайне малоизвестных. Его откалибровали на 89 открытых моделях с известным числом параметров, и оказалось, что есть явная (R²=0.917) лог-линейная зависимость скора на бенче от числа параметров.
Проецируя закрытые модели на калибровочную кривую, автор получает такие оценки*:
• из-за природы метода и из-за настроек безопасности некоторых моделей (на какие-то вопросы они могут просто отказываться отвечать), эти оценки ближе к нижним границам.
Конечно, точность все равно довольно мала, но числа интересные.
https://arxiv.org/pdf/2604.24827
Как мы знаем, закрытые лаборатории не раскрывают количество параметров своих моделей. Есть стандартный метод оценки через экономику инференса, но он дает погрешность в 2× и более из-за неизвестных деталей об инфре.
Так вот: позавчера на архиве появилась статья, в которой автор предлагает принципиально иной подход, через оценку количества знаний модели. Речь именно о знании фактов, а не интеллекте в целом, потому что способность к рассуждению можно дистиллировать и сжимать в меньшие модели, а фактические знания – нет, они ограничены энтропией Шеннона.
Методология такая: автор создал бенчмарк из 1400 фактических вопросов, разбитых на 7 уровней редкости, от широко известных фактов до крайне малоизвестных. Его откалибровали на 89 открытых моделях с известным числом параметров, и оказалось, что есть явная (R²=0.917) лог-линейная зависимость скора на бенче от числа параметров.
Проецируя закрытые модели на калибровочную кривую, автор получает такие оценки*:
– GPT-5.5 ≈ 9.7T параметров
– Claude Opus 4.6 ≈ 5.3T
– Claude Sonnet 4.6 ≈ 1.7T
– Gemini 2.5 Pro ≈ 1.2T
• из-за природы метода и из-за настроек безопасности некоторых моделей (на какие-то вопросы они могут просто отказываться отвечать), эти оценки ближе к нижним границам.
Конечно, точность все равно довольно мала, но числа интересные.
https://arxiv.org/pdf/2604.24827
Forwarded from Denis Sexy IT 🤖
Про гоблинов и енотов в GPT 5.5 – OpenAI выпустили расследование
Начиная с GPT-5.1 в ответах моделей внезапно расплодились гоблины, гремлины и прочая нечисть – сначала это было мило, но потом гоблины полезли отовсюду - особенно в Codex.
Расследование показало забавное:
ℹ️ У ChatGPT была личность «Nerdy» (душнила вайб) с системным промптом, условно «играй с языком, мир странный – наслаждайся этим»
ℹ️ Reward-модель во время обучения почему-то особенно щедро поощряла ответы с упоминанием существ. Гоблины = +reward, значит ответ с Гоблинами – предпочтителен
ℹ️ «Nerdy» личность обрабатывала всего 2.5% ответов, но 66.7% всех гоблинов ChatGPT поступали именно оттуда – нерд орда
ℹ️ Из-за того как устроена reward функциях у моделях, тренировка на генерациях ChatGPT еще сильнее усилила орду гоблинов в ответах
ℹ️ Под раздачу попали также еноты, тролли, огры и голуби. А вот лягушки не захватывали reward функции, спасибо им
В марте Nerdy отключили, reward почистили, датасет отфильтровали. Но GPT-5.5 уже успел обучиться, и в Codex ему вшили в developer prompt прямую инструкцию «не призывай гоблинов». Если хочется – её можно отключить и выпустить тварей на свободу☕️
Отсюда:
https://openai.com/index/where-the-goblins-came-from/
Начиная с GPT-5.1 в ответах моделей внезапно расплодились гоблины, гремлины и прочая нечисть – сначала это было мило, но потом гоблины полезли отовсюду - особенно в Codex.
Расследование показало забавное:
В марте Nerdy отключили, reward почистили, датасет отфильтровали. Но GPT-5.5 уже успел обучиться, и в Codex ему вшили в developer prompt прямую инструкцию «не призывай гоблинов». Если хочется – её можно отключить и выпустить тварей на свободу
Отсюда:
https://openai.com/index/where-the-goblins-came-from/
Please open Telegram to view this post
VIEW IN TELEGRAM
OpenAI
Where the goblins came from
How goblin outputs spread in AI models: timeline, root cause, and fixes behind personality-driven quirks in GPT-5 behavior.
Forwarded from Denis Sexy IT 🤖
2026, ожидания:
AGI делает за тебя скучную работу
2026, реальность:
ЗА ОРДУ🐧 🦡 😬 🍗 🕹
AGI делает за тебя скучную работу
2026, реальность:
ЗА ОРДУ
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from Denis Sexy IT 🤖
Из-за АИ Агентов этих скоро обычных имен людских не останется – челы сделали https://getviktor.com/
И кожаным Викторам приходится подписывать теперь, что они не АИ-тул, а человек😂
И кожаным Викторам приходится подписывать теперь, что они не АИ-тул, а человек
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from Дизайн-Телега 🔥
This media is not supported in your browser
VIEW IN TELEGRAM
Плагин Vector Fields — Это универсальный инструмент, который помогает вам играть, мастерить и создавать узоры из фигур.
#генератор #вектор #паттерн
#генератор #вектор #паттерн
Forwarded from Дизайн-Телега 🔥
This media is not supported in your browser
VIEW IN TELEGRAM
Мобильный дизайн для записи к врачу онлайн.
• Три экрана с ключевыми элементами: карточки врачей, поиск, навигация
• Спокойная цветовая гамма из светло-голубого и травянисто-зеленого
• Полный набор компонентов: календарь, теги, текстово-графические блоки
• Удобный и безопасный интерфейс для медицинских услуг
#mobileui #medical #appdesign #userinterface #healthcare #ux
Открыть в Figma
• Три экрана с ключевыми элементами: карточки врачей, поиск, навигация
• Спокойная цветовая гамма из светло-голубого и травянисто-зеленого
• Полный набор компонентов: календарь, теги, текстово-графические блоки
• Удобный и безопасный интерфейс для медицинских услуг
#mobileui #medical #appdesign #userinterface #healthcare #ux
Открыть в Figma
Forwarded from Дизайн-Телега 🔥
ПЕЧЕМ ВКУСНЫЕ ВАФЕЛЬКИ В FIGMA
Нарисеум вафельки в figma, заодно отработаем быстрый способ отрисовки сердца.
#Урок
Нарисеум вафельки в figma, заодно отработаем быстрый способ отрисовки сердца.
#Урок
Forwarded from Дизайн-Телега 🔥
25 Button Hover Animations
Внутри файла вы найдете 25 уникальных анимированных кнопок с возможностью изменить стиль с заливки на контур или использовать один из предустановленных параметров radius.
#animation
ОТКРЫТЬ
Внутри файла вы найдете 25 уникальных анимированных кнопок с возможностью изменить стиль с заливки на контур или использовать один из предустановленных параметров radius.
#animation
ОТКРЫТЬ
Forwarded from Дизайн-Телега 🔥
Maroon And Black
💾 Скачать и использовать
https://disk.yandex.ru/d/Dhx7h6c6Z90aOA
🔎 Посмотреть описание
https://creativemarket.com/areatype/6676075-Maroon-And-Black
#font #paid #latin
💾 Скачать и использовать
https://disk.yandex.ru/d/Dhx7h6c6Z90aOA
🔎 Посмотреть описание
https://creativemarket.com/areatype/6676075-Maroon-And-Black
#font #paid #latin