Гальюны Обнаружены
Исследователи из ETH Zurich и MATS представили прорывной метод обнаружения галлюцинаций в больших языковых моделях в реальном времени.
Разработанная система способна выявлять сфабрикованные сущности — имена, даты, цитаты — прямо во время генерации текста, без необходимости дорогостоящей внешней проверки. Метод фокусируется на обнаружении галлюцинаций на уровне токенов, что позволяет отслеживать достоверность информации по мере её появления.
Подход успешно масштабируется до моделей с 70 миллиардами параметров и показывает значительное превосходство над существующими методами. В тестах на длинных текстах классификаторы достигли AUC 0.90 против 0.71 у предыдущих решений для Llama-3.3-70B.
Удивительно, что система, обученная только на сущностях, эффективно обнаруживает ошибки даже в математических задачах, демонстрируя обобщающую способность за пределами первоначальной цели.
Исследователи опубликовали наборы данных для дальнейшего развития этой технологии, которая может стать важным шагом к созданию более надёжных ИИ-систем для критически важных областей.
https://arxiv.org/pdf/2509.03531
#Программирование #Нейросети #Наука #Технологии
@DevsRoot
Исследователи из ETH Zurich и MATS представили прорывной метод обнаружения галлюцинаций в больших языковых моделях в реальном времени.
Разработанная система способна выявлять сфабрикованные сущности — имена, даты, цитаты — прямо во время генерации текста, без необходимости дорогостоящей внешней проверки. Метод фокусируется на обнаружении галлюцинаций на уровне токенов, что позволяет отслеживать достоверность информации по мере её появления.
Подход успешно масштабируется до моделей с 70 миллиардами параметров и показывает значительное превосходство над существующими методами. В тестах на длинных текстах классификаторы достигли AUC 0.90 против 0.71 у предыдущих решений для Llama-3.3-70B.
Удивительно, что система, обученная только на сущностях, эффективно обнаруживает ошибки даже в математических задачах, демонстрируя обобщающую способность за пределами первоначальной цели.
Исследователи опубликовали наборы данных для дальнейшего развития этой технологии, которая может стать важным шагом к созданию более надёжных ИИ-систем для критически важных областей.
https://arxiv.org/pdf/2509.03531
#Программирование #Нейросети #Наука #Технологии
@DevsRoot
❤3
Австралийское правительство платит Deloitte Australia почти полмиллиона долларов за независимый экспертный отчёт, а получает литературное произведение с элементами фантастики - от GPT‑4o. И главное: консалтинговый гигант сам потом признаёт, что это всё «случайно» родилось благодаря генеративному ИИ. И всё бы ничего, если бы речь шла о презентации в PowerPoint для пятничной встречи, а не о документе, на котором основывается решение о госавтоматизации штрафов для получателей соцпособий.
Вместо сухих цифр и проверенных источников отчёт оказался полон сказочного материала: ссылки на несуществующие труды уважаемых профессоров, сочинённая судейская цитата из ключевого дела, имя судьи перепутано, а смысл цитаты звучит красиво — но в реальности её никто не произносил. Просто AI решил, что так будет «солиднее».
Сначала Deloitte хранила молчание, пока академик из Сиднейского университета не ткнул носом: ребята, это же типичные галлюцинации нейросети. Версия два. Загрузили тихо, перед длинными выходными, удалили десяток фантазийных ссылок, заменили их новыми - тоже без особой связи с реальностью. Шикарная замена: вместо ошибки в одном источнике - сразу восемь свежих. Творческий подход.
И лишь в разделе методологии, который мало кто читает, скромно признались: да, использовали GPT‑4o. Не для черновика, не для мелких вставок - для устранения «пробелов в прослеживаемости». Иными словами, модель сочинила обоснование задним числом.
Сенатор Дебора О’Нил выразилась лаконично: «У Deloitte проблемы с человеческим интеллектом». Правда, это, видимо, любезный дипломатический способ сказать: «Мы наняли вас за серьёзные деньги, а вы отдали нам текст от робота, который не умеет проверять факты». Она даже посоветовала клиентам вместо контракта с консалтинговым гигантом оформлять подписку на ChatGPT - всё равно выйдет дешевле.
Правительство, кстати, продолжает утверждать, что «суть обзора сохранена». Правда, так и не объясняет, как авторитетные рекомендации могут сохраняться, если лежат на основании, мягко говоря, дырявой методологии. Возможно, магия корпоративного бренда решает всё.
Особая ирония в том, что Deloitte гордо продаёт консультации по внедрению ИИ, зарабатывает миллиарды на этом, и при этом в рекламных материалах предупреждает: каждый вывод искусственного интеллекта должен проверять человек. Видимо, в этот раз проверка была доверена всё тому же ИИ.
Вопрос остаётся открытым: клиент будет работать с Deloitte дальше или попробует вернуть весь гонорар? Пока вернули лишь часть - частичное извинение за работу ниже стандарта. Но для всех крупных консалтинговых домов сигнал очевиден: даже если вы корпорация с громким именем и доходом $107 млрд в год, стоит один раз перестать проверять, что генерирует ваш нейроассистент - и вас начнут сравнивать с подпиской на ChatGPT.
Получается, что будущая борьба за рынок консалтинга будет не столько о том, кто лучше понимает клиента, а о том, у кого GPT врёт чуть меньше.
https://www.theregister.com/2025/10/06/deloitte_ai_report_australia/
@DevsRoot
Please open Telegram to view this post
VIEW IN TELEGRAM
The Register
Deloitte refunds Aussie gov after AI fabrications slip into $440K welfare report
: Big Four consultancy billed Canberra top dollar, only for investigators to find bits written by a chatbot
This media is not supported in your browser
VIEW IN TELEGRAM
Не вижу минусов
Решил попробовать новую нейросетевую поделку. https://kilocode.ai/models/supernova
Скорее всего очередная хайповая лажа, но посмотрим.
Затестим на C#
UPD:
Наглядно продемонстрировал русские поговорки: Толочь воду в ступе и изображать бурную деятельность.
НО немного получше Qoder, не так много ошибок компиляции.
Хотя как по мне, если агентский код вызывает ошибки компиляции, то это уже не годный агент.
@DevsRoot
Скорее всего очередная хайповая лажа, но посмотрим.
Code Supernova 1 million — это универсальная модель агентного кодирования, поддерживающая ввод изображений, запущенная в скрытом режиме с ранним доступом для пользователей Kilo Code.
Эта передовая модель характеризуется окном контекста в 1 миллион (комбинированный ввод/вывод) с неограниченным использованием — без регулирования, без ограничений.
Что такое скрытая модель? Это модель ИИ, в которой пользователи соглашаются делиться данными об использовании с поставщиком модели, чтобы помочь ей улучшить её. Взамен вы получаете бесплатный доступ к передовым возможностям ИИ в течение ограниченного времени.
Как использовать код Supernova 1M в Kilo Code
Установить Кило-код
Загрузите наше расширение VS Code или плагин JetBrains и присоединяйтесь к более чем 420 000 разработчиков, уже использующих Kilo.
Установить Кило-код
Выберите код Supernova 1 миллион
Щелкните по названию модели под полем подсказки и выберите из списка Code Supernova 1 million
Затестим на C#
UPD:
Наглядно продемонстрировал русские поговорки: Толочь воду в ступе и изображать бурную деятельность.
НО немного получше Qoder, не так много ошибок компиляции.
Хотя как по мне, если агентский код вызывает ошибки компиляции, то это уже не годный агент.
@DevsRoot
Что-то антропик совсем охренели. Еще лимиты порезали.
На картинке результат после обнуления всех лимитов и трех запросов 1 к Sonet и 2 к Opus по одному промпту каждый запрос без дополнительных итераций
@DevsRoot
На картинке результат после обнуления всех лимитов и трех запросов 1 к Sonet и 2 к Opus по одному промпту каждый запрос без дополнительных итераций
@DevsRoot
😢1
Бесконечный Цикл
Что-то антропик совсем охренели. Еще лимиты порезали. На картинке результат после обнуления всех лимитов и трех запросов 1 к Sonet и 2 к Opus по одному промпту каждый запрос без дополнительных итераций @DevsRoot
5 запросов к Opus в неделю за 20 фунтов. Очешуительно порезали🤬
🤨2
Хочу поздравить всех лысых с Днем лысых и свободных. Ура, товарищи!!😁
В общем надо думать. Или Max или Нах
Лимиты Claude Opus действительно стали жёстче: с августа и особенно осенью 2025 количество запросов к Opus на Pro-плане было снизу ограничено примерно 6–8 обращениями в неделю. Новые ограничения вводились по причине перегрузки ресурсов и злоупотребления некоторых пользователей — теперь лимит стал еженедельным, плюс сохраняются 5-часовые «окна», которые тоже могут ограничивать доступ. Юзеры массово жалуются, что новые лимиты режутся ещё строже и теперь «недельный кап» можно выбить всего за пару дней работы, причём почти любой интенсивность на Opus — даже на Pro или Max тарифе.
Текущие лимиты и их детали
На Pro (20$/мес): 40–80 часов Sonnet 4 и отдельно 6–8 запросов к Opus в неделю, но фактическое количество варьируется и отрабатывается быстро.
На Max (100$/мес): 140–280 часов Sonnet 4, 15–35 часов Opus 4. На Max (200$/мес): 240–480 часов Sonnet, 24–40 часов Opus.
Лимиты считаются по токенам, а не по времени: толстые промпты и длинные ответы больше расходуют «кап».
После достижения лимита можно перейти на менее мощные модели или попытаться купить доп. квоты по API (доступно только на Max).
Все лимиты сбрасываются в четверг 8:00 по локальному времени (или по UTC).
На форумах и Reddit пишут, что лимиты ужесточались несколько раз за последние месяцы, причём для Opus особенно.
Реакция пользователей и обсуждения
Множество жалоб на форумах GitHub, Reddit: люди попадают в недельный лимит за 1–2 дня обычной работы — особенно при работе с Opus на Pro-плане.
Основная фрустрация: некоторая непрозрачность по реальному расходу, непредсказуемость капа, отсутствие официальной подробной статистики, и резкое снижение доступности Opus даже для платных пользователей.
Некоторые отмечают, что Pro-план стал менее выгоден, особенно если именно Opus нужен часто и для сложных задач, поскольку капы ограничивают почти любую профессиональную активность.
Дискуссии о ценности Pro: платная подписка ускоряет Sonnet и даёт приоритет плюс расширяет лимиты на Sonnet, но Opus доступен намного реже — большинство считает, что ради Opus переплата не оправдана, если лимит так мал.
Многие ищут обходные пути (см. ниже), но стабильного решения пока нет.
Способы обхода лимитов
Можно оптимизировать промпты и ответы — использовать меньше токенов.
Пользоваться менее «дорогими» моделями (Sonnet вместо Opus), если задача не критична.
Покупать доп. токены на Max тарифах, если срочно требуется.
На некоторых форумах обсуждаются технические хаки по работе с API-квотами и сбросу капа через новые аккаунты или команды (например, /model opus).
Встречаются советы использовать сторонние платформы, интеграторы (Writingmate, Apidog, TeamGPT, TypingMind), иногда они дают повышенный кап через распределённые квоты.
Конкретно для 5-часового лимита неофициально работают методы типа "rolling window": лимит считается с последнего сообщения, можно успевать до следующего окна.
Итог по Pro-плану и совет
Если вам критически нужен Opus — даже Pro-план ограничивает вас жестко, и только Max (особенно за 200$) даёт заметное преимущество.
Основные плюсы Pro — более быстрый, стабильный Sonnet, приоритетная обработка, но Opus фактически доступен крайне редко.
@DevsRoot
Лимиты Claude Opus действительно стали жёстче: с августа и особенно осенью 2025 количество запросов к Opus на Pro-плане было снизу ограничено примерно 6–8 обращениями в неделю. Новые ограничения вводились по причине перегрузки ресурсов и злоупотребления некоторых пользователей — теперь лимит стал еженедельным, плюс сохраняются 5-часовые «окна», которые тоже могут ограничивать доступ. Юзеры массово жалуются, что новые лимиты режутся ещё строже и теперь «недельный кап» можно выбить всего за пару дней работы, причём почти любой интенсивность на Opus — даже на Pro или Max тарифе.
Текущие лимиты и их детали
На Pro (20$/мес): 40–80 часов Sonnet 4 и отдельно 6–8 запросов к Opus в неделю, но фактическое количество варьируется и отрабатывается быстро.
На Max (100$/мес): 140–280 часов Sonnet 4, 15–35 часов Opus 4. На Max (200$/мес): 240–480 часов Sonnet, 24–40 часов Opus.
Лимиты считаются по токенам, а не по времени: толстые промпты и длинные ответы больше расходуют «кап».
После достижения лимита можно перейти на менее мощные модели или попытаться купить доп. квоты по API (доступно только на Max).
Все лимиты сбрасываются в четверг 8:00 по локальному времени (или по UTC).
На форумах и Reddit пишут, что лимиты ужесточались несколько раз за последние месяцы, причём для Opus особенно.
Реакция пользователей и обсуждения
Множество жалоб на форумах GitHub, Reddit: люди попадают в недельный лимит за 1–2 дня обычной работы — особенно при работе с Opus на Pro-плане.
Основная фрустрация: некоторая непрозрачность по реальному расходу, непредсказуемость капа, отсутствие официальной подробной статистики, и резкое снижение доступности Opus даже для платных пользователей.
Некоторые отмечают, что Pro-план стал менее выгоден, особенно если именно Opus нужен часто и для сложных задач, поскольку капы ограничивают почти любую профессиональную активность.
Дискуссии о ценности Pro: платная подписка ускоряет Sonnet и даёт приоритет плюс расширяет лимиты на Sonnet, но Opus доступен намного реже — большинство считает, что ради Opus переплата не оправдана, если лимит так мал.
Многие ищут обходные пути (см. ниже), но стабильного решения пока нет.
Способы обхода лимитов
Можно оптимизировать промпты и ответы — использовать меньше токенов.
Пользоваться менее «дорогими» моделями (Sonnet вместо Opus), если задача не критична.
Покупать доп. токены на Max тарифах, если срочно требуется.
На некоторых форумах обсуждаются технические хаки по работе с API-квотами и сбросу капа через новые аккаунты или команды (например, /model opus).
Встречаются советы использовать сторонние платформы, интеграторы (Writingmate, Apidog, TeamGPT, TypingMind), иногда они дают повышенный кап через распределённые квоты.
Конкретно для 5-часового лимита неофициально работают методы типа "rolling window": лимит считается с последнего сообщения, можно успевать до следующего окна.
Итог по Pro-плану и совет
Если вам критически нужен Opus — даже Pro-план ограничивает вас жестко, и только Max (особенно за 200$) даёт заметное преимущество.
Основные плюсы Pro — более быстрый, стабильный Sonnet, приоритетная обработка, но Opus фактически доступен крайне редко.
@DevsRoot
😢1
Обнова у Ollama
Напомню, что Олама - это самый простой способ поставить LLM локально на комп.
GLM-4.6 и Qwen3-coder-480B доступны в облачном сервисе Ollama и легко интегрируются с привычными вам инструментами. Qwen3-Coder-30B обновлён для более быстрого и надёжного вызова инструментов в новом движке Ollama.
@DevsRoot
Напомню, что Олама - это самый простой способ поставить LLM локально на комп.
GLM-4.6 и Qwen3-coder-480B доступны в облачном сервисе Ollama и легко интегрируются с привычными вам инструментами. Qwen3-Coder-30B обновлён для более быстрого и надёжного вызова инструментов в новом движке Ollama.
Для старта:
GLM-4.6
ollama run glm-4.6:cloud
Qwen3-Coder-480B
ollama run qwen3-coder:480b-cloud
Для пользователей с объёмом видеопамяти более 300 ГБ qwen3-coder:480b также доступен локально.
@DevsRoot
Ollama
Ollama is an API for open models. Get inference locally or in the cloud, anywhere you already work.
👍2
🔥agentrouter так понимаю метят на место OpenRouter
Поэтому Сейчас халява. При заходе по ссылке выше и регистрации через Гитхаб, получаете халявные баксы для API использования
Цены тоже хороши:
цены для 1 млн токенов
@DevsRoot
Поэтому Сейчас халява. При заходе по ссылке выше и регистрации через Гитхаб, получаете халявные баксы для API использования
Цены тоже хороши:
Codex , RooCode , Qwen Code и Claude Code теперь поддерживаются ! gpt-5-codex интегрируется. Если вам нужны другие клиенты, присоединяйтесь к группе QQ: 1062402186 или напишите по адресу neo@agentrouter.org .
В настоящее время открыта регистрация только на Github и Linux.do. Регистрация по электронной почте/учётной записи не поддерживается. Регистрация по учётной записи и паролю пока не поддерживается.
DeepSeek модели:
- deepseek-r1-0528 - Input: $0.003 / Output: $0.000
- deepseek-v3.1 - Input: $0.003 / Output: $0.000
- deepseek-v3.2 - Input: $0.003 / Output: $0.000
GLM (Zhipu) модели:
- glm-4.5 - Input: $0.003 / Output: $0.000
- glm-4.6 - Input: $0.003 / Output: $0.000
Claude (Anthropic) модели:
- claude-3-5-haiku-20241022 - Input: $3.00 / Output: $15.00
- claude-3-5-sonnet-20240620 - Input: $3.00 / Output: $15.00
- claude-3-5-sonnet-20241022 - Input: $3.00 / Output: $15.00
- claude-3-7-sonnet-20250219 - Input: $3,000 / Output: $15,000
цены для 1 млн токенов
@DevsRoot
🔥1
This media is not supported in your browser
VIEW IN TELEGRAM
вышла нейронка Wan 2.5 от Alibaba. Видео и звук генерируют. Даются бесплатные кредиты для пробы.
Честно говоря некогда с этим баловаться. Я всё жду когда можно будет загрузить книгу, прописать актеров и роли, а тебе выдаст фильм в нужном жанре😁
Попробовать можно тут https://create.wan.video/
@DevsRoot
Честно говоря некогда с этим баловаться. Я всё жду когда можно будет загрузить книгу, прописать актеров и роли, а тебе выдаст фильм в нужном жанре😁
Попробовать можно тут https://create.wan.video/
@DevsRoot
😁1
Бесконечный Цикл
вышла нейронка Wan 2.5 от Alibaba. Видео и звук генерируют. Даются бесплатные кредиты для пробы. Честно говоря некогда с этим баловаться. Я всё жду когда можно будет загрузить книгу, прописать актеров и роли, а тебе выдаст фильм в нужном жанре😁 Попробовать…
This media is not supported in your browser
VIEW IN TELEGRAM
У Грока от Маска кстати получше выходит качество и не такая жесткая цензура.
Правда фей где-то потерял но он много вариантов генерит есть и с ними вроде
@DevsRoot
Правда фей где-то потерял но он много вариантов генерит есть и с ними вроде
@DevsRoot
🔥2
💾Anthropic представила крупное обновление Claude, добавив возможность создания и редактирования файлов непосредственно в интерфейсе, а также ограниченный доступ к сети для установки пакетов и библиотек.
Создание и редактирование файлов
Claude теперь может создавать и редактировать Excel-таблицы (.xlsx), PowerPoint-презентации (.pptx), Word-документы (.docx) и PDF-файлы прямо в диалоге. Вместо получения только текстовых ответов, пользователи могут описать свои потребности и получить готовые к использованию файлы. Функция работает на базе Claude Sonnet 4.5 и использует изолированную вычислительную среду, где Claude пишет и выполняет код на Python и Node.js.
Основные возможности
Новая функция позволяет превращать анализы в таблицы, идеи в презентации, а исследования в отчеты. Claude может создавать финансовые модели с рабочими формулами, выполнять сложный анализ данных, генерировать визуализации, конвертировать файлы между форматами и даже строить модели машинного обучения. Максимальный размер файла составляет 30 МБ для загрузок и выгрузок.
Ограниченный доступ к сети
При включении ограниченного доступа к сети Claude получает возможность устанавливать пакеты и библиотеки из одобренных источников. По умолчанию разрешены следующие домены: GitHub, NPM (registry.npmjs.org), PyPI (pypi.org), Yarn, репозитории Ubuntu и сервисы Anthropic. Это позволяет Claude выполнять продвинутый анализ данных, создавать кастомные визуализации и использовать специализированные библиотеки для обработки файлов.
Управление доступом
Для планов Team и Enterprise администраторы могут настраивать уровни доступа к сети: полное отключение (работа только с предустановленными пакетами), доступ только к пакетным менеджерам (по умолчанию), доступ к пакетным менеджерам и указанным доменам, или полный доступ ко всем доменам. Для планов Pro и Max доступ к сети включен по умолчанию с доступом к одобренным источникам.
Соображения безопасности
Anthropic предупреждает о потенциальных рисках безопасности. Существует возможность prompt injection атак, когда вредоносные инструкции в загруженных файлах или на веб-сайтах могут заставить Claude загружать и выполнять недоверенный код или отправлять конфиденциальные данные из контекста третьим лицам. Рекомендуется внимательно мониторить работу Claude при использовании функции и останавливать его при подозрительной активности.
💾А Чуть ранее 16 Октября появились Claude Skills
Что такое Claude Skills
Claude Skills — это новая функция, представленная Anthropic 15-16 октября 2025 года, которая превращает Claude в специализированного помощника для конкретных рабочих процессов. Skills представляют собой папки с инструкциями, скриптами и ресурсами, которые Claude автоматически загружает по мере необходимости для выполнения определенных задач.
Как это работает
Каждый Skill состоит из обязательного файла Skill.md с метаданными (название и описание) и инструкциями в формате Markdown. Дополнительно можно включать исполняемые скрипты на Python или JavaScript, шаблоны документов, корпоративные гайдлайны и справочные материалы. Claude использует систему прогрессивного раскрытия информации: сначала видит список доступных навыков с описаниями, затем при совпадении с задачей загружает полное содержимое Skill.md, и только при необходимости обращается к дополнительным файлам.
Основные возможности
Skills позволяют автоматизировать рутинные задачи без необходимости каждый раз писать идеальные промпты. Claude сам определяет, какой навык релевантен текущей задаче, что кардинально отличается от Custom GPTs от OpenAI, где все инструкции загружаются сразу. Навыки можно использовать для обеспечения стилистической консистентности текстов, соблюдения корпоративных дизайн-систем и стандартов кода, работы с офисными документами Microsoft 365 (Word, Excel, PowerPoint), и даже для создания сложных рабочих процессов.
@DevsRoot
Создание и редактирование файлов
Claude теперь может создавать и редактировать Excel-таблицы (.xlsx), PowerPoint-презентации (.pptx), Word-документы (.docx) и PDF-файлы прямо в диалоге. Вместо получения только текстовых ответов, пользователи могут описать свои потребности и получить готовые к использованию файлы. Функция работает на базе Claude Sonnet 4.5 и использует изолированную вычислительную среду, где Claude пишет и выполняет код на Python и Node.js.
Основные возможности
Новая функция позволяет превращать анализы в таблицы, идеи в презентации, а исследования в отчеты. Claude может создавать финансовые модели с рабочими формулами, выполнять сложный анализ данных, генерировать визуализации, конвертировать файлы между форматами и даже строить модели машинного обучения. Максимальный размер файла составляет 30 МБ для загрузок и выгрузок.
Ограниченный доступ к сети
При включении ограниченного доступа к сети Claude получает возможность устанавливать пакеты и библиотеки из одобренных источников. По умолчанию разрешены следующие домены: GitHub, NPM (registry.npmjs.org), PyPI (pypi.org), Yarn, репозитории Ubuntu и сервисы Anthropic. Это позволяет Claude выполнять продвинутый анализ данных, создавать кастомные визуализации и использовать специализированные библиотеки для обработки файлов.
Управление доступом
Для планов Team и Enterprise администраторы могут настраивать уровни доступа к сети: полное отключение (работа только с предустановленными пакетами), доступ только к пакетным менеджерам (по умолчанию), доступ к пакетным менеджерам и указанным доменам, или полный доступ ко всем доменам. Для планов Pro и Max доступ к сети включен по умолчанию с доступом к одобренным источникам.
Соображения безопасности
Anthropic предупреждает о потенциальных рисках безопасности. Существует возможность prompt injection атак, когда вредоносные инструкции в загруженных файлах или на веб-сайтах могут заставить Claude загружать и выполнять недоверенный код или отправлять конфиденциальные данные из контекста третьим лицам. Рекомендуется внимательно мониторить работу Claude при использовании функции и останавливать его при подозрительной активности.
💾А Чуть ранее 16 Октября появились Claude Skills
Что такое Claude Skills
Claude Skills — это новая функция, представленная Anthropic 15-16 октября 2025 года, которая превращает Claude в специализированного помощника для конкретных рабочих процессов. Skills представляют собой папки с инструкциями, скриптами и ресурсами, которые Claude автоматически загружает по мере необходимости для выполнения определенных задач.
Как это работает
Каждый Skill состоит из обязательного файла Skill.md с метаданными (название и описание) и инструкциями в формате Markdown. Дополнительно можно включать исполняемые скрипты на Python или JavaScript, шаблоны документов, корпоративные гайдлайны и справочные материалы. Claude использует систему прогрессивного раскрытия информации: сначала видит список доступных навыков с описаниями, затем при совпадении с задачей загружает полное содержимое Skill.md, и только при необходимости обращается к дополнительным файлам.
Основные возможности
Skills позволяют автоматизировать рутинные задачи без необходимости каждый раз писать идеальные промпты. Claude сам определяет, какой навык релевантен текущей задаче, что кардинально отличается от Custom GPTs от OpenAI, где все инструкции загружаются сразу. Навыки можно использовать для обеспечения стилистической консистентности текстов, соблюдения корпоративных дизайн-систем и стандартов кода, работы с офисными документами Microsoft 365 (Word, Excel, PowerPoint), и даже для создания сложных рабочих процессов.
@DevsRoot
Слева https://chat.qwen.ai/
Справа ChatGpt🤣
Жизнь удалась - это когда в пятницу вечером выходишь из дома поужинать и на всякий случай берешь загранпаспорт
С пятницей, много не пейте
Промт для проверки
@DevsRoot
Справа ChatGpt
Жизнь удалась - это когда в пятницу вечером выходишь из дома поужинать и на всякий случай берешь загранпаспорт
С пятницей, много не пейте
Промт для проверки
Крутой чувак вид с зади, идет в сторону огней большого города, голова с корпусом оглядывается назад, рукой приподнимает очки, подмигивает правым глазом, широкая улыбка сверкает зуб золотой, в джинсах в заднем кармане виднеется паспорт. Стиль 3D Art Artstation artist
@DevsRoot
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
❤1
AI-челлендж на чемпионате Yandex Cup — прокачайтесь в самых актуальных темах машинного обучения
Яндекс запустил ML-трек на своем легендарном чемпионате Yandex Cup, и в этом году организаторы собрали задачи, которые редко встречаются в обычных проектах. Это уникальная возможность поработать с передовыми технологиями искусственного интеллекта и заодно проверить свои силы на реальных индустриальных вызовах.
В квалификационном раунде вас ждут три хардкорные задачи, каждая из которых касается горячих тем современных AI-исследований:
ГЕНЕРАЦИЯ ИЗОБРАЖЕНИЙ ДЛЯ АВТОНОМНОГО ТРАНСПОРТА
Представьте, что нужно создать реалистичные картинки для камер беспилотного автомобиля, имея только векторное описание сцены. Это не просто задача по генерации — это шаг в сторону world modelling, одного из ключевых направлений в робототехнике. Умение моделировать визуальное окружение по абстрактному описанию критически важно для обучения автономных систем и симуляции различных дорожных ситуаций. Вы будете работать с генеративными моделями, учиться создавать фотореалистичные сцены и понимать, как AI видит окружающий мир.
БОРЬБА С ГАЛЛЮЦИНАЦИЯМИ БОЛЬШИХ ЯЗЫКОВЫХ МОДЕЛЕЙ
Одна из главных проблем современных LLM — они иногда выдумывают информацию вместо честного «я не знаю». Ваша задача — научить модель корректно отвечать на фактологические вопросы, не перефразировать запросы пользователя и, самое важное, уверенно признавать свою некомпетентность на провокационные или неоднозначные вопросы. Это критически важный навык для создания надежных AI-ассистентов. В процессе вы глубоко погрузитесь в механизмы работы языковых моделей и методы их калибровки.
VISION-LANGUAGE МОДЕЛИ ДЛЯ ПОНИМАНИЯ ТЕХНИЧЕСКИХ ЧЕРТЕЖЕЙ
Научите мультимодальную модель понимать сложные чертежи из задач по геометрии и физике. Звучит просто, но на практике это невероятно сложная задача — модель должна распознавать геометрические фигуры, понимать размерности, читать обозначения и извлекать математические зависимости. Все это в условиях жестких ограничений по вычислительным ресурсам. Вам придется выкручиваться, оптимизировать архитектуры и придумывать креативные решения.
ПОЧЕМУ СТОИТ УЧАСТВОВАТЬ?
Каждая задача — это полноценный research-челлендж. Чтобы показать высокие результаты, придется изучить последние научные публикации по темам. А после участия, возможно, вы сами напишете статью о своем решении! Соревновательный формат, дедлайны и азарт часто рождают самые неожиданные и гениальные подходы.
Лучшие участники по каждой задаче получат приглашение на финал в Стамбуле, где их ждет 5-часовой контест и борьба за призовой фонд в 12 миллионов рублей. Это также отличный шанс познакомиться с топовыми специалистами индустрии, обменяться опытом и показать себя потенциальным работодателям.
ВАЖНЫЕ ДАТЫ:
Квалификация уже стартовала и продлится до 5 ноября — так что времени не так много! Регистрируйтесь, выбирайте задачу по душе и начинайте экспериментировать.
Даже если вы не выйдете в финал, опыт работы с такими задачами бесценен для резюме и понимания современного AI. Это реальные индустриальные проблемы, с которыми сталкиваются компании прямо сейчас.
Регистрация и подробности: https://yandex.ru/cup/ml
@DevsRoot
Яндекс запустил ML-трек на своем легендарном чемпионате Yandex Cup, и в этом году организаторы собрали задачи, которые редко встречаются в обычных проектах. Это уникальная возможность поработать с передовыми технологиями искусственного интеллекта и заодно проверить свои силы на реальных индустриальных вызовах.
В квалификационном раунде вас ждут три хардкорные задачи, каждая из которых касается горячих тем современных AI-исследований:
ГЕНЕРАЦИЯ ИЗОБРАЖЕНИЙ ДЛЯ АВТОНОМНОГО ТРАНСПОРТА
Представьте, что нужно создать реалистичные картинки для камер беспилотного автомобиля, имея только векторное описание сцены. Это не просто задача по генерации — это шаг в сторону world modelling, одного из ключевых направлений в робототехнике. Умение моделировать визуальное окружение по абстрактному описанию критически важно для обучения автономных систем и симуляции различных дорожных ситуаций. Вы будете работать с генеративными моделями, учиться создавать фотореалистичные сцены и понимать, как AI видит окружающий мир.
БОРЬБА С ГАЛЛЮЦИНАЦИЯМИ БОЛЬШИХ ЯЗЫКОВЫХ МОДЕЛЕЙ
Одна из главных проблем современных LLM — они иногда выдумывают информацию вместо честного «я не знаю». Ваша задача — научить модель корректно отвечать на фактологические вопросы, не перефразировать запросы пользователя и, самое важное, уверенно признавать свою некомпетентность на провокационные или неоднозначные вопросы. Это критически важный навык для создания надежных AI-ассистентов. В процессе вы глубоко погрузитесь в механизмы работы языковых моделей и методы их калибровки.
VISION-LANGUAGE МОДЕЛИ ДЛЯ ПОНИМАНИЯ ТЕХНИЧЕСКИХ ЧЕРТЕЖЕЙ
Научите мультимодальную модель понимать сложные чертежи из задач по геометрии и физике. Звучит просто, но на практике это невероятно сложная задача — модель должна распознавать геометрические фигуры, понимать размерности, читать обозначения и извлекать математические зависимости. Все это в условиях жестких ограничений по вычислительным ресурсам. Вам придется выкручиваться, оптимизировать архитектуры и придумывать креативные решения.
ПОЧЕМУ СТОИТ УЧАСТВОВАТЬ?
Каждая задача — это полноценный research-челлендж. Чтобы показать высокие результаты, придется изучить последние научные публикации по темам. А после участия, возможно, вы сами напишете статью о своем решении! Соревновательный формат, дедлайны и азарт часто рождают самые неожиданные и гениальные подходы.
Лучшие участники по каждой задаче получат приглашение на финал в Стамбуле, где их ждет 5-часовой контест и борьба за призовой фонд в 12 миллионов рублей. Это также отличный шанс познакомиться с топовыми специалистами индустрии, обменяться опытом и показать себя потенциальным работодателям.
ВАЖНЫЕ ДАТЫ:
Квалификация уже стартовала и продлится до 5 ноября — так что времени не так много! Регистрируйтесь, выбирайте задачу по душе и начинайте экспериментировать.
Даже если вы не выйдете в финал, опыт работы с такими задачами бесценен для резюме и понимания современного AI. Это реальные индустриальные проблемы, с которыми сталкиваются компании прямо сейчас.
Регистрация и подробности: https://yandex.ru/cup/ml
@DevsRoot
🔥1
⚡️Компания Nvidia представила свою новую платформу для работы с искусственным интеллектом Vera Rubin Superchip на конференции GTC в Вашингтоне, анонсировав революционное решение, которое поступит в производство во второй половине 2026 года. Глава компании Дженсен Хуанг лично продемонстрировал образцы нового оборудования, назвав систему "невероятно красивым компьютером" с производительностью 100 петафлопс в режиме FP4.
Vera Rubin Superchip представляет собой интегрированную систему на одной плате, объединяющую два мощных графических процессора Rubin и процессор Vera на базе архитектуры ARM. Каждый из двух GPU оснащен 288 гигабайтами памяти стандарта HBM4, что в сумме дает 576 ГБ видеопамяти на единственную плату. Это почти втрое больше, чем у современных флагманских решений. Процессор Vera включает 88 собственных ядер ARM с поддержкой 176 потоков, специально оптимизированных для работы с задачами искусственного интеллекта.
Архитектура GPU Rubin базируется на двух чипсетах, изготовленных по технологическому процессу TSMC N3P. Каждый графический процессор оборудован восемью стеками памяти HBM4 нового поколения с пропускной способностью до 13 терабайт в секунду на чип. Образцы чипов, продемонстрированные на конференции, были произведены на Тайване в конце сентября 2025 года, что подтверждает активную фазу разработки.
Энергопотребление одной платы Vera Rubin Superchip составляет впечатляющие 1800 ватт, что существенно превышает показатели предыдущего поколения Blackwell, потребляющего около 1200-1400 ватт. Это требует применения продвинутых систем жидкостного охлаждения с микроканальными холодными пластинами для эффективного отвода тепла. Для размещения целых стоек с такими системами потребуется инфраструктура мощностью до 600 киловатт на стойку.
Объем памяти в 576 гигабайт позволяет выполнять инференс крупнейших языковых моделей непосредственно на одной плате. Например, модель GLM-4.6 с 355 миллиардами параметров в формате FP8 требует примерно 355 гигабайт памяти для размещения весов, что укладывается в доступный объем. Это открывает новые возможности для развертывания мощных систем искусственного интеллекта без необходимости распределения модели между несколькими устройствами.
Платформа Vera Rubin NVL144 в полной комплектации объединяет 72 Superchip с общей вычислительной мощностью 3.6 эксафлопс для инференса FP4 и 1.2 эксафлопс для тренировки в FP8, что втрое превосходит текущее поколение GB300 NVL72. Общий объем высокоскоростной памяти в таких системах достигает 75 терабайт.
Развитие архитектур для нейросетевых вычислений идет по пути наращивания объемов памяти, увеличения пропускной способности и оптимизации под вычисления низкой точности FP4 и FP8. Это позволяет достичь баланса между производительностью и энергоэффективностью, критически важного для массового развертывания систем генеративного искусственного интеллекта в дата-центрах по всему миру.
@DevsRoot
Vera Rubin Superchip представляет собой интегрированную систему на одной плате, объединяющую два мощных графических процессора Rubin и процессор Vera на базе архитектуры ARM. Каждый из двух GPU оснащен 288 гигабайтами памяти стандарта HBM4, что в сумме дает 576 ГБ видеопамяти на единственную плату. Это почти втрое больше, чем у современных флагманских решений. Процессор Vera включает 88 собственных ядер ARM с поддержкой 176 потоков, специально оптимизированных для работы с задачами искусственного интеллекта.
Архитектура GPU Rubin базируется на двух чипсетах, изготовленных по технологическому процессу TSMC N3P. Каждый графический процессор оборудован восемью стеками памяти HBM4 нового поколения с пропускной способностью до 13 терабайт в секунду на чип. Образцы чипов, продемонстрированные на конференции, были произведены на Тайване в конце сентября 2025 года, что подтверждает активную фазу разработки.
Энергопотребление одной платы Vera Rubin Superchip составляет впечатляющие 1800 ватт, что существенно превышает показатели предыдущего поколения Blackwell, потребляющего около 1200-1400 ватт. Это требует применения продвинутых систем жидкостного охлаждения с микроканальными холодными пластинами для эффективного отвода тепла. Для размещения целых стоек с такими системами потребуется инфраструктура мощностью до 600 киловатт на стойку.
Объем памяти в 576 гигабайт позволяет выполнять инференс крупнейших языковых моделей непосредственно на одной плате. Например, модель GLM-4.6 с 355 миллиардами параметров в формате FP8 требует примерно 355 гигабайт памяти для размещения весов, что укладывается в доступный объем. Это открывает новые возможности для развертывания мощных систем искусственного интеллекта без необходимости распределения модели между несколькими устройствами.
Платформа Vera Rubin NVL144 в полной комплектации объединяет 72 Superchip с общей вычислительной мощностью 3.6 эксафлопс для инференса FP4 и 1.2 эксафлопс для тренировки в FP8, что втрое превосходит текущее поколение GB300 NVL72. Общий объем высокоскоростной памяти в таких системах достигает 75 терабайт.
Развитие архитектур для нейросетевых вычислений идет по пути наращивания объемов памяти, увеличения пропускной способности и оптимизации под вычисления низкой точности FP4 и FP8. Это позволяет достичь баланса между производительностью и энергоэффективностью, критически важного для массового развертывания систем генеративного искусственного интеллекта в дата-центрах по всему миру.
@DevsRoot
👍2
🤓 Немного бухгалтерского и руководительского
Новый классификатор профессий (ОКПДТР) с 1 января 2026
С начала следующего года будет действовать обновлённый справочник профессий и должностей, который заменит старый документ 1994 года. По сути, это официальный перечень всех профессий и должностей с их кодами, который используется для отчётности перед государством - в Пенсионный фонд, Росстат и другие ведомства.[1][2][3]
Кому нужно обязательно обновить документы: компаниям, у которых есть сотрудники с особыми условиями - досрочные пенсии, вредные условия труда, льготы. Для таких должностей название в трудовом договоре и других документах должно точно совпадать с новым классификатором.[3]
Что делать до Нового года: кадровикам и бухгалтерам нужно проверить все документы - трудовые договоры, штатное расписание, должностные инструкции - и привести названия должностей в соответствие с новым справочником.[4][5]
Новые правила начисления премий с 1 сентября 2025
Это изменение уже вступило в силу и защищает работников от произвольного лишения премий. Раньше работодатель мог по своему усмотрению не платить премию или снять её полностью - теперь так нельзя.[6][7]
Главные правила:
- Лишить премии полностью нельзя - можно только уменьшить, и то с ограничениями[7][6]
- Снизить премию можно только за тот месяц, когда было нарушение - если выговор объявили в марте, то снижение применяется только к мартовской премии, а не ко всем последующим[7]
- Максимум на 20% от общей зарплаты - если оклад 50 тысяч плюс премия 40 тысяч (всего 90 тысяч), снизить можно максимум на 18 тысяч, то есть работник всё равно получит минимум 72 тысячи[7]
- Все условия должны быть прописаны в документах - размеры премий, сроки выплат, за что начисляются[7]
Что грозит работодателям: за нарушение этих правил компанию могут оштрафовать на 30-50 тысяч рублей, а директора или кадровика - на 10-20 тысяч. Кроме того, работник может обратиться в суд, и компанию заставят доплатить деньги.[7]
Важное изменение в расчёте среднего заработка: премии теперь учитываются по новым правилам при расчёте отпускных, командировочных и больничных.[6]
Новые договоры о материальной ответственности с 1 сентября 2025
Это касается сотрудников, которые работают с материальными ценностями - кассиров, кладовщиков, продавцов, курьеров.[8][9]
Главное нововведение: теперь такие договоры можно заключать в электронном виде через специальные системы (например, 1С, Контур). Раньше это были только бумажные документы.[9][8]
Важно: сам список должностей, с которыми заключают такие договоры, не изменился - кассиры, заведующие складами, товароведы и другие.[8][9]
Нужно ли переделывать старые договоры: Минтруд разъяснил, что перезаключать действующие договоры не обязательно. Они продолжают работать, если не противоречат Трудовому кодексу. Но для новых сотрудников нужно использовать обновлённые формы договоров.[9][8]
Практический смысл: если договор заключён электронно, то все изменения и дополнения к нему также оформляются только в электронном виде. Это упрощает документооборот для компаний.[8][9]
[1](https://www.consultant.ru/legalnews/28857/)
[2](https://www.garant.ru/news/1822790/)
[3](https://tenchat.ru/media/3904290-chto-nuzhno-znat-o-novom-klassifikatore-professiy-s-2026-goda)
[4](https://www.glavbukh.ru/news/53555-utverjdn-novyy-klassifikator-professiy-doljnostey-dlya-vybora-kodov-okz-v-efs-1)
[5](https://ppt.ru/news/klassifikatory-i-spravochniki/s-2026-goda-nuzhno-primenyat-novyy-klassifikator-professiy)
[6](https://mip-expert.ru/articles/oplata-truda/algoritm-deystviy-rabotodatelya-v-svyazi-s-novym-poryadkom-premirovaniya-s-1-sentyabrya-2025-goda/)
[7](https://www.pro-ability.ru/article_hr/tpost/amjz715el1-klyuchevie-izmeneniya-v-premirovanii-s-1)
[8](https://www.pro-ability.ru/tpost/4c4tud6271-mintrud-perevodit-dogovori-materialnoi-o)
[9](http://consultant29.ru/news/novyie-dogovoryi-o-materialnoj-otvetstvennosti-s-1-sentyabrya.html)
[10](https://www.glavbukh.ru/news/53599-obnovili-klassifikator-professiy-doljnostey-dlya-vybora-kodov-okz-v-efs-1)
@DevsRoot
Новый классификатор профессий (ОКПДТР) с 1 января 2026
С начала следующего года будет действовать обновлённый справочник профессий и должностей, который заменит старый документ 1994 года. По сути, это официальный перечень всех профессий и должностей с их кодами, который используется для отчётности перед государством - в Пенсионный фонд, Росстат и другие ведомства.[1][2][3]
Кому нужно обязательно обновить документы: компаниям, у которых есть сотрудники с особыми условиями - досрочные пенсии, вредные условия труда, льготы. Для таких должностей название в трудовом договоре и других документах должно точно совпадать с новым классификатором.[3]
Что делать до Нового года: кадровикам и бухгалтерам нужно проверить все документы - трудовые договоры, штатное расписание, должностные инструкции - и привести названия должностей в соответствие с новым справочником.[4][5]
Новые правила начисления премий с 1 сентября 2025
Это изменение уже вступило в силу и защищает работников от произвольного лишения премий. Раньше работодатель мог по своему усмотрению не платить премию или снять её полностью - теперь так нельзя.[6][7]
Главные правила:
- Лишить премии полностью нельзя - можно только уменьшить, и то с ограничениями[7][6]
- Снизить премию можно только за тот месяц, когда было нарушение - если выговор объявили в марте, то снижение применяется только к мартовской премии, а не ко всем последующим[7]
- Максимум на 20% от общей зарплаты - если оклад 50 тысяч плюс премия 40 тысяч (всего 90 тысяч), снизить можно максимум на 18 тысяч, то есть работник всё равно получит минимум 72 тысячи[7]
- Все условия должны быть прописаны в документах - размеры премий, сроки выплат, за что начисляются[7]
Что грозит работодателям: за нарушение этих правил компанию могут оштрафовать на 30-50 тысяч рублей, а директора или кадровика - на 10-20 тысяч. Кроме того, работник может обратиться в суд, и компанию заставят доплатить деньги.[7]
Важное изменение в расчёте среднего заработка: премии теперь учитываются по новым правилам при расчёте отпускных, командировочных и больничных.[6]
Новые договоры о материальной ответственности с 1 сентября 2025
Это касается сотрудников, которые работают с материальными ценностями - кассиров, кладовщиков, продавцов, курьеров.[8][9]
Главное нововведение: теперь такие договоры можно заключать в электронном виде через специальные системы (например, 1С, Контур). Раньше это были только бумажные документы.[9][8]
Важно: сам список должностей, с которыми заключают такие договоры, не изменился - кассиры, заведующие складами, товароведы и другие.[8][9]
Нужно ли переделывать старые договоры: Минтруд разъяснил, что перезаключать действующие договоры не обязательно. Они продолжают работать, если не противоречат Трудовому кодексу. Но для новых сотрудников нужно использовать обновлённые формы договоров.[9][8]
Практический смысл: если договор заключён электронно, то все изменения и дополнения к нему также оформляются только в электронном виде. Это упрощает документооборот для компаний.[8][9]
[1](https://www.consultant.ru/legalnews/28857/)
[2](https://www.garant.ru/news/1822790/)
[3](https://tenchat.ru/media/3904290-chto-nuzhno-znat-o-novom-klassifikatore-professiy-s-2026-goda)
[4](https://www.glavbukh.ru/news/53555-utverjdn-novyy-klassifikator-professiy-doljnostey-dlya-vybora-kodov-okz-v-efs-1)
[5](https://ppt.ru/news/klassifikatory-i-spravochniki/s-2026-goda-nuzhno-primenyat-novyy-klassifikator-professiy)
[6](https://mip-expert.ru/articles/oplata-truda/algoritm-deystviy-rabotodatelya-v-svyazi-s-novym-poryadkom-premirovaniya-s-1-sentyabrya-2025-goda/)
[7](https://www.pro-ability.ru/article_hr/tpost/amjz715el1-klyuchevie-izmeneniya-v-premirovanii-s-1)
[8](https://www.pro-ability.ru/tpost/4c4tud6271-mintrud-perevodit-dogovori-materialnoi-o)
[9](http://consultant29.ru/news/novyie-dogovoryi-o-materialnoj-otvetstvennosti-s-1-sentyabrya.html)
[10](https://www.glavbukh.ru/news/53599-obnovili-klassifikator-professiy-doljnostey-dlya-vybora-kodov-okz-v-efs-1)
@DevsRoot