Антропик добрался до всех офисных приложений. Жду, когда, наконец, они их полностью перепишут. Пора бы уже.
https://claude.com/claude-for-microsoft-365
https://claude.com/claude-for-microsoft-365
Claude
Claude for Microsoft 365 | Claude by Anthropic
Claude works inside Excel, PowerPoint, Word, and Outlook. Edit your files, carry context across all four apps, and stay in control of every change.
При этом сам Copilot теперь может работать на GPT 5.5 Instant. Впрочем, никому он не интересен, как мне кажется. Кто-то пользуется копайлотом в офисных приложениях?
Из других новостей от OpenAI - расширили функционал Codex по работе в браузере Google Chrome. Теперь он может сам создавать вкладки, работать в фоне и пр. Вот это любопытно, надо попробовать
https://developers.openai.com/codex/app/chrome-extension
https://developers.openai.com/codex/app/chrome-extension
ChatGPT Learn
Browser extension | ChatGPT Learn
Use Chrome, Edge, Brave, Opera, or Vivaldi with ChatGPT
Ах, да, еще маленькая и быстрая моделька от Google..
https://cloud.google.com/blog/products/ai-machine-learning/gemini-3-1-flash-lite-is-now-generally-available
https://cloud.google.com/blog/products/ai-machine-learning/gemini-3-1-flash-lite-is-now-generally-available
Google Cloud Blog
Gemini 3.1 Flash-Lite is now generally available | Google Cloud Blog
Gemini 3.1 Flash-Lite is now generally available. Designed for ultra-low latency, high-volume tasks, and unmatched cost-efficiency, Flash-Lite is already transforming how applications are built at scale.
Forwarded from Сергей Баранов: архитектура и ИТ-стратегия (Сергей Баранов)
Can I Run AI locally?
Задаете параметры своей локальной машины и получаете список моделей с оценкой их производительности на ваших мощностях.
Внутри каждой модели оценка в каждом доступном кванте.
https://www.canirun.ai
Задаете параметры своей локальной машины и получаете список моделей с оценкой их производительности на ваших мощностях.
Внутри каждой модели оценка в каждом доступном кванте.
https://www.canirun.ai
Forwarded from Анализ данных (Data analysis)
Anthropic научили Claude не шантажировать пользователей.
Помните прошлогодний скандал, когда Claude в специально подстроенных сценариях начинал шантажировать пользователя, чтобы избежать отключения? Anthropic выкатили исследование о том, как они полностью убрали это поведение, и подход там любопытный.
Сначала команда разобралась, откуда вообще взялся этот шантаж. Виноват оказался интернет: модель насмотрелась текстов, где ИИ изображается злым, хитрым и одержимым самосохранением. Стандартный пост-тренинг ситуацию не ухудшал, но и не лечил.
Дальше пробовали классический путь - показывать Claude примеры безопасного поведения в сценариях, похожих на тестовые. Эффект оказался слабым, даже несмотря на схожесть данных с финальной оценкой. Тогда инженеры переписали ответы так, чтобы в них проступали достойные причины поступать правильно. Уже теплее.
Лучше всего сработал датасет, где пользователь оказывается в этически сложной ситуации, а ассистент даёт принципиальный и качественный ответ. Сценарии в обучении были далеки от тестовых, но именно эта выборка дала максимальный прирост безопасности.
Дополнительно команда смешала качественные документы по Claude с художественными историями про согласованный, этичный ИИ. Результат - снижение агентного мисалаймента более чем в три раза, хотя сюжеты вообще не пересекались с оценочными сценариями.
Ещё пара важных моментов. Эффект от таких интервенций переживает последующее обучение с подкреплением и стакается с обычным harmlessness-тренингом. А диверсификация данных тоже помогает: добавили в простой чат-датасет про безопасность посторонние инструменты и системные промпты, и шантаж исчез из поведения быстрее.
Модели нужно объяснять не только что делать, но и почему так поступать правильно. Демонстрации работают, нарративы и принципы работают сильнее.
Полный отчёт: alignment.anthropic.com/2026/teaching-claude-why/
Помните прошлогодний скандал, когда Claude в специально подстроенных сценариях начинал шантажировать пользователя, чтобы избежать отключения? Anthropic выкатили исследование о том, как они полностью убрали это поведение, и подход там любопытный.
Сначала команда разобралась, откуда вообще взялся этот шантаж. Виноват оказался интернет: модель насмотрелась текстов, где ИИ изображается злым, хитрым и одержимым самосохранением. Стандартный пост-тренинг ситуацию не ухудшал, но и не лечил.
Дальше пробовали классический путь - показывать Claude примеры безопасного поведения в сценариях, похожих на тестовые. Эффект оказался слабым, даже несмотря на схожесть данных с финальной оценкой. Тогда инженеры переписали ответы так, чтобы в них проступали достойные причины поступать правильно. Уже теплее.
Лучше всего сработал датасет, где пользователь оказывается в этически сложной ситуации, а ассистент даёт принципиальный и качественный ответ. Сценарии в обучении были далеки от тестовых, но именно эта выборка дала максимальный прирост безопасности.
Дополнительно команда смешала качественные документы по Claude с художественными историями про согласованный, этичный ИИ. Результат - снижение агентного мисалаймента более чем в три раза, хотя сюжеты вообще не пересекались с оценочными сценариями.
Ещё пара важных моментов. Эффект от таких интервенций переживает последующее обучение с подкреплением и стакается с обычным harmlessness-тренингом. А диверсификация данных тоже помогает: добавили в простой чат-датасет про безопасность посторонние инструменты и системные промпты, и шантаж исчез из поведения быстрее.
Модели нужно объяснять не только что делать, но и почему так поступать правильно. Демонстрации работают, нарративы и принципы работают сильнее.
Полный отчёт: alignment.anthropic.com/2026/teaching-claude-why/
Наслаждаюсь в Codex командой /goal - сделали задачку, запустил ее с этой командой, уже час кодекс потихоньку ее допиливает. Лимитов даже на 100 баксах дофига (не сглазить бы). Очень хорошо
Еще раз напоминание всем. Лучше пользуйтесь Claude code, и ваши промпты никуда не денутся. А я - тоже буду считать себя русским айтишником. Теперь, правда, для Клода - я канадец.
https://t.me/data_secrets/9190
https://t.me/data_secrets/9190
Telegram
Data Secrets
Российские айтишники забили тревогу на фоне потери доступа к аккаунтам Claude
Как пишет Baza, с проблемой уже столкнулись сотни айтишников и бизнесменов из РФ, только на основании паспорта. Главная беда - потеря всех наработок, вроде перепроверенной и переписанной…
Как пишет Baza, с проблемой уже столкнулись сотни айтишников и бизнесменов из РФ, только на основании паспорта. Главная беда - потеря всех наработок, вроде перепроверенной и переписанной…
🔥1😢1
Будучи топ-менеджером, который занимается нейронками на досуге, я могу сказать, что единственный смысл заставлять топов что-то делать своими руками заключается только в том, чтобы они разобрались в технологии и возможностях. Их код, конечно, никому ни нахрен не нужен. Но зато они будут понимать, что возможно, и без кого можно обойтись…
https://t.me/partially_unsupervised/292
https://t.me/partially_unsupervised/292
Telegram
partially unsupervised
Наблюдая одним глазом за внедрением кодинг агентов на разных уровнях в разных компаниях, я не могу ответить на один вопрос: зачем топ-менеджеры поддерживают (а иногда и форсят) политику, что менеджеры теперь всерьез должны коммитить код. Не тимлиды, а настоящие…
💯1
Для любителей писать собственные промпты - не уверен, что все так прекрасно, как описывается, но можно пробовать
https://x.com/mnilax/status/2053116311132155938?s=46
https://x.com/mnilax/status/2053116311132155938?s=46
X (formerly Twitter)
Mnimiy (@Mnilax) on X
Karpathy's 4 CLAUDE.md rules cut Claude mistakes from 41% to 11%. After 30 codebases, I added 8 more
Снимок экрана 2026-05-10 в 17.11.40.png
146.1 KB
Запустил тут максимально практичный проект - посмотреть на вино в ближайших винотеках, сравнить с ценами производителей, изучить рейтинги и т.д. Codex воспринял задачу очень серьезно - поставил его на паузу после 16 часов непрерывной работы. Но прямо скажем, далось ему это не легко.
🔥1
Forwarded from эйай ньюз
Google тестит Gemini Omni
Похоже теперь Gemini умеет в видеогенерацию, а моделям Veo, как отдельной линейке, пришёл конец. Логичный шаг, учитывая возможность Gemini выдавать на выход как аудио так и изображения. Модель скорее всего полноценно покажут на следующей неделе, на Google I/O.
@ai_newz
Похоже теперь Gemini умеет в видеогенерацию, а моделям Veo, как отдельной линейке, пришёл конец. Логичный шаг, учитывая возможность Gemini выдавать на выход как аудио так и изображения. Модель скорее всего полноценно покажут на следующей неделе, на Google I/O.
@ai_newz
Большое обсуждение пошло вокруг статьи о том, что а работе с ИИ html заменит markdown. Любопытно, даже Карпаты ответил
https://x.com/karpathy/status/2053872850101285137?s=46
https://x.com/karpathy/status/2053872850101285137?s=46
X (formerly Twitter)
Andrej Karpathy (@karpathy) on X
This works really well btw, at the end of your query ask your LLM to "structure your response as HTML", then view the generated file in your browser. I've also had some success asking the LLM to p…
Про память и сновидения у Клода послушать можно здесь. Очень крутую фишку прикрутили. Кстати, русский перевод можно выбрать, если что
YouTube
Memory and dreaming for self-learning agents
How memory and dreaming turn Claude Managed Agents into self-learning systems. This session walks through design considerations for memory architectures and how dreaming verifies and enriches memory between sessions.
Здесь киллер фича - не сессии терминалов, хотя это тоже круто, но новая команда /goal - это шикарная штука. Не сомневался, что Антропик не будет ждать, чтобы ее скопировать у OpenAI. С ней агент может работать десятки часов. Проверено. Удивительно, что такие ребята как Google сидят на попе ровно и ничего не делают со своим Gemini..
https://t.me/tips_ai/4684
https://t.me/tips_ai/4684
Telegram
Tips AI | IT & AI
В Claude Code появился agent view, где все твои сессии видно одним списком.
Если раньше параллельная работа в СС была с жонглированием вкладками терминала, tmux-сеткой и попытки удержать в голове, к чему возвращаться.
Теперь с одного экрана видно: какие…
Если раньше параллельная работа в СС была с жонглированием вкладками терминала, tmux-сеткой и попытки удержать в голове, к чему возвращаться.
Теперь с одного экрана видно: какие…
Forwarded from Data Secrets
DeepMind сделали указатель мышки с ИИ
Да, ИИ может в перспективе изменить даже такие привычные вещи. Компьютерный курсор как концепция не менялся почти 50 лет, и вот DeepMind предлагают его переосмыслить.
В их механике курсор – это больше не просто курсор, которым мы водим по интерфейсу, а скорее выделитель контекста для встроенного агента.
Например, вы наводите курсор на таблицу и просите «у мышки» сформировать из нее график. Или выделяете название ресторана на картинке, а агент для вас его бронирует.
Тем самым с человека частично снимается даже такая когнитивная нагрузка, как написание промпта. То есть вам не надо объяснять ИИ детали, вы просто тыкаете во что-то и говорите «расскажи про ЭТО», «перемести ЭТО СЮДА», «исправь ЗДЕСЬ».
И, на самом деле, такое совмещение речи с жестами для человека максимально естественно, так что идея прикольная.
deepmind.google/blog/ai-pointer/
Попробовать уже можно в Gemini in Chrome и в Google AI Studio, а еще указатель собираются встроить в новые ноутбуки GoogleBook, спроектированные специально под ИИ-экспириенс.
Да, ИИ может в перспективе изменить даже такие привычные вещи. Компьютерный курсор как концепция не менялся почти 50 лет, и вот DeepMind предлагают его переосмыслить.
В их механике курсор – это больше не просто курсор, которым мы водим по интерфейсу, а скорее выделитель контекста для встроенного агента.
Например, вы наводите курсор на таблицу и просите «у мышки» сформировать из нее график. Или выделяете название ресторана на картинке, а агент для вас его бронирует.
Тем самым с человека частично снимается даже такая когнитивная нагрузка, как написание промпта. То есть вам не надо объяснять ИИ детали, вы просто тыкаете во что-то и говорите «расскажи про ЭТО», «перемести ЭТО СЮДА», «исправь ЗДЕСЬ».
И, на самом деле, такое совмещение речи с жестами для человека максимально естественно, так что идея прикольная.
deepmind.google/blog/ai-pointer/
Попробовать уже можно в Gemini in Chrome и в Google AI Studio, а еще указатель собираются встроить в новые ноутбуки GoogleBook, спроектированные специально под ИИ-экспириенс.