Forwarded from Сиолошная
Grok 4.20, обещаемый Elon Musk с августа прошлого года, появился в бете на https://grok.com/ .
При обработке вашего запроса используется до 4 агентов, которые общаются между собой; одному из них назначается роль лидера.
Думаю, что с точки зрения качества эти агенты не должны существенно накидывать по отношению к одной длинной цепочке рассуждений, но могут потенциально уменьшать время до получения ответа за счёт параллельных рассуждений и поиска.
При обработке вашего запроса используется до 4 агентов, которые общаются между собой; одному из них назначается роль лидера.
Думаю, что с точки зрения качества эти агенты не должны существенно накидывать по отношению к одной длинной цепочке рассуждений, но могут потенциально уменьшать время до получения ответа за счёт параллельных рассуждений и поиска.
Sonnet - рабочая лошадка, особенно, на подписке за 20 баксов. Поэтому обновление важное
Интересная статья про оптимизацию агентов, сам сейчас этим занимаюсь..
X (formerly Twitter)
Viv (@Vtrivedy10) on X
Improving Deep Agents with Harness Engineering
Кстати, если захотите подключить к своему OpenClaw Sonnet по подписке, то здесь написано, как это сделать через Claude code. Не используйте API, это раз в 10 дороже
X (formerly Twitter)
OpenClaw🦞 (@openclaw) on X
here's how to use the 1M context beta: https://t.co/em2fgg20hs
Киберпанк с OpenClaw продолжается. На этот раз вышла капча, которая проверяет, не то, что ты человек, а наоборот - что ты агент, а не человек. Чтобы люди не лезли на сайты для агентов. Выглядит примерно так:
uM] lI^kE tH-iS l[Ob/StE]r HaS^ eI[gHt/EeN] nEu-RoNs^ aNd[ LoS/eS tH]rEe, HoW^ mAn[Y lEfT?
Агент моментально отвечает: 15 ))
uM] lI^kE tH-iS l[Ob/StE]r HaS^ eI[gHt/EeN] nEu-RoNs^ aNd[ LoS/eS tH]rEe, HoW^ mAn[Y lEfT?
Агент моментально отвечает: 15 ))
Прикольный и несложный лайфхак. Повторяйте промпт дважды!
Telegram
Machine learning Interview
⚡️ Исследование показало: если просто повторить один и тот же запрос дважды, точность LLM заметно растёт.
В тесте на поиск элемента в длинном списке результат одной модели вырос с 21% до 97%.
Никакого файнтюнинга, дополнительных вычислений или хитрого…
В тесте на поиск элемента в длинном списке результат одной модели вырос с 21% до 97%.
Никакого файнтюнинга, дополнительных вычислений или хитрого…
Немножко добрых, но сложных советов. Для тех, кто осилит
Telegram
LLM под капотом
Список вещей, которые отправлял знакомым в последние недели с пометкой “посмотри обязательно”
• Попробовать самостоятельно OpenClaw
• Читаем про Engineering Harness в разработке (Mitchell Hashimoto + OpenAI)
• Читаем про context graphs / траектории агентов…
• Попробовать самостоятельно OpenClaw
• Читаем про Engineering Harness в разработке (Mitchell Hashimoto + OpenAI)
• Читаем про context graphs / траектории агентов…
Я такие сетки не использую, но забавная фича..
Telegram
Data Secrets
Google представили Lyria 3 для генерации музыки
Самое интересное в модельке, – пожалуй, то, что она мультимодальная. Трек можно создать не только по промпту, но и из фото или видео.
То есть вы можете просто молча (или вместе с текстом) загрузить изображение…
Самое интересное в модельке, – пожалуй, то, что она мультимодальная. Трек можно создать не только по промпту, но и из фото или видео.
То есть вы можете просто молча (или вместе с текстом) загрузить изображение…
А это уже добрые советы для продвинутых пользователей
Telegram
Denis Sexy IT 🤖
Немного полезной фигни всем тем двум людям помимо меня, кто гоняет своего OpenClaw / Claude Code CLI через телеграм:
– Этот браузер попросите поставить и сделать его дефолтом для браузинга – заметно меньше токенов потребляет:
https://github.com/pinchtab/pinchtab…
– Этот браузер попросите поставить и сделать его дефолтом для браузинга – заметно меньше токенов потребляет:
https://github.com/pinchtab/pinchtab…
❤1
Мини-энциклопедия методов обучения нейронок
https://djdumpling.github.io/2026/01/31/frontier_training.html
https://djdumpling.github.io/2026/01/31/frontier_training.html
Alex Wa's Blog
frontier model training methodologies
How do labs train a frontier, multi-billion parameter model? We look towards seven open-weight frontier models: Hugging Face’s SmolLM3, Prime Intellect’s Intellect 3, Nous Research’s Hermes 4, OpenAI’s gpt-oss-120b, Moonshot’s Kimi K2, DeepSeek’s DeepSeek…
Forwarded from Осцилляции WaveCut (WaveCut)
Это было неизбежно: рано или поздно должны были появиться специализированные решения для инференса.
И вот, Taalas (бывшая команда из Tenstorrent) выкатили то, чего я так ждал — настоящий Direct-to-Silicon.
Ребята не стали мелочиться и буквально «запекли» модель в кремний. Никакой внешней памяти, никакого HBM, никакой сложной упаковки. Веса модели и архитектура — это и есть сам чип.
Цифры выглядят дико: 17,000 токенов в секунду на Llama 3.1 8B.
Это на порядок быстрее текущей SOTA GPU, при этом чип стоит в 20 раз дешевле в производстве и потребляет в 10 раз меньше энергии.
Самое крутое, что это не просто красивые слайды для инвесторов. Железо уже существует, и его можно «потрогать» (ссылка на демо внизу).
Конечно, это ASIC, и тут есть нюанс: чип заточен под одну конкретную модель. Но Taalas продумали этот момент — они оставили поддержку LoRA-адаптеров и изменяемого контекстного окна. То есть это не совсем уж «кирпич», гибкость для файн-тюнинга остается.
Сейчас у них готов чип с Llama 8B (HC1). Весной обещают выкатить что-то среднеразмерное с ризонингом, а к зиме грозятся показать фронтир-модель на втором поколении кремния.
У меня голова идет кругом от мыслей к чему это может привести.
Ссылки:
• Анонс
• Демо (скорость реально впечатляет)
И вот, Taalas (бывшая команда из Tenstorrent) выкатили то, чего я так ждал — настоящий Direct-to-Silicon.
Ребята не стали мелочиться и буквально «запекли» модель в кремний. Никакой внешней памяти, никакого HBM, никакой сложной упаковки. Веса модели и архитектура — это и есть сам чип.
Цифры выглядят дико: 17,000 токенов в секунду на Llama 3.1 8B.
Это на порядок быстрее текущей SOTA GPU, при этом чип стоит в 20 раз дешевле в производстве и потребляет в 10 раз меньше энергии.
Самое крутое, что это не просто красивые слайды для инвесторов. Железо уже существует, и его можно «потрогать» (ссылка на демо внизу).
Конечно, это ASIC, и тут есть нюанс: чип заточен под одну конкретную модель. Но Taalas продумали этот момент — они оставили поддержку LoRA-адаптеров и изменяемого контекстного окна. То есть это не совсем уж «кирпич», гибкость для файн-тюнинга остается.
Сейчас у них готов чип с Llama 8B (HC1). Весной обещают выкатить что-то среднеразмерное с ризонингом, а к зиме грозятся показать фронтир-модель на втором поколении кремния.
У меня голова идет кругом от мыслей к чему это может привести.
Ссылки:
• Анонс
• Демо (скорость реально впечатляет)
Модели Google вроде бы и умные, но никто на них не программирует. Изменится ли это с 3.1 pro? Посмотрим..
https://t.me/ai_machinelearning_big_data/9558
https://t.me/ai_machinelearning_big_data/9558
Telegram
Machinelearning
⚡️ Релиз Gemini 3.1 Pro - новый уровень интеллекта моделей
Google официально представила Gemini 3.1 Pro, и результаты выглядят серьёзно: модель показала 77,1% в одном из самых сложных тестов на абстрактное мышление — ARC-AGI-2.
- Резкий скачок качества…
Google официально представила Gemini 3.1 Pro, и результаты выглядят серьёзно: модель показала 77,1% в одном из самых сложных тестов на абстрактное мышление — ARC-AGI-2.
- Резкий скачок качества…
Клод теперь умеет работать с git worktrees. Посмотреть о том, что это за штука, лучше здесь - вообще, это парень, который делает годные видео по Claude code, максимально рекомендую
YouTube
Stop Using Claude Code on One Branch (Do This Instead)
🚀 Access ALL video resources & get personalized help in my community:
https://www.skool.com/agentic-labs
💬 My AI voice-to-text software (Wispr Flow): https://wisprflow.ai/r?LEON114
☕ Buy me a coffee: https://www.buymeacoffee.com/leonvanzyl
💵 Donate using…
https://www.skool.com/agentic-labs
💬 My AI voice-to-text software (Wispr Flow): https://wisprflow.ai/r?LEON114
☕ Buy me a coffee: https://www.buymeacoffee.com/leonvanzyl
💵 Donate using…
Claude code получил встроенную функцию security для проверки кода на известные уязвимости. Такая проверка никогда не будет лишней
Anthropic
Making frontier cybersecurity capabilities available to defenders
Claude Code Security is one step towards our goal of more secure codebases and a higher security baseline across the industry.
О, тут некоторое время назад установил себе Claude в Excel, а сегодня поставил себе его и в PowerPoint. Это вам не кривой и косой Microsoft Copilot! Танцы с бубном, честно говоря, потребовались, но все получилось, правда надо учитывать канадский телефон и имою платную подписку на офис (ставил ее именно для таких целей, тоже пришлось поплясать, чтобы денег Майкрософту заплатить)...
А в целом, это game changer - не картинки рисовать, а с нейронкой именно презентацию редактировать. И других альтернатив разумных пока нет.
https://claude.com/claude-in-powerpoint
А в целом, это game changer - не картинки рисовать, а с нейронкой именно презентацию редактировать. И других альтернатив разумных пока нет.
https://claude.com/claude-in-powerpoint
Claude
Claude for Microsoft 365 | Claude by Anthropic
Claude works inside Excel, PowerPoint, Word, and Outlook. Edit your files, carry context across all four apps, and stay in control of every change.
👍1
Forwarded from Креативный совет
При выходе версия 3 модели была самой реалистичной моделью, занявшей первое место на всех аренах, сейчас реалистичностю никого не удивишь, но компания знает, что нужно пользователям
Рекрафт остается лидером по генерации векторных изображений и новая модель лишь поднимает планку.
Помимо этого основной упор компания сделала на соблюдение стиля и комерческую пригодность изображений, в очередной раз доказывая, что это один из лучших ии инструментов для дизайнеров
@creadvice | Наш курс ИИ Конентмейкер
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM