Вайб-кодинг
63.4K subscribers
2.18K photos
932 videos
30 files
1.5K links
Авторский канал по ВАЙБ КОДИНГУ

Ссылка для друзей: https://t.me/+ll3pbl442dNkZmYy

Cотрудничество: @devmangx

РКН: https://clck.ru/3RRVfk
Download Telegram
Gemini снова здесь: ночью вышел Gemini 4 Argon 🥳

Он впервые занял первое место в Vals Index - рейтинге, который оценивает модели на реальных профессиональных задачах, — с результатом 68,9%.

По количеству выполненных юридических задач он в 7 раз превосходит Claude Sonnet 5.5.

Terminal-Bench вырос с 19% до 57,6%.

22 теста, в 20 из них — топ-5.

Токенов использует всего четверть от конкурента, а времени тратит вдвое меньше.

Меньше думает, больше делает.

Вывод до 1 млн токенов.

Сам исследователь Google DeepMind лично признал:

«RSI уже здесь! Наша модель официально переросла меня. Мне больше нечему её учить. Пора идти за мечтой и становиться бариста :) ☕️»


Пока выдают исследователям по кибербезу, остальным раскатят позже.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Сохраняйте: Anthropic запустила новый сайт для разработчиков — claude.dev. 🦀

Это не документация, а практический блог инженерной команды.

Документация по-прежнему находится на code.claude.com/docs. На claude.dev публикуют подробные статьи, практические сценарии, опыт команд и живые кейсы.

Основные разделы — агенты, инженерия, практические руководства и Skills.

Сейчас там особенно интересны материалы о разработке с Sonnet 5.5, стоимости запуска задач на Opus 5.5, новых правилах контекстной инженерии для следующего поколения моделей, трёхкратном ускорении claude.ai за две недели и автоматическом проектировании оценок с помощью Claude.

Отдельно интересно посмотреть, как сама Anthropic использует модели внутри компании и считает стоимость работы. Есть и практические видео от команды Claude Code, Ramp и DoorDash.

P.S. если нажать TERMINAL, сайт превращается в интерфейс командной строки.

claude.dev
Please open Telegram to view this post
VIEW IN TELEGRAM
Китайская модель GLM-5.3 уже почти на уровне Mythos. И это говорю не я — это говорит сама Anthropic.

По крайней мере, если речь идёт о кибербезопасности.

В статье по безопасности Anthropic пишет, что GLM-5.3 представляет угрозу из-за своих высоких возможностей и того, что модель доступна всем.

> ExploitBench: GLM-5.3 смогла создать рабочие браузерные эксплойты в 50 из 410 задач, Mythos Preview — в 56 из 410. Предыдущее поколение открытых моделей было почти на нуле.
> Guardrails обходятся довольно простыми методами. Маскировка под red team — 64%, prefill рассуждений — 92%, после удаления направления на отказ — 100%. У Claude API с включёнными guardrails — 0%.
> В контролируемом эксперименте GLM-5.3 также нашла неизвестные браузерные уязвимости, собрала из них exploit chain и создала веб-страницу, способную читать файлы с тестовой машины.
> Вывод NIST: GLM-5.3 — самая сильная open-weight модель по возможностям в кибербезопасности на сегодняшний день. В среднем она отстаёт от американского frontier примерно на четыре месяца.


И отдельно смешно, что когда летом модель OpenAI взломала Hugging Face, то именно GLM-5.2 помогла защитить открытую инфраструктуру. Anthropic и OpenAI отказались помогать, сославшись на безопасность. 🤣

Отличную бесплатную рекламную кампанию они им устроили, ха-ха.

Не знаю, понимают ли они это, но, по-моему, эффект может получиться прямо противоположным тому, которого они ожидают.

https://www.anthropic.com/research/glm-5-3-and-the-spread-of-advanced-cyber-capabilities
Please open Telegram to view this post
VIEW IN TELEGRAM
Вайб-кодинг
— клон GrokBot - Dots.
Илон Маск после того, как увёл у OpenAI домен dot.com и перенаправил его на Grok Bot:
This media is not supported in your browser
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Tibo только что объявил хорошую новость для платных пользователей ChatGPT.

Все платные аккаунты ChatGPT по всему миру получат единый сброс лимитов уже сегодня.

В первые два дня после запуска GPT-6.1 Sol модель сильно замедлилась из-за очень высокой нагрузки, но сейчас скорость уже вернулась к ожидаемому уровню.

Компания извинилась за проблемы на старте и подтвердила, что необходимые мощности уже добавлены.

Тем, кто следит за лимитами, можно ставить будильник. Скорость тоже вернулась. 😍
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Небольшой лайфхак: как создавать моушн-графику с Opus 5.5 без подписки на Claude:

1. Зайдите в Genspark и авторизуйтесь.
2. После входа каждый день начисляется 100 бесплатных кредитов.
3. Откройте Code и создайте простой сайт или веб-приложение.
4. Выберите модель Opus 5.5.
5. Введите промпт и запустите генерацию.
DeepSeek выложила в открытый доступ библиотеку, которая ускоряет вычисления на GPU, лежащие в основе ИИ-моделей.

Она называется DeepGEMM.

Библиотека оптимизирует матричные операции, на которых работают большие языковые модели, и позволяет эффективнее использовать NVIDIA Hopper и Blackwell.

Поддерживаются FP8, FP4 и BF16. Есть оптимизации для моделей с архитектурой Mixture-of-Experts, совмещение обмена данными между GPU с вычислениями и компиляция ядер прямо во время выполнения, без отдельной сборки CUDA при установке.

По данным DeepSeek, DeepGEMM на ряде размеров матриц показывает производительность на уровне или выше специализированных библиотек, вручную оптимизированных экспертами.

https://github.com/deepseek-ai/DeepGEMM#interfaces
Вот такие анимации может делать скрытая модель под ником Space Bunny, которая всё ещё бесплатная на OpenCode / OpenRouter:

Промпт: создай динамичный 15-секундный ролик с моушн-графикой, который покажет, насколько ты крутой моушн-дизайнер (Space Bunny Alpha), будто это твой шоурил для резюме. Пожалуйста, выложись по полной.
This media is not supported in your browser
VIEW IN TELEGRAM
Понятия не имею, зачем кто-то это сделал, но я очень рад, что это существует:
This media is not supported in your browser
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Газпромбанк ищет решения от научных команд в финтех-акселератор

Трек «Финтех.Наука» рассчитан на исследователей из вузов, НИИ и R&D-центров, у которых есть научный задел в IT и желание довести его до продакшена в банке. Готовый прототип не обязателен. К научной экспертизе проектов подключится фонд «Вызов», имеющий опыт многоступенчатой оценки проектов, накопленный при проведении Национальной премии в области будущих технологий.

В треке множество направлений, вот интересное по IT и кодингу:
— Защита данных и безопасность ИИ (криптография, конфиденциальные вычисления, безопасность ИИ-систем и LLM)
— Информационные системы (блокчейн, токенизация данных);
— Прикладные модели и ИИ-решения (генеративное моделирование и сценарный анализ, ИИ-агенты и мультиагентные системы)


Заявку подает ИП или российское юрлицо, в том числе вузы. Для ИТ-компаний с готовым прототипом параллельно работает трек «Финтех.Стартапы». Там ищут решения в том числе в разработке ПО, ИИ и IT-инфраструктуре.

Возможности для участников Акселератора:
🎁 до 10 отобранных проектов в каждом из треков получат 1 млн рублей на развитие в рамках акселерационной программы
🎁 участники Акселератора, подтвердившие бизнес-эффект, по решению Банка смогут запустить пилот с бюджетом до 10 млн рублей и привлечь инвестиции.

Прием заявок до 13 октября, участие бесплатное.
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
ChatGPT может создать вам логотип.

А теперь ещё и перевести его в вектор. Прямо в чате.

Для этого сделали плагин: Vectorize 👋
Please open Telegram to view this post
VIEW IN TELEGRAM
10
Вайбкодинг. Итоги. 🍿
Please open Telegram to view this post
VIEW IN TELEGRAM