very vibe coding
120 subscribers
463 photos
126 videos
13 files
991 links
Канал Алексея Макрушина об экспериментах в области vibe coding и всего интересного, что есть в области AI, ML и тому подобного
Download Telegram
🍌 Нано банана 2 (на этот раз реально 2, а не pro) на подходе

Вот первые результаты генерации изображений через Gemini 3.1 Flash Image Preview

@creadvice | Наш курс ИИ Конентмейкер
Forwarded from эйай ньюз
🔥 Nano Banana 2 🔥

Вот и вышла нано-банана 2, о которой я писал ночью.

Как и всегда бафнули текст, консистентность и понимание промпта. Супер прорыва нет, но главная фича — это нативные 4K (или опять апскейл? но мы не узнаем), что очень приятно.

Потрогать всё это добро уже можно в AI Studio и Gemini app. А в Google Flow генерацию вообще сделали доступной для всех желающих за ноль кредитов.

Цена API: $0.151 за картинку в 4k. Что в 2x раза дешевле чем NB Pro.

Анонс

@ai_newz
Please open Telegram to view this post
VIEW IN TELEGRAM
📌 Tencent выпустил новую open-source модель WeDLM-8B-Instruct :

WeDLM-8B-Instruct: модель на ~8 млрд параметров, настроенная для диалогов и выполнения команд. Работает быстрее многих авто-регрессионных моделей и хорошо подходит для практических задач.

🚀 Плюсы
- параллельная генерация — меньше задержек
- поддержка KV-кэша и современных оптимизаций
- в ряде задач быстрее аналогов (до 3–6× на бенчмарках)

📊 Производительность
Модель показывает уверенные результаты на бенчмарках по логике, коду и знаниям, опережая базовые версии в своём классе.

📌 Характеристики
- 8B параметров
- контекст до 32 768 токенов
- лицензия Apache-2.0

🔧 Как начать
Можно запускать через собственный движок WeDLM или через стандартный Transformers API.

👉 Подходит тем, кто хочет быстро и локально развернуть мощную LLM.

Ссылка: https://huggingface.co/tencent/WeDLM-8B-Instruct
Поставил себе осьминога (claude-octopus) - он позволяет подключать к клод-коду по подписке chatGPT и Gemini. Теперь устраиваю споры между моделями в одной беседе с клодом, не перескакивая из одного окна терминала в другое. То, что нужно

https://github.com/nyldn/claude-octopus?tab=contributing-ov-file
Установил себе OpenClaw, благо mac mini есть у меня )) работает на gpt-5.3-codex. С установкой плясал часа три, из-за всяких прокси, так и не дожал, но оставил Клода на ночь - и вот, с утра все работает ))

По первым ощущениям очень даже прикольно
Я этот сервис, кстати, пользую активно. Поставил, забыл, но когда Клод код начал регулярно лазить в память прошлых разговоров, вспомнил - у меня же теперь работает Claude-mem. Очень незаметно, но очень полезно. Рекомендую

https://t.me/data_analysis_ml/4780
🔥1
Как обычно, и пары дней не прошло после выпуска Claude code диктовки голосом, как то же самое сделали OpenAI в Codex. Навайбкодили - 100%
😁1
Forwarded from Machinelearning
⚡️ Anthropic расширила возможности skill-creator.

Anthropic перенесла часть инженерной культуры: тестирование, бенчмаркинг и итеративность в процесс создания навыков и для этого теперь не нужно уметь писать код.

В skill-creator добавили автоматические тесты, бенчмарки и A/B-сравнения и теперь создатели навыков могут измерить, работает ли skill, до его запуска в продакшен.

🟡 Центральный инструмент - evals (автотесты качества).

Автор задает тестовые промпты и описывает, как выглядит нужный результат. Skill-creator запускает их параллельно: с навыком и без него.

Независимый агент-сравниватель оценивает результаты вслепую, не зная, какая версия перед ним, и сразу показывает, дает ли навык реальный прирост.

Внутренние тесты Anthropic: точность PDF-навыка выросла с 6/8 до 7/8, Excel-навыка - с 6/8 до полных 8/8.


Отдельный бенчмарк-режим дает детальную картину по каждому прогону: процент успешных тестов, время выполнения, расход токенов.

На примере PDF-навыка при работе с незаполняемыми формами и таблицами из многостраничных документов успешность выросла с 40 до 100% (при том же времени выполнения).


🟡Evals полезны и в долгосрочной перспективе.

Если базовая модель начинает проходить тесты без загруженного навыка - это сигнал о том, что навык уже есть в ее поведении и skill можно отключить. Результаты тестов хранятся локально и интегрируются в CI-системы.

🟡Обновление улучшило триггерную активацию.

Claude решает, когда подключить навык, исключительно по короткому текстовому описанию в системном промпте.

Skill-creator теперь анализирует эти описания против тестовых промптов и предлагает правки, снижающие и ложные срабатывания и пропуски.

По результатам внутреннего прогона триггеринг стал лучше на 5 из 6 публичных навыков.


Все обновления уже доступны в вебе и Cowork. Для Claude Code обновили плагин или вот он же - в репозитории, если ставить руками.


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
Гм. Я-то писал собственного агента-эвалюэйтора, но, видимо, пора переходить на стандартного.
Вот управление контекстом кажется мне ключом к большой оптимизации. Когда начинаешь думать о том, что каждый вопрос к модели - для нее «с нуля», разве что части информации - в кэше, начинаешь задавать меньше вопросов (но более подробные), очищать диалоги, и тд, и тп. посмотрим, что предлагают оптимизаторы..

https://t.me/data_analysis_ml/4788
Вот те раз, ждать ждали, но не так быстро. У меня мой OpenClaw на 5.3 сидит, буду апгрейдить, но он мне пока прогу допиливает. Вообще, впечатления и от GPT-5.3, и от OpenClaw самые положительные, скорее бы выпускали тариф на 100 баксов, пошел бы брать.,
Народ строит ВПН для нейронок - смысл в том, чтобы поставить между вами и нейронками слой, который делает запрос анонимным и не позволяет по нему вас идентифицировать. Стоит только пожелать удачи такому проекту
❤1