very vibe coding
120 subscribers
463 photos
126 videos
13 files
993 links
Канал Алексея Макрушина об экспериментах в области vibe coding и всего интересного, что есть в области AI, ML и тому подобного
Download Telegram
🥰 Незаметно для меня вышел Recraft V4

При выходе версия 3 модели была самой реалистичной моделью, занявшей первое место на всех аренах, сейчас реалистичностю никого не удивишь, но компания знает, что нужно пользователям

Рекрафт остается лидером по генерации векторных изображений и новая модель лишь поднимает планку.

Помимо этого основной упор компания сделала на соблюдение стиля и комерческую пригодность изображений, в очередной раз доказывая, что это один из лучших ии инструментов для дизайнеров

@creadvice | Наш курс ИИ Конентмейкер
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Видимо, очень скоро chatGPT запустят план на $100. Очень хорошо. Платить $200 жаба душит, а вот попробовать погонять Codex вволю за сотку - почему бы и нет? На кодинге многие предпочитают его Claude code
OpenClaw требует много токенов, и вот, наконец, использование с ним подписок стали банить не только Антропики, но и Google. Жаль, я хотел подключь Gemini. Видимо, единственная опция на будущее - chatGPT или китайцы (хуже). Вот так OpenAI получит себе новых подписчиков на платных тарифах..
Forwarded from Machinelearning
⚡️ Alibaba выпустила семейство Qwen 3.5 Medium.

Команда Qwen опубликовала серию моделей Qwen 3.5 Medium, в которую вошли:

🟠Qwen3.5-Flash
🟢Qwen3.5-35B-A3B
🟢Qwen3.5-122B-A10B
🟢Qwen3.5-27B.

Сюрприз серии - Qwen3.5-35B-A3B. По бенчмаркам она превосходит Qwen3-235B-A22B-2507, у которого активных параметров было 22B то есть разница в эффективности больше чем в 7 раз.

Qwen3.5-Flash - это продакшен-версия 35B-A3B, заточенная под агентные сценарии. Из коробки доступны контекстное окно в 1 млн. токенов и нативная поддержка fвызова функций.

Миллионный контекст снимает необходимость строить RAG при работе с большими кодовыми базами или объемными документами, модель удерживает все в контексте.

Старшие модели Qwen3.5-122B-A10B и Qwen3.5-27B ориентированы на сложные многошаговые задачи: планирование, цепочки рассуждений, долгосрочное выполнение инструкций.

Для них применялся четырехэтапный пайплайн дообучения с холодным стартом через длинный СoT и RL на основе hbpjybyu-сигналов.

122B-A10B при 10B активных параметров по логической связности конкурирует с заметно более тяжелыми dense-моделями.

Веса доступны на Hugging Face, Flash - только через Model Studio от Alibaba Cloud по цене примерно 10 центов за млн. входных и 40 центов за млн. выходных токенов


📌Лицензирование: Apache 2.0 License.


🟡Набор моделей


@ai_machinelearning_big_data

#AI #ML #LLM #Qwen #Alibiba
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from Data Secrets
This media is not supported in your browser
VIEW IN TELEGRAM
О, в Claude Code добавили удаленный котроль

Документация

Сессию нельзя запустить прямо с телефона, так что это не совсем OpenClaw (хотя фича определенно им вдохновлена).

Сначала старт на пк -> потом выполняем в терминале claude remote-control -> по ссылке или QR-коду подключаемся с телефона в приложении Claude или в браузере. И тут уже можно мониторить и управлять процессом: дописывать промпты, отслеживать статус и изменения, прерывать и тд, все как в обычном чате.

Пока доступно в research preview для Max, скоро обещают добавить в Pro.
🍌 Нано банана 2 (на этот раз реально 2, а не pro) на подходе

Вот первые результаты генерации изображений через Gemini 3.1 Flash Image Preview

@creadvice | Наш курс ИИ Конентмейкер
Forwarded from эйай ньюз
🔥 Nano Banana 2 🔥

Вот и вышла нано-банана 2, о которой я писал ночью.

Как и всегда бафнули текст, консистентность и понимание промпта. Супер прорыва нет, но главная фича — это нативные 4K (или опять апскейл? но мы не узнаем), что очень приятно.

Потрогать всё это добро уже можно в AI Studio и Gemini app. А в Google Flow генерацию вообще сделали доступной для всех желающих за ноль кредитов.

Цена API: $0.151 за картинку в 4k. Что в 2x раза дешевле чем NB Pro.

Анонс

@ai_newz
Please open Telegram to view this post
VIEW IN TELEGRAM
📌 Tencent выпустил новую open-source модель WeDLM-8B-Instruct :

WeDLM-8B-Instruct: модель на ~8 млрд параметров, настроенная для диалогов и выполнения команд. Работает быстрее многих авто-регрессионных моделей и хорошо подходит для практических задач.

🚀 Плюсы
- параллельная генерация — меньше задержек
- поддержка KV-кэша и современных оптимизаций
- в ряде задач быстрее аналогов (до 3–6× на бенчмарках)

📊 Производительность
Модель показывает уверенные результаты на бенчмарках по логике, коду и знаниям, опережая базовые версии в своём классе.

📌 Характеристики
- 8B параметров
- контекст до 32 768 токенов
- лицензия Apache-2.0

🔧 Как начать
Можно запускать через собственный движок WeDLM или через стандартный Transformers API.

👉 Подходит тем, кто хочет быстро и локально развернуть мощную LLM.

Ссылка: https://huggingface.co/tencent/WeDLM-8B-Instruct
Поставил себе осьминога (claude-octopus) - он позволяет подключать к клод-коду по подписке chatGPT и Gemini. Теперь устраиваю споры между моделями в одной беседе с клодом, не перескакивая из одного окна терминала в другое. То, что нужно

https://github.com/nyldn/claude-octopus?tab=contributing-ov-file
Установил себе OpenClaw, благо mac mini есть у меня )) работает на gpt-5.3-codex. С установкой плясал часа три, из-за всяких прокси, так и не дожал, но оставил Клода на ночь - и вот, с утра все работает ))

По первым ощущениям очень даже прикольно
Я этот сервис, кстати, пользую активно. Поставил, забыл, но когда Клод код начал регулярно лазить в память прошлых разговоров, вспомнил - у меня же теперь работает Claude-mem. Очень незаметно, но очень полезно. Рекомендую

https://t.me/data_analysis_ml/4780
🔥1
Как обычно, и пары дней не прошло после выпуска Claude code диктовки голосом, как то же самое сделали OpenAI в Codex. Навайбкодили - 100%
😁1
Forwarded from Machinelearning
⚡️ Anthropic расширила возможности skill-creator.

Anthropic перенесла часть инженерной культуры: тестирование, бенчмаркинг и итеративность в процесс создания навыков и для этого теперь не нужно уметь писать код.

В skill-creator добавили автоматические тесты, бенчмарки и A/B-сравнения и теперь создатели навыков могут измерить, работает ли skill, до его запуска в продакшен.

🟡 Центральный инструмент - evals (автотесты качества).

Автор задает тестовые промпты и описывает, как выглядит нужный результат. Skill-creator запускает их параллельно: с навыком и без него.

Независимый агент-сравниватель оценивает результаты вслепую, не зная, какая версия перед ним, и сразу показывает, дает ли навык реальный прирост.

Внутренние тесты Anthropic: точность PDF-навыка выросла с 6/8 до 7/8, Excel-навыка - с 6/8 до полных 8/8.


Отдельный бенчмарк-режим дает детальную картину по каждому прогону: процент успешных тестов, время выполнения, расход токенов.

На примере PDF-навыка при работе с незаполняемыми формами и таблицами из многостраничных документов успешность выросла с 40 до 100% (при том же времени выполнения).


🟡Evals полезны и в долгосрочной перспективе.

Если базовая модель начинает проходить тесты без загруженного навыка - это сигнал о том, что навык уже есть в ее поведении и skill можно отключить. Результаты тестов хранятся локально и интегрируются в CI-системы.

🟡Обновление улучшило триггерную активацию.

Claude решает, когда подключить навык, исключительно по короткому текстовому описанию в системном промпте.

Skill-creator теперь анализирует эти описания против тестовых промптов и предлагает правки, снижающие и ложные срабатывания и пропуски.

По результатам внутреннего прогона триггеринг стал лучше на 5 из 6 публичных навыков.


Все обновления уже доступны в вебе и Cowork. Для Claude Code обновили плагин или вот он же - в репозитории, если ставить руками.


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM