Forwarded from Креативный совет
При выходе версия 3 модели была самой реалистичной моделью, занявшей первое место на всех аренах, сейчас реалистичностю никого не удивишь, но компания знает, что нужно пользователям
Рекрафт остается лидером по генерации векторных изображений и новая модель лишь поднимает планку.
Помимо этого основной упор компания сделала на соблюдение стиля и комерческую пригодность изображений, в очередной раз доказывая, что это один из лучших ии инструментов для дизайнеров
@creadvice | Наш курс ИИ Конентмейкер
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Любопытно, дистиллированный на Qwen 3 14b большой Claude Opus. С квантом на 4 бита можно запустить на мини с 16гб
https://huggingface.co/TeichAI/Qwen3-14B-Claude-4.5-Opus-High-Reasoning-Distill-GGUF
https://huggingface.co/TeichAI/Qwen3-14B-Claude-4.5-Opus-High-Reasoning-Distill-GGUF
huggingface.co
TeichAI/Qwen3-14B-Claude-4.5-Opus-High-Reasoning-Distill-GGUF · Hugging Face
We’re on a journey to advance and democratize artificial intelligence through open source and open science.
Видимо, очень скоро chatGPT запустят план на $100. Очень хорошо. Платить $200 жаба душит, а вот попробовать погонять Codex вволю за сотку - почему бы и нет? На кодинге многие предпочитают его Claude code
OpenClaw требует много токенов, и вот, наконец, использование с ним подписок стали банить не только Антропики, но и Google. Жаль, я хотел подключь Gemini. Видимо, единственная опция на будущее - chatGPT или китайцы (хуже). Вот так OpenAI получит себе новых подписчиков на платных тарифах..
Forwarded from Machinelearning
Команда Qwen опубликовала серию моделей Qwen 3.5 Medium, в которую вошли:
Сюрприз серии - Qwen3.5-35B-A3B. По бенчмаркам она превосходит Qwen3-235B-A22B-2507, у которого активных параметров было 22B то есть разница в эффективности больше чем в 7 раз.
Qwen3.5-Flash - это продакшен-версия 35B-A3B, заточенная под агентные сценарии. Из коробки доступны контекстное окно в 1 млн. токенов и нативная поддержка fвызова функций.
Миллионный контекст снимает необходимость строить RAG при работе с большими кодовыми базами или объемными документами, модель удерживает все в контексте.
Старшие модели Qwen3.5-122B-A10B и Qwen3.5-27B ориентированы на сложные многошаговые задачи: планирование, цепочки рассуждений, долгосрочное выполнение инструкций.
Для них применялся четырехэтапный пайплайн дообучения с холодным стартом через длинный СoT и RL на основе hbpjybyu-сигналов.
122B-A10B при 10B активных параметров по логической связности конкурирует с заметно более тяжелыми dense-моделями.
Веса доступны на Hugging Face, Flash - только через Model Studio от Alibaba Cloud по цене примерно 10 центов за млн. входных и 40 центов за млн. выходных токенов
@ai_machinelearning_big_data
#AI #ML #LLM #Qwen #Alibiba
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from Data Secrets
This media is not supported in your browser
VIEW IN TELEGRAM
О, в Claude Code добавили удаленный котроль
Документация
Сессию нельзя запустить прямо с телефона, так что это не совсем OpenClaw (хотя фича определенно им вдохновлена).
Сначала старт на пк -> потом выполняем в терминале claude remote-control -> по ссылке или QR-коду подключаемся с телефона в приложении Claude или в браузере. И тут уже можно мониторить и управлять процессом: дописывать промпты, отслеживать статус и изменения, прерывать и тд, все как в обычном чате.
Пока доступно в research preview для Max, скоро обещают добавить в Pro.
Документация
Сессию нельзя запустить прямо с телефона, так что это не совсем OpenClaw (хотя фича определенно им вдохновлена).
Сначала старт на пк -> потом выполняем в терминале claude remote-control -> по ссылке или QR-коду подключаемся с телефона в приложении Claude или в браузере. И тут уже можно мониторить и управлять процессом: дописывать промпты, отслеживать статус и изменения, прерывать и тд, все как в обычном чате.
Пока доступно в research preview для Max, скоро обещают добавить в Pro.
Forwarded from Креативный совет
🍌 Нано банана 2 (на этот раз реально 2, а не pro) на подходе
Вот первые результаты генерации изображений через Gemini 3.1 Flash Image Preview
@creadvice | Наш курс ИИ Конентмейкер
Вот первые результаты генерации изображений через Gemini 3.1 Flash Image Preview
@creadvice | Наш курс ИИ Конентмейкер
Forwarded from эйай ньюз
Вот и вышла нано-банана 2, о которой я писал ночью.
Как и всегда бафнули текст, консистентность и понимание промпта. Супер прорыва нет, но главная фича — это нативные 4K (или опять апскейл? но мы не узнаем), что очень приятно.
Потрогать всё это добро уже можно в AI Studio и Gemini app. А в Google Flow генерацию вообще сделали доступной для всех желающих за ноль кредитов.
Цена API: $0.151 за картинку в 4k. Что в 2x раза дешевле чем NB Pro.
Анонс
@ai_newz
Please open Telegram to view this post
VIEW IN TELEGRAM
Самое интересное, что это не просто статья, на GitHub еще код выложен, как это применять - но, блин, Как это все непросто..
https://t.me/ai_machinelearning_big_data/9596
https://t.me/ai_machinelearning_big_data/9596
Telegram
Machinelearning
🌟 Doc-to-LoRA и Text-to-LoRA: гиперсети как генераторы LoRA
SakanaAI предложила 2 новых способа работы с памятью и дообучением LLM. Оба используют одну идею - гиперсеть, которая генерирует LoRA-адаптеры на лету, вместо того чтобы каждый раз тяжелый процесс…
SakanaAI предложила 2 новых способа работы с памятью и дообучением LLM. Оба используют одну идею - гиперсеть, которая генерирует LoRA-адаптеры на лету, вместо того чтобы каждый раз тяжелый процесс…
Forwarded from Machine learning Interview
📌 Tencent выпустил новую open-source модель WeDLM-8B-Instruct :
WeDLM-8B-Instruct: модель на ~8 млрд параметров, настроенная для диалогов и выполнения команд. Работает быстрее многих авто-регрессионных моделей и хорошо подходит для практических задач.
🚀 Плюсы
- параллельная генерация — меньше задержек
- поддержка KV-кэша и современных оптимизаций
- в ряде задач быстрее аналогов (до 3–6× на бенчмарках)
📊 Производительность
Модель показывает уверенные результаты на бенчмарках по логике, коду и знаниям, опережая базовые версии в своём классе.
📌 Характеристики
- 8B параметров
- контекст до 32 768 токенов
- лицензия Apache-2.0
🔧 Как начать
Можно запускать через собственный движок WeDLM или через стандартный Transformers API.
👉 Подходит тем, кто хочет быстро и локально развернуть мощную LLM.
Ссылка: https://huggingface.co/tencent/WeDLM-8B-Instruct
WeDLM-8B-Instruct: модель на ~8 млрд параметров, настроенная для диалогов и выполнения команд. Работает быстрее многих авто-регрессионных моделей и хорошо подходит для практических задач.
🚀 Плюсы
- параллельная генерация — меньше задержек
- поддержка KV-кэша и современных оптимизаций
- в ряде задач быстрее аналогов (до 3–6× на бенчмарках)
📊 Производительность
Модель показывает уверенные результаты на бенчмарках по логике, коду и знаниям, опережая базовые версии в своём классе.
📌 Характеристики
- 8B параметров
- контекст до 32 768 токенов
- лицензия Apache-2.0
🔧 Как начать
Можно запускать через собственный движок WeDLM или через стандартный Transformers API.
👉 Подходит тем, кто хочет быстро и локально развернуть мощную LLM.
Ссылка: https://huggingface.co/tencent/WeDLM-8B-Instruct
Поставил себе осьминога (claude-octopus) - он позволяет подключать к клод-коду по подписке chatGPT и Gemini. Теперь устраиваю споры между моделями в одной беседе с клодом, не перескакивая из одного окна терминала в другое. То, что нужно
https://github.com/nyldn/claude-octopus?tab=contributing-ov-file
https://github.com/nyldn/claude-octopus?tab=contributing-ov-file
GitHub
GitHub - nyldn/claude-octopus: Multi-tentacled orchestrator for Claude Code - Coordinates Codex CLI and Gemini CLI for parallel…
Multi-tentacled orchestrator for Claude Code - Coordinates Codex CLI and Gemini CLI for parallel task execution with intelligent contextual routing - nyldn/claude-octopus
Установил себе OpenClaw, благо mac mini есть у меня )) работает на gpt-5.3-codex. С установкой плясал часа три, из-за всяких прокси, так и не дожал, но оставил Клода на ночь - и вот, с утра все работает ))
По первым ощущениям очень даже прикольно
По первым ощущениям очень даже прикольно