Forwarded from Креативный совет
При выходе версия 3 модели была самой реалистичной моделью, занявшей первое место на всех аренах, сейчас реалистичностю никого не удивишь, но компания знает, что нужно пользователям
Рекрафт остается лидером по генерации векторных изображений и новая модель лишь поднимает планку.
Помимо этого основной упор компания сделала на соблюдение стиля и комерческую пригодность изображений, в очередной раз доказывая, что это один из лучших ии инструментов для дизайнеров
@creadvice | Наш курс ИИ Конентмейкер
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Любопытно, дистиллированный на Qwen 3 14b большой Claude Opus. С квантом на 4 бита можно запустить на мини с 16гб
https://huggingface.co/TeichAI/Qwen3-14B-Claude-4.5-Opus-High-Reasoning-Distill-GGUF
https://huggingface.co/TeichAI/Qwen3-14B-Claude-4.5-Opus-High-Reasoning-Distill-GGUF
huggingface.co
TeichAI/Qwen3-14B-Claude-4.5-Opus-High-Reasoning-Distill-GGUF · Hugging Face
We’re on a journey to advance and democratize artificial intelligence through open source and open science.
Видимо, очень скоро chatGPT запустят план на $100. Очень хорошо. Платить $200 жаба душит, а вот попробовать погонять Codex вволю за сотку - почему бы и нет? На кодинге многие предпочитают его Claude code
OpenClaw требует много токенов, и вот, наконец, использование с ним подписок стали банить не только Антропики, но и Google. Жаль, я хотел подключь Gemini. Видимо, единственная опция на будущее - chatGPT или китайцы (хуже). Вот так OpenAI получит себе новых подписчиков на платных тарифах..
Forwarded from Machinelearning
Команда Qwen опубликовала серию моделей Qwen 3.5 Medium, в которую вошли:
Сюрприз серии - Qwen3.5-35B-A3B. По бенчмаркам она превосходит Qwen3-235B-A22B-2507, у которого активных параметров было 22B то есть разница в эффективности больше чем в 7 раз.
Qwen3.5-Flash - это продакшен-версия 35B-A3B, заточенная под агентные сценарии. Из коробки доступны контекстное окно в 1 млн. токенов и нативная поддержка fвызова функций.
Миллионный контекст снимает необходимость строить RAG при работе с большими кодовыми базами или объемными документами, модель удерживает все в контексте.
Старшие модели Qwen3.5-122B-A10B и Qwen3.5-27B ориентированы на сложные многошаговые задачи: планирование, цепочки рассуждений, долгосрочное выполнение инструкций.
Для них применялся четырехэтапный пайплайн дообучения с холодным стартом через длинный СoT и RL на основе hbpjybyu-сигналов.
122B-A10B при 10B активных параметров по логической связности конкурирует с заметно более тяжелыми dense-моделями.
Веса доступны на Hugging Face, Flash - только через Model Studio от Alibaba Cloud по цене примерно 10 центов за млн. входных и 40 центов за млн. выходных токенов
@ai_machinelearning_big_data
#AI #ML #LLM #Qwen #Alibiba
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from Data Secrets
This media is not supported in your browser
VIEW IN TELEGRAM
О, в Claude Code добавили удаленный котроль
Документация
Сессию нельзя запустить прямо с телефона, так что это не совсем OpenClaw (хотя фича определенно им вдохновлена).
Сначала старт на пк -> потом выполняем в терминале claude remote-control -> по ссылке или QR-коду подключаемся с телефона в приложении Claude или в браузере. И тут уже можно мониторить и управлять процессом: дописывать промпты, отслеживать статус и изменения, прерывать и тд, все как в обычном чате.
Пока доступно в research preview для Max, скоро обещают добавить в Pro.
Документация
Сессию нельзя запустить прямо с телефона, так что это не совсем OpenClaw (хотя фича определенно им вдохновлена).
Сначала старт на пк -> потом выполняем в терминале claude remote-control -> по ссылке или QR-коду подключаемся с телефона в приложении Claude или в браузере. И тут уже можно мониторить и управлять процессом: дописывать промпты, отслеживать статус и изменения, прерывать и тд, все как в обычном чате.
Пока доступно в research preview для Max, скоро обещают добавить в Pro.
Forwarded from Креативный совет
🍌 Нано банана 2 (на этот раз реально 2, а не pro) на подходе
Вот первые результаты генерации изображений через Gemini 3.1 Flash Image Preview
@creadvice | Наш курс ИИ Конентмейкер
Вот первые результаты генерации изображений через Gemini 3.1 Flash Image Preview
@creadvice | Наш курс ИИ Конентмейкер
Forwarded from эйай ньюз
Вот и вышла нано-банана 2, о которой я писал ночью.
Как и всегда бафнули текст, консистентность и понимание промпта. Супер прорыва нет, но главная фича — это нативные 4K (или опять апскейл? но мы не узнаем), что очень приятно.
Потрогать всё это добро уже можно в AI Studio и Gemini app. А в Google Flow генерацию вообще сделали доступной для всех желающих за ноль кредитов.
Цена API: $0.151 за картинку в 4k. Что в 2x раза дешевле чем NB Pro.
Анонс
@ai_newz
Please open Telegram to view this post
VIEW IN TELEGRAM
Самое интересное, что это не просто статья, на GitHub еще код выложен, как это применять - но, блин, Как это все непросто..
https://t.me/ai_machinelearning_big_data/9596
https://t.me/ai_machinelearning_big_data/9596
Telegram
Machinelearning
🌟 Doc-to-LoRA и Text-to-LoRA: гиперсети как генераторы LoRA
SakanaAI предложила 2 новых способа работы с памятью и дообучением LLM. Оба используют одну идею - гиперсеть, которая генерирует LoRA-адаптеры на лету, вместо того чтобы каждый раз тяжелый процесс…
SakanaAI предложила 2 новых способа работы с памятью и дообучением LLM. Оба используют одну идею - гиперсеть, которая генерирует LoRA-адаптеры на лету, вместо того чтобы каждый раз тяжелый процесс…
Forwarded from Machine learning Interview
📌 Tencent выпустил новую open-source модель WeDLM-8B-Instruct :
WeDLM-8B-Instruct: модель на ~8 млрд параметров, настроенная для диалогов и выполнения команд. Работает быстрее многих авто-регрессионных моделей и хорошо подходит для практических задач.
🚀 Плюсы
- параллельная генерация — меньше задержек
- поддержка KV-кэша и современных оптимизаций
- в ряде задач быстрее аналогов (до 3–6× на бенчмарках)
📊 Производительность
Модель показывает уверенные результаты на бенчмарках по логике, коду и знаниям, опережая базовые версии в своём классе.
📌 Характеристики
- 8B параметров
- контекст до 32 768 токенов
- лицензия Apache-2.0
🔧 Как начать
Можно запускать через собственный движок WeDLM или через стандартный Transformers API.
👉 Подходит тем, кто хочет быстро и локально развернуть мощную LLM.
Ссылка: https://huggingface.co/tencent/WeDLM-8B-Instruct
WeDLM-8B-Instruct: модель на ~8 млрд параметров, настроенная для диалогов и выполнения команд. Работает быстрее многих авто-регрессионных моделей и хорошо подходит для практических задач.
🚀 Плюсы
- параллельная генерация — меньше задержек
- поддержка KV-кэша и современных оптимизаций
- в ряде задач быстрее аналогов (до 3–6× на бенчмарках)
📊 Производительность
Модель показывает уверенные результаты на бенчмарках по логике, коду и знаниям, опережая базовые версии в своём классе.
📌 Характеристики
- 8B параметров
- контекст до 32 768 токенов
- лицензия Apache-2.0
🔧 Как начать
Можно запускать через собственный движок WeDLM или через стандартный Transformers API.
👉 Подходит тем, кто хочет быстро и локально развернуть мощную LLM.
Ссылка: https://huggingface.co/tencent/WeDLM-8B-Instruct
Поставил себе осьминога (claude-octopus) - он позволяет подключать к клод-коду по подписке chatGPT и Gemini. Теперь устраиваю споры между моделями в одной беседе с клодом, не перескакивая из одного окна терминала в другое. То, что нужно
https://github.com/nyldn/claude-octopus?tab=contributing-ov-file
https://github.com/nyldn/claude-octopus?tab=contributing-ov-file
GitHub
GitHub - nyldn/claude-octopus: Multi-tentacled orchestrator for Claude Code - Coordinates Codex CLI and Gemini CLI for parallel…
Multi-tentacled orchestrator for Claude Code - Coordinates Codex CLI and Gemini CLI for parallel task execution with intelligent contextual routing - nyldn/claude-octopus
Установил себе OpenClaw, благо mac mini есть у меня )) работает на gpt-5.3-codex. С установкой плясал часа три, из-за всяких прокси, так и не дожал, но оставил Клода на ночь - и вот, с утра все работает ))
По первым ощущениям очень даже прикольно
По первым ощущениям очень даже прикольно
Ко всему прочему, это еще и токенов кучу ест. Один большой запрос со всех точек зрения лучше кучи маленьких
https://t.me/machinelearning_interview/2579
https://t.me/machinelearning_interview/2579
Telegram
Machine learning Interview
📌 Microsoft Research и Salesforce показали проблему, о которой редко говорят: диалог резко снижает надёжность LLM.
В исследовании протестировали 15 топ-моделей (GPT-4.1, Gemini 2.5 Pro, Claude 3.7 Sonnet, o3, DeepSeek R1, Llama 4) на 200 000+ симулированных…
В исследовании протестировали 15 топ-моделей (GPT-4.1, Gemini 2.5 Pro, Claude 3.7 Sonnet, o3, DeepSeek R1, Llama 4) на 200 000+ симулированных…
Я этот сервис, кстати, пользую активно. Поставил, забыл, но когда Клод код начал регулярно лазить в память прошлых разговоров, вспомнил - у меня же теперь работает Claude-mem. Очень незаметно, но очень полезно. Рекомендую
https://t.me/data_analysis_ml/4780
https://t.me/data_analysis_ml/4780
Telegram
Анализ данных (Data analysis)
✔️ Claude-Mem - open-source инструмент, который даёт Claude постоянную память между сессиями.
Главная проблема Claude Code
По умолчанию у Claude нет долгосрочной памяти:
- каждый запуск - "с чистого листа"
- весь контекст нужно передавать заново
- растут…
Главная проблема Claude Code
По умолчанию у Claude нет долгосрочной памяти:
- каждый запуск - "с чистого листа"
- весь контекст нужно передавать заново
- растут…
🔥1
Как обычно, и пары дней не прошло после выпуска Claude code диктовки голосом, как то же самое сделали OpenAI в Codex. Навайбкодили - 100%
😁1
Forwarded from Machinelearning
Anthropic перенесла часть инженерной культуры: тестирование, бенчмаркинг и итеративность в процесс создания навыков и для этого теперь не нужно уметь писать код.
В skill-creator добавили автоматические тесты, бенчмарки и A/B-сравнения и теперь создатели навыков могут измерить, работает ли skill, до его запуска в продакшен.
Автор задает тестовые промпты и описывает, как выглядит нужный результат. Skill-creator запускает их параллельно: с навыком и без него.
Независимый агент-сравниватель оценивает результаты вслепую, не зная, какая версия перед ним, и сразу показывает, дает ли навык реальный прирост.
Внутренние тесты Anthropic: точность PDF-навыка выросла с 6/8 до 7/8, Excel-навыка - с 6/8 до полных 8/8.
Отдельный бенчмарк-режим дает детальную картину по каждому прогону: процент успешных тестов, время выполнения, расход токенов.
На примере PDF-навыка при работе с незаполняемыми формами и таблицами из многостраничных документов успешность выросла с 40 до 100% (при том же времени выполнения).
Если базовая модель начинает проходить тесты без загруженного навыка - это сигнал о том, что навык уже есть в ее поведении и skill можно отключить. Результаты тестов хранятся локально и интегрируются в CI-системы.
Claude решает, когда подключить навык, исключительно по короткому текстовому описанию в системном промпте.
Skill-creator теперь анализирует эти описания против тестовых промптов и предлагает правки, снижающие и ложные срабатывания и пропуски.
По результатам внутреннего прогона триггеринг стал лучше на 5 из 6 публичных навыков.
Все обновления уже доступны в вебе и Cowork. Для Claude Code обновили плагин или вот он же - в репозитории, если ставить руками.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM