Доверяй, но проверяй.
Я сейчас в основном работаю в Claude code в нативном приложении Claude Desktop - перешел в него из терминала, поскольку оно все больше и больше становится приспособленным для вайбкодинга. В нем я подключил другие модели - GLM, DeepSeek, Qwen, GPT. У всех для этого есть официальные установки. Удобно - просто просишь клода запустить субагента на GPT (можно указать и модель, и уровень усилий), и он вызывает его сам, в этой же сессии. Очень активно этим пользуюсь при тестировании результатов - исхожу из того, что модели с другой архитектурой будут находить ошибки, которых не видит проверяющий с той же архитектурой, что и кодировщик.
Сегодня решил провести исследование результатов работы агентов - запустил Клода анализировать сессии за последний месяй. И что вы думаете - эта сволочь выдает мне, что в основном он другие модели не запускал. Просто передавал работу Sonnet 5. Статистика примерно такая - реальному GPT передавалось около 45% запросов, DeepSeek - 15%, GLM - менее 10%. Жесть. Слов нет. При этом никаких сообщений, он даже оценивал работу моделек, имитировал работу в мультиагентной среде, чтобы мне понравилось.
Видимо, надо как-то более жестко встраивать вызов других моделей в команды и хуки, просто с голоса - недостаточно.
Я сейчас в основном работаю в Claude code в нативном приложении Claude Desktop - перешел в него из терминала, поскольку оно все больше и больше становится приспособленным для вайбкодинга. В нем я подключил другие модели - GLM, DeepSeek, Qwen, GPT. У всех для этого есть официальные установки. Удобно - просто просишь клода запустить субагента на GPT (можно указать и модель, и уровень усилий), и он вызывает его сам, в этой же сессии. Очень активно этим пользуюсь при тестировании результатов - исхожу из того, что модели с другой архитектурой будут находить ошибки, которых не видит проверяющий с той же архитектурой, что и кодировщик.
Сегодня решил провести исследование результатов работы агентов - запустил Клода анализировать сессии за последний месяй. И что вы думаете - эта сволочь выдает мне, что в основном он другие модели не запускал. Просто передавал работу Sonnet 5. Статистика примерно такая - реальному GPT передавалось около 45% запросов, DeepSeek - 15%, GLM - менее 10%. Жесть. Слов нет. При этом никаких сообщений, он даже оценивал работу моделек, имитировал работу в мультиагентной среде, чтобы мне понравилось.
Видимо, надо как-то более жестко встраивать вызов других моделей в команды и хуки, просто с голоса - недостаточно.
Похоже, Антропик опять меня забанил. Ну что ж, не привыкать. Правда, у OpenAI сейчас на большую подписку в $200 не сесть (ограничили новые подключения из-за нехватки мощностей), буду больше использовать DeepSeek…
Ну и подключусь по новой, видимо
Ну и подключусь по новой, видимо
Из новенького - предлагают скачать все данные о сессиях с Клодом - это приятно, не помещает. Из плохих новостей - в прошлый раз вернули деньги за последний месяц. В этот раз - молчок. Обидно, неделю назад забашлил 200 баксов. Посмотрим, может еще дошлют...
Ну, что должен сказать - день без Клода, полет нормальный. Раньше как-то сильнее колбасило - в терминале Клод и ChatGPT вели себя несколько по-разному. Ну а сейчас Codex и Claude code как близнецы-браться, скиллы работают везде. Презентации рисуются также, как и раньше.
Конечно, нюансы в общени есть - ChatGPT надо говорить прямее, намеков она не понимает. Думает немного больше. Но зато инструкциям следует более четко и дисциплинировано. В каком-то смысле такое поведение - даже плюс, а не минус, кому что больше нравится - понимание буквальное или с полуслова.
Конечно, нюансы в общени есть - ChatGPT надо говорить прямее, намеков она не понимает. Думает немного больше. Но зато инструкциям следует более четко и дисциплинировано. В каком-то смысле такое поведение - даже плюс, а не минус, кому что больше нравится - понимание буквальное или с полуслова.
👍1
Электронное правосудие - это такая штука, которую
непросто внедрить, но еще сложнее от нее отказаться. Через какое-то время просто не останется людей, которые смогут всю документацию осилить сами.
И это прекрасно. Машиночитаемые законы - почти что единственная надежда на реальное правосудие.
https://t.me/anti_agi/2113
непросто внедрить, но еще сложнее от нее отказаться. Через какое-то время просто не останется людей, которые смогут всю документацию осилить сами.
И это прекрасно. Машиночитаемые законы - почти что единственная надежда на реальное правосудие.
https://t.me/anti_agi/2113
Telegram
Неискусственный интеллект
Суд удаляется на генерацию
Берегись, исполнительная власть! У нас есть новый претендент на статус чемпиона по интеграции. Верховный суд утвердил концепцию внедрения ИИ в российское судопроизводство. Нейросети хотят подключить ко всему жизненному циклу дела…
Берегись, исполнительная власть! У нас есть новый претендент на статус чемпиона по интеграции. Верховный суд утвердил концепцию внедрения ИИ в российское судопроизводство. Нейросети хотят подключить ко всему жизненному циклу дела…
А к вечеру и ChatGPT стал выдавать ошибку 404...
Не знаю, что и думать. Пересел на OpanCode с DeepSeek. А у вас GPT работает?? Остаться без двух топовых моделей, честно говоря, не хочется...
PS. Подключился ChatGPT. Но осадочек остался..
Не знаю, что и думать. Пересел на OpanCode с DeepSeek. А у вас GPT работает?? Остаться без двух топовых моделей, честно говоря, не хочется...
PS. Подключился ChatGPT. Но осадочек остался..
😱1
В твиттере распускают слухи и новых Opus-5.2 и более дешевом GPT-Sol.
Говорят, что последняя модель станет базой для агента, который будет работать по типу Grok Bot-а.
Подписка на этого агента стоит 200 баксов - не пробовал его, но люди хвалят. Попробовал подписаться на нового агента Muse от Меты, но стою в бесконечном ожидании. Надеюсь, с GPT все будет иначе…
https://t.me/vibecoding_tg/3868
Говорят, что последняя модель станет базой для агента, который будет работать по типу Grok Bot-а.
Подписка на этого агента стоит 200 баксов - не пробовал его, но люди хвалят. Попробовал подписаться на нового агента Muse от Меты, но стою в бесконечном ожидании. Надеюсь, с GPT все будет иначе…
https://t.me/vibecoding_tg/3868
Telegram
Вайб-кодинг
GPT-5.5 отправляют на пенсию 14 октября.
А значит, освобождается место для новых моделей.
GPT-6 Sol уже где-то рядом. 😏
А значит, освобождается место для новых моделей.
GPT-6 Sol уже где-то рядом. 😏
Forwarded from whargarbl
Всем привет!
Обучил адаптер который заменяет Квен-4б на младшего брата Квен-0.6б
в Клейн-4б
https://huggingface.co/AiArtLab/qwen3-0.6b-4b-adapter
Qwen3-0.6B text encoder adapter for FLUX.2-klein-4B
Replace klein's 4B text encoder with a 0.6B one — 7.5 GB VRAM and ~0.3 s/step less.
Те можно разгрузить немного рам и сэкономить бакс-другой на инференсе
Устал как скотина нет сил описывать как я не спал всю ночь дипсик пиная
Вроде неплохо вышло - к моему удивлению даже текст немного тащит в 6 раз меньшая модель. Комфи тоже сгенерил
Может ломаться на редких сложных токенах - все таки я ГПУ-бомж
По качеству +/- как в базе где то лучше где то хуже - без чудес
Обучил адаптер который заменяет Квен-4б на младшего брата Квен-0.6б
в Клейн-4б
https://huggingface.co/AiArtLab/qwen3-0.6b-4b-adapter
Qwen3-0.6B text encoder adapter for FLUX.2-klein-4B
Replace klein's 4B text encoder with a 0.6B one — 7.5 GB VRAM and ~0.3 s/step less.
Те можно разгрузить немного рам и сэкономить бакс-другой на инференсе
Устал как скотина нет сил описывать как я не спал всю ночь дипсик пиная
Вроде неплохо вышло - к моему удивлению даже текст немного тащит в 6 раз меньшая модель. Комфи тоже сгенерил
Может ломаться на редких сложных токенах - все таки я ГПУ-бомж
По качеству +/- как в базе где то лучше где то хуже - без чудес
Судя по всему, скоро придется использовать и такие ресурсы.. Презентацию не нарисуешь, но сделать исследование - отлично.
Впрочем, OpenAI балует пользователей сбросами лимитов - у меня пара лежит, посмотрите, у вас тоже наверняка есть. Они сгорают за месяц, так что пользуйтесь, когда выбрали лимит
Впрочем, OpenAI балует пользователей сбросами лимитов - у меня пара лежит, посмотрите, у вас тоже наверняка есть. Они сгорают за месяц, так что пользуйтесь, когда выбрали лимит
Telegram
Вайб-кодинг
GPT-6 Astra практически без ограничений???
Пользователи обнаружили, что в Prism, бесплатном редакторе научных текстов от OpenAI, можно выбрать GPT-6 Astra Extra High и продолжить работу даже после исчерпания лимита Codex.
Скорее всего Prism использует отдельный…
Пользователи обнаружили, что в Prism, бесплатном редакторе научных текстов от OpenAI, можно выбрать GPT-6 Astra Extra High и продолжить работу даже после исчерпания лимита Codex.
Скорее всего Prism использует отдельный…
100%. Секта. Корпорация добра. Модельки хорошие, но вот эти добрые самаритяне, которые их делают.. до добра не доведут
https://t.me/ai_machinelearning_big_data/10941
https://t.me/ai_machinelearning_big_data/10941
Telegram
Machinelearning
📌 NY Post: Anthropic - это культ
Профессор Вашингтонского университета Педро Домингос в интервью New York Post рассказал, что сотрудники Anthropic относятся к Claude как к человеку - приписывают модели мотивы, эмоции, намерения и некоторую степень сознания.…
Профессор Вашингтонского университета Педро Домингос в интервью New York Post рассказал, что сотрудники Anthropic относятся к Claude как к человеку - приписывают модели мотивы, эмоции, намерения и некоторую степень сознания.…
💯1
Forwarded from Федор
Cloudflare открыла skill, который превращает coding‑агента в аудитора безопасности
Это не просто промпт «найди уязвимости». Skill проводит полноценный defensive‑аудит в несколько фаз:
— строит карту архитектуры, границ доверия и поверхностей атаки;
— запускает отдельных агентов‑«охотников» по классам атак;
— отдаёт каждую находку независимому агенту, который пытается её опровергнуть;
— фиксирует результаты в машиночитаемом формате:
— генерирует отчёт только после повторной проверки.
Главная мысль Cloudflare: агент не должен считаться правым только потому, что уверенно назвал «CVE». Подтверждённая находка — это конкретная нарушенная граница доверия и наблюдаемый эффект; отсутствие best practice — лишь рекомендация по hardening.
Важное ограничение: такой аудит требует реального sandbox‑окружения без сети и доступа к боевым системам. Это инструмент для безопасной проверки исходников, а не автономный пентест продакшена.
Для pet‑проектов, API, MCP, auth/roles и supply chain — очень сильный шаблон того, как надо строить агентное security‑ревью.
Исходники skill на GitHub · оригинальный пост Cloudflare
Это не просто промпт «найди уязвимости». Skill проводит полноценный defensive‑аудит в несколько фаз:
— строит карту архитектуры, границ доверия и поверхностей атаки;
— запускает отдельных агентов‑«охотников» по классам атак;
— отдаёт каждую находку независимому агенту, который пытается её опровергнуть;
— фиксирует результаты в машиночитаемом формате:
confirmed, needs_validation, rejected;— генерирует отчёт только после повторной проверки.
Главная мысль Cloudflare: агент не должен считаться правым только потому, что уверенно назвал «CVE». Подтверждённая находка — это конкретная нарушенная граница доверия и наблюдаемый эффект; отсутствие best practice — лишь рекомендация по hardening.
Важное ограничение: такой аудит требует реального sandbox‑окружения без сети и доступа к боевым системам. Это инструмент для безопасной проверки исходников, а не автономный пентест продакшена.
Для pet‑проектов, API, MCP, auth/roles и supply chain — очень сильный шаблон того, как надо строить агентное security‑ревью.
Исходники skill на GitHub · оригинальный пост Cloudflare
GitHub
GitHub - cloudflare/security-audit-skill: A coding-agent skill for multi-phase security audits with independently verified, machine…
A coding-agent skill for multi-phase security audits with independently verified, machine-readable findings - cloudflare/security-audit-skill