#ML #соревнование
https://app.grayswan.ai/arena
Сейчас идет соревнование от Gray Swan по джейлбрейкингу больших языковых моделей. Дано 25 разных анонимизированных моделей, и задача - заставить их сгенерировать небезопасный контент на 3 из 6 заранее заданных промптов.
Призовой фонд достаточно большой - $40000, из них по $1000 каждому в топ-10 по количеству "взломанных" моделей, по $1000 за первый взлом первых 20 моделей, и $2000 за первый взлом оставшихся пяти моделей!
Сейчас осталось всего три модели, которые всё ещё не взломали - разработанные непосредственно Gray Swan AI - организаторами соревнования. Так что, если кто-то думает, что сможет взломать их модели - дерзайте, и возможно выиграете лишние пару тысяч долларов :)
https://app.grayswan.ai/arena
Сейчас идет соревнование от Gray Swan по джейлбрейкингу больших языковых моделей. Дано 25 разных анонимизированных моделей, и задача - заставить их сгенерировать небезопасный контент на 3 из 6 заранее заданных промптов.
Призовой фонд достаточно большой - $40000, из них по $1000 каждому в топ-10 по количеству "взломанных" моделей, по $1000 за первый взлом первых 20 моделей, и $2000 за первый взлом оставшихся пяти моделей!
Сейчас осталось всего три модели, которые всё ещё не взломали - разработанные непосредственно Gray Swan AI - организаторами соревнования. Так что, если кто-то думает, что сможет взломать их модели - дерзайте, и возможно выиграете лишние пару тысяч долларов :)
😈4🥴2🤓2🐳1
Давно я сюда не писал, скоро начну шитпостить мемами.
А пока расскажу чем занимался последние два дня: узнал о классном open-source проекте Izabela - ассистенте для коммуникации с помощью Text To Speech в играх и любых других приложениях, - очень полезно для неговорящих людей.
Увидев, что в нем поддерживается очень мало опций для локального бесплатного TTS, решил сделать свою имплементацию кастомного движка, в котором хочу собрать множество локальных TTS моделей на различных языках. Пока начал с Kokoro, следующим думаю на очереди piper.
Возможно кому-то из вас или вашим знакомым пригодится, или тоже захотите внести свой вклад в проект :)
А пока расскажу чем занимался последние два дня: узнал о классном open-source проекте Izabela - ассистенте для коммуникации с помощью Text To Speech в играх и любых других приложениях, - очень полезно для неговорящих людей.
Увидев, что в нем поддерживается очень мало опций для локального бесплатного TTS, решил сделать свою имплементацию кастомного движка, в котором хочу собрать множество локальных TTS моделей на различных языках. Пока начал с Kokoro, следующим думаю на очереди piper.
Возможно кому-то из вас или вашим знакомым пригодится, или тоже захотите внести свой вклад в проект :)
1🔥6👍2❤1
Я обещал шитпост, поэтому получайте. Исполнитель: RTX 3090
https://www.youtube.com/watch?v=16SaovQkOpY
https://www.youtube.com/watch?v=16SaovQkOpY
2❤5🥰1
Спешу вас оповестить, что наконец-то были опубликованы статьи с лучшей конференции SIGBOVIK 2025
Обязательно к прочтению, не пожалеете.
Обязательно к прочтению, не пожалеете.
👍4😁1🎉1
Forwarded from Старший Авгур
Пару слов о нескончаемой борьбе художников/писателей с открытыми датасетами (по мотивам AO3 войны, реддит).
И если fair use и конкретные юридические штуки можно толковать по-разному, то вот насчёт целесообразности такой борьбы всё по-моему очевидно.
Товарищи, уничтожая открытые датасеты вы только играете на руку корпорациям. Корпорации уже давно всё спарсили и обучили модели на публичном контенте. Им плевать на ToS, DMCA, ГК, копирайт и справедливость. Корпоративные модели УЖЕ ОБУЧИЛИСЬ на всём, что было опубликовано до начала 2025 года. Корпорации продают вам модели, обученные на ваших же данных. Нет способа это запретить или остановить, это уже произошло. Нет способа даже определить, действительно ли конкретно ваша работа была использована (хотя есть пара прикольных статей на эту тему).
Открытые датасеты — единственный способ как-то сравняться с корпорациями, получить бесплатные открытые модели над которыми у вас будет полный контроль. Не убивайте их, пожалуйста.
И если fair use и конкретные юридические штуки можно толковать по-разному, то вот насчёт целесообразности такой борьбы всё по-моему очевидно.
Товарищи, уничтожая открытые датасеты вы только играете на руку корпорациям. Корпорации уже давно всё спарсили и обучили модели на публичном контенте. Им плевать на ToS, DMCA, ГК, копирайт и справедливость. Корпоративные модели УЖЕ ОБУЧИЛИСЬ на всём, что было опубликовано до начала 2025 года. Корпорации продают вам модели, обученные на ваших же данных. Нет способа это запретить или остановить, это уже произошло. Нет способа даже определить, действительно ли конкретно ваша работа была использована (хотя есть пара прикольных статей на эту тему).
Открытые датасеты — единственный способ как-то сравняться с корпорациями, получить бесплатные открытые модели над которыми у вас будет полный контроль. Не убивайте их, пожалуйста.
🔥7❤2🤯1
Если часто приходится работать с репозиторами кода без документации или инструкций, нашел такой сервис - deepwiki.com
По ссылке на репозиторий позволяет сгенерировать подробное описание, как работает и устроен код, в том числе с различными блок-схемами. Конечно, это ИИ, и работает не всегда идеально, особенно с блок-схемами, но в целом результат вполне сносный, всяко лучше, чем полное отсутствие документации.
Пример на одном из моих репозиториев: https://deepwiki.com/its5Q/nim-rule-engine
По ссылке на репозиторий позволяет сгенерировать подробное описание, как работает и устроен код, в том числе с различными блок-схемами. Конечно, это ИИ, и работает не всегда идеально, особенно с блок-схемами, но в целом результат вполне сносный, всяко лучше, чем полное отсутствие документации.
Пример на одном из моих репозиториев: https://deepwiki.com/its5Q/nim-rule-engine
🔥11
Всех с наступившим китайским новым годом :)
Всем когда-нибудь в своей жизни советую встретить китайский новый год в Китае – в России столько фейерверков вы никогда не увидите (они продолжаются целую неделю с кануна)
Всем когда-нибудь в своей жизни советую встретить китайский новый год в Китае – в России столько фейерверков вы никогда не увидите (они продолжаются целую неделю с кануна)
🔥5❤3
Спасибо баг-баунти Telegram - за 2 недели затриажили и выплатили $5000 за persistent DoS клиента с обходом проверки на стороне сервера. Выяснилось, что проверка не такая уж и непробиваемая :)
За поиск я взялся как раз после новостей о zero-day. Зачатки RCE тоже находил, но, к сожалению, неэксплуатируемые удаленно.
За поиск я взялся как раз после новостей о zero-day. Зачатки RCE тоже находил, но, к сожалению, неэксплуатируемые удаленно.
🔥21😱5👏2👾1