Forwarded from Data Secrets
RNN в картинках
Объясняем как работют рекуррентные нейронные сети по такому рецепту: минимум слов, максимум схем и примеров.
Объясняем как работют рекуррентные нейронные сети по такому рецепту: минимум слов, максимум схем и примеров.
Forwarded from Data Secrets
Пул всех text2video моделей до Sora по порядку. Как всегда, все начинается с Google
Forwarded from Data Secrets
Там у Microsoft вышел новый бесплатный курс по генеративкам для начинающих. Все что нужно для прохождения — это доступ к OpenAI API и на базовом уровне уметь писать код на Python.
В курсе содержится 18 текстовых уроков, которые расскажут про базовые принципы работы с большими языковыми моделями, ИИ-агентами и тем, как это всё использовать в разработке собственных проектов.
Ссылка на курс: https://github.com/microsoft/generative-ai-for-beginners/tree/main
В курсе содержится 18 текстовых уроков, которые расскажут про базовые принципы работы с большими языковыми моделями, ИИ-агентами и тем, как это всё использовать в разработке собственных проектов.
Ссылка на курс: https://github.com/microsoft/generative-ai-for-beginners/tree/main
Forwarded from Data Secrets
HalvingSearch – ускорение поиска по сетке
Подбор гперпараметров – сложная и распросраненная задача. Для ее решения часто используют поиск по сетке, но этот алгоритм очень уж медленный. Поэтому сегодня давайте обратим внимание на halving search. Его относительно недавно добавили в sklearn, и пришло время разобраться, как с ним работать.
Подбор гперпараметров – сложная и распросраненная задача. Для ее решения часто используют поиск по сетке, но этот алгоритм очень уж медленный. Поэтому сегодня давайте обратим внимание на halving search. Его относительно недавно добавили в sklearn, и пришло время разобраться, как с ним работать.
Forwarded from Сиолошная
Зачастую самая сложная часть использования ChatGPT-like ассистентов — это составление промпта. Не так, чтоб в 1-2 предложениях, а вот прям по нормальному! К примеру, для перевода своего блогпоста с русского на английский я составил промпт в 1800 токенов/5k символов. Что-то придумал сам, что-то взял из прошлых итераций, а что-то докрутил конкретно под эту задачу — не без помощи GPT-4, конечно.
Anthropic в ходе подготовки к релизу Claude 3 решили сесть подумать и составить «мета-промпт», чтобы помочь в составлении промпта. Вставили промпт в промпт чтобы можно было работать над промптом пока работаешь с промптом🙂
В их промпте, который заставит Claude 3 генерировать длинный промпт по вашему короткому описанию задаче, больше 6000 токенов (и 25'000 знаков). Мне понравилось, что по запросу дополнительно генерируются входные переменные, которые могут меняться в рамках вашей задачи. Например, при переводе важно учитывать целевую аудиторию, кто читать-то будет? Claude 3 сама прикинет, какие полезные инпуты можно получить, и впишет их в выходной промпт.
Я попробовал на двух примерах — ну, не так хорошо, как сделал бы сам за вечер, но точно поможет обычным пользователям добиваться чуть более приятных результатов.
Поиграться тут (нужен API ключ)
Официальный гайд по промптингу от Anthropic здесь
Anthropic в ходе подготовки к релизу Claude 3 решили сесть подумать и составить «мета-промпт», чтобы помочь в составлении промпта. Вставили промпт в промпт чтобы можно было работать над промптом пока работаешь с промптом
В их промпте, который заставит Claude 3 генерировать длинный промпт по вашему короткому описанию задаче, больше 6000 токенов (и 25'000 знаков). Мне понравилось, что по запросу дополнительно генерируются входные переменные, которые могут меняться в рамках вашей задачи. Например, при переводе важно учитывать целевую аудиторию, кто читать-то будет? Claude 3 сама прикинет, какие полезные инпуты можно получить, и впишет их в выходной промпт.
Я попробовал на двух примерах — ну, не так хорошо, как сделал бы сам за вечер, но точно поможет обычным пользователям добиваться чуть более приятных результатов.
Поиграться тут (нужен API ключ)
Официальный гайд по промптингу от Anthropic здесь
Please open Telegram to view this post
VIEW IN TELEGRAM