DevNotes Live
6 subscribers
84.3K photos
12K videos
195 files
35.4K links
Автоматический агрегатор IT ресурсов в Telegram (@devnotes_robot)
Информация: https://t.me/devnotes_live/121
Download Telegram
Свежая выгрузка инструментов и в целом движа в алгоритмическом дизайне:
 
1. Adobe Firefly: Инструмент вышел из беты и доступен подписчикам Creative Cloud.
 
2. Everypixel: Статистика по количеству изображений сгенерированных инструментами алгоритмического дизайна DALL-E 2, Stable Diffusion, Midjourney и Adobe Firefly. Темпы роста огромные, хотя сюда, судя по всему, включены все промежуточные итерации, которые не идут в финальный макет.
 
3. Jambot: Официальный плагин на базе ChatGPT для FigJam. Он может просуммировать результаты брейншторма и сгенерировать идеи. Интервью с командой создателей.
 
4. Midjourney Inpainting: Новая функция позволяет изменить только часть изображения — например, только персонажа, не трогая саму сцену.
 
5. Matej Latin: Изучил, насколько удачно подбирают шрифтовые пары сервисы алгоритмического дизайна FontJoy и ChatGPT. Кое-что могут, но с кучей проблем и ограничений.
 
6. DreamFace: Генерация реалистичных трёхмерных моделей лиц по текстовому описанию. Они анимированы и текстурированы.
 
7. Captions: Многофункциональный алгоритмический инструмент создания и обработки аудио и видео. Генерирует голос по кусочку его записи, убирает слова-паразиты, улучшает попадание мимики рта в произносимый текст и много чего ещё.
 
8. Maggie Appleton: Презентация о современных языковых моделях и алгоритмических сервисах. Она описывает особенности их построения, проблемы в получении внятных результатов и свои интерфейсные концепты их решения.
 
9. TextFX: Экспериментальный проект Google, который помогает реперам писать рифмы.
 
10. HayGen Video Translate: Сервис переводит видео на другой язык. При этом он сохраняет голос и подгоняет мимику персонажа под новый текст.
 
11. Stable Audio: Новая модель от создателей Stable Diffusion позволяет генерировать музыку по текстовому описанию.
 
12. AudioGen: Экспериментальное решение Меты позволяет генерировать звуки по текстовому описанию.
 
13. Musicfy: Сервис позволяет напеть мотив песни и преобразовывает его в мелодию на конкретном инструменте.
 
14. Albus: Экспериментальная записная книжка на базе ChatGPT, которая помогает исследовать тему с разных сторон и генерировать заметки о ней.
 
#ai #algorithms
На конференции Adobe MAX 2023 традиционно показали пачку экспериментов с Adobe Firefly (раньше он назывался Sensei). И прокачали саму платформу алгоритмического дизайна:
 
1. Обновили базовую модель Firefly. Она научилась генерировать картинки в заданном стиле (нужно дать несколько примеров или выбрать из существующих рефов). Точнее генерирует людей и позволяет настраивать параметры «фотосъёмки». Помогает задавать правильные запросы (и предлагает подсказки). Ну и, само собой, даёт более лучшее качество.
 
2. Добавили векторную модель Firefly. Она помогает генерировать объекты, которые вписываются в стиль целевой иллюстрации, делает текстуры и градиенты, ну и правильно организует геометрию и слои.
 
3. Сделали модель Firefly Design. Она генерирует цельные редактируемые шаблоны (пока для их инструмента Adobe Express), которые адаптируются для разных сред вроде соцсетей или печати. Предлагает варианты текста, графики и композиции.
 
Кстати, недавно Firefly стал доступен через API в платформе NVIDIA Omniverse.
 
А вот свежие дикие штуки Adobe Sneaks:
 
#ProjectFastFill: Добавляет и удаляет объекты на видео таким же простым способом, то и Generative Fill.
 
#ProjectDraw&Delight: Превращает простейшие наброски рисунков в базовые контурные или полноцветные иллюстрации. Сюжет можно развивать и дополнять постепенно, менять позы персонажей, а также раскрашивать в духе недавнего запуска Illustrator Generative Recolor, ну и доделывать в самом Illustrator.
 
#ProjectNeo: Создаёт псевдо-трёхмерные иллюстрации с помощью простейших объектов. В примере делают архитектурный объект, который выглядит как векторная иллюстрация.
 
#ProjectSceneChange: Позволяет вставить персонажа из видео в любую другую сцену. Причём он докручивает оба видео, чтобы подходили друг к другу.
 
#ProjectPrimrose: Платье из простых текстур меняет цвет. Причём может делать анимацию из этого.
 
#ProjectGlyphEase: Создаёт шрифт на основе трёх знаков для примера, даже если это набросок на бумаге. И стилизует его в нужной технике, в том числе сверх-декоративной.
 
#ProjectPoseable: Генерирует наброски персонажей для сценарных раскадровок. Можно быстро настроить позу модели среди предложенных и описать нужный образ со сценой.
 
#ProjectResUp: Повышает разрешение видео маленького размера.
 
#ProjectDubDubDub: Генерирует дубляж видео или перевод аудио-записей на любой язык. Пытается вписаться в акустическое окружение сцены.
 
#ProjectStardust: Редактирует фото простым способом: переместить, добавить или убрать объекты, поменять одежду или дорисовать недостающую часть человека.
 
#ProjectSeeThrough: Убирает отражения и блики с фото, сделанных через стекло.
 
Скорость попадания этих набросков в основные продукты сильно выросла и в этом Adobe здорово уделывает хейтеров. И если в 2020 году тема почти сдулась, то сейчас снова тонна вдохновляющего.
 
#ai #algorithms #adobe #events
Как всегда, подборка свежего по алгоритмическому дизайну с трудом помещается в один выпуск:

DALL-E 3: Новое поколение позволяет точнее описать детали сцены, рисует людей с меньшим количеством галлюцинаций и генерирует корректный текст. Этические барьеры расширили — помимо известных людей, теперь нельзя мимикрировать под стиль ныне живущих художников (как убрать себя из обучения модели).

v0 by Vercel: Платформа для разработчиков Vercel запустила генератор интерфейсных компонентов. На выходе — код React на базе shadcn/ui и Tailwind CSS. Логика построения компонентов рандомная, но затея интересная.

Getty Images Generative AI: Официальный генератор фото от Getty Images и NVIDIA. Они тренировали его на своей базе фотографий и вроде как платят авторам рефов. Обещают полную лицензионную безопасность.

Baymard: Попробовали ChatGPT для экспертной оценки интерфейса по скриншоту и настоящей ссылке. Результаты мусорные ― находит крайне мало реальных проблем и выдумывает много несуществующих.

NN/g: Типичные задачи, для которых дизайнеры используют алгоритмические инструменты.

User Interviews: Что и для каких задач используют UX-исследователи.

Figma: Особенности современных инструментов для разработчиков, которые автоматизируют часть работы и генерируют код. И что из этого подошло для нового режима для разработчиков в Figma.

NN/g: Несколько моделей поведения пользователей при работе с генеративными сервисами.

Louis Charron: Как «галлюцинации» в генераторах картинок помогают креативности. Он сравнил разные версии Midjourney, которые сначала теряли поэтичность, а под конец немного вернули её.

Андрей Ковалёв: Коллекция стилей, в которые умеет Midjourney. Их можно использовать в своих запросах.

Vizcom: Превращает наброски от руки в полноценные 3D-рендеры.

YandexArt: Обновлённый генератор графики, который развивает прошлое поколение Шедеврум.

NN/g: Почему пользователи присваивают человеческие качества генеративным чат-помощникам и общаются с ними соответствующе.

Алина Сидоренко: Толковая памятка по работе с Midjourney. Как получить результат в разных стилях и видах дизайна (иллюстрации, текстуры, логотипы, интерфейсы и т.п.).

NN/g: Исследование генеративных ботов Bard, Bing и ChatGPT. Насколько хорошо они решают разные задачи.

YouTube: Будет предлагать идеи и сценарии для видео на основе данных об аудитории и её предпочтениях. Авторы смогут генерировать фоны по текстовому запросу и автоматически дублировать ролики на другие языки.

ChatGPT: Сможет принимать запросы голосом и лучше анализировать загруженные картинки. Например, предложит рецепт на основе фото продуктов в холодильнике. На такой картинке можно выделить детали, про которые хочется узнать. Тест-драйв.

Генератор скрытых слов на изображениях на базе Stable Diffusion и ControlNet.

Александр Селедчик: Чеклист поможет определить фото, сгенерированное алгоритмами.

Android 14: Генерирует фоны для телефона.

TryOnDiffusion: Экспериментальный инструмент «примеряет» любую одежду на ваше фото.

Jakob Nielsen: Какие метафоры кроме клишированного робота предлагают инструменты для показа самого ИИ.

Javi Lopez: Мини-игра Angry Pumpkins, сделанная с помощью DALL-E и Midjourney (графика) и GPT-4 (код).

Мета: Оцифровали пару десятков знаменитостей вроде Mr Beast и Snoop Dogg в качестве ИИ-ботов для чата с говорящей головой. И добавили много разных функций вроде алгоритмической генерации стикеров и редактирования фото.

Luma AI: Генератор 3D-моделей и сцен.

Kaiber: Генератор видео-клипов на основе текстового запроса, других видео, фото и аудио.

Suno AI: Генератор песен с вашими словами в разных жанрах.

Just AI Copilot: Свой ChatGPT от Just AI.

IKEA Instructions: Генератор иллюстраций в духе инструкций IKEA на базе Stable Diffusion XL.

Microsoft Copilot: Выходит в свежем обновлении Windows.

Spirals: Генератор спиралевидных фото.

AI Dubbing: Сервис переводит видео на другой язык. При этом он сохраняет голос персонажа.

EmojiGen: Генератор memoji.

#ai #algorithms
Новые ссылки об алгоритмическом дизайне пополняются быстрее, чем пакет с пакетами:
 
1. tldraw Make Real: Экспериментальный инструмент превращает наброски интерфейса от руки в аккуратный визуальный результат и код на React с помощью инструментов OpenAI. Можно дополнить скетч текстовым описанием того, что нужно. Причём интерфейс может иметь небанальную логику поведения. Обзор от создателей.
 
2. Midjourney: Бета-версия в браузере с человеческим интерфейсом.
 
3. KREA: Генератор изображений и видео по текстовому описанию (можно сделать условный набросок для точности). Умеет делать это в реальном времени (ещё пример). Может натренироваться на вашем собственном стиле.
 
4. NN/g: 6 типов общения с алгоритмическими чат-ботами и структура запроса к ним. Они провели дневниковое исследование среди пользователей ChatGPT, Bing Chat и Google Bard.
 
5. Luke Wroblewski: Подходы к интеграции алгоритмических возможностей в интерфейс цифровых продуктов.
 
6. Canva: Интегрировала инструменты алгоритмического сервиса Runway через встроенное приложение Magic Media.
 
7. Fusion Brain: Инструмент генерирует изображения и видео с помощью нейросети Kandinsky от Сбера.
 
8. YouTube: Серия экспериментов с генеративной музыкой. Dream Track создаёт композиции для коротких видео в духе нескольких музыкантов, вписавшихся в пилот. Music AI Tools генерирует музыку по текстовому описанию. Можно просто напеть зарисовку или сделать её другим способом, а потом перебирать инструменты и варианты звучания.
 
9. It's Nice That: Несколько дизайнеров описали свой рабочий процесс для задач, где они использовали инструменты алгоритмического дизайна. У всех достаточно хитрая солянка классических и новых приёмов.
 
10. Stable Diffusion: Теперь умеет генерировать видео по текстовому запросу.
 
11. Runway Motion Brush: Можно анимировать конкретную часть фото, если выделить её.
 
12. CLO: Генератор текстур для одежды по текстовому запросу в инструменте для цифровой моды.
 
13. Google: Экспериментальный генератор графики по текстовому запросу.
 
14. Runway TV: Экспериментальный генеративный телеканал от создателей алгоритмического инструмента для видео Runway.
 
15. Яндекс Маркет: Массовая генерация описаний товаров с YandexGPT.
 
16. Simon Willison: Советы по формулированию запросов в DALL-E 3.
 
17. Jakob Nielsen: Советует сравнивать алгоритмические инструменты не с лучшим экспертом в отрасли, а среднестатистическим. Ведь их основная ценность — повышать средний уровень в отрасли, а не обязательно совершать прорывы.
 
18. ChatGPT: Обновили модель до GPT-4 Turbo. Она обучалась на более свежей информации (до апреля 2023 года) и дешевле для разработчиков.

Также за последние месяцы начали появляться плагины вокруг дизайна вроде DoritosGPT (генерирует любые пачки чипсов Doritos), ConvertAnything (конвертирует кучу форматов изображений, видео, аудио и документов в кучу других форматов) и Canva (генерирует макеты для соцсетей и другие промо-материалы).
 
19. Яндекс Практикум: Пересказывает урок или объяснит сложный термин через YandexGPT.
 
20. Модельное агентство, которое предлагает алгоритмически сгенерированных моделей.
 
#ai #algorithms
Прошёл всего месяц, а по теме алгоритмического дизайна опять выше крыши новья:
 
Pika 1.0: Генератор видео по текстовому описанию вышел из беты и порвал танцпол своей безумной демкой.
 
Midjourney 6: Вышла альфа-версия нового поколения. Увеличили разрешение до 2048x2048, добавили генерацию небольших текстов, улучшили понимание самих запросов.
 
StorybookGPT: Плагин для ChatGPT генерирует описание компонентов для живого гайдлайна Storybook. Памятка по работе с ним.
 
iA (эксперты в работе над текстами): Оценивают сильные и слабые стороны алгоритмических инструментов в этом плане. Где они помогают и где бесполезны. В новой версии своего текстового редактора iA Writer 7 они использовали это понимание для интересной разметки авторства (вы, ChatGPT или другой источник).
 
DALL-E Party: Занятный эксперимент, который по циклу искажает цепочку генерации DALL-E. Он описывает картинку текстом, потом генерирует из него ещё одну картинку — и так по кругу.
 
Figma: Пообщались с менеджерами продуктов для массового пользователя, которые внедряют функции на базе ИИ. Как они строят продуктовую работу в таких случаях.
 
Angie Wang: Топчанское интерактивное размышление-повесть, в котором она сравнивает процесс обучения алгоритмов и маленького ребёнка — .
 
FlutterFlow AI Gen: Сервис для быстрой разработки мобильных приложений научился генерировать дизайн и код (фронт + бек) по текстовому запросу или наброску на бумаге. Он автоматизирует все этапы от идеи до реализации.
 
Alex Ivanovs: Описывает хронологию развития первого года жизни ChatGPT.
 
Krea: Добавили интересный метод «overlay view», который позволяет схематично набросать перспективу объекта и в целом основные элементы.
 
Microsoft Paint: Теперь тоже генерирует графику по текстовому описанию с функцией «Cocreator» на базе DALL-E 3. Видео-обзор.
 
Amazon Titan: Генератор изображений по текстовому описанию доступен на платформе AWS (видео-обзор).

Amazon Q: Ещё один алгоритмический помощник в AWS. Он подключается к корпоративным сервисам и помогает анализировать информацию из них.
 
Audiobox: Новая модель для генерации аудио от Меты. Может взять за основу ваш голос, текстовый запрос, готовую музыку и сгенерировать или доработать/переосмыслить их.
 
Output Co-Producer: Генератор семплов по текстовому запросу от создателей инструмента Output.
 
Instagram: Пробует менять фон в stories с помощью алгоритмического дизайна (ещё).
 
Исследователи Hugging Face и Carnegie Mellon University посчитали энергозатраты на генерацию изображений с помощью алгоритмического дизайна. Выходит много — сопоставимо с полной зарядкой телефона (исследование).
 
HeyGen Custom Avatar: Сервис создаёт фотореалистичные аватары пользователей, которые могут читать текст на видео. Голос и мимика — тоже ваши.
 
Magnific: Один из самых качественных алгоритмических сервисов по улучшению качества фото на базе.

Prompt Brush: Пародия на инструменты, работающие по текстовому запросу. Иллюстрацию по такому запросу руками рисует иллюстратор Pablo Delcan.
 
Luke Wroblewski: Советует давать подсказки в инструментах, работающих по текстовому запросу. Пользователи часто не понимают, как правильно что-то спросить у них.
 
YandexART: Научился генерировать ёлочные игрушки в нескольких стилях.
 
Google и Vogue: Изучили, как ИИ влияет на процессы и сценарии покупки модной одежды.
 
Spotify: Тестирует генерацию плейлистов по текстовому запросу.
 
Точка: Усилила интерактивный справочник с помощью ChatGPT. Сервис «Ассистент» помогает отвечать на бухгалтерские вопросы.
 
Curio: Говорящие игрушки, которые придумывают истории и диалоги с помощью ChatGPT. Анонс — https://www.youtube.com/watch?v=f5rLMWzjDIg.
 
Ars Technica: Сравнили, кто лучше хохмит — ChatGPT или Bard (спойлер: ChatGPT).
 
Битрикс CoPilot: Алгоритмические инструменты, встроенные в платформу. Генерирует, анализирует и улучшает контент.
 
Яндекс Недвижимость: Может искать квартиры по текстовому запросу вместо перебора фильтров с помощью YandexGPT.
 
#ai #algorithms
Пропустил месяц в выпусках про алгоритмический дизайн, так что теперь разгребать с полсотни новья:

Взаимодействие с такими инструментами:
1. Emily Campbell: Паттерны проектирования инструментов.

2. IBM: Принципы дизайна инструментов. Они дают удачные примеры реализации для каждой рекомендации.

3. Christopher Kovel: Почему алгоритмы не заменят пользовательских исследователей. Они подают надежды во вторичных исследованиях, которые делаются на основе уже опубликованных отчётов. Но не смогут в первичные, где нужно общаться с пользователями и зачастую импровизировать в рамках изначального плана.

4. Jakob Nielsen и Sarah Gibbons: Можно ли считать эмпатию от алгоритмических инструментов настоящей. Сара скептична, Якоб воодушевлён.

5. NN/g: Феномен «подхалимства» при работе с генеративными чат-ботами. Они стараются быть вежливыми и угодить пользователю, поэтому готовы противоречить фактам.

6. Jakob Nielsen: Анализирует свежее исследование Microsoft, которое показывает рост продуктивности благодаря помощнику Copilot. Цифры местами завышены (они такие только для идеальной ситуации), но данные в целом интересные.

7. Moritz Gießmann: Проблемы результатов алгоритмического дизайна с точки зрения accessibility.

8. Luke Wroblewski: Совмещение очков дополненной реальности и возможностей алгоритмического дизайна на лету.

Создание таких инструментов:
1. Конспект панельной дискуссии Noah Levin (Figma), Nadim Hossain (Databricks), Greg Hochmuth (Midjourney) и Joe Burfitt (Modyfi).

2. Intercom: Обновлённый продуктовый процесс при работе над функциональностью на базе ИИ.

Кейсы и инструкции:
1. Antoine Vidal: Как генерировать предсказуемую сцену в разных стилях с помощью подключения алгоритмических инструментов к 3D-программам.

2. Яндекс Лавка: Упаковка на базе YandexArt.

3. Вкусвилл: Упаковка.

4. ASML: Фильм о бренде. Для этих 1 минуты и 50 секунд собрали 7852 изображений на основе 1963 текстовых запросов в Midjourney, потом обработали в Runway. Видео.
 
Инструменты для изображений:
1. iA: Алгоритмически сгенерированная графика всё больше похожа на клишированные стоковые изображения. Они сформулировали конкретные приёмы, которые вызывают такое ощущение. iA придерживаются этого мнения и про видео.

2. Austin Gil: Как самому реализовать генерацию изображений в браузере на базе OpenAI.

3. Ideogram: Иллюстрации с реальным текстом по текстовому запросу.

4. ImageFX: Фото и иллюстрации по текстовому описанию от Google.

5. EverArt: Многофункциональный инструмент, который может генерировать и редактировать изображения. Может подстроиться под заданный стиль.

6. iStock AI Generator: Фото и иллюстрации по текстовому описанию. Обещают гарантированную безопасность в плане авторских прав на картинки. Анонс.

7. Яндекс Маркет: YandexArt генерирует изображения товаров в разном окружении, если загрузить фото на однотонном или прозрачном фоне.

8. Apple: Редактирование и ретушь фото по текстовому запросу.

9. BRIA RMBG: Удаляет фон на фото с очень пристойным качеством.

10. DignifAI: Угарный эксперимент от 4chan — одевает откровенные фото.

Инструменты для видео:
1. OpenAI Sora: Генерация видео по текстовому запросу (выглядит фешенебельно). Как это работает.

2. Stable Video: Генератор видео по текстовому запросу от создателей Stable Diffusion.

Другие дизайнерские инструменты:
1. Moodboard Creator: Генерирует базовые основы для визуального стиля. Правда, к мудбордам это отношения не имеет и попадание в запрос по жанру сомнительное.

2. Miro Assist: Умеет группировать и суммировать идеи, генерировать диаграммы и изображения, убрать фон у картинки.

3. Mural AI: Умеет группировать и суммировать идеи, генерировать ментальные карты. Он интегрирован с Microsoft 365 Copilot.

4. NVIDIA ACE (Avatar Cloud Engine): Оживляет игровых персонажей в живое взаимодействие без заранее заданного сценария с их решением. Видео.
 
5. Valve: Разрешит включать больше генеративного контента в игры для Steam.

#ai #algorithms
Вторая часть запоздалого выпуска про алгоритмический дизайн. Чуть меньше про сам дизайн, чуть больше про платформы:
 
Инструменты:
1. Wix AI Website Builder: Второй заход Wix на поляну алгоритмического дизайна после ADI. В этот раз он генерируется по текстовому запросу.
 
Взаимодействие с такими инструментами:
1. Silvia Podesta: Ментальные модели обычного поиска и новых подходов на базе чат-ботов типа Perplexity. Как отличается поведение и ожидания пользователей.

Общий тренд:
1. Everypixel: Обзор главных запусков и законодательных инициатив в сфере генеративного ИИ в 2023 году.

2. Sequoia Capital: Начинается второй акт генеративного ИИ. Он больше про полезные сценарии использования, а не просто технологии.

3. Simon Willison: Что отрасль узнала про большие языковые модели в 2023 году.

4. Визуализация того, как устроены большие языковые модели.
 
Платформы:
1. Microsoft добавляет кнопку Copilot в свой стандарт клавиатур для Windows. Это сильное заявление — в последний раз они делали это 30 лет назад с кнопкой Windows.
 
2. ChatGPT: Всё-таки появился каталог плагинов.
 
Также они тестируют возможность запоминать диалоги и строить следующие с их учётом.

3. Google выпустили свою новую модель Gemini 1.5. Она умеет, например, анализировать видео. Они переименовали Bard в Gemini.
 
4. Mistral: Французский аналог ChatGPT с инвестициями от Microsoft.

5. Claude: Выходцы из OpenAI запустили своя большие языковые модели. Анонс.

6. NVIDIA Chat with RTX: Языковая модель для локальной работы.
 
Другие инструменты:
1. Яндекс добавил возможности YandexGPT в свой браузер. Он помогает писать тексты, пересказывать и переводить видео и генерировать изображения. Это также повысит безопасность.

2. MusicFX: Обновился генератор музыки и битов по текстовому запросу от Google.

3. Afforai: Профессиональный поисковик по исследовательским публикациям. Он может просуммировать найденное.

4. Adobe Acrobat: Сможет пересказывать содержание PDF-документов.

5. Экспериментальный помощник при покупках на Amazon. Он может дать общие рекомендации перед покупкой, подобрать товары или ответить на вопросы о конкретных вещах

6. Walmart прокачает поиск на мобильных с помощью OpenAI.
 
Этика:
1. В открытый доступ утекла обучающая выборка для Midjourney, в которой многие иллюстраторы и дизайнеры нашли себя. Они использовали это как одно из доказательств для судебного иска.

2. Google перекрутил ручку инклюзивности Gemini и он стал выдавать нелепые исторические сюжеты.

3. Duolingo: Сократили 10% фрилансеров за счёт ИИ-инструментов.
 
#ai #algorithms
Чтобы пакет с пакетами про алгоритмический дизайн не успел переполниться, закидываю его сюда:
 
Relume: Грамотная концепция конструктора сайтов на базе алгоритмического дизайна. Он помогает составить карту сайта, сделать wireframes и собрать стиль на основе мудбордов. Всё это можно экспортировать в Webflow или Figma (они сделали тонну компонентов для типовых ситуаций).
 
NN/g: Помощь пользователям-новичкам при работе с алгоритмическими чат-ботами. Они провели небольшое исследование китайских сервисов и описала типичные проблемы людей, которые сталкиваются с таким впервые.
 
OpenAI: Попросили семь художников и режиссёров попробовать их новую модель Sora для генерации видео. Получилась крутая демонстрация возможностей.
 
Google AI Studio: Общедоступная версия языковой модели Gemini 1.5 Pro через новый, частично визуальный интерфейс.
 
Midjourney Character Reference: Теперь можно сохранить черты лица или детали одежды персонажа в разных генерациях.
 
Vincent Koc: Фреймворк «компас генеративного ИИ». Он помогает проектировать интерфейсы таких продуктов.

MeasuringU: Можно ли использовать ChatGPT для тестирования дерева в информационной архитектуре? Успешность выполнения задач сильно завышена, а вот простоту решения задачи предполагает неплохо.
 
Jakob Nielsen написал спорную статью об автоматической поддержке accessibility с помощью ИИ. Это вызвало огромную волну критики в проф.сообществе и Adrian Roselli собрал ссылки на все такие статьи.
 
Maze: Сервис для проведения пользовательских исследований добавляет алгоритмические функции. Он подскажет как грамотно сформулировать вопрос для респондента, задать догоняющие вопросы, анализировать общие темы и в целом организовывать проекты.
 
Devin: Платформа для разработчиков, которая мощно развивает концепцию копилотов. Она не только пишет код и исправляет баги, но и помогает разобраться в незнакомых технологиях, выкатывать на прод и много чего ещё.
 
Adobe Acrobat: Дизайн интерфейса Generative summary. Их принципы алгоритмического дизайна.
 
Victoria Turk: Анализирует современные инструменты генерации изображений по текстовому запросу и показывает на конкретных примерах, насколько они полны клишированных стереотипов.
 
Leonardo AI: Генератор фото и иллюстраций по текстовому описанию.
 
Blaze: Алгоритмический генератор текстов для блогов, социальных сетей и рекламы.
 
Jakob Nielsen: Приводит несколько исторических аналогий на тему страха «использующие ИИ-инструменты отупеют». Это далеко не всегда так.
 
Everypixel: Глоссарий самых популярных терминов, использующихся на текущем этапе эволюции ИИ.
 
Adobe Project Music GenAI Control: Генератор музыки по текстовому описанию. Можно докрутить готовую композицию по скорости, экспрессивности и т.п.
 
Arcads: Генератор вертикальных рекламных видео с вымышленными актёрами. На входе – ваш сценарий.
 
HeyGen Avatar in Motion 1.0: Генератор вертикальных рекламных видео с вымышленными актёрами в движении.
 
Grok-1: xAI Илона Маска опубликовала исходный код своей ИИ-платформы Grok-1 на GitHub.
 
YandexGPT 3: Новая версия языковой модели Яндекса. Также в Yandex Cloud появился API YandexArt для генерации фото и иллюстраций.
 
Яндекс Почта: Научилась пересказывать важные письма за последнюю неделю с помощью YandexGPT.
 
Intuit Assist: Алгоритмический помощник подсказывает, как управлять финансами.
 
#ai #algorithms
«Я ещё не договорила», сказала недавняя мини-подборка об алгоритмическом дизайне. Лучше выгрузить сейчас, пока снова не стало слишком много:
 
1. Rosenfeld Media запускают новую конференцию «Designing with AI» с фокусом на дизайн с ИИ. Она пройдёт 4-5 июня в онлайне.
 
2. UX Pilot: Многофункциональный инструмент алгоритмического дизайна. Умеет генерировать макеты, wireframes, цветовые палитры, тексты, планы рабочих сессий. Также может сделать оценку дизайна.
 
3. Adobe Photoshop: Можно стилизовать часть изображения на основе другого стилистического изображения-примера, менять части изображения на похожие по духу объекты, вырезать и сгенерирвать фон.
 
4. Adobe Premiere Pro: Можно генерировать видео по текстовому запросу, добавлять или удалять объекты, расширять кадр. Будет возможность подключить сторонние модели вроде OpenAI Sora, Pika Labs или Runway.
 
5. Knowing Machines: Откуда берут данные для обучения алгоритмов популярные генераторы фото и иллюстраций. Они пользуются базой LAION-5B, для которой сделали несколько курированных людьми выборок. Исходя из особенностей этих выборок становится понятно, почему многие картинки от Midjourney или Stable Diffusion выглядят однообразно.
 
6. Oliver Reichenstein: Интервью с основателем iA на тему стоковости результатов работы инструментов алгоритмического дизайна. И то, как может измениться подход дизайнеров, которые хотят этого избежать.
 
7. Figma Wireframe Designer: Плагин генерирует wireframes по текстовому запросу.
 
8. Amelia Wattenberger: Интересный концепт алгоритмического инструмента для помощи писателям. Он помогает сбалансировать повествование по сложности, эмоции и другим параметрам.
 
9. Spline: Генератор 3D-объектов по текстовому запросу.
 
10. VIDIM: Экспериментальный инструмент Google дорисовывает промежуточные кадры видео по первому и последнему.
 
11. Google Vids: Генератор видео для Google Workspace на базе презентаций Google Slides. Можно выбрать стиль и записать себя.
 
12. Яндекс Поиск: Алгоритмический чат-бот на базе YandexGPT.
 
13. Алиса: Прокачалась с помощью YandexGPT. Она сможет отвечать сама на большее количество вопросов.
 
14. Meta AI: Алгоритмический чат-бот. Работает как отдельный инструмент и внутри продуктов типа Facebook.
 
15. Mail.ru: В productivity-сервисах появился генеративный ИИ. Короткий пересказ писем, генерация текстов в заметках.
 
16. SoundID VoiceAI: Плагин для DAW превращает запись вашего голоса в любой другой и делает его звучание более профессиональным.
 
#ai #algorithms
Свежая супертяж-подборка об алгоритмическом дизайне:

СБОРКА ИНТЕРФЕЙСА
1. Gov.uk: Как можно превращать обычную бумажную форму в веб-версию. Tim Paul использовал дизайн-систему Gov.uk и автоматически разбивал её на шаги. Демка работает даже на основе бумажного скетча. Исходный код и более ранний эксперимент его коллеги Kuba Bartwicki.

2. GPT-4o: OpenAI выпустили новую модель 4o (omni), которая может анализировать текст, звук, изображения и видео в реальном времени. И выдавать результат также в реальном времени. Получается фактически легендарный фильм «Она» (они даже имитировали голос Скарлетт Йохансон, пока она не подала в суд). На презентации показали мощные демки с синхронным переводом на другой язык, адаптацией интонации под собеседника и контекстными шутками, обсуждением помещения собеседника (захват картинки с камеры), диалогом двух ИИ.

Eric Vyacheslav сгенерировал с её помощью макеты в Figma на основе спецификации.

ГРАФИЧЕСКИЙ ДИЗАЙН И ИСКУССТВО
1. Flair: Сервис генерирует эффектную сцену подачи вашего продукта (например, упаковка или одежда).

2. Robert Hodgin: Несколько раз прогнал цикл «Midjourney генерирует картинку → ChatGPT описывает её → Midjourney делает новую картинку по этому описанию». Он показал, как менялось это изображение от запроса к запросу.

3. Exactly AI: Инструмент для создания иллюстраций в заданном стиле.

4. Сбер вместе с музейными специалистами попытался восстановить картины, утерянные во время войны. Они сделали уже два проекта для Волгограда и Воронежа.

ВЗАИМОДЕЙСТВИЕ С ТАКИМИ ИНСТРУМЕНТАМИ
1. Книга Josh Clark и Veronika Kindred «Sentient Design» готовится в Rosenfeld Media. Они запустили этот термин вместе с флагманским выступлением и обзорной статьёй, плюс продают услуги типа Sentient Design Sprint.

2. Connor Joyce: Ещё один набор паттернов.

3. Alex Klein: Концепция интерфейсов на базе ИИ-агентов. Они не просто выполняют отдельные куски задач, а помогают по всему user journey.

4. iA: Предлагает по-другому посмотреть на ChatGPT и похожие сервисы. Если не ждать от них готовый результат, а использовать как собеседника и корректора — результат становится намного качественнее.

5. NN/g: Роль дизайнера. Какие навыки становятся важны вместо технических.

6. Everypixel: Типы «галлюцинаций».

ВИДЕО И КИНО
1. ToonCrafter: Генератор анимационных роликов на основе их первого и последнего кадра.

2. Luma Dream Machine: Генератор видео по текстовому запросу. Может в том числе анимировать обычную картинку (поток оживших мемов в первые дни зашкаливал).

3. KLING: Новый добротный генератор видео по текстовому описанию.

4. Runway Gen:48: Конкурс Runway для режиссёров — они должны были создать за 48 часов фильм на основе этого инструмента алгоритмического дизайна с условиями по сценарию.

5. AI Film Festival 2024: Runway второй раз провели фестиваль кино, сделанного при помощи ИИ.

6. Showrunner: Экспериментальный онлайн-кинотеатр от студии Fable генерирует сериалы по вашему запросу. С нужным стилем и сюжетом.

ИГРЫ
1. Microsoft Copilot появится в играх. Они показали демо для Minecraft.

2. Эксперимент с генеративной сценой в виртуальной реальности.

ЭТИКА И ЗАКОННОСТЬ
1. Everypixel: Что происходит с авторскими правами на контент, который используют для обучения больших языковых моделей. Кто с кем судится, есть ли легальные варианты для компаний.

2. Фотограф Miles Astray выиграл конкурс ИИ-фотографии 1839 Color Photography Awards с реальным фото. Его дисквалифицировали в итоге, но пранк вышел отменный.

3. Google Gemini в поиске выдаёт бредовые и опасные рекомендации типа клея в пицце. Они обучали его в том числе на данных Reddit, где много такого стёба.

4. Экспериментальный проект даёт возможность пообщаться с собеседником в чате, а потом угадать — это был человек или бот.

ДРУГИЕ ИНСТРУМЕНТЫ
1. IKI AI: Сервис поможет анализировать набор документов в разных форматах.

2. ElevenLabs Sound Effects: Генератор звуков для видео и подкастов по текстовому описанию.

#ai #algorithms