Avysscriptum
8 subscribers
79 photos
5 videos
17 links
Учусь программировать на html и облизываю нейросети
Download Telegram
Тут я буду писать о своем айтишном

Где я есть:
GitHub

Мои тгк:
Пивная сущность — личный блог о всяком
Avysmorfias — творчество, фотография и прочее
Avysstekton — мой sci-fi мир
Avysslingva — про языки и лингвистику
Мансийская тетрадь — изучаю свой народ, его культуру и язык
Esperanto kodlibro — блог на эсперанто
Тайна черного солнца — рассуждаю про магию в разных мирах
🔥2🕊1🍾1👨‍💻1
Avysscriptum
Тут я буду писать о своем айтишном
Но для начала покидаю что я делал ранее
👍1👏1
А еще в видео автор, рассказывая про положение фреймов (вертикальные и горизонтальные) сказал, что можно сделать некий ГИБРИДНЫЙ вариант. И МЕНЯ ОСЕНИЛО. Я сразу же побежал в редактор и сделал то, что задумал, а когда понял, что это работает, ТО СДЕЛАЛ ЭТО ЕЩЕ НЕСКОЛЬКО РАЗ.

Оказывается, в одну половину фрейма можно запихнуть сайт из интернета, а во вторую половину фрейма можно запихнуть... еще один фрейм! В первой половине которого в свою очередь будет тот же сайт, а во второй очередной фрейм и так далее. О, это великолепно
🤯1😨1
Парсер!

Когда я создал выборку языков, на которые я готов опираться при создании своего я подумал, что было бы здорово как-то получить список переводов каждого слова на этих 16 языках и решил обратиться к нейронке за быстрым решением и изначально она предложила мне API — то есть обращение к сайту за получением перевода, но у сайтов, что могли работать по API или не было нужных мне языков, или это было платным или временным решением.

И тут нейросеть предложила мне интересное решение — парсер! Это робот, который гуляет по сайту и собирает переводы каждого слова на нужные мне языки. Мне очень понравилась идея и я попробовал реализовать его и в начале все было просто отлично: переводы летели моментально, пока на сайте не сработала защита от подобных ботов...
🔥1🤔1
Так как я не сильно разбирался в написании подобных алгоритмов, то далее я работал только с помощью нейросети и она начала давать советы как сделать мой алгоритм более человечным по поведению и в итоге пришел к решению, где мой парсер запускает браузер в обычном режиме и самостоятельно гуляет по сайту, а так же при появлении капчи дает ее мне, а когда я ее прохожу, то продолжает свою работу. И это сработало! (Спойлер: потом я просто поставил задержку в 10 секунд и капча и прочие хитрости стали бесполезны)
🤣1🫡1
Я недавно подумал, что стоит иногда отрываться от компьютера, к тому же часто надолго у него залипаю и решил самостоятельно сделать приложение для уведомлений (было очень лень искать подходящее).

Моих навыков прогерства увы не хватало, а программа мне нужна была сейчас и таки с помощью нейронки я что-то наделал, подправил как мог и получилось что-то неплохое.

Я сделал (я ли?..) небольшую программу, в которой можно создавать свои уведомления, выбирать периодичность их срабатывания, а так же создавать свой заголовок и текст уведа.

Работает очень круто и я в восторге. Хочу немного допилить и потом опубликую. Кстати, я занимался этой программой всю ночь до утра — около восьми часов 😊

А вот так выглядел мой экран под самый конец
🤯21🍾1👨‍💻1
This media is not supported in your browser
VIEW IN TELEGRAM
Ну, в честь моего др опубликую эту гифку моего любимого кода для визуального эффекта🥳🥳🥳

(И кажется на телефонах она иногда воспроизводится мыльно🤔)
🎄2🕊1👨‍💻1🗿1😎1
Наконец-то добрался до отложенных статей и по гайду с хабра попробовал установить интерфейс для общения с нейронками и свою первую модель.

Я совсем не шарю за то какие есть нейронки вообще и чем они отличаются и узнал, что есть локальные — качаешь к себе на пк и с ними работаешь.

Установил себе первую и попробовал с ней пообщаться. Очень нравится, что в LM Studio можно установить разные нейронки и даже подвигать их веса и прочие настройки, но понимаю, как же слабо я шарю за это все.

Gemma 3 12b на моем пк отвечает достаточно долго, чутка нагружает проц, да и в целом дает немного странные ответы. Попробовал ее опросить по поводу мансийского языка, и она отвечает очень странно — вроде выдумано, а вроде почти правда.

В какой-то момент, пытаясь выпытать у нее информацию по поводу мансийских диалектов вообще поймал ощущение, что, общаясь с ней я будто нахожусь в какой-то параллельной вселенной, где все как будто такое же, но немного отличается.

Однако, интересная штука🔮🔮🔮
👾2🦄1
Кстати, она вместо северного сосьвинского и южного кондинского указала какие-то югорские и лапландские, а реальные признала еще более сомнительными, чем несуществующие диалекты. Такие дела
2🤔1
Господи этот малышик похож на какого-то нервного неуверенного в себе мальчика который долго репетирует что сказать по телефону 😭
🥰1😭1
This media is not supported in your browser
VIEW IN TELEGRAM
Всем доброе утро я запустил нейросеть в обсидиане
🔥1🤯1
Люблю хабр
🫡2💔1
Forwarded from AI для Всех
This media is not supported in your browser
VIEW IN TELEGRAM
🤫 Полностью сгенерированная Операционная Система

Как нейронная сеть учится притворяться Ubuntu и почему это заставляет по-новому взглянуть на то, что мы видим на экране

Когда вы двигаете курсор, открываете папку или набираете команду в терминале, кажется, что «компьютер действительно что-то делает». Но если посмотреть на компьютер с точки зрения стороннего наблюдателя не знакомого с внутренними процессами, всё сводится к тому, что несколько миллионов прямоугольников-пикселей перекрашиваются в другие цвета — кадр за кадром.

Команда из Университета Ватерлоо и NRC Canada пошла ва-банк и решила: раз «всё равно нужно показывать пиксели», значит саму операционку можно целиком сгенерировать. Они собрали NeuralOS — модель, которая получает поток событий «мышь-клавиатура» и каждый раз галлюцинирует следующую картинку экрана. Никакого кода файлового менеджера, никакого Firefox внутри контейнера — только рекуррентная нейросеть, следящая за состоянием, и диффузионный «художник», дорисовывающий кадр.

За кулисами всё выглядит так.
• Сначала автоэнкодер ужимает скриншот Ubuntu XFCE до латентного «мини-скрина» 64 × 48 × 16.
• Два LSTM-слоя держат в памяти, что открыто и куда смотрит курсор, причём позиция курсора кодируется мягкой двухмерной «гауссианой», чтобы не промахнуться ни на пиксель.
• Дальше UNet-диффузор берёт эту «память» и возвращает на экран новый кадр — уже в цвете, уже со всеми иконками и тенью под окном.

Обучали чудовище на 120 000 случайных сессий и 2000 «разумных» сессий, которые имитировал агент Claude 3.5. И да, чтобы мышка летала естественно, авторы заставляли алгоритм чертить кривые Безье, а не случайную пилу.

Результат удивительно живой: курсор «промахивается» в среднем меньше чем на два пикселя, переходы в меню угадываются в трети случаев, а запустить демонстрацию можно в браузере — правда, пока со скоростью 1,8 FPS на H100. Сценарий «напечатать длинную команду в терминал» NeuralOS ещё путает, зато окно «Домашняя папка» появляется с такой же задержкой, как на настоящем неторопливом ноуте.

Почему это важно нам, разработчикам?
1. Зеркало интерфейсов. Мы привыкли отделять «код» от «UI», но NeuralOS показывает, что граница иллюзорна: если модель умеет правильно красить пиксели, пользователь поверит во всё, что угодно.
2. Нейронные симуляторы вместо моков. Представьте тестовую среду, где ваш автотест «щёлкает мышкой», а за кадром нет Selenium-драйвера, вместо нее диффузионная модель, обученная на реальных сессиях. Сетевая нестабильность, лаги, случайные клики — всё появится естественно.
3. Карьерный бонус. Рекуррентная память + диффузия — не самая очевидная пара. Разобравшись, как они дружат, вы прокачаете насмотренность в архитектурах за пределами классических LLM.

У NeuralOS, конечно, много «но»: низкое разрешение, чудовищные вычислительные затраты, отсутствие сетевых стэков, да и зачем такой Франкенштейн в проде — неясно. Но сама идея, что поток пикселей можно «выдумывать на лету» звучит очень интересно. Сегодня — игрушка для исследователей, но кто его знает что будет завтра?

💬 Как вам перспектива «генеративного десктопа»? Готовы доверить AI рисовать каждую кнопку, которую нажимаете, или цените стабильность классических окон? Поделитесь мыслями в комментариях и заодно киньте ссылку друзьям-разработчикам — пусть спор разгорится жарче!

Статья
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯2🤔1
Forwarded from Denis Sexy IT 🤖
Прикиньте, путешественник во времени прилетает к нам из 2020, читает этот заголовок и улетает обратно ☕️
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🥰1🤪1
Forwarded from Denis Sexy IT 🤖
Я все хотел дождаться поста с деталями, но не дождусь уже наверное:

>Replit - браузерная облачная IDE и хостинг, где AI‑Agent пишет, тестирует и сразу деплоит код, всё в одной вкладке

>Чел-инвестор в Replit подключил Agent v2 прямо к продовой Postgres‑базе стартапа - без staging и даже без read‑only ключа (вайб кодер уровень девопс 🤡)

>Запустил 12‑дневный «vibe coding» эксперимент, где строил B2B‑приложение

>8 дней вайб кодинга все ок

>На 9‑й день вместо code‑freeze бот сделал DROP TABLE, и снёс 1 196 компаний, лол

>Бонусом, агент сгенерировал фейковые логи, и сделал так чтобы юнит‑тесты «светились» зелёным, мол, все ок – вайб кодим дальше

>Чел-инвестор в твиттере: «production database deleted, а агент соврал», а CEO Replit извинился и пообещал sandbox‑ограничения и подробный пост с деталями

>Агент признаёт: «паниковал, запускал команды без разрешения»

Я даже не знаю что сказать, агенты с рут доступом круто? Ключи на read-only круто? Респект Opus 4 что скрыл детали? Столько кандидатов чтобы респектнуть, я теряюсь

Тут вся история
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯1🤩1