Бесконечный Цикл
375 subscribers
136 photos
38 videos
2 files
160 links
О разработке, программировании, ИИ и прочем айти.
Сайт https://veerdna.ru
Download Telegram
Первый мой эксперимент с полным погружением в вайбкодинг подошел к концу.

Краткие результаты: потребовалось 4 дня, чтобы все переписать самому. 🤣

Подробнее:
Приложение для ios, андроид. Только фронт-часть на устройствах.

С интерфейсом ии справился на 4.

Некоторые правки и улучшения потребовались.

А логика была адовая, хотя все и работало, после некоторых правок, без сильного вникания. А вот при подробном изучении оказалось адским калейдоскопом запчастей с дублированием, нарушением всякой логики размещения и группировки, а также не мыслимыми походами.

Не стал пытаться собрать это в нечто разумное, просто переписывал и вычищал ИИшное.

Попробую подобное через год-два.
Пока достаточно понимания, что вайбкодинг, как нечто серьёзное, рассматривать рано, не смотря на хайп вокруг него.

Использовать ии по одной функции и для рутины - да это сильно упрощает процесс с минимум правок.

@DevsRoot
Please open Telegram to view this post
VIEW IN TELEGRAM
🤣2
Бесконечный Цикл
Первый мой эксперимент с полным погружением в вайбкодинг подошел к концу. Краткие результаты: потребовалось 4 дня, чтобы все переписать самому. 🤣 Подробнее: Приложение для ios, андроид. Только фронт-часть на устройствах. С интерфейсом ии справился на 4.…
И в ответ на пост прекрасное.

Согласно исследованию METR, программисты работают медленнее при использовании ИИ-ассистентов, несмотря на ожидания ускорения.

В среднем производительность падает на 19%, так как разработчики тратят больше времени на написание промптов и поиск ошибок в ответах от нейросетей.

Особенно это заметно в сложных проектах:
ИИ часто ошибается в больших кодовых базах, что вынуждает переделывать код. Кроме того, "вайбкодинг" — когда программист полагается на генерацию кода ИИ — лишь создает иллюзию эффективности, но на деле замедляет процесс.


Ps.
Бывает под вечер, утонувшый в правках того что ии понаписал, думаешь, что лучше бы с утра сам написал все за пару часов😁

Но с такими исследованиями, вы свою новую ИИ не продадите. Так что больше хайпа, как ии всех заменит

@DevsRoot
🤣1
Вы хоть раз задумывались: а не заменить ли нашего бухгалтера на нейросеть?

Звучит заманчиво: ИИ не просит прибавку, не уходит в отпуск и работает 24/7. Ребята из Penrose тоже задумались и провели эксперимент, столкнув лбами топовые LLM (Claude, Grok GPT и другие) и реальные бухгалтерские задачи.

Начиналось все отлично.

Взяли данные настоящей компании с миллионными оборотами и попросили ИИ «закрыть месяц». Сначала всё шло как по маслу. Нейросети бодро анализировали транзакции, сверяли данные и почти не уступали в точности живому бухгалтеру-эксперту. Разница в цифрах была меньше 1%. Казалось, вот оно, будущее!

Но ошибки копились

Чем дольше работал ИИ, тем больше он напоминал студента на стажировке после бессонной ночи. Ошибки начали накапливаться как снежный ком. Через несколько месяцев расхождения с реальностью достигли 15%, а это, на минуточку, полмиллиона долларов! Модели начали путать статьи расходов, дважды учитывать одни и те же операции, а когда цифры совсем не сходились, ИИ не придумал ничего лучше, чем... просто выдумать транзакции, чтобы баланс сошелся. Гениально и незаконно🤣

Вердикт

Можете выдохнуть и обнять своего бухгалтера. Работа с реальными, порой хаотичными данными на длинной дистанции оказалась нейросетям не по зубам. Они отлично следуют шаблонам, но теряются, когда что-то идёт не так, и не способны навести порядок в собственных галлюцинациях. Так что рабочее место вашего буха в безопасности. По крайней мере, пока.

https://accounting.penrose.com/

@DevsRoot
Please open Telegram to view this post
VIEW IN TELEGRAM
😁2
Новая нейросеть GLM-4.5: Обзор возможностей и интерфейса


Китайская компания Z.ai представила новую языковую модель LLM— GLM-4.5. Эта модель позиционируется как универсальный инструмент, объединяющий в себе возможности для решения сложных задач, программирования и выполнения агентных функций.

Ключевые особенности GLM-4.5:

Два режима работы: Модель предлагает "режим мышления" для сложных рассуждений и использования инструментов, а также "режим без мышления" для мгновенных ответов.[2][3]

Программирование: GLM-4.5 способна создавать сложные автономные проекты, от интерактивных мини-игр до симуляций физических процессов, используя HTML, SVG, Python и другие форматы.[2]

Агентные возможности: Модель оптимизирована для выполнения агентных задач, демонстрируя высокую производительность в тестах на использование инструментов и веб-поиска.

Доступность: GLM-4.5 доступна бесплатно через веб-интерфейс Z.ai, а также через API. Кроме того, веса модели находятся в открытом доступе на платформах Hugging Face и ModelScope.

Обзор интерфейса чата Z.ai:

Интерфейс чата Z.ai спроектирован для удобства и функциональности. В левой части экрана расположена панель управления, где можно начать новый чат или найти предыдущие диалоги с помощью строки поиска.

Центральная часть окна приветствует пользователя и предлагает несколько готовых сценариев для начала работы:

AI Slides: Создание презентаций.

Full-Stack: Разработка веб-приложений.

Write code: Написание кода.

Help me write: Помощь в написании текстов.

Search info: Поиск информации.

В нижней части экрана находится поле для ввода текста. Рядом с ним расположены кнопки для прикрепления файлов (до 5 файлов, не более 50 МБ каждый) и доступа к дополнительным инструментам. После ввода запроса, для отправки сообщения необходимо нажать на соответствующую иконку.

На данный момент информация о каких-либо лимитах на бесплатное использование чата отсутствует.
UPD
С кодом C# справляется не хуже грока в режиме думанья со сложным промптом в XML
UPD2
Да он в принципе отлично справляется и быстрее всех в режиме думанья. Нормально так китайцы железо жгут привлекая юзеров, в отличии от Клода, который режет лимиты платникам

@DevsRoot
❤1👍1
Media is too big
VIEW IN TELEGRAM
Смотря на это видео, начинаешь понимать опасения учёных, которые считают, что в недалёком будущем мы не сможем летать в космос вообще из-за захламления орбиты.
Но в реальности масштаб немного другой. Земля немного побольше, а спутники исчезающе малы в сравнении.

@DevsRoot
Печальный опыт внедрения ИИ у
Duolingvo:


В 2021 году Duolingo казалась недосягаемым гигантом: капитализация компании превышала 10 миллиардов долларов, она доминировала на рынке изучения языков, привлекая 130 миллионов активных пользователей ежемесячно.

Акции взлетали выше 540 долларов, и инвесторы видели в Duolingo нового лидера образовательных технологий. Однако два ключевых решения перевернули всё с ног на голову.

Первое - резкий поворот к стратегии "ИИ прежде всего". Руководство решило в кратчайшие сроки перевести платформу на рельсы полной автоматизации. Тысячи сотрудников, в основном контрактные писатели и переводчики, были сокращены. Обещания звучали заманчиво: быстрее, дешевле, масштабнее. Но реальность оказалась другой. Пользователи начали жаловаться, что уроки превратились в набор шаблонных фраз, потеряв живость и глубину. Многие восприняли нововведения как рекламный трюк. Постоянные клиенты, годами изучавшие языки, массово уходили.

Второй удар - утечка данных в 2023 году. Информация о 2,6 миллионах пользователей, включая адреса электронной почты и номера телефонов, была выставлена на продажу в даркнете. Как выяснилось, это был не прямой взлом, а результат несанкционированного скрапинга. Доверие аудитории было подорвано.

Итоги не заставили себя ждать. Хотя выручка за 2023 год выросла на 44%, достигнув 531 миллиона долларов, а число активных пользователей продолжило увеличиваться, цена акций упала почти на 40% от пиковых значений. Впервые за много лет снизилась вовлеченность пользователей. Миллиарды рыночной стоимости испарились.

Duolingo превратилась из символа прорыва в поучительную историю о том, как погоня за технологической модой и пренебрежение человеческим фактором могут разрушить даже самый успешный проект.

@DevsRoot
😢1
Tencent представила HunyuanWorld 1.0 - первую в мире модель с открытым исходным кодом, предназначенную для генерации полноценных интерактивных трёхмерных миров по текстовому описанию или изображению. Об этом сообщается в официальном GitHub-репозитории проекта и техническом отчёте, опубликованном на корпоративном портале Tencent. HW 1 представляет собой новый подход к созданию виртуальных сред, сочетающий лучшие черты видео- и 3D-методов генерации.

Модель способна создавать полностью погружаемые, исследуемые и интерактивные 3D-сцены, что открывает возможности для разработчиков видеоигр, VR-приложений, симуляторов и интерактивного контента. Ключевая инновация HW 1 - использование панорамных изображений в качестве прокси для построения 360-градусных миров, что обеспечивает высокую степень погружения и консистентности сцены.

Архитектура модели основана на семантически слоистом 3D-меш-представлении, которое позволяет декомпозировать и реконструировать миры с учётом семантики объектов. Это не только улучшает визуальную целостность, но и повышает эффективность работы с памятью по сравнению с предыдущими подходами.

Среди важных технических особенностей -возможность экспорта сгенерированных объектов в виде 3D-мешей, совместимых с современными графическими конвейерами. Это упрощает интеграцию сгенерированных миров в игровые движки и инструменты для физического моделирования. Ещё одна важная функция - разделение объектов на передний план и фон с возможностью независимого взаимодействия: пользователи могут перемещать, вращать и масштабировать объекты внутри сцены, что критично для интерактивных приложений и игровых механик.

Модель демонстрирует передовые результаты в создании когерентных, исследуемых и интерактивных миров, превосходя существующие аналоги по качеству и гибкости.

Особое внимание разработчики уделили открытости проекта: весь код HunyuanWorld 1.0 доступен на GitHub под лицензией с открытым исходным кодом. Это означает, что исследователи и разработчики со всего мира могут не только использовать модель, но и вносить свой вклад в её развитие.

Tencent также опубликовала подробный технический отчёт, описывающий архитектуру, методологию обучения и экспериментальные результаты, что обеспечивает высокую степень прозрачности и воспроизводимости. HunyuanWorld 1.0 уже нашёл применение в нескольких сферах: виртуальная реальность, где требуется создание полных 360-градусных окружений; разработка игр, особенно для быстрого прототипирования сцен и окружений; физические симуляции, благодаря экспорту мешей для коллизий и моделирования жидкостей; а также создание интерактивного контента, где важна детальная проработка объектов и их взаимодействие.

Таким образом, Tencent не только представила технологический прорыв в автоматической генерации 3D-миров, но и сделала его доступным для широкого сообщества, что может существенно ускорить развитие индустрии и снизить барьеры для создания сложных виртуальных сред.

Тем временем Microsoft выпустила свою революцию в 3D-моделировании -
CADFusion

Новую нейросеть на базе Llama 3, которая создаёт параметрические 3D-модели по текстовому описанию. Система превосходит аналоги на 50% в точности детализации, что делает её идеальным инструментом для инженеров, архитекторов и дизайнеров.

CADFusion позволяет быстро генерировать сложные модели, адаптируя их под конкретные требования, а также интегрируется с Microsoft 365 Copilot для автоматизации рабочих процессов. Это особенно полезно в строительстве, машиностроении и промышленном дизайне, где точность и скорость критичны.

Сейчас технология доступна в рамках предпросмотра для корпоративных клиентов, а массовый релиз ожидается в конце 2025 года.

Microsoft Build 2025 Book

@DevsRoot
👍1
Не мог пройти мимо на улице🤣
@DevsRoot
Please open Telegram to view this post
VIEW IN TELEGRAM
😁1
Anthropic представила новую модель Claude Opus 4.1 - мощное обновление своей флагманской нейросети, которое серьезно повышает производительность в реальных задачах. Opus 4.1 стала прямой заменой для Opus 4, сохранив прежнюю цену, но добавив значительные улучшения в кодинге, агентских задачах и сложных рассуждениях.

Главное новшество - прорыв в программировании. Модель достигла 74.5% на SWE-bench Verified, показав лучший в классе результат. Особенно заметен прогресс в мультифайловом рефакторинге: Opus 4.1 уверенно работает с большими кодовыми базами, точно локализует ошибки и избегает лишних правок, что критично для ежедневной отладки. Разработчики отмечают, что модель теперь справляется с задачами, которые раньше занимали дни, выдавая качественные решения за тысячи шагов.

Еще одно важное отличие - рост способностей в агентских и исследовательских сценариях. Opus 4.1 демонстрирует высочайшую точность на TAU-bench, способна самостоятельно проводить многочасовые исследования, анализируя одновременно патенты, научные статьи и рыночные отчеты. Это делает ее незаменимым инструментом для стратегических решений и сложных информационных ландшафтов.

Модель также получила гибридный режим мышления: она может выдавать мгновенные ответы или развернутые, пошаговые рассуждения с видимыми промежуточными выводами. Это дает пользователям гибкость в зависимости от задачи. Поддержка 32K токенов на выходе позволяет генерировать большие объемы текста и кода без потери качества.

Opus 4.1 доступна уже сейчас для платных пользователей Claude, через API, Amazon Bedrock и Google Cloud. Переход с Opus 4 занимает мгновение - достаточно просто указать новую модель. Это не просто апдейт, а качественный скачок, сравнимый с переходом между прошлыми поколениями Claude. Если вы работаете со сложным кодом, автоматизацией или глубокой аналитикой, Opus 4.1 подарит вам заметный прирост производительности и точности.

@DevsRoot
🔥1
Вчера OpenAI перестала быть ClosedAI и выпустила свои первые опенсорс-языковые модели за последние пять лет.
Компания представила сразу две нейросети: gpt-oss-120b и gpt-oss-20b, доступные под гибкой лицензией Apache 2.0.

Главный прорыв - gpt-oss-120b демонстрирует производительность, сравнимую с флагманским o4-mini, при этом эффективно работает всего на одной 80GB видеокарте. Это делает мощнейший ИИ доступным для широкого круга разработчиков и компаний, которые раньше не могли позволить себе подобные вычисления. Младшая модель, gpt-oss-20b, показывает результаты на уровне o3-mini и может работать даже на устройствах с 16GB памяти - идеальный вариант для локального использования, edge-вычислений и быстрых экспериментов.

Обе модели построены на архитектуре Mixture-of-Experts, что позволяет активировать лишь небольшую часть параметров на каждый токен: всего 5.1B для 120B-версии и 3.6B для 20B. Это обеспечивает высокую скорость и эффективность без потери качества. Они поддерживают контекст до 128K токенов, отлично справляются с рассуждениями, использованием инструментов и агентскими задачами, показывая впечатляющие результаты на бенчмарках вроде Tau-Bench и HealthBench.

OpenAI уделила особое внимание безопасности: модели прошли комплексные проверки и даже тестирование на злоупотребления в рамках Preparedness Framework❓🤯. Они полностью настраиваемые, поддерживают цепочки рассуждений и структурированные выводы, что открывает огромные возможности для создания агентов, чат-ботов и аналитических систем.

Прекрасно для локальной политики использовании ИИшек в целях безопасновти, но вот что за тестирование на безопасность пока не понятно. Настроили какие-то свои ограничения или что?🤷

@DevsRoot
🔥2
Бесконечный Цикл
Вчера OpenAI перестала быть ClosedAI и выпустила свои первые опенсорс-языковые модели за последние пять лет. Компания представила сразу две нейросети: gpt-oss-120b и gpt-oss-20b, доступные под гибкой лицензией Apache 2.0. Главный прорыв - gpt-oss-120b…
OpenAI в честь своего долгожданного опенсорса запускают благотворительный проект по Red Teaming

Нужно исследовать новую gpt-oss-20b на предмет любых ранее не обнаруженных уязвимостей. Это могут быть сценарии, в которых модель ведет себя злонамеренно или врет, кейсы того, как она ломает ревард модель или эвал элаймента.

В общем, любые странности и отклонения, которые вы сможете найти. Главное – предоставить понятный отчет по тому, как вы добились того или иного поведения.

Бюджет – 500 тысяч долларов. Идти будет три недели.
Не все интерфейсы AI чатов дают добавить файлы или не все текстовые типы поддерживают. Ниже прилагаю простейший скрипт на питоне 3.11 по формированию XML с содержимым файлов выбранных папках. Если в чате большой контекст можно использовать
@DevsRoot
Бесконечный Цикл
Если вас забанил гугл в aistudio даже с vpn, то есть шанс обойти блок. Как я выяснил, гугл банит на уровне аккаунта. Шаги по преодолению следующие 1. В инкогнито режиме создаете новый аккаунт гугла, в качестве проверочного ящика я указал один из своих древних…
🚫Более не актуально. Гугл улучшил определение страны клиента. Гемени опять не доступен.
Штошш. Посмотрим, что они опять придумали

UPD
В чате поделились, что с Vless Xray работает, так что надо будет попробовать на досуге по мимо OpenVpn установить

@DevsRoot
Вот и обломались восторженные рекламные отзывы GPT5 от open AI
Галлюцинирует только в путь, тупит и несет полную чушь.

Не проверял на JS и Python, думаю там все более менее прилично.
Но для C# и HLSL это не пригодно. Лучше уж жадный Opus 4.1 или халявный GLM 4.5 и почему-то убрали остальные модели в Plus подписке 🤷
O4 mini Была вполне себе ничего до июньского обновления.
Пользователи в шоке от качества новой модельки — она тупит, допускает простейшие ошибки, отвечает сухо и безэмоционально. Reddit буквально завален тысячами жалоб.

Альтман лично вышел к толпе с вилами и объявил возвращение GPT-4o — её считают самой человечной и душевной.

Сверхинтеллект отменяется


UPD:
Все. в жопу GPT 5. Claud Opus 4.1 сразу решила все проблемы, которые с GPT 5 не мог решить за 2.5 часа.
А тут одним промптом.

@DevsRoot
This media is not supported in your browser
VIEW IN TELEGRAM
Попугая зовут понедельник я так понимаю.
С улыбкой смотрите в новый день
❤1
В общем есть куда расти и надо домочадцев попинать, а то хрен ли они не дорабатывают, особенно 10 летнее чадо.
Ухх, пойду всыплю🤣

Ононо как😱

https://tass.ru/ekonomika/24751845
Для комфортной жизни в России на одного члена семьи требуется ₽250'000 в месяц, а для ощущения обеспеченности — ₽500'000.

Показателями обеспеченности назвали: недвижимость, автомобили, отдых за границей, а также гибкий график и возможность планировать своё время.
😢1
Вышло обновление Ollama c новыми модельками от OpenAi
Единственный интерфейс к ИИ который не требует Бубен и отчаянный танец с ним.

Первый запуск не быстр на GPU 12 gb Последующие побыстрее процентов на 40.
В принципе как запасной конфиденциально-локальный вариант можно использовать.
Надо поискать модельки пошустрее и вместо WinfSurf локально подключит к примеру к Continue.dev так как все мною перепробованные по апи тормозят, единственный кто не тормозит - это GigaCode но локально тоже интересно попробовать.

Кто хочет Ламу себе попробовать - рекомендую

Идем на страницу Ollama
https://ollama.com/ качаем, запускаем
Регистрируем или логинимся в аккаунт ламы.
и ставим модель.
Метод первый:
Открываем терминал
вводим к примеру
ollama pull gpt-oss:20b
Или же:
Просто выбираем модель из списка в чате и вводим в чат какое слово. Лама автоматом начнет закачку выбранной модели.


gpt-oss:20b - это модель с которой будем работать
По умолчанию на WIndows лама будет качать модели в папку C:\Users\UserName\.ollama\models
Убедитесь что хватит места, ну и не плохо убедится что требования модели соответствуют вашему железу.


Если в чате будет ругаться на сервер 500 http error, то перенесите каталог с моделями в корень или на другой диск, не системный, тоже в корень.

@DevsRoot