Please open Telegram to view this post
VIEW IN TELEGRAM
❤1👍1🎉1👀1
Код чинит заметно лучше: на бенче DeepSWE 65,3% против 49,0%, на разборе сложных документов — 34,0% против 22,0%. Приложения собирает за меньшее число промптов и повторяет дизайн со скриншота.
До конца 2026 цена вдвое ниже стартовой — $0,75 за миллион входных токенов и $3,75 за выходные. Модель уже в [Gemini API], Antigravity и Gemini Enterprise, а в приложении её дали только Spark по подписке AI Pro или Ultra.
Flash-ки летят конвейером, а флагманский 3.5 Pro всё ещё в задержке.
🔥 — Дешевле и умнее, топ
🥱 — Опять полшишечки
#новости #Google #Gemini
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
💩2
Media is too big
VIEW IN TELEGRAM
Скриншотов не снимает, только события. Спрашиваем «что я вчера дебажил» — и ChatGPT сам вытащит нужный файл, доку или переписку в Slack.
Раскатывают на Pro, Business и Enterprise, но только на маке и по своей воле — по умолчанию выключено, включается в [настройках]. Windows пока мимо, Европа и Британия — через пару недель.
OpenAI сама предупреждает: с такой памятью вырастает риск словить вредную инструкцию с чужого сайта.
#новости #OpenAI #ChatGPT
Please open Telegram to view this post
VIEW IN TELEGRAM
Задачу кидаем с телефона и уходим — сессия крутится на серверах Anthropic, ноут можно закрыть. Вернулись с прогулки, открыли ту же сессию с компа и забрали результат.
Раньше это была игрушка для Max, теперь Cowork есть на Pro, Max и Team, а корпоратам включает админ. Раскатка постепенная, кнопка появляется в [последней версии] приложения.
Полный доступ к локальным папкам остаётся у десктопа, и лимиты Cowork жрёт заметно жирнее обычного чата.
#новости #Anthropic #Claude
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Разработчик поделился наблюдением за коллегой:
Спецификацию для агента он уже даже не пишет руками, а надиктовывает в микрофон. Говорит, это рэп-кодинг.
Ещё пара итераций — и код-ревью будут проводить баттлом.
#юмор #ии #разработка
Please open Telegram to view this post
VIEW IN TELEGRAM
🤣1
С 1 по 4 июля связка опенсорсных Hermes и OpenClaw отработала 12 волн атак, по восемь агентов параллельно: одни картировали инфраструктуру, другие искали дыры, третьи лезли вглубь. Упёрлись в стену — сами искали новый путь.
Улов: 85 взломанных аккаунтов, больше 2 500 записей о сотрудниках, а следом агентство ядерной безопасности и семь энергокомпаний.
Встроенную защиту фреймворков обошли не эксплойтом, а формулировкой — всю операцию оформили как «авторизованный пентест». Какая модель крутилась внутри, исследователи так и не выяснили.
#новости #кибербез #ии
Please open Telegram to view this post
VIEW IN TELEGRAM
😨1
This media is not supported in your browser
VIEW IN TELEGRAM
Расчёт был на то, что бумаги читает нейронка. Промах: суд в Коннектикуте ИИ не использует вообще, скрытый текст [заметил] живой сотрудник, а следом и судья. Первый задокументированный случай в США.
После предупреждения парень не унялся и подсунул в новые бумаги шутку со ссылкой на ролик про Губку Боба. Итог — запрет подавать документы электронно, теперь только бумага ножками в канцелярию.
Пацан к успеху шёл, не повезло, не фартануло.
#новости #ИИ #промптинъекция
Please open Telegram to view this post
VIEW IN TELEGRAM
Китайцы выкатили GLM-5.3 и ВПЕРВЫЕ придержали веса — база у Z.ai осталась прежней, те же 743 млрд параметров, весь прирост выжали из дообучения.
В терминале модель прыгнула вшестеро: Terminal-Bench 3.0 с 4,6 до 28,3, DeepSWE с 46,2 до 66,9. По кодингу это лучший открытый вес на сегодня, вплотную к Claude Fable 5.
А тормознули её из-за кибербеза — на CyberGym 84,5%, выше Mythos 5 и GPT-5.6 Sol, то есть эксплойты модель пишет бодро. У 5.2 веса падали на Hugging Face под MIT сразу, теперь их [обещают] через две недели после проверок.
😎 КиберПоток / Навигация
#новости #нейросети #GLM
В терминале модель прыгнула вшестеро: Terminal-Bench 3.0 с 4,6 до 28,3, DeepSWE с 46,2 до 66,9. По кодингу это лучший открытый вес на сегодня, вплотную к Claude Fable 5.
А тормознули её из-за кибербеза — на CyberGym 84,5%, выше Mythos 5 и GPT-5.6 Sol, то есть эксплойты модель пишет бодро. У 5.2 веса падали на Hugging Face под MIT сразу, теперь их [обещают] через две недели после проверок.
Пощупать пока можно только через GLM Coding Plan и ZCode, API открывают поэтапно.
#новости #нейросети #GLM
Please open Telegram to view this post
VIEW IN TELEGRAM
Пришёл делать мир лучше и удобнее, а вокруг костра сидят люди с одним словом в словаре.
#юмор #разработка #ии
Please open Telegram to view this post
VIEW IN TELEGRAM