Технозаметки Малышева
11.9K subscribers
5.21K photos
1.96K videos
43 files
5.18K links
Новости инноваций из мира Искусственного Интеллекта. 🤖 [РКН: 7021469833 ]

Всё об ИИ, ИТ трендах и Технологической Сингулярности.

🤖: @ai_gptfreebot [бесплатный бот]
✍️: @tsingular_bot [каталог ботов и курсов]

💸: https://pay.cloudtips.ru/p/c8960bbb
Download Telegram
Forwarded from XOR
This media is not supported in your browser
VIEW IN TELEGRAM
Google выпустила Gemini 3.8 Flash — новая быстрая модель уже обходит гигантов в кодинге.

По данным WSJ, во внутренних тестах сотрудники Google предпочитали её ответы Claude Opus. Сама модель обещает быть дешевой и заточенной под кодинг и агентные задачи.

Gemini 3.8 Flash уже начала появляться у пользователей, так что ждем официального релиза.

Сентябрь жаркий на модели 😻

@xor_journal
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥12🤣5
Keenable SELECT: веб как таблица, к которой пишешь SQL

Стартап Keenable, который в августе вышел из стелса с $26 млн от Accel, показал вторую большую идею: SELECT, отдельный MCP-сервер, где агент запрашивает данные из открытого веба одним SQL-запросом и получает таблицу вместо стены ссылок.

Да, по сути каждый сайт становится строкой таблицы: сервер сам гоняет поиски, скачивает страницы, вытаскивает запрошенные поля и собирает строки с источниками.

🔧 Как это работает:
Ты спрашиваешь агента по-человечески, а агент, по гайду внутри самого тула, пишет read-only SELECT на диалекте DuckDB.
В запросе живут табличные функции WEB_SEARCH и WEB_FETCH, а семантические функции SEM_EXTRACT и SEM_NORM достают и нормализуют поля силами LLM.
Реальный пример из документации: один вызов прогнал 7 поисков, слил 1 400 результатов в 1 125 страниц, вытащил три поля с каждой и сгруппировал в таблицу «модель, источники, запас хода, цена».

Ответ приезжает компактным табличным кодированием вместо JSON, поэтому таблица почти не ест контекст.

📊 Фишка для дальних сессий:
Каждый вызов возвращает id набора данных, и повторный вопрос читает сохранённое, без нового обхода веба.
«А теперь только до €30 000, отсортируй по убыванию» выполняется по сохранённой таблице за секунды, наборы данных живут до 30 дней.

💼 Зачем это агентам:
Фаундеры Андрей Стыскин и Матиас Петри по 20 лет строили поиск в Яндексе и Amazon Alexa, в Keenable уже проиндексировано 100+ млрд страниц, поиск для агентов в разы дешевле.
Схема «агент читает ссылки по одной и собирает ответ руками» становится одним tool call'ом: сервер отдаёт готовые строки с источниками.

Подключается за минуту к Claude Code, Cursor, VS Code, ChatGPT в developer mode, по одному API-ключу на всё.

Честные оговорки из документации: запрос занимает секунды-минуты, извлечение не проверяет факты, точные цифры сверяй по независимым страницам.

📎 SELECT · Документация · TechCrunch о раунде

#Keenable #агенты #SQL
———
@tsingular | Max | YouTube | RuTube
🔥641👍1
Gemini 3.8 Flash и отдельная версия для кибербеза

Google выкатил Gemini 3.8 Flash: лучшую свою модель для кодинга и рассуждений при цене и скорости 3.7, плюс отдельный вариант 3.8 Flash Cyber для ИБ.

Оба варианта построены на общем ядре, прокачанном в том числе тренировкой на задачах кибербезопасности.

🔧 Что умеет базовая 3.8 Flash:
На DeepSWE v1.1 обходит большинство больших фронттир-моделей в автономном решении инженерных задач, при этом стоит дешевле.
В профессиональных областях обходит 3.7 и конкурентов: Vals Finance Agent V2 для финансов, Harvey Legal Agent для юристов, 54,9% на HLE-Verified.
На сложных задачах модель работает усерднее, делает больше шагов и чаще использует инструменты, даже если тратит больше токенов.
Для экономных режимов есть параметр effort и по-прежнему поддерживаемая 3.7 Flash.

🛡 А теперь про Cyber-вариант:
Отдельная модель для доверенных защитников по программе Fairwind (Palo Alto Networks, Snowflake, Wiz среди партнёров).
На CyberGym, бенчмарке поиска уязвимостей, показывает фронттир-уровень, обходит 3.5 Flash Cyber и модели крупнее.
На внутреннем бенчмарке по 20 языкам находит уязвимости с успехом выше 70%.
Приоритет отдан патчингу, а не эксплойтам: на CWE-Bench 47,2% pass@1 против 47,8% у лидирующей фронттир-модели, но дешевле.
Google уже использует 3.8 Flash Cyber для защиты собственного кода.

Цены до конца года: $0,75 за миллион входных токенов и $3,75 за выходные, с 1 января дороже. ($1.5 вход/ $7.5 выход)

Получается реальный конкурент DeepSeek Pro и GLM 5.3 вышел.

📎 Анонс в блоге Google

#Gemini #cybersecurity #агенты
———
@tsingular | Max | YouTube | RuTube
🔥911
This media is not supported in your browser
VIEW IN TELEGRAM
Nousportal запустили реффералку.

теперь при покупке подписки вы получите $15 скидки.
Т.е. план будет стоить не $20 для вас, а всего $5

Регаться по ссылке

#NousResearch #скидки
———
@tsingular
❤‍🔥421
Higgsfield выпустили плагин для смартфона, который превращает его в контроллер камеры в сцене.
В итоге нейрорендер получил еще больше реализма в кадре.

Осталось подключить модели, которые видео рендерят быстрее реального времени и можно прикручивать к играм.

#higgsfield #нейрорендер
------
@tsingular
🔥9432
This media is not supported in your browser
VIEW IN TELEGRAM
Utopia: база знаний, которая помнит, когда каждый факт был правдой

На GitHub появилась Utopia: self-hosted платформа знаний, где RAG по своим документам работает поверх графа, в котором у каждого факта есть метка времени и срок жизни.
585 звёзд за первые недели, лицензия Apache-2.0, весь стек это один бинарник на Rust и база на Postgres.

Память с датой:
Большинство баз знаний отвечает на вопрос «что», Utopia построена вокруг «когда».
У каждого факта в графе поля valid_from и valid_to, вопрос «кто вёл проект X в третьем квартале 2024» решается чтением графа на нужный момент.
Факты дописываются, а не перезаписываются: исправление закрывает прошлую версию, история можно проследить по изменеиям во времени.
На странице графа таймлайн таскаешь мышью, и связи перерисовываются на выбранную дату.
Каждое ребро ссылается на предложение-первоисточник, без доказательства в граф ничего не попадает.

⚖️ Чем отличается от аналогов:
У Zep с движком Graphiti та же идея временных фактов, но это отдельная библиотека поверх Neo4j или FalkorDB, у Utopia только Postgres.
Mem0 отдаёт граф знаний лишь в платном тарифе за $249 в месяц, а тут открыт весь код.
RAGFlow и AnythingLLM хорошо ищут по документам, но время факта они не моделируют.
Отдельно стоит выделить полезную фишку, - "очередь ревью" она позволяет оценить сомнительные выводы и кандидаты на слияние сущностей через подтверждения человеком.

💼 Зачем бизнесу:
Классическая дыра RAG: инструкция изменилась в марте, а чат отвечает по февральской версии. Здесь это лечится на уровне модели данных.
Тот же граф по дороге станет памятью агентов: схема под memory-пространства уже есть, MCP-сервер в планах.
Но надо учитывать, что это v0.1 от одного мантейнера и фреймворк ещё сырой: API-ключи в базе лежат без шифрования, пути обновлений не гарантированы.

Для пилота в доверенной сети годится, в прод ставить рано.
Смотрим, изучаем, сравниваем с аналогами.

📎 GitHub · Zep/Graphiti для сравнения

#utopia #RAG #темпоральный #граф #opensource

———
@tsingular | Max | YouTube | RuTube
🔥10422
This media is not supported in your browser
VIEW IN TELEGRAM
Hermes Desktop подключился к нескольким gateway сразу

В Hermes 0.21.0 настольное приложение научилось держать реестр подключений: локальный рантайм, удалённые gateway в локалке или на VPS, SSH-хосты и инстансы Hermes Cloud в одном окне.
Раньше Desktop цеплялся к одному бэкенду за раз, теперь это панель управления флотом агентов.

🔌 Как устроен реестр:
Четыре типа подключений: локальный, Remote gateway по HTTP(S), SSH и Hermes Cloud, у каждого своё имя-метка вроде «Homelab».
SSH заботится о вас: приложение само открывает туннель и запускает дашборд, для остальных hermes serve поднимается руками.
Кнопка Test проверяет оба плеча, HTTP и WebSocket: «Reachable» значит, что чат заработает.
Профили с одинаковыми именами на разных машинах различаются хэндлами @имя-устройство.

⚙️ Как это работает внутри:
Каждая пара подключение-профиль получает свой бэкенд и сокет, фоновые агенты продолжают стримить, пока смотришь на другой gateway.
Перечисление агентов идёт по REST без дозвона к каждому WebSocket, недоступный gateway не роняет ростер, а помечается янтарной точкой.
Сессии, файлы, cron, каналы и память всегда живут на машине, которой принадлежит профиль.
Обновление всех инстансов одной кнопкой: hermes update уезжает параллельно на каждую машину.

💼 Зачем бизнесу:
Типовой сценарий: Hermes на домашнем сервере, на рабочей машине и на VPS, всё в одном окне вместо терминалов и вкладок.
Плагинам открыли SDK: host.connections() и host.agents() дают реестр и объединённый ростер, Bot Mode уже работает как референсный потребитель.
Токены лежат в файлах 0600 в основном процессе Electron, опционально шифруются через OS keychain.
Оговорка: Sessions всегда показывает один активный gateway, чтобы был понятен контекст работы.

📎 Документация · Releases

#hermes #nousresearch #агенты #desktop
———
@tsingular | Max | YouTube | RuTube
🔥6🏆31
В Лондоне можно вызвать первое в Европе роботакси в Uber

Британская Wayve и Uber запустили в Лондоне первое такси с автопилотом по запросу: 15 машин Ford Mustang Mach-E поехали по городу, где работает свыше 100 тысяч частных извозчиков.
Вызов через обычный Uber, за рулём пока лицензированный водитель: молчит всю поездку, но перехватит управление по просьбе пассажира.

🚗 Почему это важно:
TfL в августе выдал Mustang лицензию private hire, полный отказ от водителя ждёт одобрения DVSA, но, похоже, не в этом году.
На автономные поездки записались 100 тысяч пользователей Uber, а машин всего 15, поймать роботакси шансы не большие.
Лондон ключевой рынок Европы: Waymo и Baidu тоже тестируются здесь, Uber получается первым начал реальную работу.

🧠 Чем Wayve отличается от Waymo:
Стек Wayve это end-to-end AI Driver: обучаемая модель вместо HD-карт с правилами.
Модель натренирована на данных из 70+ стран и переносится между городами и типами машин, в феврале Wayve подняла $1,2 млрд при оценке $8,6 млрд (Microsoft, NVIDIA, Uber, Mercedes).
На тест-драйве Guardian машина сама перепарковалась, освободив ворота.
Дальше планируется наладить производство и выпустить на дороги серийные Nissan Leaf вместо ретрофиттинга с соблюдением требований безопасности и регуляторки.

💼 Зачем бизнесу:
Загреб летом стал первой точкой Uber в Европе, Лондон второй, впереди 10+ городов и пилот в Токио.
Uber говорит, что пока никто не умеет делать AV-поездку дешевле, чем когда водитель человек, но со временем экономика подтянется.

Профсоюз GMB предупреждает о возможных потрясениях, но Uber обещает, что водители без работы не останутся. (как? :) )

📎 The Guardian · Wayve × Uber × Nissan

#wayve #uber #роботакси #роботы
———
@tsingular | Max | YouTube | RuTube
3🆒2👍1
Нью-Йорк запретил ученикам использовать AI до старшей школы

Мэр Нью-Йорка Зохран Мамдани объявил годовой мораторий на генеративный AI в городских школах: без него остаются около 600 тысяч учеников от начальной школы по восьмой класс.
Мораторий стартует в 2026-2027 учебном году вместе с лимитами экранного времени и пилотом AI-инструментов в старших классах.

🚫 Что именно запрещено:
Ученикам до старшей школы полностью запрещено использовать AI в классе, включая софт со встроенным генеративным AI, это один из самых жёстких запретов в США.
Учителям нельзя проверять работы AI-инструментами, но можно планировать уроки с AI.
Компаньон-чатботы для дружбы и психологической поддержки запрещены во всех классах.
До третьего класса запрещены персональные экраны, средним классам разрешено максимум 45 минут экранного времени в день.
Старшеклассникам AI разрешены только в отдельных случаях, плюс уроки AI-грамотности дважды в год.

🔬 Зохран Мамдани против «неизбежности»:
«Детям нужны учителя и человеческая связь, чтобы учиться и расти», индустрия же уверяет, что AI-образование неизбежно, «мы так не считаем».
Вместе с запретом запущен пилот для пяти классов с проверенными инструментами: Quill для английского, Edia для математики, Brisk Teaching, Playlab, в которых соблюдается принцип «ученик главный мыслитель».
Коалиция из педагогов, родителей и экспертов весь год оценивает эффект и опубликует выводы.

💼 Зачем бизнесу:
Крупнейший школьный округ США закрыл рынку EdTech рынок размером в 600 тысяч пользователей: вендорам нужно доказывать безопасность и эффективность до, не после.
Исключения остаются: инструменты для детей с инвалидностью, мультиязычных учеников и информатика.
Тренд международный: Норвегия, Швеция и Нидерланды тоже ограничивают ИИ технологии в школах.

📎 The Verge · Пресс-релиз мэрии

#образование #ньюйорк #регулирование #AI
———
@tsingular | Max | YouTube | RuTube
🔥7🤔311
This media is not supported in your browser
VIEW IN TELEGRAM
Китайцы, конечно, крутые. без вопросов!

В городах Китая на общественных цифровых дисплеях вместо изображений знаменитостей и рекламных объявлений теперь демонстрируются портреты ученых, исследователей и изобретателей

По сообщениям, жители довольны этими переменами и называют их настоящими звездами – людьми, чьи достижения заслуживают восхищения и уважения.

#Китай #новости
———
@tsingular
🔥66👍18🏆1422
Раз уж Гермес превращается в мультиагентную систему - удобно если у каждого из них будет свой аватар в зависимости от места хостинга.

Нарезал немного профилей, вдруг вам тоже пригодится.

Если нужен под какой-то другой стиль - пишите, пока промпт горячий.

#аватары #Hermes
———
@tsingular
🔥113🆒1