LLM не умеет писать безопасный код на джаве.
Veracode проверили около 100 моделей на способность писать безопасный код на питоне, js, шарпе и джаве. Лишь 4% сгенерированных решений были безопасны с первого раза. Даже после уточняющих промтов доля безопасного кода не превысила 40%. Любопытно, что названия моделей команда не приводит. Боится исков?)
И ещё немного цифр:
▪️ 45% образцов кода не прошли проверку на безопасность и содержали уязвимости из списка OWASP Top 10
▪️ Лучше не просить писать модели на Java. Он оказался самым «опасным» языком — 72% сгенерированного LLM Java-кода включали уязвимости
▪️ У других языков все получше: Python – 38 %, JavaScript – 43 %, C# – 45 % не проходят проверки безопасности
https://t.me/anti_agi/957
Veracode проверили около 100 моделей на способность писать безопасный код на питоне, js, шарпе и джаве. Лишь 4% сгенерированных решений были безопасны с первого раза. Даже после уточняющих промтов доля безопасного кода не превысила 40%. Любопытно, что названия моделей команда не приводит. Боится исков?)
И ещё немного цифр:
▪️ 45% образцов кода не прошли проверку на безопасность и содержали уязвимости из списка OWASP Top 10
▪️ Лучше не просить писать модели на Java. Он оказался самым «опасным» языком — 72% сгенерированного LLM Java-кода включали уязвимости
▪️ У других языков все получше: Python – 38 %, JavaScript – 43 %, C# – 45 % не проходят проверки безопасности
https://t.me/anti_agi/957
Telegram
Неискусственный интеллект
LLM стали умнее, но код их безопаснее не стал
Veracode проверили около 100 моделей на способность писать безопасный код на питоне, js, шарпе и джаве. Лишь 4% сгенерированных решений были безопасны с первого раза. Даже после уточняющих промтов доля безопасного…
Veracode проверили около 100 моделей на способность писать безопасный код на питоне, js, шарпе и джаве. Лишь 4% сгенерированных решений были безопасны с первого раза. Даже после уточняющих промтов доля безопасного…
😁9👻4❤1👍1😱1
Гляжу, в комментах много кто возбудился на мой предыдущий стёб над неадекватышем Альтманом)
Просто напомню, что гугл еще весной без помпа и пафоса тихо выкатил бесплатный апп, который запускается почти на любом андроиде и позволяет скачать целую пачку разных квантизованных моделей на телефон и пользоваться ими везде. И для этого даже не нужно 16гб памяти
Среди моделей есть даже вполне неплохие версии Gemma и Qwen-2.5. А еще можно подключить свой HF аккаунт и... ну вы понимаете, почему Альтман выглядит глупо? 😁
https://t.me/EF9MERA/840
Просто напомню, что гугл еще весной без помпа и пафоса тихо выкатил бесплатный апп, который запускается почти на любом андроиде и позволяет скачать целую пачку разных квантизованных моделей на телефон и пользоваться ими везде. И для этого даже не нужно 16гб памяти
Среди моделей есть даже вполне неплохие версии Gemma и Qwen-2.5. А еще можно подключить свой HF аккаунт и... ну вы понимаете, почему Альтман выглядит глупо? 😁
https://t.me/EF9MERA/840
Telegram
EFEMERA: AI news
Приложение от Google для локального запуска ИИ-моделей
◯ Google AI Edge Gallery - экспериментальное приложение для телефонов
◯ Доступно бесплатно на Android и iOS (планируется в ближайшее время)
◯ Можно добавлять свои ИИ-модели и работать без подключения…
◯ Google AI Edge Gallery - экспериментальное приложение для телефонов
◯ Доступно бесплатно на Android и iOS (планируется в ближайшее время)
◯ Можно добавлять свои ИИ-модели и работать без подключения…
1❤8😁4👀3🔥1👌1
Чтобы вы не думали, что я только про АйЯй думаю, вот вам хорошая идея, чем заняться последними летними ночами
Метеорный поток Персеиды активен с 17 июля по 24 августа и достигает максимума 12 августа. Все на выходных валим из города, трепаться в темноте и смотреть на метеоритный дождь
Я в прошлом году наблюдал его с коллегами где-то в горах. Жаль, в этом так не получится(
https://starwalk.space/ru/news/all-you-need-to-know-about-the-perseids
Метеорный поток Персеиды активен с 17 июля по 24 августа и достигает максимума 12 августа. Все на выходных валим из города, трепаться в темноте и смотреть на метеоритный дождь
Я в прошлом году наблюдал его с коллегами где-то в горах. Жаль, в этом так не получится(
https://starwalk.space/ru/news/all-you-need-to-know-about-the-perseids
Star Walk
Звездопад Персеиды 2026 12–13 августа: где будет видно и как наблюдать
Персеиды достигнут пика 12–13 августа 2026 года, и в этом году условия для наблюдения отличные! Читайте статью, чтобы узнать больше.
1👍8🔥2
Да наконец-то переходим от хайпа "ИИ нас всех заменит" к адекватному "ИИ уменьшит когнитивную нагрузку и необходимость всё помнить"
Такой подход уже хороший и правильный. Это и людям приятно и мир улучшит. Просто представьте, что любой вчерашний выпускник медвуза может в любой деревне ставить обоснованный и корректный диагноз на уровне именитых врачей. Или такое же в строительтсве, машиностроении, транспортной инфраструктуре...
Такой подход уже хороший и правильный. Это и людям приятно и мир улучшит. Просто представьте, что любой вчерашний выпускник медвуза может в любой деревне ставить обоснованный и корректный диагноз на уровне именитых врачей. Или такое же в строительтсве, машиностроении, транспортной инфраструктуре...
1😎8👎1
Forwarded from Data Secrets
Google продолжают радовать прикладными модельками: они выпустили диагностическую медицинскую ИИ-систему
Особенность guardrailed-AMIE (g-AMIE) в том, что она создана именно как помощник врача, а не его замена. Вместо того, чтобы давать какие-то медицинские рекомендации, модель просто формирует для живого специалиста информационную сводку и гипотезы, которые стоит проверить.
В основе Gemini 2.0 Flash, но тут важнее форма процесса. За все отвечают три агента:
1. Диалоговый. Он опрашивает пациента, запрашивает какие-то необходимые документы и делает краткое заключение с гипотезами и описанием случая.
2. Проверяющий. Чекает, чтобы ничего из того, что написал диалоговый, не представляло из себя медицинскую рекомендацию (такую дать может только врач)
3. SOAP-агент. Генерирует итоговый отчет. Сначала объективные заключения, потом гипотезы и план их проверки, зачем черновик заключения для пациента.
Результаты передаются в руки врачу. Тот в специальном интерфейсе все просматривает, редактирует и решает, какой окончательный диагноз поставить и что делать с пациентом.
Google тут молодцы именно в том, что не пытаются бежать вперед паровоза и заменить врача, а ориентируются на реальную ситуацию в сфере. Понятно, что ставить полностью автономного агента в клинике никто не будет, но вот такая система, которая просто помогает врачу, не снимая с него основную ответственность за принятие решений, вполне может работать в любой больнице уже завтра почти без рисков.
Ну и да: по точности предлагаемых диагнозов и плана лечения (а еще по уровню эмпатии) g-AMIE обошла и врачей, и младший мед.персонал.
research.google/blog/enabling-physician-centered-oversight-for-amie/
Особенность guardrailed-AMIE (g-AMIE) в том, что она создана именно как помощник врача, а не его замена. Вместо того, чтобы давать какие-то медицинские рекомендации, модель просто формирует для живого специалиста информационную сводку и гипотезы, которые стоит проверить.
В основе Gemini 2.0 Flash, но тут важнее форма процесса. За все отвечают три агента:
1. Диалоговый. Он опрашивает пациента, запрашивает какие-то необходимые документы и делает краткое заключение с гипотезами и описанием случая.
2. Проверяющий. Чекает, чтобы ничего из того, что написал диалоговый, не представляло из себя медицинскую рекомендацию (такую дать может только врач)
3. SOAP-агент. Генерирует итоговый отчет. Сначала объективные заключения, потом гипотезы и план их проверки, зачем черновик заключения для пациента.
Результаты передаются в руки врачу. Тот в специальном интерфейсе все просматривает, редактирует и решает, какой окончательный диагноз поставить и что делать с пациентом.
Google тут молодцы именно в том, что не пытаются бежать вперед паровоза и заменить врача, а ориентируются на реальную ситуацию в сфере. Понятно, что ставить полностью автономного агента в клинике никто не будет, но вот такая система, которая просто помогает врачу, не снимая с него основную ответственность за принятие решений, вполне может работать в любой больнице уже завтра почти без рисков.
Ну и да: по точности предлагаемых диагнозов и плана лечения (а еще по уровню эмпатии) g-AMIE обошла и врачей, и младший мед.персонал.
research.google/blog/enabling-physician-centered-oversight-for-amie/
🔥6👍5
Forwarded from Data Secrets
Альтман внезапно заявил, что ИИ может оказаться пузырем
(Да-да, главное говорить это уже после выпуска GPT-5)
Сэм сравнил рыночные условия с бумом доткомов в девяностых. Тогда тоже была массовая гонка инвестиций, но затем всего за 2 года главная американская фондовая биржа Nasdaq потеряла почти 80% своей стоимости: многие компании так и не смогли выйти на прибыль.
К слову, если текущее состояние рынка – все-таки пузырь, то он уже сейчас больше, чем интернет-пузырь. От этом недавно писал в своем отчете известный экономист с Уолл-стрит Торстен Слок. По его словам, текущие показатели переоценки акций (фактически цена к ожидаемой прибыли) для топ‑10 компаний сегодня сильно выше, чем это было тогда. График наверху.
Ну что, у кого какие идеи для стартапов?🙂
(Да-да, главное говорить это уже после выпуска GPT-5)
Сэм сравнил рыночные условия с бумом доткомов в девяностых. Тогда тоже была массовая гонка инвестиций, но затем всего за 2 года главная американская фондовая биржа Nasdaq потеряла почти 80% своей стоимости: многие компании так и не смогли выйти на прибыль.
«Пузыри формируются, когда умные люди начинают слишком увлекаться какой-то хорошей идеей. Находимся ли мы в фазе, когда инвесторы в целом слишком увлечены ИИ? По-моему, да. Но при этом остается ли ИИ самым важным событием в мире за долгое время? По-моему, тоже да»
К слову, если текущее состояние рынка – все-таки пузырь, то он уже сейчас больше, чем интернет-пузырь. От этом недавно писал в своем отчете известный экономист с Уолл-стрит Торстен Слок. По его словам, текущие показатели переоценки акций (фактически цена к ожидаемой прибыли) для топ‑10 компаний сегодня сильно выше, чем это было тогда. График наверху.
Ну что, у кого какие идеи для стартапов?
Please open Telegram to view this post
VIEW IN TELEGRAM
😁3😱1🌭1
Forwarded from Denis Sexy IT 🤖
6 месяцев назад, CEO антропика говорил, что 90% кода будет писаться LLM уже через 6 месяцев
Кажется, не получилось, ждем новых предсказаний☕️
Источник
Кажется, не получилось, ждем новых предсказаний
Источник
Please open Telegram to view this post
VIEW IN TELEGRAM
😁17
Несколько месяцев назад находил context7.com - это централизованный MCP сервер для ИИ агентов. Помогает агенту не тупить, галлюцинируя методы, которых он не знает, а просто искать по ним документацию под каждый нужный случай
А сегодня нашёл ещё одно изделие того же плана, но уже рассчитанное на мясных пользователей: deepwiki.com. Прям на сайте встроен ИИ поиск, можно початиться с доками, а можно подключить как MCP к вашему ассистенту или редактору
Т.е полезно не только как ИИ расширение, но и как вполне себе удобная вики по всему более-менее популярному
А сегодня нашёл ещё одно изделие того же плана, но уже рассчитанное на мясных пользователей: deepwiki.com. Прям на сайте встроен ИИ поиск, можно початиться с доками, а можно подключить как MCP к вашему ассистенту или редактору
Т.е полезно не только как ИИ расширение, но и как вполне себе удобная вики по всему более-менее популярному
1🔥10👍6❤1
Гугл опубликовали первый cookbook гайд по разработке агентских систем, если вдруг кому-то интересно
(ENG) https://docs.google.com/document/d/1rsaK53T3Lg5KoGwvf8ukOUvbELRtH-V0LnOIFDxBryE/mobilebasic#ftnt_ref1
(RU) https://github.com/pridees/agentic-design-patterns-book-rus?tab=readme-ov-file
(ENG) https://docs.google.com/document/d/1rsaK53T3Lg5KoGwvf8ukOUvbELRtH-V0LnOIFDxBryE/mobilebasic#ftnt_ref1
(RU) https://github.com/pridees/agentic-design-patterns-book-rus?tab=readme-ov-file
Google Docs
Agentic Design Patterns
Agentic Design Patterns 👉 🧠 ✅ I’m excited to share that my new book, "Agentic Design Patterns: A Hands-On Guide to Intelligent AI Agents," is officially out! 👉 🧠 ✅ In a field moving at lightning speed, this book focuses on the durable, fundamental patterns…
🔥10👍2👀2😢1
Вы точно не скучали по ИИ херне, но я бдю и шарю.
Сегодня: как переключить гугл в режим ИИ ассистента, вместо поисковика (работает не на всех аккаунтах, к сожалению)
Сегодня: как переключить гугл в режим ИИ ассистента, вместо поисковика (работает не на всех аккаунтах, к сожалению)
😁1
Forwarded from Точки над ИИ
This media is not supported in your browser
VIEW IN TELEGRAM
Всем любителям и любительницам Google Chrome
Вы можете установить режим Google AI по умолчанию внутри Chrome. Это работает быстро и дает мультимодальный поиск.
Как настроить у себя:
1. Введите в строку «
2. Нажмите «Добавить» в разделе «Поиск по сайту»
3. Дайте ему имя, которое вы хотите (AI Mode) и ярлык (ai).
4. В качестве URL-адреса введите:
"
Как только он будет добавлен, перейдите к трем точкам рядом с ним и выберите «Сделать по умолчанию»
Готово! Ну и всегда можно быстро откатиться обратно.
#browser@TochkiNadAI
Вы можете установить режим Google AI по умолчанию внутри Chrome. Это работает быстро и дает мультимодальный поиск.
Как настроить у себя:
1. Введите в строку «
chrome://settings/searchEngines» 2. Нажмите «Добавить» в разделе «Поиск по сайту»
3. Дайте ему имя, которое вы хотите (AI Mode) и ярлык (ai).
4. В качестве URL-адреса введите:
"
https://www.google.com/search?udm=50&q=%s" Как только он будет добавлен, перейдите к трем точкам рядом с ним и выберите «Сделать по умолчанию»
Готово! Ну и всегда можно быстро откатиться обратно.
#browser@TochkiNadAI
🌭4
Забавная статейка со смешными предсказаниями провалов технологий за последние 150 лет. Рекомендую к прочтению, ибо вызывает улыбку
Пара цитат:
https://medium.com/free-code-camp/worst-tech-predictions-of-the-past-100-years-c18654211375
Пара цитат:
1876: «Американцам нужен телефон, а нам — нет. У нас много посыльных». — Сэр Уильям Прис , главный инженер Британской почты.
1932: «Нет ни малейшего намёка на то, что ядерная энергия когда-либо станет достижимой. Это означало бы, что атом пришлось бы расщеплять по собственному желанию.”—Альберт Эйнштейн.
1992: «Идея персонального коммуникатора в каждом кармане — это «несбыточная мечта, движимая жадностью». — Энди Гроув , тогдашний генеральный директор Intel.
https://medium.com/free-code-camp/worst-tech-predictions-of-the-past-100-years-c18654211375
Medium
The absolute worst technology predictions of the past 150 years
There’s a long-standing tradition among scientists, engineers, and industrialists. Every new year, they make predictions about a future.
😁8👍5❤1🔥1
Всем интересующимся: завтра будет конфа про ИИ для русскоговорящих. Онлайн. С возможностью послушать бесплатно
https://www.ai-dev.live/
https://www.ai-dev.live/
AI Dev 2025
Практическая онлайн-конференция про то как AI-инструментами кратно ускорять разработку.
👍5😁2🥴1
Оп-па. Походу, я в АВ тест попал. Готовимся прощаться с обычным поиском
😢7🔥3😱1