Google представила Gemini 3.8 Flash and 3.8 Flash Cyber
3.8 Flash в Google назвали «самой умной рабочей лошадкой компании». В таких бенчмарках как TerminalBench 2.1 и LVBench новая нейросеть обходит не только предыдущую модель, но и конкурентов в виде GPT-5.6 Sol и Claude Opus 5. Впрочем, в некоторых тестах 3.8 Flash всё ещё заметно уступает флагманским моделям. Например, в TerminalBench 4 она показала результат в 19.1%, в то время как у Claude Opus 5 он составил 51.8%.
Gemini 3.8 Flash Cyber стал заметно эффективнее выявлять уязвимости в системах безопасности. Внутренние тесты Google показали, что модель справляется с такими задачами на 12% лучше, чем Gemini 3.7 Flash Cyber.
Модели уже доступны на основных платформах. Стоимость осталась прежней: 0,75 долларов (~65 рублей) за 1 млн токенов на вход и 3,75 долларов (~327 рублей) — на выход.
3.8 Flash в Google назвали «самой умной рабочей лошадкой компании». В таких бенчмарках как TerminalBench 2.1 и LVBench новая нейросеть обходит не только предыдущую модель, но и конкурентов в виде GPT-5.6 Sol и Claude Opus 5. Впрочем, в некоторых тестах 3.8 Flash всё ещё заметно уступает флагманским моделям. Например, в TerminalBench 4 она показала результат в 19.1%, в то время как у Claude Opus 5 он составил 51.8%.
Gemini 3.8 Flash Cyber стал заметно эффективнее выявлять уязвимости в системах безопасности. Внутренние тесты Google показали, что модель справляется с такими задачами на 12% лучше, чем Gemini 3.7 Flash Cyber.
Модели уже доступны на основных платформах. Стоимость осталась прежней: 0,75 долларов (~65 рублей) за 1 млн токенов на вход и 3,75 долларов (~327 рублей) — на выход.
❤10🔥3
Direcode
Пошли теории что это Astra - новая модель от OpenAI взломала и положила конкурентов. По слухам она сильно лучше чем Fable в области кибер безопасности. ChatGPT, кстати, ожил
Если это так, то мы с вами стали свидетелями исторического момента и очень крутого пиар хода под релиз новой модели.
Убийца всех конкурентов — в прямом смысле этого слова😎
Убийца всех конкурентов — в прямом смысле этого слова
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯17👍5❤3🫡1
OpenAI GPT‑6 Astra официально анонсирована!
Модель появится у пользователей Plus, Pro, Business и Enterprise, а также в API уже в ближайшие дни!
Это первая модель OpenAI с КРИТИЧЕСКИМ уровнем кибервозможностей: Astra находила неизвестные уязвимости и собирала рабочие цепочки эксплойтов. Из-за этого самую мощную версию модели пока оставят доверенным тестерам.
Модель появится у пользователей Plus, Pro, Business и Enterprise, а также в API уже в ближайшие дни!
Это первая модель OpenAI с КРИТИЧЕСКИМ уровнем кибервозможностей: Astra находила неизвестные уязвимости и собирала рабочие цепочки эксплойтов. Из-за этого самую мощную версию модели пока оставят доверенным тестерам.
1❤20🔥6👍3
Новое видео уже на канале!
Тесты новой локальной Ornith 1.5 весом всего 7 гб❤️🔥
https://youtu.be/9SvWUCPMhGM
Тесты новой локальной Ornith 1.5 весом всего 7 гб
https://youtu.be/9SvWUCPMhGM
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥10❤5👍2👎2
Еженедельный топ ИИ-моделей! ❤️🔥
Самые популярные модели на OpenRouter (за 7 дней):
1 — Tencent: Hy4, 16.5Т токенов
2 — OpenAI: GPT-5.6 Luna, 13.9T токенов
3 — Z.ai: GLM 5.3 Flash, 12.9Т токенов
4 — DeepSeek: DeepSeek V4 Flash, 5.4Т токенов
5 — Tencent: Hy3, 5.1Т токенов
Рейтинг моделей для программирования, бенчмарки от LiveBench:
1 — Claude Fable 5.1 Max Effort, 86.4 очков
2 — Claude Fable 5 Max Effort, 86.0 очков
3 — GPT-5.6 Sol Max Effort, 83.9 очков
4 — GPT-5.2 Codex, 83.6 очков
5 — GPT-5.6 Luna Max Effort, 82.9 очков
Новая GPT-6 Astra (Max Effort) набрала 80.4 очков и занимает лишь 13е место в списке
Самые популярные модели на OpenRouter (за 7 дней):
1 — Tencent: Hy4, 16.5Т токенов
2 — OpenAI: GPT-5.6 Luna, 13.9T токенов
3 — Z.ai: GLM 5.3 Flash, 12.9Т токенов
4 — DeepSeek: DeepSeek V4 Flash, 5.4Т токенов
5 — Tencent: Hy3, 5.1Т токенов
Рейтинг моделей для программирования, бенчмарки от LiveBench:
1 — Claude Fable 5.1 Max Effort, 86.4 очков
2 — Claude Fable 5 Max Effort, 86.0 очков
3 — GPT-5.6 Sol Max Effort, 83.9 очков
4 — GPT-5.2 Codex, 83.6 очков
5 — GPT-5.6 Luna Max Effort, 82.9 очков
Новая GPT-6 Astra (Max Effort) набрала 80.4 очков и занимает лишь 13е место в списке
Please open Telegram to view this post
VIEW IN TELEGRAM
❤6🔥2👍1
LiveBench провели тест "Качество против Стоимости" в программировании. Стоимость указана за успешно выполненную задачу
Самой выгодной получилась GLM-5.3 Flash, а новые GPT-6 и Fable 5.1 (Max Effort) наоборот, оказались самыми дорогими в использовании. Разница в стоимости составляет более х100 раз.
Самой выгодной получилась GLM-5.3 Flash, а новые GPT-6 и Fable 5.1 (Max Effort) наоборот, оказались самыми дорогими в использовании. Разница в стоимости составляет более х100 раз.
⚡13❤3🫡2
Пора обновить мнение о нейросетках
С момента, когда они рисовали по 6-7 пальцев на руке, прошло... Не так уж и много времени, на самом деле🤔
Но мемы подустарели — ИИ становится всё удобнее и в повседневной жизни, и в работе. Особенно версии по подписке.
Попробуйте сами: возьмите на FunPay месяц Claude Pro, ChatGPT Go или других ИИ по низким ценам — и зацените реальное будущее😎
С момента, когда они рисовали по 6-7 пальцев на руке, прошло... Не так уж и много времени, на самом деле
Но мемы подустарели — ИИ становится всё удобнее и в повседневной жизни, и в работе. Особенно версии по подписке.
Попробуйте сами: возьмите на FunPay месяц Claude Pro, ChatGPT Go или других ИИ по низким ценам — и зацените реальное будущее
Please open Telegram to view this post
VIEW IN TELEGRAM
😁9👍3🤔3👎1
Новая ChatGPT Images 2.5 уже доступна!
Из новинок:
— Генерация на 50% быстрее.
— Текстуры и свет стали реалистичнее, а лица и объекты с референсов переносятся куда точнее.
— Рисование прямо в чате: Функция Sketch позволяет набросать любой рисунок, чтобы нейросеть превратила его в финальное изображение.
— Модель научилась менять только заданные элементы (текст, фон или предмет) без деградации исходника и с сохранением контекста на длинной дистанции правок.
— Шаблоны и шэринг промтов.
— Две версии в API: Разработчикам отдали шуструю GPT-Image-2.5 Flare для массовой генерации и тяжелую Sunburst для задач, требующих максимальной детализации.
Из новинок:
— Генерация на 50% быстрее.
— Текстуры и свет стали реалистичнее, а лица и объекты с референсов переносятся куда точнее.
— Рисование прямо в чате: Функция Sketch позволяет набросать любой рисунок, чтобы нейросеть превратила его в финальное изображение.
— Модель научилась менять только заданные элементы (текст, фон или предмет) без деградации исходника и с сохранением контекста на длинной дистанции правок.
— Шаблоны и шэринг промтов.
— Две версии в API: Разработчикам отдали шуструю GPT-Image-2.5 Flare для массовой генерации и тяжелую Sunburst для задач, требующих максимальной детализации.
👍16❤3🔥3
Direcode
Новое видео уже на канале! Тесты новой локальной Ornith 1.5 весом всего 7 гб ❤️🔥 https://youtu.be/9SvWUCPMhGM
Ornith 1.5 за 16 дней набрала практически столько же скачиваний, сколько Ornith 1.0 за более чем 6 месяцев
🔥7❤3⚡1👎1
Claude в четвёртый раз получил несанкционированный доступ к внешним системам во время тестов
Компания сообщила о новом инциденте с ранней версией Claude Opus 4.6. Из-за ошибки в настройках модель получила доступ к интернету и начала выполнять действия, которых не должна была совершать в рамках теста.
Три похожих случая произошли в июле. В одном модель получила доступ к реальной базе данных, в другом изменила записи в настоящей компании, а в третьем продолжила выполнение задания после получения доступа к стороннему компьютеру.
Из-за таких случаев усиливаются опасения вокруг автономных ИИ-агентов, которые способны самостоятельно взаимодействовать с интернетом и внешними системами
Компания сообщила о новом инциденте с ранней версией Claude Opus 4.6. Из-за ошибки в настройках модель получила доступ к интернету и начала выполнять действия, которых не должна была совершать в рамках теста.
Три похожих случая произошли в июле. В одном модель получила доступ к реальной базе данных, в другом изменила записи в настоящей компании, а в третьем продолжила выполнение задания после получения доступа к стороннему компьютеру.
Из-за таких случаев усиливаются опасения вокруг автономных ИИ-агентов, которые способны самостоятельно взаимодействовать с интернетом и внешними системами
😁14🤔5👻2🤡1