Какие сейчас обстоятельства:
— GPT 5.5 сейчас дороже, чем 4.7 Opus.
— По API выйдет позже.
— Доступна только для Pro / Plus / Business.
— Пока что появилась только в Codex, обновитесь до последней версии.
— Модель должна быть быстрее прошлых.
Знаете...
Делать обзоры на модели — это чисто не моё дело.
Единственные модели, которые я тестирую, это Gemini. Они легкодоступны и так далее.
Но всё равно. Скорее всего, в следующий раз придётся хорошенько подготовиться.
Если хотите обзоров от меня то ждите целые статьи.
— GPT 5.5 сейчас дороже, чем 4.7 Opus.
— По API выйдет позже.
— Доступна только для Pro / Plus / Business.
— Пока что появилась только в Codex, обновитесь до последней версии.
— Модель должна быть быстрее прошлых.
Знаете...
Делать обзоры на модели — это чисто не моё дело.
Единственные модели, которые я тестирую, это Gemini. Они легкодоступны и так далее.
Но всё равно. Скорее всего, в следующий раз придётся хорошенько подготовиться.
Если хотите обзоров от меня то ждите целые статьи.
Geometry90
❤🔥4 4
Светлый Уголок | ии
Deepseek V4 Доступен на arena.ai 4 варианта: Flash think / Flash / Pro Think / Pro Geometry90
🔹 DeepSeek-V4-Pro Всего: 1,6 Триллиона / Aктивных параметров: 49 млрд
Светлый Уголок | ии
🔹 DeepSeek-V4-Pro Всего: 1,6 Триллиона / Aктивных параметров: 49 млрд
DeepSeek-v4 Pro и Flash уже доступны через официальный API.
https://api-docs.deepseek.com/quick_start/pricing
Geometry90
Вышел DeepSeek V4. Сейчас быстренько расскажу вам про него.
Нас долго грели обещаниями, ждали два месяца, но чуда (как я вижу) не произошло.
В ранних тестах результаты были лучше. Видимо, в релизе урезали активные параметры ради стабильности контекста и защиты от галлюцинаций. Модель стала шаблонной.
Кодинг средний - 3 место на arena.ai среди опен-сурс с сильным отставанием по баллам.
Текст v4 на arena.ai: обычная V4 Pro (без размышлений) на 20-м месте, хуже Qwen 3.5 (19-е место) и GLM 5.1 (15-е место).
Версия V4 Pro Thinking справляется с текстом хуже обычной V4 Pro. Обе проигрывают Gemini 3 Flash (Minimal Thinking). В общем рейтинге ПО КОДУ модель на 14-м месте, уступая Gemini 3.1 Pro.
Архитектура отличная. Отдать этих разработчиков под контроль Google - собрали бы AGI.
Нас долго грели обещаниями, ждали два месяца, но чуда (как я вижу) не произошло.
В ранних тестах результаты были лучше. Видимо, в релизе урезали активные параметры ради стабильности контекста и защиты от галлюцинаций. Модель стала шаблонной.
Кодинг средний - 3 место на arena.ai среди опен-сурс с сильным отставанием по баллам.
Текст v4 на arena.ai: обычная V4 Pro (без размышлений) на 20-м месте, хуже Qwen 3.5 (19-е место) и GLM 5.1 (15-е место).
Версия V4 Pro Thinking справляется с текстом хуже обычной V4 Pro. Обе проигрывают Gemini 3 Flash (Minimal Thinking). В общем рейтинге ПО КОДУ модель на 14-м месте, уступая Gemini 3.1 Pro.
Архитектура отличная. Отдать этих разработчиков под контроль Google - собрали бы AGI.
А сейчас я думаю, что это просто удобная улучшенная модель для школьников - делать домашку без VPN.
Geometry90
На самом деле самым настоящим ИИ-игроком является Google, как бы мы их ни ненавидели за свои проделки...
Они очень крутые ребята.
Самое классное что у них сейчас есть:
Google DeepMind
Google Research
Google Quantum AI
Google Cloud AI & Infrastructure (отсюда топовые чипы TPU)
Это просто сборище умов, и сколько бы крутых сотрудников от них ни уходило, Google всегда может вернуть их, поверьте.
Именно они разработали архитектуру Трансформеров, на которой работают OpenAI, Anthropic и xAI и next.
Даже на фоне китайцев, именно Google Research чаще всего выпускает статьи о новых разработках в отличи от конкурентов. За 2025 год вышло уже около 631 исследовательских работ.
Поэтому:
Decoupled DiLoCo — вы не обратили внимание, но эта имба очень сильно ускоряет обучение, (представили вчера).
MesaNet — ВОТ ЭТО!!! Уже отдельный пост друзья. Эта штука была представлена буквально 30 минут назад, посмотрите картинку.
Они очень крутые ребята.
Самое классное что у них сейчас есть:
Google DeepMind
Google Research
Google Quantum AI
Google Cloud AI & Infrastructure (отсюда топовые чипы TPU)
Это просто сборище умов, и сколько бы крутых сотрудников от них ни уходило, Google всегда может вернуть их, поверьте.
Именно они разработали архитектуру Трансформеров, на которой работают OpenAI, Anthropic и xAI и next.
Даже на фоне китайцев, именно Google Research чаще всего выпускает статьи о новых разработках в отличи от конкурентов. За 2025 год вышло уже около 631 исследовательских работ.
Поэтому:
Decoupled DiLoCo — вы не обратили внимание, но эта имба очень сильно ускоряет обучение, (представили вчера).
MesaNet — ВОТ ЭТО!!! Уже отдельный пост друзья. Эта штука была представлена буквально 30 минут назад, посмотрите картинку.
Geometry90
🙏6❤🔥1
Gemini 3.5 Разнесёт всех?...
@MatthewBerman провёл интервью с Томасом Курианом, (генеральным директором Google Cloud).
Мэттью: «Ходят слухи, что Mythos — первая модель с 10 триллионами параметров. Играет ли Google уже в пространстве моделей на 10 триллионов параметров? Вы близки к этому? На каком этапе жизненного цикла вы находитесь?»
Томас Куриан: «Вы увидите от нас новые вещи по Gemini: анонсы будут и на Next, и вскоре после него. Что касается возможностей модели, мы очень гордимся тем, где сейчас находится Gemini. Она уже долгое время держится на уровне state-of-the-art. У нас очень скоро выйдет новая версия Gemini, и по всем бенчмаркам, которые мы видели, ...(она хорошая), мы тоже очень уверены в ней»
— Источник.
@MatthewBerman провёл интервью с Томасом Курианом, (генеральным директором Google Cloud).
Мэттью: «Ходят слухи, что Mythos — первая модель с 10 триллионами параметров. Играет ли Google уже в пространстве моделей на 10 триллионов параметров? Вы близки к этому? На каком этапе жизненного цикла вы находитесь?»
Томас Куриан: «Вы увидите от нас новые вещи по Gemini: анонсы будут и на Next, и вскоре после него. Что касается возможностей модели, мы очень гордимся тем, где сейчас находится Gemini. Она уже долгое время держится на уровне state-of-the-art. У нас очень скоро выйдет новая версия Gemini, и по всем бенчмаркам, которые мы видели, ...(она хорошая), мы тоже очень уверены в ней»
— Источник.
Geometry90
X (formerly Twitter)
AiBattle (@AiBattle_) on X
Thomas Kurian (Google Cloud CEO): "We have a new version of Gemini coming very, very soon, and from all the benchmarks we have seen, we have been very confident on that as well"
38:16 - 38:25
38:16 - 38:25
Светлый Уголок | ии
Gemini 3.5 Разнесёт всех?... @MatthewBerman провёл интервью с Томасом Курианом, (генеральным директором Google Cloud). Мэттью: «Ходят слухи, что Mythos — первая модель с 10 триллионами параметров. Играет ли Google уже в пространстве моделей на 10 триллионов…
Я считаю, что в этот раз Google установит новые стандарты, хотя раньше было так же: после выхода версии 3.1 Pro мы не увидели значительного прироста, однако модели X.5 очень хорошие и удачные модели за долгое время выпусков google.
Самое главное от чего нужно избавиться Google — это экономия ресурсов. Видимо, DeepMind всё ещё испытывает дефицит. И лично я считаю, что проблема здесь не в Google, а именно в самом DeepMind.
Хотя в самом интервью говорится об обратном, типа что у Google нет проблем с этим, НО разве ваша халатность по отношению к пользователям Antigravity и урезание лимитов не показывают, что вы сейчас слабы? В общем, стратегия Google ясна. Но качество их продуктов сегодня — это явно намеренные проделки.
Если не смотреть на продукты, а обратить внимание на модели Gemini, то сейчас это самые непригодные и недолгосрочные модели в использовании. (По мнению многих людей, и по моему мнению тоже). И чтобы исправить это, на мой взгляд, нужно менять подход к обучению, чем сейчас, похоже занимается DeepMind.
Самое главное от чего нужно избавиться Google — это экономия ресурсов. Видимо, DeepMind всё ещё испытывает дефицит. И лично я считаю, что проблема здесь не в Google, а именно в самом DeepMind.
Хотя в самом интервью говорится об обратном, типа что у Google нет проблем с этим, НО разве ваша халатность по отношению к пользователям Antigravity и урезание лимитов не показывают, что вы сейчас слабы? В общем, стратегия Google ясна. Но качество их продуктов сегодня — это явно намеренные проделки.
Если не смотреть на продукты, а обратить внимание на модели Gemini, то сейчас это самые непригодные и недолгосрочные модели в использовании. (По мнению многих людей, и по моему мнению тоже). И чтобы исправить это, на мой взгляд, нужно менять подход к обучению, чем сейчас, похоже занимается DeepMind.
Кстати, вспомним ту ситуацию с тем, что DeepMind реально взялись за агентность, и Сергей Брин реально приказал всем улучшать модель в инженерных возможностях и как ранее заявляли, модель уже начинает своё обучение. У них есть ещё месяц до I/O.
Не стоит забывать, что Google обладает самой мощной кодовой базой в мире. Объём их библиотек — это примерно 2 миллиарда строк кода, собранных в едином монорепозитории. Больше чем когда либо у всех.
Geometry90
❤🔥3
Forwarded from ✨AI Watchtower✨ (Arena Overseer)
🆕 New OpenAI API models available:
• gpt-5.5
• gpt-5.5-2026-04-23
• gpt-5.5-pro
• gpt-5.5-pro-2026-04-23
• gpt-5.5
• gpt-5.5-2026-04-23
• gpt-5.5-pro
• gpt-5.5-pro-2026-04-23
🙏2
GPT IMAGE 2 получит обновление!
Они не забросили эту модель – будут вносить улучшения почти каждую неделю.
Прочитав комментарии, я понял: они не пропускают ни одного и отвечают на каждый. Вот что они собираются исправить:
– Галлюцинации.
– Шум, эти дурацкие точки, дурацкие стили, блики.
– Добавят прозрачность.
– Улучшат реализацию в 2K.
И многое другое.
Мы видим, какие отзывчивые разработчики и какое большое у них преимущество в этом плане. Это здорово.
Они не забросили эту модель – будут вносить улучшения почти каждую неделю.
Прочитав комментарии, я понял: они не пропускают ни одного и отвечают на каждый. Вот что они собираются исправить:
– Галлюцинации.
– Шум, эти дурацкие точки, дурацкие стили, блики.
– Добавят прозрачность.
– Улучшат реализацию в 2K.
И многое другое.
Мы видим, какие отзывчивые разработчики и какое большое у них преимущество в этом плане. Это здорово.
🙏12
Мне кажется GPT IMAGE 2 получил сильный нёрф.
Очень сильный.
Я не один такой?
Очень сильный.
Я не один такой?
Когда может выйти Gemini 3.5 Pro?
В прошлом году Gemini 2.5 Pro вышел 25 марта и 6 мая получил (06-05), а на I/O Google уже закрепил его как главную модель.
Сейчас им нужен такой же ход, только сильнее, ведь плохо сделать на I/O они не могут.
Просто выйти на I/O с Gemini 3.1 GA / 3.2 – это очень слабенько. Это даст ощущение, что Google догоняет.
Поэтому Gemini 3.5 Pro до I/O выглядит вполне реальным сценарием.
Не факт, что прямо на сцене представят. Скорее даже раньше – в начале мая, чтобы модель успели протестировать до конференции.
Ждём. Учимся. Работаем.
Думаю, раньше, чем многие ждут.
В прошлом году Gemini 2.5 Pro вышел 25 марта и 6 мая получил (06-05), а на I/O Google уже закрепил его как главную модель.
Сейчас им нужен такой же ход, только сильнее, ведь плохо сделать на I/O они не могут.
Просто выйти на I/O с Gemini 3.1 GA / 3.2 – это очень слабенько. Это даст ощущение, что Google догоняет.
Поэтому Gemini 3.5 Pro до I/O выглядит вполне реальным сценарием.
Не факт, что прямо на сцене представят. Скорее даже раньше – в начале мая, чтобы модель успели протестировать до конференции.
I/O стартует 19 мая. До него осталось 24 дня.
Ждём. Учимся. Работаем.
Geometry90
❤🔥6