Светлый Уголок | ии
Photo
Почему я думаю, что botbot2 на arena.ai — это именно Nano Banana 2 Lite?
— По промпту она может воспроизвести Патрика МакГухана из 1960-х. Другие модели у меня этого не делают.
— В тесте с «зеркальным пространством» она делает отражения лучше, чем остальные модели.
— На выходе изображения с SynthID — главная тому причина.
— Это не 2 Pro и не 2 Flash Ga, потому что модель ощущается проще по общему уровню результатов. Да, она сильна в отдельных тестах, но до Pro или 2 Flash всё же не дотягивает.
— Гуглу просто выгоднее подсовывать вам самые слабые версии.
— По промпту она может воспроизвести Патрика МакГухана из 1960-х. Другие модели у меня этого не делают.
— В тесте с «зеркальным пространством» она делает отражения лучше, чем остальные модели.
— На выходе изображения с SynthID — главная тому причина.
— Это не 2 Pro и не 2 Flash Ga, потому что модель ощущается проще по общему уровню результатов. Да, она сильна в отдельных тестах, но до Pro или 2 Flash всё же не дотягивает.
— Гуглу просто выгоднее подсовывать вам самые слабые версии.
Geometry90
Светлый Уголок | ии
Спорим, что подобные игры можно будет создавать по одному промту уже в конце 2026 года?
This media is not supported in your browser
VIEW IN TELEGRAM
«Я пробовал создать игру в стиле побега с помощью Claude Design.
Он дал лучший результат. Я был поражён!»
6 января я писал, что к концу 2026 года подобные игры, возможно, уже можно будет делать по одному промпту.
С того поста прошло 4 месяца, и прогресс уже выглядит очень даже неплохо, хотя, на самом деле, Claude Opus 4.7 с одним промптом такое бы не сделал.
Наткнулся на этот твит и решил вспомнить свой старый пост. Тогда это звучало как прогноз, а сейчас такие вещи уже начинают показывать на практике.
Пока это, конечно, ещё не предел. А ещё я всё-таки ожидал там большего, но кто его знает, что там ждать от Gemini 3.5 в середине лета.
Он дал лучший результат. Я был поражён!»
6 января я писал, что к концу 2026 года подобные игры, возможно, уже можно будет делать по одному промпту.
С того поста прошло 4 месяца, и прогресс уже выглядит очень даже неплохо, хотя, на самом деле, Claude Opus 4.7 с одним промптом такое бы не сделал.
Наткнулся на этот твит и решил вспомнить свой старый пост. Тогда это звучало как прогноз, а сейчас такие вещи уже начинают показывать на практике.
Пока это, конечно, ещё не предел. А ещё я всё-таки ожидал там большего, но кто его знает, что там ждать от Gemini 3.5 в середине лета.
Geometry90
Скоро я покажу вам кое-что интересное.
Нет, это не мой «„"(проект)"„», это то, что в какой-то степени удивит вас и заставит понять, как работает эта система на самом деле. Пора показать правду.
Нет, это не мой «„"(проект)"„», это то, что в какой-то степени удивит вас и заставит понять, как работает эта система на самом деле. Пора показать правду.
Please open Telegram to view this post
VIEW IN TELEGRAM
Если честно, я видел карточку того, что будет представлено на I/O.
Там нет упоминаний о новых ИИ-моделях.
Не знаю, было такое упоминание в карточке 2025 года перед I/O.
Акцент сделан на трёх главных направлениях: Android, Google Cloud и Chrome.
Google либо хочет выпустить всё в следующем месяце, либо у них и вовсе кончились козыри.
Я даже не верю, что у них получится построить Veo4.
Veo3 и так наполнена огромным датасетом, проблема не в недостаточности его.
Они не смогли обеспечить ей контроль, сколько бы ни пытались, и слияние Gemini и Veo в единую reasoning систему не поможет.
Google вроде готовит там что-то тихо, а вроде у них уже просто не хватает мощностей.
Возможно, их стратегия теперь такая: просто сидеть тихо и выпускать тихие и небольшие релизы без какого-либо значения.
На это мы ещё посмотрим.
Там нет упоминаний о новых ИИ-моделях.
Не знаю, было такое упоминание в карточке 2025 года перед I/O.
Акцент сделан на трёх главных направлениях: Android, Google Cloud и Chrome.
Google либо хочет выпустить всё в следующем месяце, либо у них и вовсе кончились козыри.
Я даже не верю, что у них получится построить Veo4.
Veo3 и так наполнена огромным датасетом, проблема не в недостаточности его.
Они не смогли обеспечить ей контроль, сколько бы ни пытались, и слияние Gemini и Veo в единую reasoning систему не поможет.
Google вроде готовит там что-то тихо, а вроде у них уже просто не хватает мощностей.
Возможно, их стратегия теперь такая: просто сидеть тихо и выпускать тихие и небольшие релизы без какого-либо значения.
Я не буду говорить, получим ли мы Gemini 3.5 или версию 3.2.
пока рано что-либо утверждать.
На это мы ещё посмотрим.
🙏4
Светлый Уголок | ии
Если честно, я видел карточку того, что будет представлено на I/O. Там нет упоминаний о новых ИИ-моделях. Не знаю, было такое упоминание в карточке 2025 года перед I/O. Акцент сделан на трёх главных направлениях: Android, Google Cloud и Chrome. Google…
Но это только обещания.
❤🔥3
Релиз уже на следующей неделе.
Было много общений, ожиданий, и с моей стороны тоже.
Каким был бы мой канал, если бы я не публиковал подробные инсайды? Верно, никаким.
Именно надежды и ожидание тоже дают вам эмоции. Поэтому даже если за 2 недели обещаний ничего не вышло, думаю, дождаться этого на следующей неделе всё равно стоило.
А вот 5o, к сожалению, всё ещё не готов.
Geometry90
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
GPT 5.4 PRO получил обновление, и один из сотрудников в X написал: «Ребята, скажите, как там дела у GPT 5.4 PRO?»
Хах, делают вид, или прикалываются. Но скорее всего это уже GPT 5.5, который тестируется сейчас, и ребята просто смотрят на результаты и реакцию людей.
У людей есть два варианта мнений: это либо апгрейд GPT 5.4 PRO, либо скрытое тестирование GPT 5.5.
Что касается самой модели и её способностей, напишу позже.
Пока что на видео лучший результат, который я видел, реально топ. GPT 5.5 демонстрирует абстрактное продуманное мышление, и это просто жесть, насколько круто он может думать.
— Источник с тем пеликаном.
Хах, делают вид, или прикалываются. Но скорее всего это уже GPT 5.5, который тестируется сейчас, и ребята просто смотрят на результаты и реакцию людей.
У людей есть два варианта мнений: это либо апгрейд GPT 5.4 PRO, либо скрытое тестирование GPT 5.5.
Что касается самой модели и её способностей, напишу позже.
Пока что на видео лучший результат, который я видел, реально топ. GPT 5.5 демонстрирует абстрактное продуманное мышление, и это просто жесть, насколько круто он может думать.
— Источник с тем пеликаном.
Geometry90
🙏1
This media is not supported in your browser
VIEW IN TELEGRAM
Сейчас на ai.studio проводят новые A/B-тесты. Это безусловно какой-то новый checkpoint.
Его результаты не намного, но всё же лучше, чем у обычной Gemini 3.1 pro.
Его результаты не намного, но всё же лучше, чем у обычной Gemini 3.1 pro.
Geometry90
TPU v8 могут быть представлены в этом месяце.
И ещё напомню: TPU v7 получили отличную оптимизацию под inference, которая по цене/производительности и энергоэффективности обошла многих конкурентов.
И ещё напомню: TPU v7 получили отличную оптимизацию под inference, которая по цене/производительности и энергоэффективности обошла многих конкурентов.
Geometry90
Хорошая новость, ребята! Как же я рад, что они задвинулись.
Google создала новую команду DeepMind под руководством Сергея Брина для улучшения моделей кодирования — пишет The Information.
Они обучают её непосредственно на своей внутренней базе для выполнения сложных долгосрочных инженерных задач.
А я уверен, что баз у них с этим больше, чем у всех вместе взятых OpenAI и Antropic.
Надеюсь, они анонсируют свою новую модель кодирования на Google I/O 2026.
Это может быть отдельная модель или крупное обновление Gemini 3.5. Ждать ли её на Google I/O 2026? Не знаю.
https://t.co/PlhqALElcH
Google создала новую команду DeepMind под руководством Сергея Брина для улучшения моделей кодирования — пишет The Information.
Они обучают её непосредственно на своей внутренней базе для выполнения сложных долгосрочных инженерных задач.
А я уверен, что баз у них с этим больше, чем у всех вместе взятых OpenAI и Antropic.
Надеюсь, они анонсируют свою новую модель кодирования на Google I/O 2026.
Это может быть отдельная модель или крупное обновление Gemini 3.5. Ждать ли её на Google I/O 2026? Не знаю.
https://t.co/PlhqALElcH
Geometry90
The Information
Google Creates Strike Team to Improve Coding Models
Google has assembled a strike team of researchers and engineers to improve its AI coding models, according to three people with direct knowledge of the situation, as it looks to automate more of its own coding and ultimately its AI research. The push was…
🙏7
Модель Kimi k2.6 вышла на официальном сайте kimi.com, вы можете прямо сейчас её протестировать.
Ранее в начале этого месяца модель была доступна лишь тестерам, но уже ближе к середине её стали разворачивать в kimi.com/code, где она тоже сейчас доступна.
Модель неплохая. Всем всегда нравились китайские модели Moonshot. Самое главное преимущество в том, что модели Kimi могут думать очень долго, что даёт им значительное преимущество в рассуждениях с кодовыми базами. Сейчас модель имеет контекст в 256K токенов.
У меня была инсайдерская информация о том, что следующие модели Kimi получат 1M токенов контекста, но Kimi k2.6 не является такой моделью, ждём ещё.
Ранее в начале этого месяца модель была доступна лишь тестерам, но уже ближе к середине её стали разворачивать в kimi.com/code, где она тоже сейчас доступна.
Модель неплохая. Всем всегда нравились китайские модели Moonshot. Самое главное преимущество в том, что модели Kimi могут думать очень долго, что даёт им значительное преимущество в рассуждениях с кодовыми базами. Сейчас модель имеет контекст в 256K токенов.
У меня была инсайдерская информация о том, что следующие модели Kimi получат 1M токенов контекста, но Kimi k2.6 не является такой моделью, ждём ещё.
Geometry90
❤🔥1 1
Forwarded from 🚨 AI News | TestingCatalog (Alexey)
Apple has a new CEO 👀
Tim Cook is stepping down from his role. Wondering if AI strategy will change for Apple as well?
Tim Cook is stepping down from his role. Wondering if AI strategy will change for Apple as well?