Пупырка AI
826 subscribers
1.07K photos
705 videos
1 file
1.33K links
твой ai-бабл. комьюнити про ии, дизайн и продукт. авторские репосты, цитаты и жвачка. основной канал — @logicIntermission

насыпать бустов, чтобы добавить реакций в канал — https://t.me/boost/LumpySpaceCollection
Download Telegram
бывший глава поиска яндекса строит поисковик для ai-агентов

keenable — инфраструктурный сервис андрея стыскина и маттиаса петри. у него собственный crawler и индекс более чем из 100 млрд документов. разработчик подключает search api, mcp или cli, а агент получает результаты уже с извлечённым текстом и может забирать любую страницу в чистом markdown

это замена поисковым api google и bing для моделей, агентов и голосовых ассистентов. второй слой select превращает тысячи найденных страниц в таблицу и позволяет извлекать, фильтровать и объединять факты со ссылкой на каждый источник. пользователю не нужно открывать отдельный поисковик

стыскин провёл 15 лет в яндексе и дошёл до главы поиска и рекламы. затем в amazon agi он вместе с петри строил веб-поиск для ai-приложений. keenable вышла из stealth с посевным раундом $26 млн от accel, conviction и ангелов. компания говорит, что её api уже работают в нескольких ai-лабораториях, но имена клиентов пока не раскрывает

новости уже несколько дней, но я чет сразу не написал, исправляюсь

keenable
1
This media is not supported in your browser
VIEW IN TELEGRAM
в xiaomi 18 fold появилась «сфера вдохновения» xiao ai. пользователь удерживает плавающий шар, ведёт его к изображению или тексту и голосом уточняет действие

первоисточник
doop посадил дизайнеров и агентов за один холст

doop — общий бесконечный canvas для людей, claude, codex и других mcp-агентов. агенты показывают курсоры и задачи, постепенно собирают html-фреймы прямо на холсте, рецензируют работу друг друга и используют общую память о решениях и вкусе команды.

дизайнер может дать обратную связь во время работы. комментарии, состояние задач и принятые правила остаются видимыми для следующего агента.

присутствие, прогресс и память превращают генерацию макетов в совместную работу на общей поверхности.

product hunt
21
Пупырка AI
ждём сегодня?
рассмотрел ещё в видео 6.
This media is not supported in your browser
VIEW IN TELEGRAM
пока gpt-6 не вышел, Сундар питчит новый войс режим

docs live слушает свободный рассказ и одновременно собирает из него структурированный документ. по разрешению пользователя он подтягивает детали из gmail, drive, chat и веба, помогает сделать план и настроить тон. в ролике голосовой диалог постепенно превращается в готовый бриф на том же экране.

рядом запускаются gmail live для голосового поиска по почте и keep live, который превращает поток мыслей в списки и заметки.

функции выходят на этой неделе. gmail и keep доступны подписчикам google ai plus, pro и ultra, docs — pro и ultra. бизнес-клиентам workspace их обещают позднее.

первоисточник
openai начала выпуск gpt-6 astra

после нескольких недель задержки из-за киберрисков openai открыла astra первым организациям из программы daybreak. в ближайшие дни модель появится у подписчиков plus, pro, business и enterprise, а также в api и amazon bedrock. стандартная цена составляет $10 за миллион входных и $50 за миллион выходных токенов.

astra работает напрямую в браузере и настольных программах, собирает документы, таблицы и презентации, тестирует интерфейсы и ведёт длинные рабочие процессы. в codex модель сохраняет заметки между заполненными окнами контекста и умеет искать в прошлых окнах без очередного сжатия истории.

openai утверждает, что на osworld astra выполняет задачи примерно на 47% быстрее gpt-5.6 sol. защитные проверки могут приостанавливать полезную работу, а расширенные кибервозможности пока останутся внутри контролируемого доступа.

openai
Forwarded from Denis Sexy IT 🤖
Вышла новая GPT 6 (в течение недели дадут всем) – я ее активно потестировал (спасибо JetBrains), и я честно впечатлен – я все громкие модели видел, все эти модели трогал, и меня сложно удивить, но она смогла

Наверное, больше всего меня впечатлили две вещи:

💿 Она нормально коротко общается, больше никакого слопа в ответах на три экрана

💿 Она понимает, то, как будет выглядеть сцена, пока она ее кодит – я не знаю как это объяснить, но люди так не умеют – пока она пишет код, еще до того как она его запустит, она ЗНАЕТ как он будет выглядеть – возникает странное чувство, что у тебя тут мозг инопланетянина подключен, который по другому думает пока делает вещи

Вот примеры, которые она собрала за 15 минут с простых промптов (без спек, а просто – иди сделай, вот файлы с фотками или видео)

Первое видео – это одесская дача где я часто бывал в детстве, я просто дал ей фотографии и видео (штук 10), и она собрала за пару ходов мне 3D карту которую я могу и как ностальгию использовать и как карту для CS 1.6 – отдельно меня удивили текстуры, она сама вырезала фотографии из видео и расставила в рамки, или там занавеску от душа – то есть, я уже могу предположить, что все ваши исторические фотографии можно будет перестроить через како-то время в какие-то сцены; в 3D-не-3D не важно, она сама понимает где что находится смотря на фотографии или кадры в пространстве, делая нужную карту
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
⚡5
Forwarded from Denis Sexy IT 🤖
Media is too big
VIEW IN TELEGRAM
Или вот, пример, взял видео которое я уже постил в канал (https://t.me/denissexy/6193), с интерактивным механическим экраном из Амстердама, конвертировал в текст и попросил сделать мне интерактивный веб-механизм который покажет как экран устроен

То есть я взял видео, прогнал через Whisper, получил голландский текст, и в итоге она собрала мне этот же механизм – за 15 минут в Codex

Я не знаю что будет дальше, но это уже больше чем мне нужно для любого проекта в любом виде

И так в любой задаче:
– она может и потренировать модели сама
– и уйти использовать компьютер на ночь ковыряя там какие-то вещи решая задачу через Computer Use
– и разобраться в монорепе легаси без дополнительных каких-то спек

Мне кажется, разработка софта постепенно умирает – теперь и уже какое-то время, вопрос не как получить софт, а за что именно платит пользователь и где пользователь увидел рекламу этого софта

С каждым релизом все больше в этом убеждаюсь – наверное, начало сингулярности выглядит как-то так иначе как оно еще моглы бы выглядеть
1
agi или ещё нет?

грег брокман, президент и сооснователь openai, завершил закрытый брифинг для журналистов словами «добро пожаловать в эру agi» и сказал, что лично считает agi достигнутым

цифры:

• astra набрала 72,6% на osworld и проходила задачи примерно за 40 минут против 75 у sol

• на automationbench результат вырос с 18,1% до 41,4%. codex получил память между окнами контекста и поиск по прошлым сообщениям.

• на frontiermath tier 4 модель набрала 97,6%, на exploitbench — 100%

• общий intelligence index artificial analysis при этом равен 61,2, ниже claude fable 5.1 с 65,7

• coding agent index почти не вырос — 67 против 65,1 у sol
продолжение нашего любимого маркетингового сериала года “наушники от OpenAI”

сегодня калифорнийская цветочная лавка «Сладкий Горошек» запостила фотку босого Палмера Лаки (Окулус, Палантир) с букетом цветов и подписью ~ «нам так ПОВЕЗЛО, что местный предприниматель покупает у нас букеты».

лавки этой, кстати, не существует, у твиттера 180 подписчиков, а в ушах и руках у Палмера, можно. призумив, увидеть те самые наушники, которые мы уже видели на Скарсгарде на супербоуле, затем на криптографической афише, и потом еще на снятой в подозрительно высоком качестве скрытой съёмке в кафе.
ну всё, есть дела на выходные
4
gemini открыла генерацию полноценных песен всем пользователям

lyria 3.5 теперь работает в веб-версии и мобильном приложении gemini по всему миру, а также в api, google vids и flow music. можно выбрать вокал или инструментал, жанр и длину, либо дать до десяти изображений как источник настроения. модель выдаёт стерео 44,1 кгц вместе с текстом песни.

в gemini треки могут длиться до трёх минут и получают обложку от nano banana. google встраивает synthid в каждый результат. музыка становится ещё одной обычной модальностью внутри общего чата, рядом с изображениями и видео.

первоисточник