Путин подписал закон, который запретит Apple препятствовать установке магазина приложений RuStore
На продаваемых в РФ телефонах и планшетах с 1 сентября должна быть обеспечена возможность установки и обновления единого магазина и других приложений российский разработчиков.
Forwarded from vc.ru
OpenAI официально объявила, что закрыла сделку по покупке стартапа Io бывшего дизайнера Apple Джони Айва за $6,5 млрд. Вместе они собираются разработать «принципиально новое» ИИ-устройство.
В июне 2025 года OpenAI удаляла все публикации о сделке из-за судебного иска к Io
vc.ru/ai/2090502
В июне 2025 года OpenAI удаляла все публикации о сделке из-за судебного иска к Io
vc.ru/ai/2090502
Forwarded from Content-Review.com
Что Apple покажет этой осенью: от сверхтонкого iPhone до часов со спутниковой связью
До конца 2025 года Apple, по слухам, планирует выпустить больше 15 новых устройств.
• В линейке Айфонов пополнение — iPhone 17 Air, самый тонкий и лёгкий в истории. Правда, батарея у него тоже будет «самая тонкая».
• В Pro-версии Айфона делают ставку на три камеры по 48 МП и новую систему охлаждения.
• Apple Watch Ultra 3 получат поддержку спутниковой связи.
• У нового HomePod mini будет лучше звук.
• Возможно, в новом Apple TV появится Wi-Fi 7 и камера для FaceTime.
• Вторая версия AirTag получит тройной радиус действия и защиту от слежки
• Вся техника продолжит постепенно переходить на чипы M5.
Обновлений продуктов много, инноваций не слишком. А тонкий Айфон без ряда функций и с уменьшенной батареей выглядит очень странно. Уже скоро узнаем, какие из утечек оказались правдой.
Подробнее рассказали на сайте.
До конца 2025 года Apple, по слухам, планирует выпустить больше 15 новых устройств.
• В линейке Айфонов пополнение — iPhone 17 Air, самый тонкий и лёгкий в истории. Правда, батарея у него тоже будет «самая тонкая».
• В Pro-версии Айфона делают ставку на три камеры по 48 МП и новую систему охлаждения.
• Apple Watch Ultra 3 получат поддержку спутниковой связи.
• У нового HomePod mini будет лучше звук.
• Возможно, в новом Apple TV появится Wi-Fi 7 и камера для FaceTime.
• Вторая версия AirTag получит тройной радиус действия и защиту от слежки
• Вся техника продолжит постепенно переходить на чипы M5.
Обновлений продуктов много, инноваций не слишком. А тонкий Айфон без ряда функций и с уменьшенной батареей выглядит очень странно. Уже скоро узнаем, какие из утечек оказались правдой.
Подробнее рассказали на сайте.
Forwarded from UX Live 🔥
This media is not supported in your browser
VIEW IN TELEGRAM
О, фигма вчера нативно стекляшечный эффект для фреймов добавила. Оперативно и вовремя, сразу минус 3000 туториалов на тему «Делаем гласуай как у эппл😲 ! Нееет вот теперь по настоящему😡 ! Вот этот еще лучше и экономит память😬 ».
Интересно как с этим будут справляться фронты🍷
Интересно как с этим будут справляться фронты
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from addmeto (Grigory Bakunov)
Пока болею, кажется чуть не упустил самое важное "мы передумали" за последние несколько лет - судя по всему UK собираются отменить требование по встраиванию бэкдора в шифрование для Apple и iCloud. Причем причина, если честно, очень простая - давление со стороны официальных лиц США.
Можно смотреть на это с двух сторон - либо JD Vance так профессионально доказал британцам, что им не нужно снижение безопасности через бэкдоры, либо (что наверное более вероятно) Британии были обещаны доступы к бэкдорам, доступным американским спецслужбам.
На самом деле насколько я знаю, никаких бэкдоров для служб там нет, но есть бесконечные ресурсы FBI/CIA по поиску уязвимостей и их эксплуатация. Впрочем глобально это не делает никакой разницы https://www.techradar.com/computing/cyber-security/the-uk-could-make-a-u-turn-on-apples-encryption-backdoor-demand
Можно смотреть на это с двух сторон - либо JD Vance так профессионально доказал британцам, что им не нужно снижение безопасности через бэкдоры, либо (что наверное более вероятно) Британии были обещаны доступы к бэкдорам, доступным американским спецслужбам.
На самом деле насколько я знаю, никаких бэкдоров для служб там нет, но есть бесконечные ресурсы FBI/CIA по поиску уязвимостей и их эксплуатация. Впрочем глобально это не делает никакой разницы https://www.techradar.com/computing/cyber-security/the-uk-could-make-a-u-turn-on-apples-encryption-backdoor-demand
TechRadar
The UK could make a U-turn on Apple's encryption backdoor demand
US officials have criticized the order that led Apple to remove its iCloud end-to-end encryption feature in the UK in February. Now, the UK is reportedly looking for a way to back down.
Forwarded from Content-Review.com
Цифра дня
3 миллиарда смартфонов продала Apple с момента запуска первого iPhone в 2007 году. Тим Кук сообщил об этом почти мимоходом во время отчета о прибылях за третий квартал 2025 года. Первый миллиард iPhone набрали за девять лет к 2016 году, второй – примерно к сентябрю 2021-го, а теперь вот последовал и третий.
Мы поинтересовались у читателей и выяснили, что треть из них пользуются Айфоном. Кстати, сильно выше, чем доля устройств Apple в целом по России.
3 миллиарда смартфонов продала Apple с момента запуска первого iPhone в 2007 году. Тим Кук сообщил об этом почти мимоходом во время отчета о прибылях за третий квартал 2025 года. Первый миллиард iPhone набрали за девять лет к 2016 году, второй – примерно к сентябрю 2021-го, а теперь вот последовал и третий.
Мы поинтересовались у читателей и выяснили, что треть из них пользуются Айфоном. Кстати, сильно выше, чем доля устройств Apple в целом по России.
Bloomberg: Apple создаст поиск, похожий на ChatGPT, и улучшит Siri и Safari — на сайте вакансий компания разместила более десятка объявлений о поиске специалистов
Forwarded from Код.ру
Grok Imagine стал бесплатным для всех пользователей iOS — раньше модель была доступна за $30–50 в месяц.
На что способна Imagine, показали по ссылке:
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from Аишка
Apple снова меняет траекторию
Apple долго держалась за осторожную стратегию в искусственном интеллекте: никаких модных чатботов, последовательная интеграция функций на базе ИИ в приложения, умные функции прямо на устройстве, чтобы не жертвовать приватностью. Как показала практика, такой подход не понравился ни юзерам, ни инвесторам, которым хотелось инновационных и понятных ИИ-продуктов вроде ChatGPT или Gemini.
Поэтому в последнее время позиция изменилась. Тим Кук прямо сказал, что компания собирается «существенно» увеличить траты на ИИ и готова к крупным покупкам. Речь идёт не только о найме специалистов, но и о строительстве собственных дата-центров.
В кулуарах обсуждали покупку Perplexity – поискового стартапа с «ответным» интерфейсом, который сейчас оценивается в 14 миллиардов долларов. Рассматривали и мягкий вариант – партнёрство, чтобы встроить технологию в Safari или Siri. Это могло бы снизить зависимость от Google в поиске и добавить недостающие нейроответы. Но Perplexity публично заявляли, что о сделке ничего не знают.
Параллельно компания строит собственную систему «ответов» – внутри она известна как Answers или AKI. Идея проста: пользователь задаёт вопрос, а Siri или Safari сразу выдают готовый ответ, используя данные из интернета. Это должно подстраховать ситуацию, пока «большая» Siri готовится к переезду на новую архитектуру.
Apple одумались и теперь пробуют параллельно разные подходы: переговоры о M&A, разработка собственного движка нейроответов, архитектурный апгрейд Siri, вложения в чипы и дата-центры.
Apple долго держалась за осторожную стратегию в искусственном интеллекте: никаких модных чатботов, последовательная интеграция функций на базе ИИ в приложения, умные функции прямо на устройстве, чтобы не жертвовать приватностью. Как показала практика, такой подход не понравился ни юзерам, ни инвесторам, которым хотелось инновационных и понятных ИИ-продуктов вроде ChatGPT или Gemini.
Поэтому в последнее время позиция изменилась. Тим Кук прямо сказал, что компания собирается «существенно» увеличить траты на ИИ и готова к крупным покупкам. Речь идёт не только о найме специалистов, но и о строительстве собственных дата-центров.
В кулуарах обсуждали покупку Perplexity – поискового стартапа с «ответным» интерфейсом, который сейчас оценивается в 14 миллиардов долларов. Рассматривали и мягкий вариант – партнёрство, чтобы встроить технологию в Safari или Siri. Это могло бы снизить зависимость от Google в поиске и добавить недостающие нейроответы. Но Perplexity публично заявляли, что о сделке ничего не знают.
Параллельно компания строит собственную систему «ответов» – внутри она известна как Answers или AKI. Идея проста: пользователь задаёт вопрос, а Siri или Safari сразу выдают готовый ответ, используя данные из интернета. Это должно подстраховать ситуацию, пока «большая» Siri готовится к переезду на новую архитектуру.
Apple одумались и теперь пробуют параллельно разные подходы: переговоры о M&A, разработка собственного движка нейроответов, архитектурный апгрейд Siri, вложения в чипы и дата-центры.
Forwarded from vc.ru
Apple ведёт переговоры об использовании Gemini для обновлённой Siri и предложила Google изучить возможность создать ИИ-модель, которая легла бы в основу голосового помощника, узнало Bloomberg.
Среди других кандидатов для партнёрства издание называло Anthropic
vc.ru/apple/2175331
Среди других кандидатов для партнёрства издание называло Anthropic
vc.ru/apple/2175331
Forwarded from Аишка
Apple перезапускает Siri… Снова
По информации коллег из Bloomberg, Apple тестирует внутри компании приложение Veritas – закрытую песочницу для обкатки Siri на LLM-архитектуре.
Модели каких провайдеров будут использоваться, пока не ясно. Сейчас в Apple Intelligence встроена интеграция с ChatGPT, подписку на который можно купить прямо из окна настроек. Но компания также обсуждала возможные партнёрства с Google, Anthropic и даже думала о покупке Perplexity (возможно, как раз и протестируют разные варианты).
Apple не планирует выпускать Veritas для публики. Это внутренняя песочница, где сотрудники проверяют длинные диалоги, память о прошлых чатах, доступ к почте и медиатеке и другие функции, которые должны превратить голосового ассистента в ИИ-агента. Компания боится повторения скандалов со сливом переписок, галлюцинациями и опасными для здоровья советами ИИ.
Это очередной план развития Siri на фоне нескольких переориентаций команды и переносов. А сервис между тем продолжает косить кадры Apple – публикация совпала с уходом (официально по собственному желанию) Робби Уокера, старшего руководителя по ИИ и поиску, который ещё недавно отвечал за разработку аналога Perplexity и, вероятно, не справился.
По информации коллег из Bloomberg, Apple тестирует внутри компании приложение Veritas – закрытую песочницу для обкатки Siri на LLM-архитектуре.
Модели каких провайдеров будут использоваться, пока не ясно. Сейчас в Apple Intelligence встроена интеграция с ChatGPT, подписку на который можно купить прямо из окна настроек. Но компания также обсуждала возможные партнёрства с Google, Anthropic и даже думала о покупке Perplexity (возможно, как раз и протестируют разные варианты).
Apple не планирует выпускать Veritas для публики. Это внутренняя песочница, где сотрудники проверяют длинные диалоги, память о прошлых чатах, доступ к почте и медиатеке и другие функции, которые должны превратить голосового ассистента в ИИ-агента. Компания боится повторения скандалов со сливом переписок, галлюцинациями и опасными для здоровья советами ИИ.
Это очередной план развития Siri на фоне нескольких переориентаций команды и переносов. А сервис между тем продолжает косить кадры Apple – публикация совпала с уходом (официально по собственному желанию) Робби Уокера, старшего руководителя по ИИ и поиску, который ещё недавно отвечал за разработку аналога Perplexity и, вероятно, не справился.
Forwarded from Аишка
Apple ускорила свою языковую модель в 128 раз
Команда Apple представила FS-DFM – диффузионную языковую модель, которая генерирует текст за 8 шагов вместо 1024 у классических аналогов. Это ускорение в 128 раз при сопоставимом качестве.
Чем диффузионная отличается от авторегрессионной, типа ChatGPT? Мы как-то об этом писали. Если очень коротко, то это метод параллельной генерации текста, когда модель создаёт его не токен за токеном, а весь сразу – что гораздо быстрее. Для этого используется шум, как и в случае с картинками.
Проблема в том, что до сих пор подобные модели требовали сотен итераций, что убивало весь выигрыш в скорости. Apple решила задачу двумя приёмами: принудительно ограничили количество шагов и заставили нейросеть делать сразу большие шаги к результату, а стабилизировали процесс за счёт использования переменной скорости.
Модель весит 170 миллионов параметров и обходит конкурентов размером 7–8 миллиардов (LLaDA-8B и Dream-7B), которые в режиме малых шагов выдают артефакты.
Подобные исследования – часть стратегии Apple по созданию эффективных локальных моделей для своих устройств. Диффузия даёт два преимущества: параллелизм (быстрее на специализированных чипах) и контролируемость (управление генерацией через контекст, а не только промпт).
Команда Apple представила FS-DFM – диффузионную языковую модель, которая генерирует текст за 8 шагов вместо 1024 у классических аналогов. Это ускорение в 128 раз при сопоставимом качестве.
Чем диффузионная отличается от авторегрессионной, типа ChatGPT? Мы как-то об этом писали. Если очень коротко, то это метод параллельной генерации текста, когда модель создаёт его не токен за токеном, а весь сразу – что гораздо быстрее. Для этого используется шум, как и в случае с картинками.
Проблема в том, что до сих пор подобные модели требовали сотен итераций, что убивало весь выигрыш в скорости. Apple решила задачу двумя приёмами: принудительно ограничили количество шагов и заставили нейросеть делать сразу большие шаги к результату, а стабилизировали процесс за счёт использования переменной скорости.
Модель весит 170 миллионов параметров и обходит конкурентов размером 7–8 миллиардов (LLaDA-8B и Dream-7B), которые в режиме малых шагов выдают артефакты.
Подобные исследования – часть стратегии Apple по созданию эффективных локальных моделей для своих устройств. Диффузия даёт два преимущества: параллелизм (быстрее на специализированных чипах) и контролируемость (управление генерацией через контекст, а не только промпт).
Forwarded from Марзаганов вещает
Siri наконец-то поумнеет благодаря Google. Bloomberg пишет, что Apple заплатит около $1 млрд в год за использование модели Gemini с 1,2 трлн параметров — это в восемь раз мощнее нынешней модели от Apple Intelligence. Gemini будет отвечать за сложные запросы Siri, а данные обещают хранить на серверах Apple.
А теперь вспомните, сколько шума было на той самой презентации Apple Intelligence. Сейчас же компания выбрала признать поражение и не использовать посредственный продукт, а арендовать мощности у конкурента.
Но, безусловно, для пользователей это плюс
А теперь вспомните, сколько шума было на той самой презентации Apple Intelligence. Сейчас же компания выбрала признать поражение и не использовать посредственный продукт, а арендовать мощности у конкурента.
Но, безусловно, для пользователей это плюс
Forwarded from Аишка
Media is too big
VIEW IN TELEGRAM
Apple пробует новый путь для генерации видео
Apple представила STARFlow-V – модель для генерации видео, у которой, в отличие от популярных сейчас решений вроде Veo, Sora, Kling и остальных диффузионных систем, в основе лежит другой подход (normalizing flows).
Вместо многократного добавления и очистки шума здесь сразу моделируют, каким должен быть следующий кусок ролика. Одна и та же модель из текста генерирует видео, может «оживлять» статичные изображения и изменять уже готовые клипы. По качеству она пока не дотягивает до флагманов рынка, и Apple этого не скрывает, ведь задачей было в принципе доказать, что архитектура рабочая.
Один уровень модели следит за тем, чтобы видео оставалось последовательной историей: объекты не исчезали из кадра, персонажи не «телепортировались», сцена менялась плавно. Другой уровень отвечает за внешний вид каждого кадра: текстуры, свет, мелкие детали. Модель двигается по ролику от начала к концу и на каждом шаге опирается только на уже созданные кадры, а не на «подсказки» из будущего. Чтобы результат не был шумным и не содержал артефактов, поверх основного генератора обучен лёгкий модуль, который за один дополнительный проход чистит картинку.
Зачем это нужно? Такая схема подходит для сценарией, где видео нужно генерировать в ответ на действия пользователя: в играх, AR/VR, интерактивных сервисах, ассистентах. Когда модель идёт строго вперёд по времени, её проще встроить в живой продукт, а не использовать только для офлайн-рендера. У Apple появляется своя потоковая модель, которая удобна для будущих симуляторов и «мировых моделей», которые не просто рисуют картинку, а оценивают, насколько происходящее соответствует реальности.
Apple представила STARFlow-V – модель для генерации видео, у которой, в отличие от популярных сейчас решений вроде Veo, Sora, Kling и остальных диффузионных систем, в основе лежит другой подход (normalizing flows).
Вместо многократного добавления и очистки шума здесь сразу моделируют, каким должен быть следующий кусок ролика. Одна и та же модель из текста генерирует видео, может «оживлять» статичные изображения и изменять уже готовые клипы. По качеству она пока не дотягивает до флагманов рынка, и Apple этого не скрывает, ведь задачей было в принципе доказать, что архитектура рабочая.
Один уровень модели следит за тем, чтобы видео оставалось последовательной историей: объекты не исчезали из кадра, персонажи не «телепортировались», сцена менялась плавно. Другой уровень отвечает за внешний вид каждого кадра: текстуры, свет, мелкие детали. Модель двигается по ролику от начала к концу и на каждом шаге опирается только на уже созданные кадры, а не на «подсказки» из будущего. Чтобы результат не был шумным и не содержал артефактов, поверх основного генератора обучен лёгкий модуль, который за один дополнительный проход чистит картинку.
Зачем это нужно? Такая схема подходит для сценарией, где видео нужно генерировать в ответ на действия пользователя: в играх, AR/VR, интерактивных сервисах, ассистентах. Когда модель идёт строго вперёд по времени, её проще встроить в живой продукт, а не использовать только для офлайн-рендера. У Apple появляется своя потоковая модель, которая удобна для будущих симуляторов и «мировых моделей», которые не просто рисуют картинку, а оценивают, насколько происходящее соответствует реальности.
Apple купила
Q.ai за 2 миллиардаQ.ai — израильский стартап, разрабатывающий AI для распознавания речи по мимике. В прошлом его команда делала технологию, на которой основаны Xbox Kinect и FaceID.
Приобретение Q.ai — вторая по стоимости покупка Apple после Beats. Все 100 сотрудников стартапа присоединятся к Apple и, видимо, будут участвовать в создании новых носимых устройств.
Forwarded from Аишка
Говори тише: Apple тратит 2 миллиардра на стартап и делает шаг к чтению мыслей
Несмотря на мечты авторов носимых устройств и голосовых помощников, далеко не все готовы идти по улице и орать в наушники «поставь напоминание на 10 вечера постирать носки». Это одна из причин, почему «ИИ-наушники» и прочие подобные устройства с треском проваливаются вскоре после выпуска. Apple, видимо, тоже это понимают, и поэтому потратили 2 миллиарда долларов на покупку израильского стартапа Q.ai. Это вторая по масштабу сделка в истории компании. Технологии стартапа позволяют считывать беззвучную речь – артикуляцию губ и микровибрации мышц лица.
Ключевым активом сделки стал Авиад Майзельс. В 2013 году Купертино уже покупали его компанию PrimeSense. Тогда это казалось странной тратой денег, а уже через четыре года компания на основе этих технологий представила Face ID. Теперь Майзельс возвращается, чтобы дать устройствам способность слышать пользователя без звука – прямо дежавю.
Выиграет от возможности беззвучного управления даже не iPhone или Mac, а устройства типа Vision Pro и потенциальные умные очки, которые якобы разрабатывает компания. Полноценной клавиатуры у них нет, управлять интерфейсом неудобно, а технология тихого ввода вкупе с ассистентом помогут сделать управление более простым и понятным, расширив сценарии использования за пределы дома.
Предыдущие попытки решить эту задачу, вроде проекта AlterEgo от MIT, массивные и требуют постоянного контакта с кожей. Разработка Q.ai, в теории, более универсальная за счёт работы с оптикой и микрофонами, и её можно будет интегрировать в наушники или очки. По цене в 2 миллиарда можно предположить, что проект уже в какой-то стадии готовности. Возможно, и результаты мы увидим в ближайшие годы.
Интереснее всего другое. Технология считывает микродвижения и проговаривание про себя, которые человек не всегда контролирует. Как система отличит осознанную команду от случайных мыслей и движений? А помня попытки компании определять физическую активность пользователя через микрофоны и гироскопы, страшно становится – ведь к ним добавится и чтение невысказанных слов. Чтение мыслей на подходе?
Несмотря на мечты авторов носимых устройств и голосовых помощников, далеко не все готовы идти по улице и орать в наушники «поставь напоминание на 10 вечера постирать носки». Это одна из причин, почему «ИИ-наушники» и прочие подобные устройства с треском проваливаются вскоре после выпуска. Apple, видимо, тоже это понимают, и поэтому потратили 2 миллиарда долларов на покупку израильского стартапа Q.ai. Это вторая по масштабу сделка в истории компании. Технологии стартапа позволяют считывать беззвучную речь – артикуляцию губ и микровибрации мышц лица.
Ключевым активом сделки стал Авиад Майзельс. В 2013 году Купертино уже покупали его компанию PrimeSense. Тогда это казалось странной тратой денег, а уже через четыре года компания на основе этих технологий представила Face ID. Теперь Майзельс возвращается, чтобы дать устройствам способность слышать пользователя без звука – прямо дежавю.
Выиграет от возможности беззвучного управления даже не iPhone или Mac, а устройства типа Vision Pro и потенциальные умные очки, которые якобы разрабатывает компания. Полноценной клавиатуры у них нет, управлять интерфейсом неудобно, а технология тихого ввода вкупе с ассистентом помогут сделать управление более простым и понятным, расширив сценарии использования за пределы дома.
Предыдущие попытки решить эту задачу, вроде проекта AlterEgo от MIT, массивные и требуют постоянного контакта с кожей. Разработка Q.ai, в теории, более универсальная за счёт работы с оптикой и микрофонами, и её можно будет интегрировать в наушники или очки. По цене в 2 миллиарда можно предположить, что проект уже в какой-то стадии готовности. Возможно, и результаты мы увидим в ближайшие годы.
Интереснее всего другое. Технология считывает микродвижения и проговаривание про себя, которые человек не всегда контролирует. Как система отличит осознанную команду от случайных мыслей и движений? А помня попытки компании определять физическую активность пользователя через микрофоны и гироскопы, страшно становится – ведь к ним добавится и чтение невысказанных слов. Чтение мыслей на подходе?
Forwarded from Аишка
Зрение и руки Siri: Apple тестирует модель, которая управляет интерфейсом
Корпорации не теряют надежды сделать такой ИИ, который будет пользоваться привычными интерфейсами за человека, не требуя перестройки самих операционных систем. Apple старается не отставать от тренда и представила прототип Ferret-UI Lite – компактную модель на три 3 параметров, которая получает на вход скриншот и текстовую команду, а затем учится самостоятельно находить нужные элементы и нажимать кнопки, выполняя задачи пользователя. Всё это, по заявлениям компании, локально.
Чтобы заставить одновременно зрение и логику работать на мобильном железе, инженеры сделали упор на создание единой оптимизированной модели. Она обрабатывает скриншот, нарезая его на сетку ячеек, генерирует цепочку рассуждений и выдает конкретное действие по координатам – тап, свайп или ввод текста. Главное отличие от аналогов, которое и позволяет добиться большей эффективности – буквально использование лупы. Агент не сканирует весь экран, он сначала грубо предсказывает нужную зону, потом обрезает картинку вокруг неё и после приближения начинает планировать действия.
По результатам тестов модель справляется с точечным поиском конкретного элемента, обходя некоторые модели в 2 раза больше по параметрам. Однако если нужно сделать несколько шагов и кликов, эффективность падает. Ждать Ferret-UI Lite в ближайшем обновлении iOS, понятное дело, не стоит. А вот через несколько поколений вполне можно получить рабочий прототип. Зачем это нужно – не совсем понятно, но как минимум слабовидящим людям устройствами станет пользоваться проще.
Корпорации не теряют надежды сделать такой ИИ, который будет пользоваться привычными интерфейсами за человека, не требуя перестройки самих операционных систем. Apple старается не отставать от тренда и представила прототип Ferret-UI Lite – компактную модель на три 3 параметров, которая получает на вход скриншот и текстовую команду, а затем учится самостоятельно находить нужные элементы и нажимать кнопки, выполняя задачи пользователя. Всё это, по заявлениям компании, локально.
Чтобы заставить одновременно зрение и логику работать на мобильном железе, инженеры сделали упор на создание единой оптимизированной модели. Она обрабатывает скриншот, нарезая его на сетку ячеек, генерирует цепочку рассуждений и выдает конкретное действие по координатам – тап, свайп или ввод текста. Главное отличие от аналогов, которое и позволяет добиться большей эффективности – буквально использование лупы. Агент не сканирует весь экран, он сначала грубо предсказывает нужную зону, потом обрезает картинку вокруг неё и после приближения начинает планировать действия.
По результатам тестов модель справляется с точечным поиском конкретного элемента, обходя некоторые модели в 2 раза больше по параметрам. Однако если нужно сделать несколько шагов и кликов, эффективность падает. Ждать Ferret-UI Lite в ближайшем обновлении iOS, понятное дело, не стоит. А вот через несколько поколений вполне можно получить рабочий прототип. Зачем это нужно – не совсем понятно, но как минимум слабовидящим людям устройствами станет пользоваться проще.
Forwarded from LIVE — Telegram, AI и технологии
В то время как Amazon, Microsoft, Meta и Google тратят более $100 млрд в квартал на дата-центры — Apple не успевает поставлять Mac Mini и Mac Studio из-за высокого спроса на устройства для запуска OpenClaw и других локальных ИИ-моделей.
Please open Telegram to view this post
VIEW IN TELEGRAM
Apple готовит свои первые умные очки с ИИ — по данным инсайдеров.
Тестируют несколько дизайнов: классику, как у Меты, более узкую версию и ещё две модели с округлыми линзами.
Функции: фото и видео, распознавание объектов, навигация, чтение текста и встроенный ассистент с ИИ. Всё тесно связано с iPhone. Релиз ожидается не раньше 2027 года.
Please open Telegram to view this post
VIEW IN TELEGRAM