Нейросети для чайника 👾
2.09K subscribers
209 photos
90 videos
17 files
201 links
Про нейросети: @deepfaker

Admin @cocuc

Нейросети для новичков (каталог) @NeuralNoobs
Download Telegram
🛠 ️ God’s Eye View: открытый «глобус-шпион» с реальными самолётами и камерами

God’s Eye View — открытый проект, который собирает на 3D-глобусе данные из публичных источников: рейсы самолётов, корабли, спутники, землетрясения и камеры.

Можно выбрать самолёт и перейти в режим «кабины», включить стили вроде тепловизора или ночного видения, а с ключом OpenAI — управлять картой голосом. Запустить базовую версию можно без аккаунтов и API-ключей.

Важно: авторы предупреждают, что часть режимов — например, трафик, положение камер и запуски — может быть смоделирована, оценена или реконструирована.

GitHub проекта

Источник
🤖 OpenAI разрешила медорганизациям подключать электронные медкарты к ChatGPT

OpenAI открыла организациям здравоохранения возможность подключать к ChatGPT электронные медкарты (EHR) и другие профильные источники данных.

Это поможет врачам получать в одном диалоге контекст по пациенту, обращаться к медицинским исследованиям и доверенной отраслевой информации. Функция предназначена для клиник и медорганизаций: подключение и доступ к данным настраивает сама организация.

Источник
🤖 Meta представила модель для расшифровки созвонов с 20+ спикерами в реальном времени

Meta представила Muse Voice Transcribe — модель для потоковой расшифровки речи. Она определяет, кто говорит, поддерживает диаризацию для 20+ спикеров и автоматически фиксирует окончание реплик.

Модель работает с несколькими языками, поддерживает переключение языков внутри фразы и позволяет повышать точность с помощью настроек языка, ключевых слов и контекста. Meta заявляет первое место Muse Voice Transcribe в рейтинге потокового speech-to-text от Artificial Analysis и на публичных бенчмарках диаризации.

Источник
🤖 OpenAI: модель Astra получила уровень Critical по кибербезопасности

OpenAI готовит к выпуску модель Astra и относит её возможности в кибербезопасности к уровню Critical по собственной Preparedness Framework.

Компания опубликовала предварительный разбор оценки модели и мер защиты, которые развиваются вместе с её возможностями. Astra ещё не выпущена.

Источник
👍1
🚀 Atlas превращает несколько фото в 3D-сцену с управляемой камерой

World Labs представила Atlas — модель, которая строит 3D-мир по фото и видео, а затем позволяет «летать» по нему с заданной траекторией камеры.

Что показали:
— из 1–6 референсных фото можно сгенерировать новые ракурсы и ролик до минуты в 1440p;
— по 2–3 снимкам модель способна восстановить сцену, но невидимые области она достраивает правдоподобно, а не обязательно точно;
— из записи с 3–5 обычных смартфонов можно сделать эффект bullet time: заморозить момент и выбрать новый угол обзора;
— результат можно экспортировать как облако точек или Gaussian splats для 3D-рендера.

Пока Atlas доступен только по заявке на ранний доступ.

Источник
👍1
Media is too big
VIEW IN TELEGRAM
🚀 Google представила Gemini 3.8 Flash: модель может собрать 3D-игру или «DOS-версию» Google Maps по одному запросу

Google анонсировала Gemini 3.8 Flash — новую модель для программирования и AI-агентов. В качестве демо компания показала 3D-игру с исследованием замка и рабочую «DOS-версию» Google Maps с маршрутами и Street View: оба проекта, по заявлению Google, модель собрала по простому запросу в Antigravity.

Gemini 3.8 Flash доступна разработчикам через API, Google AI Studio, Android Studio и другие инструменты Google; подписчики Google AI Pro и Ultra получат её в приложении Gemini, AI Mode и Google Sheets. Компания заявляет, что модель лучше решает длинные многошаговые задачи, но на сложных запросах может расходовать больше токенов.

Одновременно представили Gemini 3.8 Flash Cyber для поиска уязвимостей и подготовки патчей. Доступ к ней ограничен проверенными защитниками через программу Fairwind.

Источник
👍1
This media is not supported in your browser
VIEW IN TELEGRAM
🛍 Claude показал ИИ-помощника, который сам ищет товары и следит за заказами

В демо покупатель просто описывает задачу — например, просит найти подарок ребёнку в заданный бюджет. Помощник подбирает варианты, запоминает предпочтения, помогает собрать корзину и проверить состояние заказа.

Вторая версия работает на стороне магазина: следит за продажами и возвратами, замечает проблемы и отсекает подозрительные команды от покупателей.

Пока это не отдельное приложение для всех. Anthropic открыла основу, на которой магазины смогут создавать таких помощников.

Источник
👍1
This media is not supported in your browser
VIEW IN TELEGRAM
🧠 🎨 На Hugging Face языковую модель научили рисовать акварель кодом

Это не генератор готовых картинок: модель пишет JavaScript-скетч, который рисует цветы через библиотеку с эффектами растекания краски, текстуры бумаги и полупрозрачных слоёв.

Для обучения автор собрал 178 понравившихся ему AI-работ и использовал их как ориентир вкуса. Получились намеренно неровные, «живые» акварельные цветы вместо типичной глянцевой нейрографики.

Главное: опубликованы модель, датасет, среда обучения и код — рецепт можно повторить и настроить под собственный визуальный стиль.

Источник
This media is not supported in your browser
VIEW IN TELEGRAM
🤖 Исследовательская насадка для смартфона помогает искать скрытые камеры по бликам линз

SweepLED — исследовательский прототип: светодиодная решётка крепится к смартфону, меняет подсветку, а алгоритм анализирует отражения и пытается отличить объектив камеры от обычных бликов. В испытании на 30 предметах авторы сообщили о точности 93,9%, но такой небольшой тест не подтверждает надёжность устройства в любых условиях. Прототип пока не продаётся и не заменяет внимательную ручную проверку жилья или номера.

Источник
🤖 NVIDIA договорилась купить Hugging Face за $12,93 млрд

NVIDIA объявила о соглашении по покупке Hugging Face — платформы, где разработчики публикуют и запускают AI-модели.

На Hugging Face размещены более 3 млн моделей, 500 тыс. датасетов и 1 млн приложений; сервисом пользуются свыше 18 млн человек.

NVIDIA обещает сохранить платформу открытой: разработчики смогут выбирать любые модели, облака, провайдеров инференса и железо — использовать GPU NVIDIA будет необязательно.

Компания планирует усилить инфраструктуру, надёжность, проверку моделей и инструменты для их запуска.

Источник
This media is not supported in your browser
VIEW IN TELEGRAM
🚀 Muse Spark 1.3: что изменилось в модели Meta для кода и агентных задач

Meta начала развёртывание Muse Spark 1.3 в Muse Code и Meta Model API. Модель рассчитана на длинные агентные и инженерные сценарии: должна лучше удерживать требования, уточнять неоднозначные запросы, вести несколько задач в одном диалоге и запрашивать подтверждение перед необратимыми действиями.

По внутренним сравнениям Meta с Spark 1.2, новая версия выполняет задачи примерно с на 20% меньшим числом вызовов инструментов и тратит на 25% меньше токенов. Это заявленная экономия токенов и действий агента, а не прямое утверждение о снижении вычислительных ресурсов.

Демо на странице Meta — прототип агента, созданный моделью; это не интерфейс готового продукта вроде Ads Manager.

Источник
Media is too big
VIEW IN TELEGRAM
🚀 Google сделала прогноз погоды в пять раз детальнее — его обновляют каждый час

Google DeepMind представила WeatherNext 3 — ИИ-модель погоды, которая использует свежие спутниковые данные и строит глобальный прогноз каждый час.

— температура и влажность — с детализацией до 5 км;
— прогноз осадков на день и дальше — до 50% точнее, по данным Google;
— модель учитывает ветер на высоте турбин, облачность и солнечную радиацию — это полезно для расчёта выработки чистой энергии.

WeatherNext 3 уже начинает появляться в Поиске Google, Gemini и Google Maps. На прикреплённой визуализации видно, как новая версия убирает «пиксельность» старой карты температуры.

Для штормовых предупреждений Google советует по-прежнему ориентироваться на местные метеослужбы.

Источник
🛠 NVIDIA PAIR: как распределять запросы локальных AI-агентов между несколькими ПК

NVIDIA PAIR — бесплатный open-source инструмент в статусе беты для тех, у кого в одной локальной сети есть несколько совместимых компьютеров. Он обнаруживает доступные устройства и направляет независимые запросы локальных AI-агентов на менее загруженные машины.

PAIR работает с Ollama и LM Studio. Это может пригодиться, если агент разбивает задачу на параллельные подзадачи: например, основной ПК занят игрой или работой, а часть инференса выполняется на другом компьютере в сети.

Поддерживаются Windows, macOS и Linux, видеокарты GeForce RTX 20-й серии и новее, RTX PRO, DGX Spark, а также Apple Silicon M4 и новее.

Источник
This media is not supported in your browser
VIEW IN TELEGRAM
🚀 Runway показала ИИ-мир, который меняется во время игры

Runway представила GWM Worlds 2 — исследовательскую модель, которая в реальном времени генерирует интерактивный мир вместе со звуком.

В демо можно ходить от первого лица, управлять камерой и действовать в мире, а текстовыми командами — менять погоду, предметы и события. Например, превратить закат в ночь и вызвать песчаную бурю, пока другой игрок продолжает исследовать локацию.

Модель выдаёт 720p при 24 fps. Это пока research preview: на длинных сценах могут «плыть» детали, текстуры и геометрия.

Источник
🤖 GPT-6 Astra проверила 41 финансовый документ за минуты — в кейсе Legora

OpenAI рассказала о кейсе юридической платформы Legora: GPT-6 Astra обработала 41 финансовый документ за несколько минут и нашла все четыре специально внесённые ошибки.

В этом сценарии Legora заявляет почти 40%-ный прирост производительности проверки. Это не автономная замена специалиста, а способ быстрее разобрать большую пачку отчётности перед финальной проверкой человеком.

Источник
This media is not supported in your browser
VIEW IN TELEGRAM
🤖 NeoMME ищет нужные страницы PDF по изображению — без OCR

H Company открыла модели NeoMME для команд, которые строят поиск по документам. Ретривер обрабатывает страницы PDF как изображения, поэтому при поиске учитывает вёрстку, таблицы, графики и типографику — без предварительного извлечения текста через OCR.

В демо можно загрузить документ и запрос: модель вернёт наиболее релевантные страницы, а не готовый ответ на вопрос. Доступны версии на 260M и 800M параметров под лицензией Apache 2.0.

Источник
Media is too big
VIEW IN TELEGRAM
🤖 Разработчик показал AI-воссоздание Palace of Fine Arts в Blender

Шариф Шамим опубликовал 30-секундный ролик с 3D-версией Palace of Fine Arts в Сан-Франциско — ротондой, колоннадой, водой и вечерним светом.

Автор называет использованную систему GPT-6 Astra. Подробностей о самой модели или процессе работы в публикации нет, но в видео можно оценить итоговый кинематографичный 3D-рендер.

Источник
Media is too big
VIEW IN TELEGRAM
ИИ восстановил паровоз в Blender по старому чертежу

Tom Krcha показал, как загрузил старый чертёж паровоза и попросил GPT-6 Astra собрать модель в Blender. По словам автора, за несколько минут ИИ создал 3295 отдельных редактируемых объектов.

На видео — готовый локомотив, его сетка и структура деталей в сцене Blender.

Источник
This media is not supported in your browser
VIEW IN TELEGRAM
AI-минифильм о последнем человеке в бункере

Метель снаружи, тревожный шлюз, зелёный свет старого телевизора — и человек в защитной маске, который, кажется, остался один.

Короткое AI-видео без сюжета в лоб, но атмосферу постапокалиптической игры передаёт отлично. Я бы посмотрела такой трейлер целиком.

Источник
This media is not supported in your browser
VIEW IN TELEGRAM
🤖 Что Bloomberg сообщил о GPT‑6 Astra: пока без характеристик и даты запуска

Bloomberg опубликовал 93‑секундный фрагмент интервью с Сэмом Альтманом, в котором GPT‑6 Astra называют следующим поколением технологий OpenAI и важной вехой на пути к AGI.

Практических деталей в ролике нет: не показаны интерфейс или возможности модели, не названы сроки запуска, условия доступа и цена. Разговор посвящён прежде всего безопасности ИИ и правилам его использования.

Поэтому GPT‑6 Astra пока стоит воспринимать как заявленное направление OpenAI, а не как подтверждённый релиз с понятными функциями для пользователей.

Источник: Bloomberg

Источник
🚀 🎵 В Gemini появилась Lyria 3.5 — можно собрать трек с вокалом или без

Google добавила в Gemini новую музыкальную модель Lyria 3.5. Она умеет генерировать более выразительный вокал и насыщенные аранжировки — по крайней мере, так заявляет компания.

В приложении можно:
— описать жанр или выбрать его;
— сделать вокальный или инструментальный трек;
— выбрать короткую либо более длинную версию;
— начать с шаблона для фоновой музыки, джингла, поздравления или рингтона.

Полезно для тех, кому нужен быстрый саунд для ролика, презентации или своего проекта, но нет времени писать музыку с нуля. Lyria 3.5 уже доступна всем пользователям Gemini в вебе и мобильном приложении.

Источник