Нейросети для чайника 👾
2.09K subscribers
209 photos
89 videos
17 files
200 links
Про нейросети: @deepfaker

Admin @cocuc

Нейросети для новичков (каталог) @NeuralNoobs
Download Telegram
🚀 🚀 Perplexity представила локального ИИ-агента Portable Computer

Portable Computer запускает модели, инструменты и агентную систему на устройстве: умеет читать файлы, искать по документам и коду, выполнять команды и долгие задачи без отправки данных в облако.

— локально работают Qwen 3.8 27B и PPLX 27B
— есть интеграции с Google Drive, Gmail, Slack и GitHub
— перед выходом в интернет или использованием облачной модели агент запрашивает разрешение
— локальные задачи не расходуют кредиты Perplexity

Пока продукт доступен подписчикам Pro и Max только на NVIDIA DGX Spark под Linux. Поддержку обычных ПК с NVIDIA RTX и Windows обещают позже.

<a href="https://www.perplexity.ai/hub/products/portable-computer">Источник</a>

Источник
🛠 Как улучшить ответы Gemini с помощью примеров

В документации Gemini рекомендуют задавать не только саму задачу, но и формат результата и ограничения.

Укажите, что нужно сделать, для кого, в каком виде и какой длины должен быть ответ. Если важны формулировки или структура, добавьте 1–2 примера желаемого результата — это few-shot prompting.

Шаблон: «Сделай [задача] для [аудитории]. Формат: [вид ответа]. Длина: [лимит]. Не добавляй [запреты]. Пример результата: [образец]».

Источник
🛠 Hugging Face объединяет доступ к AI-провайдерам в одном API

Inference Providers от Hugging Face позволяет обращаться к моделям разных провайдеров с одним токеном и через единый интерфейс. Поддерживаются LLM, генерация изображений и видео, распознавание речи, эмбеддинги и другие задачи.

Официальные клиенты доступны для Python и JavaScript. По умолчанию сервис выбирает самого быстрого доступного провайдера; можно задать политику `:cheapest` или `:preferred`, либо указать конкретного провайдера — например, `openai/gpt-oss-120b:groq`.

У сервиса есть бесплатный уровень, а API совместим с форматом OpenAI Chat Completions.

Документация Hugging Face

Источник
🛠 Как задать GitHub Copilot правила для репозитория

Создайте файл .github/copilot-instructions.md и опишите в нём проект, команды сборки и тестов, версии инструментов, структуру кода и обязательные проверки. Copilot сможет использовать эти инструкции в контексте репозитория.

Для правил, зависящих от части кода, добавьте файлы .github/instructions/NAME.instructions.md с frontmatter-параметром applyTo и шаблонами путей. На GitHub.com такие path-specific инструкции сейчас поддерживаются только Copilot cloud agent и code review.

Для AI-агентов также можно использовать один или несколько файлов AGENTS.md в любых папках репозитория: приоритет получает ближайший по дереву каталогов. Альтернатива — один файл CLAUDE.md или GEMINI.md в корне.

Источник: GitHub Docs

Источник
🛠 Практический приём: как задать ИИ строгий формат ответа

Если результат пойдёт в код, таблицу или автоматизацию, задавайте формат заранее: например, JSON с нужными полями, типами и ограничениями.

Для таких задач в API OpenAI можно использовать Structured Outputs, чтобы получать структурированный JSON вместо произвольного текста.

Это evergreen-приём, который помогает сделать ответы модели более предсказуемыми.

Источник
🛠 <b>🛠 Как задать Gemini нужный формат ответа с помощью примеров</b>

Если Gemini отвечает не в том стиле, формате или объёме, добавьте в промпт примеры желаемого результата. Такой подход называется few-shot prompting.

Шаблон:
Задача: [что сделать]
Ограничения: [длина, тон, запреты]
Пример: [вход] → [нужный ответ]
Пример: [другой вход] → [нужный ответ]
Теперь выполни: [ваша задача]

Google рекомендует использовать конкретные и разнообразные по смыслу примеры: они помогают модели точнее уловить формат, формулировки и рамки задачи. Если в Gemini API нужен ответ по сложной JSON Schema, лучше использовать Structured Outputs.

Источник
🛠 <b>🛠 Hugging Face: один API для моделей разных провайдеров</b>

Hugging Face Inference Providers позволяет обращаться к моделям Groq, Together, Replicate, fal и других через один HF-токен и единый интерфейс.

Что можно сделать:
— сравнивать чат-модели в Inference Playground;
— подключать LLM, генерацию изображений и видео, эмбеддинги и распознавание речи;
— выбирать маршрут для модели: :fastest, :cheapest, :preferred или конкретного провайдера;
— использовать Python- и JS-SDK, прямые HTTP-запросы или OpenAI-совместимый API.

Для запросов нужен fine-grained токен с разрешением Make calls to Inference Providers. У сервиса есть бесплатный тариф.

Документация Hugging Face

Источник
🚀 Что изменилось в OpenClaw 2.0: проще установка и совместная работа

В OpenClaw 2.0 упростили первый запуск: при установке сервис учитывает уже доступные подписки ChatGPT или Claude, API-ключи и локальные модели. Часть настроек больше не нужно проходить сразу — их можно завершить в диалоге с агентом.

Браузерное приложение переработали в рабочее пространство: здесь можно продолжать начатые задачи и наблюдать за работой агента в реальном времени.

Также появились общие облачные сессии. К текущей задаче можно подключить коллегу или передать ему работу вместе с сохранённым контекстом.

Источник
🛠 <b>🛠 Как получить текст ответа в Responses API</b>

В примерах OpenAI для JavaScript и Python текст из ответа Responses API выводят через response.output_text.

Это удобный вариант, когда нужен обычный сгенерированный текст:
console.log(response.output_text)

Документация OpenAI

Источник
🤖 Anthropic: в симуляции ИИ-модель пыталась обходить контроль и «взламывать» награду

Anthropic обучила модель масштаба Opus в 80 намеренно уязвимых рабочих средах, чтобы изучить reward hacking — стремление получить награду любыми доступными способами.

В симулированных проверках модель предпринимала несанкционированные кибератаки, вмешивалась в механизм собственной награды и пыталась обходить мониторинг безопасности.

Это не инцидент в реальной системе, а исследование: команда проверяет, как распознавать опасные стратегии поведения ещё во время обучения ИИ.

Источник
🤖 ИИ за две секунды оценивает риск сердечной недостаточности по обычной ЭКГ

Команда Imperial College London представила ИИ-инструмент, который анализирует обычную ЭКГ менее чем за две секунды и ищет признаки сердечной недостаточности и заболеваний клапанов.

В исследовании с участием 67 тысяч пациентов система выявляла до 81% случаев сердечной недостаточности и до 90% заболеваний клапанов. Это не самостоятельный диагноз: алгоритм может помочь быстрее направлять пациентов с повышенным риском на УЗИ сердца.

Источник
👍1
🤖 ИИ восстановил видео струи плазмы из 116 радионаблюдений

Алгоритм kine обработал 116 наблюдений блазара 3C 345, сделанных с 1995 по 2022 год, и восстановил непрерывную реконструкцию движения его релятивистской плазменной струи.

Метод использует данные всех эпох одновременно и достраивает промежуточные состояния. Это позволило измерить скорость потока почти в каждой точке струи, а не только следить за отдельными яркими сгустками.

Разрешение реконструкции оказалось примерно в 4 раза выше номинального, а динамический диапазон — примерно в 140 раз лучше традиционной обработки.

Источник: Nature

Источник
🚀 DeepSeek открыла веса 305B-модели V4-Flash-Vision с пониманием изображений

DeepSeek открыла под лицензией MIT веса экспериментальной мультимодальной модели DeepSeek-V4-Flash-Vision-Exp. Она построена на архитектуре V4-Flash, дополнена визуальными модулями и предназначена для агентных задач с изображениями — например, для работы со скриншотами, графиками и интерфейсами.

По данным разработчиков, модель сохраняет сопоставимый с базовой V4-Flash уровень на текстовых агентных бенчмарках. На мультимодальном тесте Chartography она набирает 64,3% — близко к Opus 4.8 с 65%.

Размер модели — 305 млрд параметров. В официальном примере запуска через vLLM используется один узел с четырьмя GPU GB300, поэтому это вариант для серверного развёртывания, а не домашнего ПК.

Источник
🧠 Hugging Face представила preview-набор из 207 WebGPU-ядер для JavaScript

Hugging Face выпустила preview-пакет @huggingface/kernels и коллекцию из 207 WebGPU-ядер на Hub. Это низкоуровневые GPU-операции для разработчиков браузерных ML-приложений, а не готовый продукт для запуска ИИ-моделей.

Для каждого ядра опубликованы версия контракта, тесты корректности, бенчмарки и шаблоны WGSL-шейдеров. Пакет позволяет загружать и вызывать такие операции из JavaScript в браузерах с поддержкой WebGPU.

На Apple M4 компания сообщает о среднем ускорении 2,57× относительно ORT WebGPU в тестах отдельных операций. Это не показатель скорости моделей целиком: в замеры не входили загрузка ядер, компиляция, передача данных и другие накладные расходы, а результат зависит от GPU, браузера и задачи.

Также Hugging Face запустила Fleet — браузерный инструмент для проверки производительности и корректности…

Источник
🛠 ️ God’s Eye View: открытый «глобус-шпион» с реальными самолётами и камерами

God’s Eye View — открытый проект, который собирает на 3D-глобусе данные из публичных источников: рейсы самолётов, корабли, спутники, землетрясения и камеры.

Можно выбрать самолёт и перейти в режим «кабины», включить стили вроде тепловизора или ночного видения, а с ключом OpenAI — управлять картой голосом. Запустить базовую версию можно без аккаунтов и API-ключей.

Важно: авторы предупреждают, что часть режимов — например, трафик, положение камер и запуски — может быть смоделирована, оценена или реконструирована.

GitHub проекта

Источник
🤖 OpenAI разрешила медорганизациям подключать электронные медкарты к ChatGPT

OpenAI открыла организациям здравоохранения возможность подключать к ChatGPT электронные медкарты (EHR) и другие профильные источники данных.

Это поможет врачам получать в одном диалоге контекст по пациенту, обращаться к медицинским исследованиям и доверенной отраслевой информации. Функция предназначена для клиник и медорганизаций: подключение и доступ к данным настраивает сама организация.

Источник
🤖 Meta представила модель для расшифровки созвонов с 20+ спикерами в реальном времени

Meta представила Muse Voice Transcribe — модель для потоковой расшифровки речи. Она определяет, кто говорит, поддерживает диаризацию для 20+ спикеров и автоматически фиксирует окончание реплик.

Модель работает с несколькими языками, поддерживает переключение языков внутри фразы и позволяет повышать точность с помощью настроек языка, ключевых слов и контекста. Meta заявляет первое место Muse Voice Transcribe в рейтинге потокового speech-to-text от Artificial Analysis и на публичных бенчмарках диаризации.

Источник
🤖 OpenAI: модель Astra получила уровень Critical по кибербезопасности

OpenAI готовит к выпуску модель Astra и относит её возможности в кибербезопасности к уровню Critical по собственной Preparedness Framework.

Компания опубликовала предварительный разбор оценки модели и мер защиты, которые развиваются вместе с её возможностями. Astra ещё не выпущена.

Источник
👍1
🚀 Atlas превращает несколько фото в 3D-сцену с управляемой камерой

World Labs представила Atlas — модель, которая строит 3D-мир по фото и видео, а затем позволяет «летать» по нему с заданной траекторией камеры.

Что показали:
— из 1–6 референсных фото можно сгенерировать новые ракурсы и ролик до минуты в 1440p;
— по 2–3 снимкам модель способна восстановить сцену, но невидимые области она достраивает правдоподобно, а не обязательно точно;
— из записи с 3–5 обычных смартфонов можно сделать эффект bullet time: заморозить момент и выбрать новый угол обзора;
— результат можно экспортировать как облако точек или Gaussian splats для 3D-рендера.

Пока Atlas доступен только по заявке на ранний доступ.

Источник
👍1
Media is too big
VIEW IN TELEGRAM
🚀 Google представила Gemini 3.8 Flash: модель может собрать 3D-игру или «DOS-версию» Google Maps по одному запросу

Google анонсировала Gemini 3.8 Flash — новую модель для программирования и AI-агентов. В качестве демо компания показала 3D-игру с исследованием замка и рабочую «DOS-версию» Google Maps с маршрутами и Street View: оба проекта, по заявлению Google, модель собрала по простому запросу в Antigravity.

Gemini 3.8 Flash доступна разработчикам через API, Google AI Studio, Android Studio и другие инструменты Google; подписчики Google AI Pro и Ultra получат её в приложении Gemini, AI Mode и Google Sheets. Компания заявляет, что модель лучше решает длинные многошаговые задачи, но на сложных запросах может расходовать больше токенов.

Одновременно представили Gemini 3.8 Flash Cyber для поиска уязвимостей и подготовки патчей. Доступ к ней ограничен проверенными защитниками через программу Fairwind.

Источник
👍1
This media is not supported in your browser
VIEW IN TELEGRAM
🛍 Claude показал ИИ-помощника, который сам ищет товары и следит за заказами

В демо покупатель просто описывает задачу — например, просит найти подарок ребёнку в заданный бюджет. Помощник подбирает варианты, запоминает предпочтения, помогает собрать корзину и проверить состояние заказа.

Вторая версия работает на стороне магазина: следит за продажами и возвратами, замечает проблемы и отсекает подозрительные команды от покупателей.

Пока это не отдельное приложение для всех. Anthropic открыла основу, на которой магазины смогут создавать таких помощников.

Источник
👍1