Anything2Explainer превращает любую статью в готовый YouTube-ролик — свежий скилл для Claude сам изучает тему, пишет сценарий, делает раскадровку, анимации, озвучку и субтитры, а на выходе отдаёт готовый MP4.
Можно просто написать тему или скормить Anything2Explainer материал — дальше ИИ делает всё сам. Проект бесплатный, а на одно видео с анимацией, озвучкой и субтитрами уходит около часа.
Ссылка
Telegram: @Age_of_it
Можно просто написать тему или скормить Anything2Explainer материал — дальше ИИ делает всё сам. Проект бесплатный, а на одно видео с анимацией, озвучкой и субтитрами уходит около часа.
Ссылка
Telegram: @Age_of_it
🔥1
This media is not supported in your browser
VIEW IN TELEGRAM
Уменьшаем расход токенов ВДВОЕ — Nvidia дропнули на GitHub бесплатную систему SoL-Pi.
Она бустит харнесс нейронок:
- Перебрали кучу вариантов обвязки и закинули в систему сразу четыре лучших механизма;
- Методы сжимают контекст, результаты и логи;
- По бенчам в GPT-5.6 Sol и Opus 5 получилось сократить расход токенов на 50% и сохранить качество результатов;
- Сокращение стоимости работы агентов — около 30%.
Ссылка
Telegram: @Age_of_it
Она бустит харнесс нейронок:
- Перебрали кучу вариантов обвязки и закинули в систему сразу четыре лучших механизма;
- Методы сжимают контекст, результаты и логи;
- По бенчам в GPT-5.6 Sol и Opus 5 получилось сократить расход токенов на 50% и сохранить качество результатов;
- Сокращение стоимости работы агентов — около 30%.
Ссылка
Telegram: @Age_of_it
👍1💔1
Grok 4.7 ВЫШЕЛ — похоже, это самый мощный Grok за всю историю
Новая модель заметно прокачалась по сравнению с Grok 4.6: лучше справляется с длинным контекстом, кодом и документами.
При этом цену решили не повышать — она осталась на уровне предыдущей версии.
Ссылка
Telegram: @Age_of_it
Новая модель заметно прокачалась по сравнению с Grok 4.6: лучше справляется с длинным контекстом, кодом и документами.
При этом цену решили не повышать — она осталась на уровне предыдущей версии.
Ссылка
Telegram: @Age_of_it
🔥1
Claude Opus 5.5 вышел — Anthropic дропнули флагманскую модель,
По бенчам она превосходит Fable 5.1 и GPT-6. А ещё она на 20% дешевле предыдущей версии.
• Скорость генерации выросла в среднем на 30%.
• Общается четче и человечнее предыдущих моделей. Тексты стали легче для восприятия.
• Для работяг увеличили 5-часовой лимит.
• Claude Sonnet 5.5 и Claude Haiku 5.5 выйдут в ближайшие недели.
Ссылка
Telegram: @Age_of_it
По бенчам она превосходит Fable 5.1 и GPT-6. А ещё она на 20% дешевле предыдущей версии.
• Скорость генерации выросла в среднем на 30%.
• Общается четче и человечнее предыдущих моделей. Тексты стали легче для восприятия.
• Для работяг увеличили 5-часовой лимит.
• Claude Sonnet 5.5 и Claude Haiku 5.5 выйдут в ближайшие недели.
Ссылка
Telegram: @Age_of_it
OpenAI выпустила GPT-6 Sol и GPT-6 Luna
Семейство GPT-6 расширилось сразу двумя новыми моделями — Sol и Luna.
Обе построены на наработках GPT-6 Astra, но рассчитаны на более быстрые и дешёвые сценарии работы в масштабе.
Главное:
- GPT-6 Sol — более мощная рабочая модель для сложных задач.
- GPT-6 Luna — более быстрая и экономичная версия для массовых запросов и автоматизаций.
- OpenAI отдельно оптимизировала кэширование и inference.
- API для Sol и Luna стал на 50% дешевле по сравнению с промо-ценами GPT-5.6.
- На AutomationBench новые модели заметно улучшают соотношение качество / стоимость относительно GPT-5.6.
Теперь линейка выглядит так:
GPT-6 Astra — максимум возможностей
GPT-6 Sol — сильная модель для серьёзной повседневной работы
GPT-6 Luna — скорость, масштаб и низкая стоимость
OpenAI явно хочет сделать агентов и автоматизации заметно дешевле для продакшена.
https://openai.com/index/introducing-gpt-6-sol-and-luna/
Telegram: @Age_of_it
Семейство GPT-6 расширилось сразу двумя новыми моделями — Sol и Luna.
Обе построены на наработках GPT-6 Astra, но рассчитаны на более быстрые и дешёвые сценарии работы в масштабе.
Главное:
- GPT-6 Sol — более мощная рабочая модель для сложных задач.
- GPT-6 Luna — более быстрая и экономичная версия для массовых запросов и автоматизаций.
- OpenAI отдельно оптимизировала кэширование и inference.
- API для Sol и Luna стал на 50% дешевле по сравнению с промо-ценами GPT-5.6.
- На AutomationBench новые модели заметно улучшают соотношение качество / стоимость относительно GPT-5.6.
Теперь линейка выглядит так:
GPT-6 Astra — максимум возможностей
GPT-6 Sol — сильная модель для серьёзной повседневной работы
GPT-6 Luna — скорость, масштаб и низкая стоимость
OpenAI явно хочет сделать агентов и автоматизации заметно дешевле для продакшена.
https://openai.com/index/introducing-gpt-6-sol-and-luna/
Telegram: @Age_of_it
❤1
Alibaba представила Qwen3.8-LiveTranslate — модель синхронного перевода речи с сохранением голоса говорящего.
Модель обрабатывает аудио, видео и текст в едином потоке, различает участников разговора и показывает оригинал вместе с переводом. Заявленная задержка составляет около 2,3 секунды.
Qwen3.8-LiveTranslate поддерживает 60 языков, сохраняет тембр и темп речи, учитывает визуальный контекст и удерживает имена и термины в продолжительных беседах.
Ссылка
Telegram: @Age_of_it
Модель обрабатывает аудио, видео и текст в едином потоке, различает участников разговора и показывает оригинал вместе с переводом. Заявленная задержка составляет около 2,3 секунды.
Qwen3.8-LiveTranslate поддерживает 60 языков, сохраняет тембр и темп речи, учитывает визуальный контекст и удерживает имена и термины в продолжительных беседах.
Ссылка
Telegram: @Age_of_it
This media is not supported in your browser
VIEW IN TELEGRAM
Лучшую модель для распознавания речи дропнули в опенсорс — спецы из NVIDIA выкатили Nemotron 3 Diarization.
Она разбирает голоса даже в дорожках, где люди спорят друг с другом, и умеет определять, кто и когда говорит.
Всего модель для диаризации поддерживает разговоры до 8 участников. Это лучшие показатели по бенчам среди всех моделей такого типа: доля ошибок 14% — на 24% ниже ближайшего конкурента.
Модель всего на 100 млн параметров и много мощностей не требует.
Ссылка
Telegram: @Age_of_it
Она разбирает голоса даже в дорожках, где люди спорят друг с другом, и умеет определять, кто и когда говорит.
Всего модель для диаризации поддерживает разговоры до 8 участников. Это лучшие показатели по бенчам среди всех моделей такого типа: доля ошибок 14% — на 24% ниже ближайшего конкурента.
Модель всего на 100 млн параметров и много мощностей не требует.
Ссылка
Telegram: @Age_of_it
👍2
Julia 1: decision-модель на 144 млн параметров, которая работает даже на CPU
Supersonic Labs представила Julia 1 - компактную мультиязычную модель для принятия решений без генерации длинного текста.
Она получает контекст, вопрос и от 2 до 20 вариантов, после чего выбирает лучший и возвращает оценки для каждого варианта.
Главное:
- всего 144,3 млн параметров;
- работает полностью на CPU;
- построена на базе
- 73,15% на Typed Decisions против 72,7% у Jev reference;
- 71,5% на MASSIVE сразу по 52 языкам;
- на Apple M4 — до 51,2 решения/с в batch-режиме;
- запускается даже на Android-планшете;
- обучение и эксперименты обошлись команде примерно в $104.
Модель подходит для routing, классификации, yes/no решений, ранжирования и выбора действий.
Ссылка
Telegram: @Age_of_it
Supersonic Labs представила Julia 1 - компактную мультиязычную модель для принятия решений без генерации длинного текста.
Она получает контекст, вопрос и от 2 до 20 вариантов, после чего выбирает лучший и возвращает оценки для каждого варианта.
Главное:
- всего 144,3 млн параметров;
- работает полностью на CPU;
- построена на базе
mmBERT-small;- 73,15% на Typed Decisions против 72,7% у Jev reference;
- 71,5% на MASSIVE сразу по 52 языкам;
- на Apple M4 — до 51,2 решения/с в batch-режиме;
- запускается даже на Android-планшете;
- обучение и эксперименты обошлись команде примерно в $104.
Модель подходит для routing, классификации, yes/no решений, ранжирования и выбора действий.
Ссылка
Telegram: @Age_of_it
❤3
Hyperresearch превращает Claude Code и Codex в полноценного Deep Research-агента
Hyperresearch - open-source harness для глубоких исследований поверх Claude Code и OpenAI Codex.
Что умеет:
- запускать 16-шаговый research pipeline из одного запроса;
- собирать сотни источников за один запуск;
- проверять, действительно ли каждая цитата подтверждает утверждение;
- выявлять дубли и перепечатки, чтобы не считать их независимыми источниками;
- прогонять черновик через несколько критиков;
- сохранять все найденные материалы в постоянное searchable-хранилище;
- восстанавливать исследование после падения с нужного шага;
- искать статьи, книги, clinical trials, SEC filings и макроданные через единый интерфейс.
Есть режимы от быстрых исследований примерно на 30 минут до экспериментальных «dissertation runs» на десятки тысяч слов и сотни источников.
Работает с Claude Code и Codex.
Ссылка
Telegram: @Age_of_it
Hyperresearch - open-source harness для глубоких исследований поверх Claude Code и OpenAI Codex.
Что умеет:
- запускать 16-шаговый research pipeline из одного запроса;
- собирать сотни источников за один запуск;
- проверять, действительно ли каждая цитата подтверждает утверждение;
- выявлять дубли и перепечатки, чтобы не считать их независимыми источниками;
- прогонять черновик через несколько критиков;
- сохранять все найденные материалы в постоянное searchable-хранилище;
- восстанавливать исследование после падения с нужного шага;
- искать статьи, книги, clinical trials, SEC filings и макроданные через единый интерфейс.
Есть режимы от быстрых исследований примерно на 30 минут до экспериментальных «dissertation runs» на десятки тысяч слов и сотни источников.
Работает с Claude Code и Codex.
Ссылка
Telegram: @Age_of_it
❤1😁1
This media is not supported in your browser
VIEW IN TELEGRAM
На Hugging Face вышла Qwen-Image-2.1-viggle-turbo v0.2.
Она поддерживает генерацию по тексту и редактирование изображений всего за 6 шагов — это примерно в 5 раз быстрее, чем 40-шаговая Qwen-Image-2.1.
Ссылка
Telegram: @Age_of_it
Она поддерживает генерацию по тексту и редактирование изображений всего за 6 шагов — это примерно в 5 раз быстрее, чем 40-шаговая Qwen-Image-2.1.
Ссылка
Telegram: @Age_of_it
This media is not supported in your browser
VIEW IN TELEGRAM
ElevenLabs сбросила бомбу — вышли две новые модели Eleven v4 и v4 Turbo, и это меняет всё.
• 90 языков — русский на месте.
• Клонирует голос за 10 секунд.
• Модели сами адаптируют интонацию под текст.
• Для точечной настройки есть теги:
• Можно создавать фоновые звуки:
Главное: можно стримить сгенерированный голос в прямом эфире — Turbo-версии создаёт озвучку за 150 миллисекунд.
Ссылка
Telegram: @Age_of_it
• 90 языков — русский на месте.
• Клонирует голос за 10 секунд.
• Модели сами адаптируют интонацию под текст.
• Для точечной настройки есть теги:
[excited, happy], [laughs], [said angrily in French accent];• Можно создавать фоновые звуки:
[light rain] и [phone buzzing];Главное: можно стримить сгенерированный голос в прямом эфире — Turbo-версии создаёт озвучку за 150 миллисекунд.
Ссылка
Telegram: @Age_of_it
👍2
GPT-6.1 Sol вышла — Альтман дропнул мощнейшую модель для кодинга и профессиональных задач.
По производительности она совпадает с Astra, но стоит значительно дешевле.
Telegram: @Age_of_it
По производительности она совпадает с Astra, но стоит значительно дешевле.
Telegram: @Age_of_it
Google официально представила Gemini 4 Argon
Это новая frontier-модель компании для сложных многошаговых задач: программирования, финансового и юридического анализа, корпоративных workflow и кибербезопасности.
Главная особенность Argon — до 1 миллиона выходных токенов против 64K у предыдущего поколения. Google делает ставку на очень длинные траектории рассуждений, где модель может работать над одной задачей сотни тысяч токенов подряд.
Что показали внутри Google:
- 77,9% на DeepSWE v1.1 для сложных software engineering задач;
- первое место на AutomationBench с 51,3%;
- 91,7% на LVBench для понимания длинных видео;
- 68% на CWE-bench v1 по исправлению уязвимостей.
Но интереснее реальные кейсы. Агенты Argon помогали Google переносить крупные C/C++-кодовые базы на Rust, включая компоненты Fuchsia Zircon объёмом более 800 000 строк. В другом проекте модель переработала 32 000 строк SIMD-кода в Rust, а итоговая версия работала в 2,7 раза быстрее предыдущего Rust-порта.
Telegram: @Age_of_it
Это новая frontier-модель компании для сложных многошаговых задач: программирования, финансового и юридического анализа, корпоративных workflow и кибербезопасности.
Главная особенность Argon — до 1 миллиона выходных токенов против 64K у предыдущего поколения. Google делает ставку на очень длинные траектории рассуждений, где модель может работать над одной задачей сотни тысяч токенов подряд.
Что показали внутри Google:
- 77,9% на DeepSWE v1.1 для сложных software engineering задач;
- первое место на AutomationBench с 51,3%;
- 91,7% на LVBench для понимания длинных видео;
- 68% на CWE-bench v1 по исправлению уязвимостей.
Но интереснее реальные кейсы. Агенты Argon помогали Google переносить крупные C/C++-кодовые базы на Rust, включая компоненты Fuchsia Zircon объёмом более 800 000 строк. В другом проекте модель переработала 32 000 строк SIMD-кода в Rust, а итоговая версия работала в 2,7 раза быстрее предыдущего Rust-порта.
Telegram: @Age_of_it
👍2
This media is not supported in your browser
VIEW IN TELEGRAM
Китайские разработчики показали Unimate, которая умеет оживлять 3D-персонажей по текстовому описанию.
Нейронке достаточно дать готовую модельку и написать, какое движение нужно получить. Она сама учитывает скелет персонажа, суставы, исходную позу и пропорции костей.
За счет этого одну систему можно использовать для разных персонажей без отдельного обучения под каждую модель.
Ссылка
Telegram: @Age_of_it
Нейронке достаточно дать готовую модельку и написать, какое движение нужно получить. Она сама учитывает скелет персонажа, суставы, исходную позу и пропорции костей.
За счет этого одну систему можно использовать для разных персонажей без отдельного обучения под каждую модель.
Ссылка
Telegram: @Age_of_it
👍1
This media is not supported in your browser
VIEW IN TELEGRAM
Nano Banana в прошлом — бывшие разработчики Google выпустили Ideogram 4.5, которая не портит пикчи после редактирования.
- С её помощью можно перекрасить объект, поменять освещение вместе с тенями и отражениями;
- Перевести текст с сохранением стиля;
- Постепенно восстановить старое фото;
- Меняется только выбранный элемент — всё остальное остаётся на месте.
Авторы сравнили её с GPT Image и Nano Banana: те после серии правок начинают копить искажения, а Ideogram держит детали.
Ссылка
Telegram: @Age_of_it
- С её помощью можно перекрасить объект, поменять освещение вместе с тенями и отражениями;
- Перевести текст с сохранением стиля;
- Постепенно восстановить старое фото;
- Меняется только выбранный элемент — всё остальное остаётся на месте.
Авторы сравнили её с GPT Image и Nano Banana: те после серии правок начинают копить искажения, а Ideogram держит детали.
Ссылка
Telegram: @Age_of_it
👍2
This media is not supported in your browser
VIEW IN TELEGRAM
Голосовые теперь можно записывать ВЕЗДЕ — разработчица сделала приложение, которое читает по губам и превращает беззвучную речь в текст.
Просто смотрите в камеру и произносите нужную фразу одними губами — приложение распознаёт её и печатает за вас. Теперь можно «надиктовывать» хоть в офисе, хоть в метро, хоть ночью.
Ссылка
Telegram: @Age_of_it
Просто смотрите в камеру и произносите нужную фразу одними губами — приложение распознаёт её и печатает за вас. Теперь можно «надиктовывать» хоть в офисе, хоть в метро, хоть ночью.
Ссылка
Telegram: @Age_of_it
Media is too big
VIEW IN TELEGRAM
На GitHub выложили скилл для Claude Code, который превращает обычную картинку в полноценную 3D-сцену с отдельными моделями объектов и звуковым сопровождением.
Получившийся мир можно дальше закинуть в Unity, Unreal, Godot или Blender. По словам автора, весь процесс занимает меньше пяти минут.
Ссылка
Telegram: @Age_of_it
Получившийся мир можно дальше закинуть в Unity, Unreal, Godot или Blender. По словам автора, весь процесс занимает меньше пяти минут.
Ссылка
Telegram: @Age_of_it
DeepSeek выпустил десктоп-агента на полном опен-сорсе.
— Агент умеет работать с файлами, кодом и терминалом локально на вашем компьютере.
— Главное: всё сделано из плагинов. Можно докрутить любые скиллы агента, которых не было изначально.
— Легко ищет по инету, генерит тексты, пишет код — все быстро и без сбоев.
— Работает на Windows и macOS.
Ссылка
Telegram: @Age_of_it
— Агент умеет работать с файлами, кодом и терминалом локально на вашем компьютере.
— Главное: всё сделано из плагинов. Можно докрутить любые скиллы агента, которых не было изначально.
— Легко ищет по инету, генерит тексты, пишет код — все быстро и без сбоев.
— Работает на Windows и macOS.
Ссылка
Telegram: @Age_of_it
👍2