Google выпустили Gemma 4 – новое поколение моделей с открытыми весами
В релиз вошли 4 модели: от компактной 2B до на 31B. По метрикам это новая открытая SOTA.
Любую из моделей семейства можно поднять в DS Lab за несколько минут на арендованных мощностях: без настройки окружения, установки библиотек и прочего. Удобно для локального инференса, файнтюнинга или разработки продуктов и петпроектов.
1. Создаете проект с готовым ML-окружением, выбираете подходящий GPU и прописываете в терминал:
2. Открываете вкладку «Порты» в IDE: там уже готов публичный HTTPS-адрес.
3. Готово, теперь вы можете использовать модель, которая поднята у вас в DS Lab, в любом клиенте через OpenAI-совместимый API, просто поменяв base_url на этот адрес.
Попробовать: dslab.tech
В релиз вошли 4 модели: от компактной 2B до на 31B. По метрикам это новая открытая SOTA.
Любую из моделей семейства можно поднять в DS Lab за несколько минут на арендованных мощностях: без настройки окружения, установки библиотек и прочего. Удобно для локального инференса, файнтюнинга или разработки продуктов и петпроектов.
1. Создаете проект с готовым ML-окружением, выбираете подходящий GPU и прописываете в терминал:
sudo apt-get update && sudo apt-get install -y zstd pciutils lshw
curl -L https://github.com/ollama/ollama/releases/download/v0.20.0-rc0/ollama-linux-amd64.tar.zst -o /tmp/ollama.tar.zst
cd /tmp && tar -xf ollama.tar.zst
sudo cp bin/ollama /usr/local/bin/ollama
OLLAMA_HOST=0.0.0.0:11434 OLLAMA_ORIGINS=* ollama serve &
ollama pull gemma4:31b
2. Открываете вкладку «Порты» в IDE: там уже готов публичный HTTPS-адрес.
3. Готово, теперь вы можете использовать модель, которая поднята у вас в DS Lab, в любом клиенте через OpenAI-совместимый API, просто поменяв base_url на этот адрес.
Попробовать: dslab.tech
В DS Lab есть авто-выключение проекта при бездействии. Работает это так: таймер запускается только когда вы полностью прекращаете работу. Зашли в проект, запустили ячейку, написали строчку кода — таймер сбрасывается. Проект выключится только если вы действительно ничего не делаете в течение заданного времени.
По умолчанию это 10 минут. Теперь этот интервал настраивается. Можно поставить час, несколько часов или вовсе отключить авто-выключение, если держите тяжёлую GPU-конфигурацию и не хотите думать о таймере.
Обновление уже на сайте: dslab.tech
Please open Telegram to view this post
VIEW IN TELEGRAM
Интеграции с GitHub и Hugging Face
Теперь в настройках профиля можно один раз подключить аккаунты GitHub и Hugging Face. После этого авторизация работает автоматически во всех проектах: и в терминале, и в плагинах.
Никакого git config, никаких токенов при каждом запуске. Подключили один раз и все работает из коробки в любом проекте: git push, git pull, загрузка моделей с HF.
Уже доступно на сайте: https://dslab.tech/integrations
Теперь в настройках профиля можно один раз подключить аккаунты GitHub и Hugging Face. После этого авторизация работает автоматически во всех проектах: и в терминале, и в плагинах.
Никакого git config, никаких токенов при каждом запуске. Подключили один раз и все работает из коробки в любом проекте: git push, git pull, загрузка моделей с HF.
Уже доступно на сайте: https://dslab.tech/integrations
Смена версии Python прямо в проекте
Раньше версия Python была фиксированной и поменять ее было нельзя. Теперь это решено: в боковом меню проекта появились настройки Python, где можно выбрать нужную версию в пару кликов.
Обновление уже на сайте: dslab.tech
Раньше версия Python была фиксированной и поменять ее было нельзя. Теперь это решено: в боковом меню проекта появились настройки Python, где можно выбрать нужную версию в пару кликов.
Обновление уже на сайте: dslab.tech
Сегодня делимся с вами большим обновлением DS Lab: мы открываем доступ к собственному API-сервису, который разрабатывали с глубоким упором на доступность, скорость и удобство.
Пробуйте и оставляйте нам вашу обратную связь: dslab.tech/model
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
GLM-5.2 стала вдвое дешевле в DS Lab API
На этой неделе
По случаю релиза мы временно снизили цены на модель до 25 июня. Теперь стоимость составляет 70 ₽ за 1M входящих токенов и 220 ₽ за 1M исходящих токенов.
Для сравнения, официальный API стоит дороже: 1.4$ за input и 4.4$ ₽ за output на миллион токенов.
Если давно хотели посмотреть, на что способна новая флагманская open-source модель с контекстом 1M токенов, сейчас хороший момент попробовать ее в реальных задачах.
https://dslab.tech/ai/models/llm/glm-5.2
На этой неделе
Z.ai выпустили GLM-5.2 – одну из самых сильных открытых моделей на рынке прямо сейчас. Она уже успела занять первое место на Design Arena и подняться на вторую строчку Code Arena.По случаю релиза мы временно снизили цены на модель до 25 июня. Теперь стоимость составляет 70 ₽ за 1M входящих токенов и 220 ₽ за 1M исходящих токенов.
Для сравнения, официальный API стоит дороже: 1.4$ за input и 4.4$ ₽ за output на миллион токенов.
Если давно хотели посмотреть, на что способна новая флагманская open-source модель с контекстом 1M токенов, сейчас хороший момент попробовать ее в реальных задачах.
https://dslab.tech/ai/models/llm/glm-5.2
Обновления в DS Lab API
➖ Добавили Sakana Fugu Ultra. Модели пока нет даже на OpenRouter. Цена: 500 ₽ / 3000 ₽ за 1M входных и выходных токенов.
➖ Снизили цены на DeepSeek V4 Pro. Теперь 43 ₽ / 87 ₽ вместо 191 ₽ / 382 ₽ за 1M входных и выходных токенов.
➖ До 1 июля DeepSeek V4 Flash доступна на 50% дешевле официальных цен. Стоимость составляет 4 ₽ / 8 ₽ за 1M входных и выходных токенов.
Пробуйте: dslab.tech/ai
Пробуйте: dslab.tech/ai
Please open Telegram to view this post
VIEW IN TELEGRAM