👨🏼‍💻Перекладываю 📊 в 🌲🇫🇮
659 subscribers
233 photos
7 videos
55 links
Backend SE @ №1 🇫🇮 Fintech,
DA + DE = AE? @ little🇫🇮startup,
Ex Product Data Analyst @ SkyEng,
Ex Data Engineer @ Starship (delivery robots),
Ex Data Analyst @ EPAM,
Я НЕ РАЗМЕЩАЮ РЕКЛАМУ
Download Telegram
Пилю пет-проект. Для себя в первую очередь, т.к. не уверен в коммерческом потенциале идеи, хотя, безусловно, свою аудиторию продукт найдёт, и даже пригодится. А изучать рынок и пристреляться к стоимости реги нет времени, и желания.

Очень непривычно делать это вайб-простихоспаде-кодингом.

Сделла внятное продуманное «ТЗ по созданию ТЗ» для ЧатаГПТ.
ЧатГПТ по этому ТЗ сделал внятное ТЗ для Клода в виде MD файла.
Клод из этого ТЗ сделал внятную архитектуру проекта, и ТЗ для Курсора.

Курсор собрал.
Клод отревьюил, дал замечания.
Курсор исправил.
Клод отревьюил.
Курсор исправил.
Клод одобрил.

Запустил проект в v1.0
Работает.
На 99% результат корректный, на 1% не корректный.

Сижу. Думаю.
Версия 1.1 должна либо стать проще, лишившись части функионала, но на 100% верной.
Либо стать сложнее. Обрасти дополнительным фунционалом, без прироста точности (а точностью заняться после ещё пары итераций).

По сути, если упростить весь процесс, это питоновый скрипт, который получат на вход определённую информацию, парсит её, делит на сектора, и дописывает туда дополнительные значения. Ну и обёрнуто это в простую хтмл-вебморду, с радиобаттонами и чекбоксами, для выбора настроек.

И вот сижу, и думаю, пойти в бок, и попробовать сделать v1.0.b , и собрать не через петухон, а через использование дешёвой LLM модели.
Или пойти по хардкору, и взять LLM модель, которую надо локально разворачивать, докручивать, мб дообучать, но это оверкил какой-то, и скорее усложнение ради собственного веселья профессионального, и практики, чем для сборки продукта.

___
Хотел использовать Кодекс, но на моём личном компе (макбук 2021г) чип от Интел, и Кодекс не заводится на нём… Жаль, ибо оперативы на этом ноуте больше чем на рабочем значительно.
🔥75🤔4
👨🏼‍💻Перекладываю 📊 в 🌲🇫🇮
Пилю пет-проект. Для себя в первую очередь, т.к. не уверен в коммерческом потенциале идеи, хотя, безусловно, свою аудиторию продукт найдёт, и даже пригодится. А изучать рынок и пристреляться к стоимости реги нет времени, и желания. Очень непривычно делать…
Ещё довольно занятно, что бОльшая часть времени теперь уходит на создание спецификации архитектуры «в голове/на бумаге», чтобы описать внятный алгоритм и нюансы агенту.

По сути, это программирование своим обычным языком, обычной речью. «Код речью».

Но само «программирование» никуда не делось, от появления агентов.

Я пока не дошёл до совсем уже низкоуровневых блок-схем.

Но высоко-уровнево уже докатился до этого. В формате — на вход подаём ЭТО и ВОТ ТАК, дальше ЕСЛИ _ ТО, ИНАЧЕ _ , ну описание корнеркейсов, и возможных проблем.

Поразгонять возможные проблемы с нейронкой тоже занятно. Помогает найти что-то, чего сам недопёр, или описать технически грамотнее.

В занятные времена живём.
👍13🔥21
Старею. Распробовал Mayhem, и Bathory.

Вторых (точнее второго) четвертый день подряд по кругу слушаю, альбомы с 1988 по последний… Но особенно два, 1991 и 2001.

Что дальше? Ранний Darkthrone?) Ужас-ужас.
😁7🔥5👍1
Посоветуйте, пожалуйста, годные кейсы сборки пайплайна по построению Базы Знаний на нейронках-агентах.

Дано: есть куча аудио, в этих аудио кроется кладезь знаний по нужной мне теме.
Аудио транскрибированы (ну или будут транскрибированы) через Whisper облачный от Open AI (транскрибировал бы локально, но через облако процесс в разы быстрее).

Транскрибации в двух форматах — с таймкодами по фразам, и просто скомпанованные по абзацам.

Задача: Подобрать модель, или набор моделей, или готового агента или я хз что, что превратит транскрибации в «учебники» в формате ПДФ с форматированием. И! Затем ВЕСЬ МАССИВ транскрибаций (или ПДФок) превратит в базу знаний, например, в формате MD файлов, или в Ноушене, чтобы можно было быстро найти ответ, когда возникает какой-то вопрос по теме. Либо по содержанию, либо по тегам, либо поиском по БЗ.

Почему ищу какое-то решение, а не просто «скормить Клоду» — я скормил Клоду ОДНУ запись на 5 часов (одну маленькую тему раскрытую), и эти пять часов в виде транскрибации выжрали весь дневной лимит токенов у Клода, и я едва уложился, чтобы получить законченный результат, а не ждать до обновления для продолжения и проверки результата.

Ну и руками всё делать влом, хочется автоматизировать.
🔥7
Ну всё, с 6го июля, официально ♦️рубист♦️
Ох, ёклмн.
Встречай меня бекенд-бра́тушка.

P.S. И на 10% ☕️джавист…
P.P.S. Надо думать, в кого расти дальше. DA+DE (+DP ака инфра), + теперь софтвардевство бекендерское.
И куда с этим всем через года два…  А через пять?
Мде.
🔥16👏5
Какие времена — такие и преложения в Линкедине
👍9🔥6😁3
Уииии, антиспам-бот работает. Под капотом байес и регрессия, и никаких ллм и зависимости от оплаты подписки и токенов.

Ещё и крутится локально, с возможностью продолжить с того места где аптайм упадёт.

Пара часов вечером ушла на команды Клоду, Клод сделал ТЗ для Курсора, Курсор написал, Клод отревьюил, я добыл для обучения датасеты, скормил, подключил к каналам.

Пошла жарямба.

Не коммерческий проект, писал для себя и друзей, бо задрали спамеры в чатах наших.
🔥9👍2
Немного о Финляндии.

Статья про квантовые компьютеры, но заголовок королевский
😁5🤔1
Металисты есть в канале?) Принёс вам прекрасного, финского, и что прекрасно, бесплатно.

Легенды и классика финского металла с оркестром, свежак, буквально вчера был эфир — https://areena.yle.fi/1-78068043

Документалка про финский метал с 1970х по 2020е
https://areena.yle.fi/1-77347316 (субтитры на финском и шведском)

О, пока ссылки нёс, нашёл документалку про норвежский блек-метал
https://areena.yle.fi/1-50802130

Смотреть непересмотреть.
🔥12