journalctl -u micro
Ennesimo caso android: perché il telefono non va più in deep sleep, ciucciando tutta la batteria?
Niente, ha deciso di non entrare più in deep sleep, allora stanotte l'ho forzato io: spegnendolo
🔥1
Se volete fare trascrizioni audio multilingua, in locale, velocemente, con GPU non obbligatoria, consiglio tantissimo
https://github.com/SYSTRAN/faster-whisper
Il modello small impiega ~2min su CPU per trascrivere 13min di audio, con una qualità eccezionale.
https://github.com/SYSTRAN/faster-whisper
Il modello small impiega ~2min su CPU per trascrivere 13min di audio, con una qualità eccezionale.
GitHub
GitHub - SYSTRAN/faster-whisper: Faster Whisper transcription with CTranslate2
Faster Whisper transcription with CTranslate2. Contribute to SYSTRAN/faster-whisper development by creating an account on GitHub.
👍1
journalctl -u micro
Se volete fare trascrizioni audio multilingua, in locale, velocemente, con GPU non obbligatoria, consiglio tantissimo https://github.com/SYSTRAN/faster-whisper Il modello small impiega ~2min su CPU per trascrivere 13min di audio, con una qualità eccezionale.
transcribe.py
3.1 KB
Here take this
❤1
journalctl -u micro
Ennesimo caso android: perché il telefono non va più in deep sleep, ciucciando tutta la batteria?
Forse posso trarre una conclusione: prima di spegnerlo vedevo zero Wake Locks MA degli "Alarms" generati continuamente da Google Play Services.
Una volta riavviato, questi sono scomparsi, e la batteria è tornata a durare come prima, forse di più.
Una volta riavviato, questi sono scomparsi, e la batteria è tornata a durare come prima, forse di più.
Nell'ultimo anno ho avuto parecchio a che fare con i RAG — Retrieval Augmented Generation: trasformi dei documenti che il modello non conosce in markdown e poi in vettori, su cui verrà eseguita una ricerca semantica per similarità con la richiesta dell'utente.
• documenti: usage.pdf sdk.pdf
• spezzetta ogni tot parole
• vettorizza con modello di embedding
• salva in Chroma
• utente: cos'è X e cosa posso sviluppare?
• cerca i pezzi inerenti
• trova pezzi da entrambi i documenti
• bot: (riassunto)
Suona figo? Non lo è, perché per casi reali non funziona una sega.
• per vettorizzare 20 pezzi su CPU ci vogliono anche 40min
• i documenti sono una merda (garbage in, garbage out)
• l'utente scrive male
• non puoi far generare elenchi
• stessa query utente, ogni volta dà dei risultati diversi
• paradosso pre-conoscenza: devi sapere in anticipo quali sono i documenti nel RAG per poter ottenere risultati marginalmente accettabili
• devi fare decomposizione della query, cercando per parole chiave che l'utente non ha specificato
• devi spezzettare i documenti, altrimenti esplode il contesto del modello
• ci sono tanti match ridondanti e il pezzo che ti interessa viene filtrato via? non puoi farci nulla
• se ti inventi di importare pytorch (serve ad Unstructured) ti porti dietro le librerie di CUDA anche se non le userai mai (+2GB)
Ciò che invece ho notato funzionare 1000x meglio è stato un tool agentico scritto in mezz'ora netta, che si interfaccia con le api di Bookstack ed esporta le pagine in markdown, con spezzettamento e rerank
• documenti: usage.pdf sdk.pdf
• spezzetta ogni tot parole
• vettorizza con modello di embedding
• salva in Chroma
• utente: cos'è X e cosa posso sviluppare?
• cerca i pezzi inerenti
• trova pezzi da entrambi i documenti
• bot: (riassunto)
Suona figo? Non lo è, perché per casi reali non funziona una sega.
• per vettorizzare 20 pezzi su CPU ci vogliono anche 40min
• i documenti sono una merda (garbage in, garbage out)
• l'utente scrive male
• non puoi far generare elenchi
• stessa query utente, ogni volta dà dei risultati diversi
• paradosso pre-conoscenza: devi sapere in anticipo quali sono i documenti nel RAG per poter ottenere risultati marginalmente accettabili
• devi fare decomposizione della query, cercando per parole chiave che l'utente non ha specificato
• devi spezzettare i documenti, altrimenti esplode il contesto del modello
• ci sono tanti match ridondanti e il pezzo che ti interessa viene filtrato via? non puoi farci nulla
• se ti inventi di importare pytorch (serve ad Unstructured) ti porti dietro le librerie di CUDA anche se non le userai mai (+2GB)
Ciò che invece ho notato funzionare 1000x meglio è stato un tool agentico scritto in mezz'ora netta, che si interfaccia con le api di Bookstack ed esporta le pagine in markdown, con spezzettamento e rerank
👍3
Forwarded from Gianmarco Gargiulo Mastodon Bridge
#ChatControl 1.0 and 2.0 Explained: There is not one proposed “Chat Control” law — there are two, and they are moving through the EU institutions in parallel. This page untangles the two.
https://fightchatcontrol.eu/chat-control-overview
https://fightchatcontrol.eu/chat-control-overview
journalctl -u micro
Nell'ultimo anno ho avuto parecchio a che fare con i RAG — Retrieval Augmented Generation: trasformi dei documenti che il modello non conosce in markdown e poi in vettori, su cui verrà eseguita una ricerca semantica per similarità con la richiesta dell'utente.…
Incredibile comunque quanto il gioco d'azzardo abbia fatto presa in commerciali e sviluppatori — le slot machines e il poker non bastano più, ora anche i computer vanno a probabilità
Ottieni cattivi risultati? Eh skill issue, –1mln€ in fatturato
Ottieni cattivi risultati? Eh skill issue, –1mln€ in fatturato
journalctl -u micro
https://gitgud.io/wackyideas/aerothemeplasma/ This is a project which aims to recreate the look and feel of Windows 7 as much as possible on KDE Plasma, whilst adapting the design to fit in with modern features provided by KDE Plasma and Linux. Ogni singolo…
KolourPaint con Aero, più librerie annesse
https://invent.kde.org/albert-tomanek/kolourpaint/-/tree/saribbon-aero
https://gitgud.io/atmk/libaero-qt
https://github.com/czyt1988/SARibbon
https://invent.kde.org/albert-tomanek/kolourpaint/-/tree/saribbon-aero
https://gitgud.io/atmk/libaero-qt
https://github.com/czyt1988/SARibbon
Mi segnalano che Lepida, una società gestita dalla regione Emilia-Romagna, continuerà ad offrire lo SPID gratuitamente (untill...?)
https://id.lepida.it
https://id.lepida.it
Caddy tip — per forzare correttamente il CORS senza che gli header si mescolino con quelli del backend, è necessario rispondere subito alla richiesta pre-flight.
@cors-preflight {
method OPTIONS
header Origin *
}
handle @cors-preflight {
header {
Access-Control-Allow-Origin *
Access-Control-Allow-Methods *
Access-Control-Allow-Headers *
Access-Control-Max-Age 86400
}
respond 204 # override backend CORS
}👍2
>i got banned from OpenAI for "Cyber Abuse"
︀︀>no idea what I did
︀︀>paste the ban notice into Codex
︀︀>ask it to figure out what triggered the ban
︀︀>Codex found that I asked it for an API key to my own server
︀︀>Codex writes appeal
︀︀>Codex submits appeal
︀︀>a few minutes later appeal auto-approved by some AI at OpenAI
︀︀
︀︀banned by AI, convicted by AI, defended by AI, and pardoned by AI in about 10 minutes
https://fixupx.com/endpointarena/status/2075245286339846145
🧵 Thread • FixupX
Michael (@endpointarena)
>i got banned from OpenAI for "Cyber Abuse"
>no idea what I did
>paste the ban notice into Codex
>ask it to figure out what triggered the ban
>Codex found that I asked it for an API key to my own server
>Codex writes appeal
>Codex submits appeal
>a few minutes…
>no idea what I did
>paste the ban notice into Codex
>ask it to figure out what triggered the ban
>Codex found that I asked it for an API key to my own server
>Codex writes appeal
>Codex submits appeal
>a few minutes…
😭2🤯1
journalctl -u micro
Mi segnalano che Lepida, una società gestita dalla regione Emilia-Romagna, continuerà ad offrire lo SPID gratuitamente (untill...?) https://id.lepida.it
Mi segnalano anche che con Lepida esiste uno script homebrew per ricavare il proprio TOTP da inserire nel vostro portachiavi
https://github.com/iecho8ae/lepidatotp
https://github.com/iecho8ae/lepidatotp
GitHub
GitHub - iecho8ae/lepidatotp
Contribute to iecho8ae/lepidatotp development by creating an account on GitHub.
❤1