Linuxiz
1.04K subscribers
881 photos
179 videos
12 files
1.08K links
اخبار لحظه ای و معرفی ابزار های کامپیوتری و برنامه نویسی

راه ارتباطی


@Javi368
Download Telegram
This media is not supported in your browser
VIEW IN TELEGRAM
یه مدل اوپن سورس و لوکال دیگه اومده که می‌گه Jev در برابر ما آشغالی بیش نیست!

اسمش laya-mlx هستش و توی ویدیو روی مک بوک ایر 16 گیگ ران شده. و فقط 1 گیگ رم مصرف می‌کنه.

github.com/mizorewww/laya-mlx

@Linuxiz
🔥2
مقایسه و بنچمارک بین مدل های تصمیم گیرنده
البته توی این مقایسه jev به عنوان رفرنس در نظر گرفته شده

huggingface.co/spaces/multimodalart/jev-decision-index


@Linuxiz
This media is not supported in your browser
VIEW IN TELEGRAM
یه نفر یه تم لیکویید گلس برای وب با React ساخته

تست آنلاین :
cruxgarden.github.io/plasma-ui

سورس کد :

github.com/CruxGarden/plasma-ui

@Linuxiz
❤1
دنبال یک موزیک پلیر آفلاین اندروید هستید که رابط کاربری خوبی داشته باشه؟
نیو پلیر یک پلیر با رابط کاربری شبیه به اسپاسیفای
کاملا آفلاین و استفاده از موزیک های دانلود شده
لود سریع و پشتیبانی از بیشتر قابلیت های اسپاسیفای
شخصی سازی تم و تنظیمات

- توجه این نسخه ی اولیه هست و ممکنه باگ داشته باشه

https://github.com/Realjustawall/neo-player

@Linuxiz
جالب ترین چیزی که امروز دیدم اینه، یه نفر یه رابط کاربری ساخته هرچیزی که توش تایپ می‌کنید براتون به صورت ui نشونش می‌ده پشت صحنه مدل هوش مصنوعی Jev هستش.

البته این نکته هم بگم سورس کدش رو دیدم چیز جدیدی خلق نمی‌شه همش از قبل ساخته شده و وظیفه Jev اینه که متنی که می‌نویسید رو با سرعت بالا به ui تبدیل کنه.

تست آنلاین:
shapeshiftui.vercel.app

سورس کد:

github.com/anishfn/shapeshift


@Linuxiz
👍1
برای اینکه دانش کلی Jev رو ببینم چطوره 122 سؤال کنکور تجربی 1405 رو دادم به اون و 5 مدل دیگه. مدل‌های بزرگ بهتر، کند‌تر و گرون‌تر هستن اما مهم برام مدل‌های کوچیک بود. مثلا از لونا 25 درصد بهتر عمل‌ کرد در حالی که 4.5 برابر ارزون‌تر و 3.7 برابر سریع‌تره. دیپ‌سیک و Qwen رو هم لوله کرد.

@Linuxiz
حیفم اومد این ابزار باحال رو بهتون معرفی نکنم

اگه دولوپر وب باشید، احتمالاً بیشتر از چیزی که فکر می‌کنید به FFmpeg نیاز پیدا می‌کنید.

یه ابزار خط فرمان (CLI) برای پردازش فایل‌های مدیاست؛ یعنی فقط برای تبدیل فرمت ویدئو نیست و کلی کار دیگه هم می‌تونید باهاش انجام بدید.

مثلاً:


تبدیل فرمت ویدئو و صدا
کم کردن حجم ویدئو
حذف صدا از ویدئو
استخراج فریم‌های ویدئو به‌عنوان تصویر
تبدیل گروهی تعداد زیادی فایل
تبدیل تصاویر به WebP و بهینه‌سازی حجمشون
تغییر ابعاد تصاویر به‌صورت batch
ساخت GIF یا ویدئو از مجموعه‌ای از تصاویر


اما قسمت جذاب‌ترش برای توسعه‌دهنده‌هاست:

فرض کنید ۵۰۰ تا تصویر دارید و می‌خواید همه‌شون با یک دستور به WebP تبدیل بشن، ابعاد مشخصی داشته باشن و داخل یک پوشه خروجی ذخیره بشن.

یا مثلاً یک ویدئوی ۲۰ ثانیه‌ای دارید و می‌خواید ازش برای یک انیمیشن اسکرولی، تعداد مشخصی فریم استخراج کنید.

لازم نیست یکی‌یکی با Photoshop یا ابزارهای آنلاین سر و کله بزنید؛
یک دستور می‌نویسید و می‌ذارید FFmpeg کار رو انجام بده.

و چون یک ابزار خط فرمانه، فقط محدود به ویندوز نیست؛ روی Linux و macOS هم قابل استفاده‌ست و حتی می‌تونید روی VPS و سرور، پردازش فایل‌ها رو بدون محیط گرافیکی انجام بدید.

برای پروژه‌های WordPress، Laravel و حتی اسکریپت‌های شخصی، وقتی پای پردازش تعداد زیادی فایل وسط باشه، این ابزار واقعاً کاربردیه.

اگر با مدیا سر و کار دارید، FFmpeg رو یه گوشه ذهنتون داشته باشید.
احتمالاً یه روزی به دردتون می‌خوره.

@Linuxiz
❤1👍1
آدرس سایتتون رو اینجا وارد کنید بهتون می‌گه چند درصد ساخته آشغال هوش مصنوعی یا AI Slop هستش

تکنیک کارش هم اینه هم عکس می‌گیره با مدل ویژن برسیش می‌کنه هم سوالاتی با Jev رو میپرسه همچنین با یه مرورگر هدلس سایتتون رو باز می‌کنه و المان هاشو برسی می‌کنه اگه چیز های کلیشه ای و تکراری ببینه می‌گه با AI ساخته شده:

madewithjev.com/free-tools/ai-slop-detector

@Linuxiz
تریدینگ‌ویو پرمیوم سالی 720 دلار هزینه داره، یه توسعه‌دهنده فرانسوی کتابخانه‌ای اوپن‌سورس داره که:
– قیمت لحظه‌ای و اندیکاتورها رو رایگان میده
– استراتژیها رو در چند دقیقه بکتست میکنه
– با اندیکاتورهای Invite-Only و Replay کار میکنه

github.com/Mathieu2301/TradingView-API

@Linuxiz
تو این سایت می‌تونید هم اپلیکیشن هایی که مردم به کمک Ai لانچ کردن رو ببینید و هم اپلیکیشن خودتون رو معرفی کنید:

https://vibecoders.ir/



حتما چک کنید. ایده های خوبی می‌شه ازش گرفت.

@Linuxiz
وقتی Server Action می‌سازید نکست واسش یه public endpoint در نظر می‌‌گیره که با POST قابل فراخوانیه و موقع استفاده هم از سمت کلاینت بهش رکوئست می‌ده. در نتیجه این endpoint خارج از فضای مرورگر هم قابل دسترس هست (مثل Postman)

حالا اگه یه server action دارید که عملیات حساسی انجام می‌ده، داخلش حتما Auth رو داشته باشید.

@Linuxiz
❤1
Media is too big
VIEW IN TELEGRAM
یه مدل جایگزین مدل معروف Jev اومده که می‌گه 9 برابر سریع تر استنتاج می‌کنه، در حالی که توی کارهایی مثل کار با کامپیوتر، گیمینگ و Tool Calling عملکردی در حد Jev داره.

اسمش CLM-8B هستش و ایده اصلیش اینه که به‌جای پردازش دوباره همه‌چیز، State و Action رو از هم جدا می‌کنه تا بتونه Embeddingهاشون رو جداگانه Cache کنه و دوباره استفاده کنه. این یعنی وقتی محیط مدام تغییر می‌کنه ولی Actionهای ممکن ثابت می‌مونن، کلی محاسبه اضافه حذف می‌شه.

جالب‌تر اینکه با یه Fine-tuning سبک، روی بنچمارک‌های سخت Agentic Coding به 81.6% توی DeepSWE و 87.6% توی Terminal-Bench 2.1 رسیده و ادعای SOTA داده. یعنی فقط بحث سرعت نیست و برای Coding Agentهای چندمرحله‌ای هم عملکرد جدی‌ای داره.

تیم سازنده در نهایت Scaling Lawهای CLM رو هم بررسی کرده و نشون داده Contrastive Loss با افزایش Compute، اندازه مدل و اندازه دیتاست، به شکل قابل‌پیش‌بینی کاهش پیدا می‌کنه. خلاصه اینکه ایده اصلی CLM اینه: State و Action رو از هم جدا کن، Cache کن و با هزینه خیلی کمتر و سرعت بالاتر تصمیم بگیر:
github.com/Contrastive-LM/CLM

@Linuxiz
This media is not supported in your browser
VIEW IN TELEGRAM
اوففف انویدیا هاگینگ فیس رو خریده داره چیکار می‌کنه! یه مدل داده بیرون 8 نفرم که همزمان صحبت می‌کنن می‌تونه بفهمه! و فقط 100 میلیون پارامتر داره اسمش Nemotron 3 Diarization هستش


تست آنلاین:
huggingface.co/spaces/nvidia/nemotron-diarization

توضیحاتش:
huggingface.co/blog/nvidia/nemotron-diarization

@Linuxiz
Media is too big
VIEW IN TELEGRAM
ورژن جدید رتبه بندی مدل های تصمیم گیر مثل Jev منتشر شده!

ورژن قبلی که اینجا توی کانال منتشر شد کمی دقیق نبود حالا پارامتر های دقیق تری بهش اضافه شده، همچنین مدل AutoJev-27B که مربوط به Perplexity و CTO اون، Denis Yarats، هستش، بین مدل‌های اوپن ویت فعلا بالاترین جایگاه رو گرفته، ولی هنوز 0.8 امتیاز از مدل Jev عقب‌تره.

huggingface.co/spaces/multimodalart/jev-decision-index


@Linuxiz
This media is not supported in your browser
VIEW IN TELEGRAM
اگه خواستید سریع یه لوگو یا آیکون یا فونت بسازید برید توی این سایت خروجی png یا svg و ... هم می‌تونید ازش بگیرید:

etienne.design/tools/inbetween


@Linuxiz
❤1
آرک‌جت یه پلتفرم امنیتی واسه اپلیکیشن‌هاست که به صورت SDK وارد کد بک‌اند‌تون می‌شه و روی Api / اکشن‌ها Security Policy اعمال می‌کنه:

https://arcjet.com/

از مهم‌ترین قابلیت‌هاش میشه به Bot Detection, Rate Limiting, Shield / WAF, SignUp Protection, Email Validation و … اشاره کرد.

@Linuxiz
یه نفر با three.js و هوش مصنوعی بازی سایبرپانک رو ساخته! همچنین توی سورس کدش تمام بخش‌های مهم پروژه رو مستند کرده و برای ایجنت‌های هوش مصنوعی هم دستورالعمل‌های مشخصی شامل بایدها و نبایدها (Do's & Don'ts) آماده کرده تا بتونید خودتون از روش یاد بگیرید.

تست آنلاین (دقت کنید حتما مرورگرتون به کارت گرافیکتون دسترسی داشته باشه):

threejspunk.vercel.app

سورس کد:
github.com/ektogamat/threejs-conference

@Linuxiz
❤2
️ گوگل دو تا مدل هوش مصنوعی جدید به اسم Gemini 3.8 Flash TTS و Flash-Lite TTS برای تبدیل متن به صدا معرفی کرده که رسماً تولید صدا رو وارد یه مرحله جدید می‌کنه.

دیگه خبری از صداهای بی‌روح و پیش‌فرض نیست؛ حالا می‌تونی با توضیحات متنی ساده، صدای کاملاً اختصاصی بسازی، لحن، لهجه، سرعت و حتی احساسات گوینده رو خط‌به‌خط کارگردانی کنی.

این مدل‌ها حتی می‌تونن صداهای طبیعی مثل خنده، آه کشیدن، یا پچ‌پچ کردن رو ادا کنن و مکالمه بین دو نفر رو بدون افت کیفیت در فایل‌های طولانی تولید کنن. برای حفظ امنیت هم تمامی خروجی‌ها با واترمارک SynthID مشخص می‌شن.

@Linuxiz
👏2👍1
اگه با LLMها کار کرده باشی، احتمالاً با این مشکل برخوردی از مدل می‌خوای یه JSON مشخص برگردونه، ولی مدل ممکنه ساختار رو خراب کنه یا مقداری خارج از چیزی که خواستی بده. TypeLLM اومده این مشکل رو از ریشه حل کنه؛ به‌جای اینکه فقط خروجی رو بعداً validate کنه، موقع تولید جواب، فضای انتخاب مدل رو محدود می‌کنه.

مثلاً اگه بگی مقدار type فقط می‌تونه billing ،technical یا account باشه، مدل عملاً فقط اجازه داره یکی از همین گزینه‌ها رو انتخاب کنه. یعنی به‌جای اینکه مدل آزادانه متن تولید کنه و بعد امیدوار باشیم JSON درست باشه، decoding از همون اول با schema هماهنگ می‌شه.

جالب‌تر اینکه TypeLLM برای این کار از constrained decoding و token probabilities استفاده می‌کنه و کنار SGLang و مدل‌های open-source اجرا می‌شه. حتی می‌تونه بخش reasoning رو آزاد بذاره و فقط موقع تولید جواب نهایی، محدودیت schema رو اعمال کنه؛ یعنی thinking آزاد، خروجی نهایی type-safe.

github.com/TypeLLM/TypeLLM


@Linuxiz
پرداخت اینترنتی توی ایران و کشور های همسایه از چه سالی شروع شد؟

البته این جدول یه نکاتی داره مثلا عربسان قبل 2018 هم پرداخت اینترنتی داشت و فقط یکپارچه نبود و کارت های محدودی ساپورتش می‌کردن و همچنین ویزا و مستر کارت هم وجود داشت که بین المللیه.

@Linuxiz
❤1
This media is not supported in your browser
VIEW IN TELEGRAM
هوش مصنوعی پزشکی داره همچنان بی سروصدا پیشرفت می‌کنه حالا می‌تونی استخوان‌ها رو از عکس رادیولوژی قفسه سینه حذف کنی

شرکت Qure AI مدلی منتشر کرده که تصویر رادیوگرافی رو به بافت نرم، استخوان و ریه‌ها تفکیک می‌کنه؛ در نتیجه دنده‌ها دیگه چیزی رو که پشتشون قرار گرفته پنهان نمی‌کنن

تست آنلاین :

huggingface.co/spaces/hugging-apps/bone-suppression-chest-xray

@Linuxiz