Linuxor ?
31.7K subscribers
1.89K photos
512 videos
12 files
1.67K links
اخبار لحظه ای تکنولوژی و معرفی ابزار های کامپیوتری و برنامه نویسی!

ارتباطات و تبلیغات :
@LinuxorContact
Download Telegram
This media is not supported in your browser
VIEW IN TELEGRAM
ایده خلاقانه تاریخ‌زن برای فاکتورها. تاریخ رو روی مهر تنظیم کن، دکمه رو فشار بده تا تاریخ روی صفحه چاپ بشه (با صدا ببینید):

feralui.dev/stamp


@Linuxor
This media is not supported in your browser
VIEW IN TELEGRAM
یه ایجنت کدنویسی به اسم Pi که کاملاً داخل مرورگرت اجرا میشه و برای اجرا از یه مدل 2B روی WebGPU استفاده می‌کنه

این پروژه از MiniCPM5-2B + Pi ساخته شده و قدرتش رو از ترکیب Transformers.js + WebGPU + وزن‌های ONNX چهار‌بیتی (4-bit) می‌گیره.

تمام تلاش‌های قبلی برای ساخت همچین چیزی شکست خورده بودن، ولی به نظر میاد MiniCPM5 بالاخره باعث شده این ایده واقعاً قابل استفاده بشه.

همین الان روی Hugging Face در دسترسه:

huggingface.co/spaces/victor/MiniCPM5-2B-WebGPU-Pi

@Linuxor
اگه بچه مایه دارید و کارت گرافیک 5070 یا 4080 دارید این پروژه رو حتما ذخیره کن یه نصب‌کننده اختصاصی و راه‌انداز آماده برای اجرای Qwen3.8-27B روی کارت‌های NVIDIA معمولی هستش هم بهتون لوکال چت می‌ده هم API برای استفاده توی بقیه برنامه ها

کاربرا روی 5070ti تونستن تا 100 توکن بر ثانیه بگیرن
البته اگه مایه دار نیستی و قشر متوسط به بالایی و 4060 داری تا 15 توکن بر ثانیه خروجی می‌تونی بگیری که بد نیست

github.com/MiaAI-Lab/Qwen3.8-27B-16gb-NVIDIA-GPUs-one-click-install


@Linuxor
گویا دعوای OpenAi با ایلان ماسک بالا کشیده و ایلان ماسک دسترسی چت جی پی تی رو به توییتر قطع کرده (عکس سفید چت جی پی تی که دسترسی به توییتر نداره و عکس سیاه جمنای که دسترسی به توییتر داره)

این دعوا بخاطر این بود که OpenAi گفت آقا خوشم از ایلان ماسک (مالک cursor) نمیاد و حتی قرارداد های cursor هم خاتمه داد.

قبل تر ایلان ماسک با سم التمن (مدیر عامل OpenAi) مستقیما وارد درگیری لفظی شده بودن.


@Linuxor
Media is too big
VIEW IN TELEGRAM
یه نفر به DeepSeek یه ساب‌ایجنت از Astra داد (یعنی یه ایجنت فرعی که توسط ایجنت اصلی برای انجام بخشی از کار استفاده می‌شه). بعد به Astra هم یه ساب‌ایجنت از DeepSeek داد (یعنی DeepSeek به‌عنوان ایجنت فرعی، زیر نظر Astra کار می‌کرد) نتایج رو ببنینید چه تفاوتی داره:

DeepSeek + Astra:
alesha-pro.github.io/bench-portal/games/kart-deepseek-astra

Astra + DeepSeek:
alesha-pro.github.io/bench-portal/games/kart-astra-deepseek

Astra solo:
alesha-pro.github.io/bench-portal/games/kart-astra-solo

DeepSeek solo:
alesha-pro.github.io/bench-portal/games/kart-deepseek-solo


@Linuxor
2
یکی از عجیب ترین چیز هایی که دیدم اینه وقتی به جمنای یه کار طولانی میدی وسطش اینترنتت قطع می‌شه اونم قطع می‌شه انگار داره روی سیستم تو کارو انجام میده!

@Linuxor
This media is not supported in your browser
VIEW IN TELEGRAM
قشنگ ترین چیزی که امروز دیدم اینه، می‌دونیم مدل QWEN 27B نسبتا کوچیکه و قوی حالا یه عده اومدن این مدل کوچیک رو انداختن روی یه کلاستر مجموعه ای از کارت گرافیک ها و نتیجه شده 2000 توکن بر ثانیه که سرعت فوق العاده بالاییه.

حالا این سرعت به چه دردی می‌خوره؟ باهاش می‌شه به صورت زنده هرچیزی که می‌خوای رو بسازی ویدیوی بالا رو ببنید کل اینترنت در لحظه ساخته می‌شه و هرچی بخواید از جمله گوگل براتون ساخته می‌شه دقت کنید اون سایت گوگل و یوتیوب واقعی نیست در لحظه هوش مصنوعی با درخواستتون براتون می‌سازتش!


@Linuxor
This media is not supported in your browser
VIEW IN TELEGRAM
گوگل همین چند روز پیش یه ابزار رو متن‌باز کرده که می‌تونه هر کاری رو روی موبایل به‌صورت خودکار انجام بده. آرتمیس پرامپت‌ها رو تبدیل می‌کنه به فرایندهای خودکار.

ایده‌ش ساده‌ست به‌جای اینکه برای هر کاری کلی اسکریپت و selector بنویسی، به AI می‌گی چه کاری انجام بده و Agent خودش محیط اندروید رو می‌بینه، روی عناصر UI کلیک می‌کنه، متن وارد می‌کنه، Swipe می‌کنه و بین مراحل مختلف جلو می‌ر

با Codex، Claude Code و Antigravity یکپارچه میشه
ورک‌فلوها رو به‌صورت خودکار اجرا می‌کنه و لاگ‌ها رو هم ثبت می‌کنه

github.com/google/artemis

@Linuxor
This media is not supported in your browser
VIEW IN TELEGRAM
دیدین این منوها چقدر می‌رن رو مخ و هی بسته می‌شن. بخاطر اینه که safe polygon ندارن. UI لایبرری‌ها معمولا این رو دارن و شما لازم نیست کاری بکنین. ولی اگر دیدین هی بسته می‌شه بدونین مشکل کجاست و بگید ایجنت فیکس کنه.

@Linuxor ~ craftWithPooria
This media is not supported in your browser
VIEW IN TELEGRAM
مدل GPT-6 Astra می‌تونه بعضی از واقعاً پیچیده‌ترین مسائل مربوط به محدودیت‌های فضایی رو حل کنه؛ از باز کردن قطعاتی که به هم قفل شدن گرفته تا رد کردن یک طناب از داخل 3 حلقه.

qinengwang-aiden.github.io/demos/constraint_demos


@Linuxor
خیلیا وقتی پستی چیزی از AI می‌بینن یا کسی میاد میگه توی دو ساعت فلان چیزو ساختم احساس عقب موندگی می‌کنن.
ولی واقعیتش ساختن چیزها با خلق کردن ارزش خیلی متفاوته.

هوش مصنوعی فقط هزینه و زمان ساختن رو پایین آورده؛ به این معنی نیست که ارزش چیزهایی که ساخته میشن بالاست اتفاقا باید بجای انقلاب انتظار اینو داشته باشید در آینده با مجموعه ای از آشغال های ساخته شده با هوش مصنوعی مواجه می‌شید قبل از AI که آشغال ساختن کار سختی بود گیتهاب 400 میلیون تا ریپو داشت که 99.99 درصدش آشغال بودن و هیچ کاربردی نداشتن و ارزش خاصی تولید نمیکردن با اینکه کلی زحمت پای هرکدومش بود. حالا مقایسش کنید با الانی که یارو دو ساعته یه چیز می‌سازه...


@Linuxor
This media is not supported in your browser
VIEW IN TELEGRAM
یه یادآوری دوستانه: می‌تونی بیشتر از 500 مدل متن‌باز رو به‌صورت رایگان توی Google Colab فاین‌تیون کنی.

حتی می‌تونی فایل‌های PDF یا CSV رو هم آپلود کنی و ازشون دیتاست‌های مصنوعی (Synthetic Dataset) قابل استفاده بسازی.

colab.research.google.com/github/unslothai/unsloth/blob/main/studio/Unsloth_Studio_Colab.ipynb


خود تیم Unsloth توی GitHub گفته که:

امکان فاین‌تیون کردن 500+ مدل رو داره.
روی Google Colab قابل اجرا هستش.
می‌تونه از فایل‌هایی مثل PDF، CSV و JSON/DOCX دیتاست بسازه.
این دیتاست‌ها می‌تونن به شکل synthetic dataset تولید بشن.
مدل فاین‌تیون‌شده رو می‌تونی به فرمت‌هایی مثل GGUF و Safetensors خروجی بگیری.

حتی Hugging Face هم در مستندات خودش برای فاین‌تیون Gemma 4 به Unsloth Studio اشاره کرده و مشخصاً گفته که Unsloth Studio روی Google Colab هم اجرا می‌شه.

@Linuxor
Media is too big
VIEW IN TELEGRAM
چطور یه مدل 35B رو روی RTX 3060 با 12GB VRAM اجرا کنیم؟

با ترکیب Q4_K_M + MoE CPU offloading میشه مدل Qwen3.8-35B-A3B رو روی یه RTX 3060 اجرا کرد.

کل 262K کانتکست رو هم استفاده می‌کنه. سرعت decode حدود 50 توکن بر ثانیه هستش و سرعت prefill حدود 550 توکن بر ثانیه.

کانفیگ:
llama-server
-m Qwen3.8-35B-A3B-Q4_K_M.gguf
-ngl 99 --n-cpu-moe 26 -c 262144 -fa on --jinja
-np 1
--cache-type-k q8_0 --cache-type-v q8_0
--temp 0.6 --top-p 0.95 --top-k 20
--reasoning on


@Linuxor
This media is not supported in your browser
VIEW IN TELEGRAM
یه چیزی که توجه همه رو جلب کرده قدرت بالای GPT-6-Astra توی درک سه بعدی هستش اون هم بدون آموزش اختصاصی برای هر کار (Zero-shot) از چرخوندن حرفه ای خودکار توی دست تا حل کردن روبیک و معما های سه بعدی.

سورس کد :

github.com/jianglongye/dexterous-astra

@Linuxor
1
This media is not supported in your browser
VIEW IN TELEGRAM
نمایی از اجرای Qwen 3.8 Flash Next روی Macbook M5 24 GB. حالت Thinking خاموشه مقدار 2K پنجره کانتکست و حدود 4 توکن بر ثانیه خروجی.

البته کاربران که استفاده کردن گفتن با این پرفومنس این مدل عملاً روی این لپ تاپ قابل استفاده نیست، مخصوصاً توی مرحله‌ی prefilling. اگه کانتکست رو بزرگ‌تر کنی، پردازشش ساعت‌ها طول می‌کشه.

@Linuxor
یه آزمون خیلی ساده برای اینکه بفهمید توی شرکت بهتون بیش از حد فشار میاد یا نه

کافیه به یک ماه گذشته خودتون نگاه کنید میانگین ببینید چقدر بعد از تایم کاری که اومدید خونه تونستید چیزی خلق کنید البته منظور از خلق یه چیز بزرگ نیستا هر چیز کوچیکی و اختیاری ای هم حسابه؛ اگه چیزی خلق نکردید بازم نشونه منفی ای نیست ولی اگه به سمت چیز های اعتیاد آور مثل بعضی گیم ها یا شبکه های اجتماعی مثل اینستاگرام رفتید و تا آخر شب توش بودید یعنی عملا مغزتون زیاد کار کرده و بدهی داره.

@Linuxor
دوستان اگر ارور های تحریم آنتی گراویتی اذیتتون میکنه (که علت عمدش هم بخاطر VPN هستش) از این آنتی گراویتی ترمینالی استفاده کنید

مثل اینکه آنتی گراویتی گرافیکی کش داره و اگه یه بار با اینترنت خراب برید دفعه های بعدی اگر حتی VPN خوب هم بزنید ممکنه بخاطر کش قبلی گیر بده بهتون؛ البته یه دلیل دیگه هم که حدس میزنم اینه سیستمش به صورت استاندارد از اینترنت استفاده نمیکنه (مثل گوگل کروم) و این باعث میشه VPN نتونه پوشش کامل بدتش و بعضی از اطلاعات حتی وقتی وی پی ان روشن باشه هم از پشت VPN رد نشه و مستقیم رد بشه.


خیلی برای من پیش اومده آنتی گراویتی ترمینالی کار میکرده اما آنتی گراویتی گرافیکی کار نمیکرده :

antigravity.google/product/antigravity-cli


@Linuxor
به نظر من سی پیو های AMD خیلی از اینتل بهترن، می‌تونی درش بیاری سرتو باهاش بخارونی خیلی حال میده، تازه اگه سیستم تازه خاموش شده باشه میتونی به عنوان اتو مو هم ازش استفاده کنی.


@Linuxor
This media is not supported in your browser
VIEW IN TELEGRAM
شرکت تازه‌تأسیس کاکتوس از Needle 3 رونمایی کرده؛ یه مدل بنیادی برای اتوماسیون که حجمش بین 8 تا 29 مگابایت هستش و می‌تونه با DeepSeek V4 Flash توی یه کار خاص رقابت کنه.

این مدل فقط از یک مجموعه وزن weights استفاده می‌کنه، اما با عمق‌های مختلف از 2 تا 20 لایه، هر عمق عملاً یه مدل مستقل محسوب میشه. یکی از نکات جالبش اینه که Needle می‌تونه به‌صورت کاملاً محلی روی Raspberry Pi 5 اجرا بشه و به سرعت تا 4,000 توکن در ثانیه برسه.

اساساً برای چت کردن ساخته نشده. هر تعامل باهاش به شکل یه function call انجام میشه؛ یعنی ابزارهایی که اپلیکیشن در اختیارش میذاره به مدل داده میشن و Needle بر اساس چیزی که کاربر گفته، ابزار مناسب رو انتخاب می‌کنه و تمام آرگومان‌های موردنیازش رو هم پر می‌کنه.

اگه کاربر چیزی بخواد که هیچ‌کدوم از ابزارهای موجود نتونن انجامش بدن، Needle به‌جای حدس زدن، یه لیست خالی برمی‌گردونه. همچنین برای اجرا روی دستگاه‌های مختلف طراحی شده؛ از موبایل‌ها و گجت‌های پوشیدنی گرفته تا دستگاه‌های خانه هوشمند، ربات‌های کوچیک و میکروکنترلرها:

huggingface.co/Cactus-Compute/needle3

@Linuxor
This media is not supported in your browser
VIEW IN TELEGRAM
این روش هم برای دیدن دیاگرام پروژه های روی گیتهابه یه دید خوبی بهتون درباره پروژه و ریپازیتوری میده.

@Linuxor