Linuxor ?
31.7K subscribers
1.88K photos
503 videos
12 files
1.65K links
اخبار لحظه ای تکنولوژی و معرفی ابزار های کامپیوتری و برنامه نویسی!

ارتباطات و تبلیغات :
@LinuxorContact
Download Telegram
This media is not supported in your browser
VIEW IN TELEGRAM
این یه ابزار بسیار سریع برای فهمیدن ساختار اسناده که با Jev کار می‌کنه؛ می‌تونه تشخیص بده هر بخش از یه فایل چه نوع سندیه و حتی وقتی چند سند پشت سر هم داخل یه PDF هستن.

مثلاً یه PDF داری که داخلش چندین Invoice، قرارداد و Purchase Order اسکن شده. DocJev می‌تونه تشخیص بده هر کدوم از کجا شروع و کجا تموم میشه و در نهایت اون‌ها رو از هم جدا کنه.

برای Document Processing، اتوماسیون حسابداری، پردازش Invoice و ساخت pipelineهای هوشمند برای اسناد، پروژه جالبیه بنچمارک هاشم هست:

github.com/jerryjliu/docjev

@Linuxor
پروژه freebuff.com روکه میشناسید میتونید رایگان از مدلایی که میده استفاده کنید شعارشه
یکی اومده api رو ریورس کرده تا بشه توی هارنس‌های دیگه هم استفاده کرد!

github.com/trefeon/freebucks-proxy


@Linuxor ~ maanimis
یه نکته اخلاقی که میشه از LLM ها و Jev برای زندگی برداشت کرد اینه که حرف زدن بی‌جا هزینه داره و کنتور می‌اندازه و باید پول بیشتری بدی؛


@Linuxor
This media is not supported in your browser
VIEW IN TELEGRAM
یه مدل جدید از Viggle روی Hugging Face منتشر شده که برای تولید و ادیت تصویر ساخته شده: Qwen-Image-2.1 Viggle Turbo که 6 برابر از مدل اصلی سریع تره!

این نسخه با تکنیک distillation از مدل اصلی Qwen-Image-2.1، تعداد مراحل تولید رو از حدود 40 step به فقط 4 step رسونده. یعنی هدفش اینه که خروجی‌های مدل رو با محاسبات خیلی کمتر و سرعت بالاتر تولید کنه، تست آنلاین:

huggingface.co/spaces/Viggle/Qwen-Image-2.1-viggle-turbo


@Linuxor
برای اینکه دانش کلی Jev رو ببینم چطوره 122 سؤال کنکور تجربی 1405 رو دادم به اون و 5 مدل دیگه. مدل‌های بزرگ بهتر، کند‌تر و گرون‌تر هستن اما مهم برام مدل‌های کوچیک بود. مثلا از لونا 25 درصد بهتر عمل‌ کرد در حالی که 4.5 برابر ارزون‌تر و 3.7 برابر سریع‌تره. دیپ‌سیک و Qwen رو هم لوله کرد.

@Linuxor ~ VForMhrlife
آدرس سایتتون رو اینجا وارد کنید بهتون می‌گه چند درصد ساخته آشغال هوش مصنوعی یا AI Slop هستش

تکنیک کارش هم اینه هم عکس می‌گیره با مدل ویژن بررسیش می‌کنه هم سوالاتی با Jev رو میپرسه همچنین با یه مرورگر هدلس سایتتون رو باز می‌کنه و المان هاشو برسی می‌کنه اگه چیز های کلیشه ای و تکراری ببینه می‌گه با AI ساخته شده:

madewithjev.com/free-tools/ai-slop-detector

@Linuxor
Media is too big
VIEW IN TELEGRAM
دیوونه‌کننده‌ست! یه نفر از Opus 5.5 خواسته براش یه انیمیشن پیکسل‌آرت از فرایند آموزش یه شبکه عصبی بسازه. نتیجه جالب شده!


@Linuxor
اینجا اومدن و تمام چیز هایی که با Jev ساخته شده و اوپن سورسه رو جمع آوری کردن از روتینگ بگیر تا لیبل زنی و کلسیفیکیشن و ترید

github.com/v-modal/awesome-jev-tools

@Linuxor
بعضیا میگن کانال جدیدا چقدر شده Jev Jev خب معلومه دیگه جِو گیر شدم دیگه...

@Linuxor
1
Media is too big
VIEW IN TELEGRAM
مدل Opus 5.5 واقعاً یه لول دیگه‌ست.

یه نفر یه صحنه قابل‌بازی از یه قایق ساخته که توی مناظر ژاپنی جریان داره؛ با آب‌وهوای پویا، نورپردازی روز و شب، تکسچرهای واقع‌گرایانه و کاراکترهای 3D.

سایت رو هم می‌تونید به‌صورت زنده ببینید:
valley.mengto.here.now

انعکاس‌های آب، فیزیک، مناظر و معماری واقعاً دیوونه‌کننده‌ان. اگه توی مرورگرتون بد نشون داده می‌شه ویدیو رو ببینید احتمالا کارت گرافیکتون فعال نیست.

@Linuxor
تریدینگ‌ویو پرمیوم سالی 720 دلار هزینه داره، یه توسعه‌دهنده فرانسوی کتابخانه‌ای اوپن‌سورس داره که:
– قیمت لحظه‌ای و اندیکاتورها رو رایگان میده
– استراتژیها رو در چند دقیقه بکتست میکنه
– با اندیکاتورهای Invite-Only و Replay کار میکنه

github.com/Mathieu2301/TradingView-API

@Linuxor ~ Algotrade24
1
Media is too big
VIEW IN TELEGRAM
یه نفر اومده توی بازی کلش رویال دوتا مدل تصمیم گیر لوکال Laya و آنلاین Jev رو به جون هم انداخته، هر دو از Qwen (از طریق Cerebras) برای تشخیص و درک میدان نبرد استفاده می‌کنن و برای خوندن کارت‌ها و مقدار اکسیر هم از OpenCV استفاده می‌کنن. بعد از اون، Jev و Laya تصمیم می‌گیرن چه کارتی رو بازی کنن و کجا قرارش بدن. این تصمیم‌ها در نهایت به لمس کردن صفحه داخل بازی تبدیل میشن.

نتیجه جالب شد در حد هم بازی کردن ولی Laya بازی رو برد.


@Linuxor
Linuxor ?
من اگه راننده تاکسی بشم 11: میدونیییییی؟ هوش مصنوعی یه زخمی به هر حوزه ای زده ولی فعلا حوزه خاصی رو نکشته مثلا کسایی که توی صنعت کلیپ سازی هستن فکر میکنن حوزشون نابود شده ولی من چندین بار با هوش مصنوعی خواستم یه کلیپ تمیز بسازم نشده، چون یه ریزه کاری هایی…
من اگه راننده تاکسی بشم 12:

میدونیییییی؟ اینکه می‌گن هوش مصنوعی جای میمون (ما انسان ها) رو میگیره همش مسخره بازیه، این میمون از دیر باز توی طبیعت موجود زبر و زرنگی بوده مثلا گزارش اخیر اوبر اومدن برنامه نویسارو تشویق کردن که از کلاد استفاده کنن تا پیشرفت شرکت بره بالا ولی به اون طرف قضیه نگاه نکردن هر مهندس ماهی بیش از 2000 دلار هزینه AI انداخته بود گردن شرکت و ساده ترین کارهارو داده بود به AI انجام بده و جالب اینجا بود حتی نتیجه مفید رضایت بخشی هم در نهایت تولید نشده بود خلاصه اوبر مجبور شد سقف 1500 دلار تعیین کنه. AI هنوز نمیتونه اونجوری که باید ارزش تولید کنه؛ بخداااا


@Linuxor
یکی اومده می‌گه یه عده فریلنسر (فحش) (فحش) (فحش) دارن با قیمت پایین کار میکنن و ما هم مجبوریم با قیمت پایین کار کنیم چیکار کنیم؟

بهش توضیح هم دادم که با حرف من هیچ تغییری توی مزنه رخ نمیده، بازار فریلنسری رو مثل یه دفتر سفارش بزرگ در نظر بگیرید که قیمتش تقریبا از عرضه و تقاضا ساخته می‌شه البته کمی روند قیمت گذاریش با روند قیمت گذاری بیت کوین یا دلار فرق داره. من که به عنوان رسانه دار نمیتونم بگم فلان قیمت کار کنید چون دخالت توی بازاره ولی قانونش رو می‌گم : تو و رفیقات اگه واقعا دلتون میخواد مزنه و قیمت بالا بره هیچ سفارشی چه ارزون و چه گرون رو نباید قبول کنین! حالا چرا گرون هارو قبول نکنین، اونا که خوبن؟ جوابش خیلی سادس چون اون سفارشا علاوه بر اینکه فشار تقاضا ایجاد میکنن و باعث می‌شن آدم هایی که ارزون کار میکنن برن سراغشون سرشون شلوغ تر بشه و کار ارزون قبول نکنن؛ همچنین این سفارشا مثل یه پرچم سبز هستن که این سیگنال رو به همه میدن ببینید قیمتا رفته بالا ها!

البته اینم بگم که حجم زیادی هم نظر باید داشته باشید تنهایی نمیتونید مزنه یه مارکت به این بزرگی رو تغییر بدید.

@Linuxor
Media is too big
VIEW IN TELEGRAM
تا حالا کنجکاو شدین ببینین $1874.40 توکن Opus 5.5 چه شکلیه؟

شدیداً پیشنهاد می‌کنم کل ویدیو رو با کیفیت آخر و روی یه صفحه‌نمایش بزرگ و با صدای روشن ببینین. به همه‌ی جزئیات ریزش دقت کنین:
- پرنده‌هایی که دارن پرواز می‌کنن و توی اقیانوس شیرجه می‌زنن.
- پارچه‌ها، تابلوها و چراغ‌هایی که توی باد تکون می‌خورن.
- خرچنگ‌هایی که کنار ساحل این‌ور اون‌ور می‌رن و وقتی نزدیکشون می‌شین، خودشون رو زیر شن‌ها یا زمین پنهان می‌کنن.
- ماهی‌هایی که در کنار نهنگ شنا می‌کنن.
- چراغ‌هایی که شب اسکله رو روشن می‌کنن.
بعد دوربین رو زوم‌اوت کنین تا کل جزیره رو ببینین.
ویدیو با رزولوشن 1440p اجرا میشه و هیچ‌وقت FPS از 60 پایین نمیاد.


تست آنلاین:
dgreenheck.github.io/tidewater

سورس کد:
github.com/dgreenheck/tidewater


@Linuxor
This media is not supported in your browser
VIEW IN TELEGRAM
یه مدل جایگزین مدل معروف Jev اومده که می‌گه 9 برابر سریع تر استنتاج می‌کنه، در حالی که توی کارهایی مثل کار با کامپیوتر، گیمینگ و Tool Calling عملکردی در حد Jev داره.

اسمش CLM-8B هستش و ایده اصلیش اینه که به‌جای پردازش دوباره همه‌چیز، State و Action رو از هم جدا می‌کنه تا بتونه Embeddingهاشون رو جداگانه Cache کنه و دوباره استفاده کنه. این یعنی وقتی محیط مدام تغییر می‌کنه ولی Actionهای ممکن ثابت می‌مونن، کلی محاسبه اضافه حذف می‌شه.

جالب‌تر اینکه با یه Fine-tuning سبک، روی بنچمارک‌های سخت Agentic Coding به 81.6% توی DeepSWE و 87.6% توی Terminal-Bench 2.1 رسیده و ادعای SOTA داده. یعنی فقط بحث سرعت نیست و برای Coding Agentهای چندمرحله‌ای هم عملکرد جدی‌ای داره.

تیم سازنده در نهایت Scaling Lawهای CLM رو هم بررسی کرده و نشون داده Contrastive Loss با افزایش Compute، اندازه مدل و اندازه دیتاست، به شکل قابل‌پیش‌بینی کاهش پیدا می‌کنه. خلاصه اینکه ایده اصلی CLM اینه: State و Action رو از هم جدا کن، Cache کن و با هزینه خیلی کمتر و سرعت بالاتر تصمیم بگیر:
github.com/Contrastive-LM/CLM

@Linuxor
همیشه می‌بینم می‌گن آقا برای پیشرفت توی کاراتون منتور بگیرید، من خودم نمی‌دونم چرا اصلا با کلمه منتور حال نمی‌کنم تابحال هم کسی توی زندگیم نگفته فلان کارو کن از قضا مسیر های اشتباه زیادی هم رفتم و هزینه های زیادی هم دادم...

حتی الانم برگردم عقب هم منتور نمی‌گیرم البته اون موقع پول نداشتم ولی الان که دارم هم نمی‌گیرم چون حس میکنم انسان اصلا بدون اشتباهات هزینه دار رشد نمی‌کنه چه بسا اصلا من توی اون دوران قدیم هم کلی مردم رندوم راهنماییم کردن اونا هم یه جور منتور های رایگان بودن دیگه ولی اون موقع توی کتم نرفته بهشون گوش بدم دقیقا مثل اون بچه ای که بهش می‌گی درس بخون نمی‌خونه؛ به نظرم آدمی زاد خیلی احمق تر از اون حرفاست که بخواد با حرف های بقیه چیزی توی کلش بره شاید وانمود کنه به حرف ها گوش می‌ده ولی تا هزینه نده فکر نمیکنم بهش عمل کنه😁

@Linuxor
10
This media is not supported in your browser
VIEW IN TELEGRAM
اوففف انویدیا هاگینگ فیس رو خریده داره چیکار می‌کنه! یه مدل داده بیرون 8 نفرم که همزمان صحبت می‌کنن می‌تونه بفهمه و مجزا هرکدوم رو تبدیل به متن کنه! و فقط 100 میلیون پارامتر داره اسمش Nemotron 3 Diarization هستش


تست آنلاین:
huggingface.co/spaces/nvidia/nemotron-diarization

توضیحاتش:
huggingface.co/blog/nvidia/nemotron-diarization

@Linuxor
Media is too big
VIEW IN TELEGRAM
یه نفر یه پروژه جالب منتشر کرده که می‌تونه هر وب‌کم رو تبدیل کنه به چندتا تشخیص‌دهنده‌ی زنده‌ی AI؛ از تشخیص احساسات و شمارش گرفته تا تشخیص اشیا، اونم با اجرای کاملاً لوکال روی دستگاه.


سرعتش بالاست، روی Apple M5، اجرای PyTorch/MPS با FP16 حدود 210ms و اجرای MLX با 8-bit حدود 160ms در p50 تأخیر داشته؛ یعنی برای پردازش زنده‌ی تصویر، به سرعت قابل توجهی رسیده.

توی بنچمارک کنترل‌شده‌ی 9 سؤالی هم latency از 358.5ms به 259.6ms رسیده؛ یعنی 27.6٪ کاهش تأخیر. جالب‌تر اینکه هر 84 تصمیم از 84 تصمیم بین روش‌های مقایسه‌شده با هم match شدن.

علاوه بر کد کلی از تجربه ارزشمندش هم نوشته:

github.com/yoheinakajima/glance-speedlab

@Linuxor
Media is too big
VIEW IN TELEGRAM
یه نفر با Opus 5.5 و کتابخونه three.js بازی اسپایدرمن ساخته این بازی رو اگه چند سال پیش یه نفر می‌ساخت و توی یه استور گیمر ها برای فروش می‌ذاشت میلیون ها دلار درآمد داشت.

البته کسی که اینو ساخته (xikhar) اینطوری نبوده که به هوش مصنوعی بگه برو برام فلان بازی رو بساز و هوش مصنوعی هم بسازتش! طرف برنامه نویس هستش و سال ها تجربه داره و یه ضرب هم ساخته نشده و به مرور با توسعه و دیباگ ساخته شده پس حتی قوی ترین مدل ها هم اینطوری نیستن که ولشون کنید خودشون به امون خدا براتون بسازن نیاز به دانش خود شما هم دارن، برای همینه همیشه می‌گم یادگیری رو بخاطر هوش مصنوعی کنار نزارید چون هوش مصنوعی فرصت های خوبی براتون می‌سازه اما خودتون هیچی بلد نباشید نمی‌تونید به خوبی ازش استفاده کنید.


@Linuxor
This media is not supported in your browser
VIEW IN TELEGRAM
ورژن جدید رتبه بندی مدل های تصمیم گیر مثل Jev منتشر شده!

ورژن قبلی که اینجا توی کانال منتشر شد کمی دقیق نبود حالا پارامتر های دقیق تری بهش اضافه شده، همچنین مدل AutoJev-27B که مربوط به Perplexity و CTO اون، Denis Yarats، هستش، بین مدل‌های اوپن ویت فعلا بالاترین جایگاه رو گرفته، ولی هنوز 0.8 امتیاز از مدل Jev عقب‌تره.

huggingface.co/spaces/multimodalart/jev-decision-index


@Linuxor