چند سال پیش یادمه با یکی صحبت میکردم سنش توی رنج 30-35 بود بعد ایشون دنبال یه رود مپی میگشت می گفت من قدیما برنامه نویس بودم و الان همش یادم رفته میخوام از اول شروع کنم به یاد گیری؛ منم همون موقع در حد توانم کمکش کردم ولی ته دلم خندیدم بهش با خودم گفتم چه چاخانی داره میبنده مگه میشه آدم یه چیزی یادش بره!
دقیقا همون اتفاق طرف برای خودم افتاد ولی با این تفاوت من همزمان اکتیو در حال یادگیری هم هستم ولی یه بخش بزرگی از چیزارو که قدیم کار میکردم کامل فراموش کردم انگار اصلا ندیدمشون. بعدش فهمیدم طرف چه راستی گفته فشار و استرس های زندگی به راحتی حافظه رو پاک میکنه.
@Linuxor
دقیقا همون اتفاق طرف برای خودم افتاد ولی با این تفاوت من همزمان اکتیو در حال یادگیری هم هستم ولی یه بخش بزرگی از چیزارو که قدیم کار میکردم کامل فراموش کردم انگار اصلا ندیدمشون. بعدش فهمیدم طرف چه راستی گفته فشار و استرس های زندگی به راحتی حافظه رو پاک میکنه.
@Linuxor
This media is not supported in your browser
VIEW IN TELEGRAM
یه مدل اوپن سورس و لوکال دیگه اومده که میگه Jev در برابر ما آشغالی بیش نیست!
اسمش laya-mlx هستش و توی ویدیو روی مک بوک ایر 16 گیگ ران شده. و فقط 1 گیگ رم مصرف میکنه.
github.com/mizorewww/laya-mlx
@Linuxor
اسمش laya-mlx هستش و توی ویدیو روی مک بوک ایر 16 گیگ ران شده. و فقط 1 گیگ رم مصرف میکنه.
github.com/mizorewww/laya-mlx
@Linuxor
Media is too big
VIEW IN TELEGRAM
یه نفر به مدل لوکال Laya و Jev بازی دایناسور گوگل کروم رو میده و در کمال تعجب Laya از Jev بهتر بازی میکنه:
github.com/virajbhartiya/laya-vs-jev
خدابیامرز Jev سه روز بیشتر عمر نکرد😁
@Linuxor
github.com/virajbhartiya/laya-vs-jev
خدابیامرز Jev سه روز بیشتر عمر نکرد😁
@Linuxor
This media is not supported in your browser
VIEW IN TELEGRAM
با این پروژه میتونید از طریق هوش مصنوعی Jev موبایل اندرویدتون رو کنترل کنید، بهش یه هدف میدی، خودش UI گوشی رو بررسی میکنه، تصمیم میگیره قدم بعدی چی باشه و actionهایی مثل باز کردن اپ، Tap، تایپ کردن، اسکرول و Back رو اجرا میکنه؛ بدون اینکه لازم باشه مسیر از قبل بهش دیکته شده باشه.
جالبتر اینه که بعد از انجام هر action، وضعیت گوشی دوباره بررسی میشه تا Agent فقط با فکر کردن که انجام شد کار رو تموم نکنه.
github.com/droidrun/mobile-jev
@Linuxor
جالبتر اینه که بعد از انجام هر action، وضعیت گوشی دوباره بررسی میشه تا Agent فقط با فکر کردن که انجام شد کار رو تموم نکنه.
github.com/droidrun/mobile-jev
@Linuxor
This media is not supported in your browser
VIEW IN TELEGRAM
یه پروژه جالب به اسم Jev Ultrafast که توسط Browser Use منتشر شده که هدفش ساختن Browser Agentهای سریعتر و کمهزینهتره. ایدهش اینه که برای هر حرکت، مدل مجبور نباشه screenshot صفحه رو ببینه و کل UI رو دوباره تحلیل کنه. Jev بهجای screenshot، ساختار صفحه و المنتهای قابل تعامل رو به شکل ساده و شمارهگذاریشده در اختیار مدل میذاره؛ مثلاً [3] textbox یا [7] button. مدل فقط تصمیم میگیره روی کدوم المنت چه کاری انجام بشه. یعنی بهجای اینکه LLM مستقیماً browser رو کنترل کنه، بیشتر شبیه یه decision maker عمل میکنه:
hgithub.com/browser-use/jev-ultrafast
@Linuxor
hgithub.com/browser-use/jev-ultrafast
@Linuxor
مقایسه و بنچمارک بین مدل های تصمیم گیرنده
البته توی این مقایسه jev به عنوان رفرنس در نظر گرفته شده
huggingface.co/spaces/multimodalart/jev-decision-index
@Linuxor
البته توی این مقایسه jev به عنوان رفرنس در نظر گرفته شده
huggingface.co/spaces/multimodalart/jev-decision-index
@Linuxor
This media is not supported in your browser
VIEW IN TELEGRAM
مدل Jev میدونیم که ورودی متن قبول میکنه حالا چی میشه اگه بتونه تصویر و صدا هم بگیره و بر اساس اونا تصمیم بگیره؟ یه عده دارن Jev-Omni رو توسعه میدن که یه مدل چند وجهی تصمیم گیرنده به حساب میآد
برای مثال وصلش میکنید به دوربین خونتون با سرعت بالا اگه صحنه خطرناکی رو ببینه بهتون اعلام میکنه! خودشون ادعا کردن از Jev بنچمارکش بالا تره.
huggingface.co/akhilaaa3/Jev-Omni
@Linuxor
برای مثال وصلش میکنید به دوربین خونتون با سرعت بالا اگه صحنه خطرناکی رو ببینه بهتون اعلام میکنه! خودشون ادعا کردن از Jev بنچمارکش بالا تره.
huggingface.co/akhilaaa3/Jev-Omni
@Linuxor
کلاد از مدل Opus 5.5 رونمایی کرد، به گفته خودشون 40 درصد هزینه استفاده کمتری داره.
همچنین گفتن که : داریم محدودیتهای استفاده 5 ساعته رو برای پلنهای Pro، Max و Team افزایش میدیم.
همچنین برای کاربرهای دارای اشتراک، امکان ریست شدن محدودیت نرخ استفاده (Rate Limit) رو فراهم میکنیم؛ یعنی یه ریست در اختیارتون قرار میگیره که میتونید ذخیرهش کنید و هر موقع که خودتون خواستید ازش استفاده کنید.
@Linuxor
همچنین گفتن که : داریم محدودیتهای استفاده 5 ساعته رو برای پلنهای Pro، Max و Team افزایش میدیم.
همچنین برای کاربرهای دارای اشتراک، امکان ریست شدن محدودیت نرخ استفاده (Rate Limit) رو فراهم میکنیم؛ یعنی یه ریست در اختیارتون قرار میگیره که میتونید ذخیرهش کنید و هر موقع که خودتون خواستید ازش استفاده کنید.
@Linuxor
This media is not supported in your browser
VIEW IN TELEGRAM
یه نفر یه تم لیکویید گلس برای وب با React ساخته
تست آنلاین :
cruxgarden.github.io/plasma-ui
سورس کد :
github.com/CruxGarden/plasma-ui
@Linuxor
تست آنلاین :
cruxgarden.github.io/plasma-ui
سورس کد :
github.com/CruxGarden/plasma-ui
@Linuxor
This media is not supported in your browser
VIEW IN TELEGRAM
آپدیت جدید کلاد Opus 5.5 چه شکلیه؟
یه نفر ازش خواسته که مفهوم فوکوس دوربین رو با ساختن یه آزمایشگاه تعاملی لنز توضیح بده.
این چیزیه که بعد از 1 ساعت و 26 دقیقه، با یه بار اجرا و با هزینه 25.66 دلار برای API ساخته، حلقهی فوکوس رو حرکت بدید تا ببینید عناصر شیشهای داخل لنز چطور جابهجا میشن و صفحهی فوکوسِ واضح رو در سرتاسر صحنه تغییر میدن:
lens.lab.sael.net
@Linuxor
یه نفر ازش خواسته که مفهوم فوکوس دوربین رو با ساختن یه آزمایشگاه تعاملی لنز توضیح بده.
این چیزیه که بعد از 1 ساعت و 26 دقیقه، با یه بار اجرا و با هزینه 25.66 دلار برای API ساخته، حلقهی فوکوس رو حرکت بدید تا ببینید عناصر شیشهای داخل لنز چطور جابهجا میشن و صفحهی فوکوسِ واضح رو در سرتاسر صحنه تغییر میدن:
lens.lab.sael.net
@Linuxor
This media is not supported in your browser
VIEW IN TELEGRAM
جالب ترین چیزی که امروز دیدم اینه، یه نفر یه رابط کاربری ساخته هرچیزی که توش تایپ میکنید براتون به صورت ui نشونش میده پشت صحنه مدل هوش مصنوعی Jev هستش.
البته این نکته هم بگم سورس کدش رو دیدم چیز جدیدی خلق نمیشه همش از قبل ساخته شده و وظیفه Jev اینه که متنی که مینویسید رو با سرعت بالا به ui تبدیل کنه.
تست آنلاین:
shapeshiftui.vercel.app
سورس کد:
github.com/anishfn/shapeshift
@Linuxor
البته این نکته هم بگم سورس کدش رو دیدم چیز جدیدی خلق نمیشه همش از قبل ساخته شده و وظیفه Jev اینه که متنی که مینویسید رو با سرعت بالا به ui تبدیل کنه.
تست آنلاین:
shapeshiftui.vercel.app
سورس کد:
github.com/anishfn/shapeshift
@Linuxor
Media is too big
VIEW IN TELEGRAM
توی آمریکا یه نفر یه سیستم ساخته داره از مدل Jev برای مسائل حقوقی استفاده میکنه، برای مثال ازش پرسیده: صاحبخونه چقدر وقت داره که ودیعهی مستأجر رو برگردونه؟
این سیستم با سرعت بالا 134 بخش قانونی از قوانین 45 ایالت رو بررسی کرده، توی 42 ایالت همون قانون مشابه رو پیدا کرده و مهلت دقیق قانونی رو از 12 قانون مختلف عیناً نقل کرده، تازه هزینه کل این جستجو هم ناچیز در میاد.
@Linuxor
این سیستم با سرعت بالا 134 بخش قانونی از قوانین 45 ایالت رو بررسی کرده، توی 42 ایالت همون قانون مشابه رو پیدا کرده و مهلت دقیق قانونی رو از 12 قانون مختلف عیناً نقل کرده، تازه هزینه کل این جستجو هم ناچیز در میاد.
@Linuxor
This media is not supported in your browser
VIEW IN TELEGRAM
این یه ابزار بسیار سریع برای فهمیدن ساختار اسناده که با Jev کار میکنه؛ میتونه تشخیص بده هر بخش از یه فایل چه نوع سندیه و حتی وقتی چند سند پشت سر هم داخل یه PDF هستن.
مثلاً یه PDF داری که داخلش چندین Invoice، قرارداد و Purchase Order اسکن شده. DocJev میتونه تشخیص بده هر کدوم از کجا شروع و کجا تموم میشه و در نهایت اونها رو از هم جدا کنه.
برای Document Processing، اتوماسیون حسابداری، پردازش Invoice و ساخت pipelineهای هوشمند برای اسناد، پروژه جالبیه بنچمارک هاشم هست:
github.com/jerryjliu/docjev
@Linuxor
مثلاً یه PDF داری که داخلش چندین Invoice، قرارداد و Purchase Order اسکن شده. DocJev میتونه تشخیص بده هر کدوم از کجا شروع و کجا تموم میشه و در نهایت اونها رو از هم جدا کنه.
برای Document Processing، اتوماسیون حسابداری، پردازش Invoice و ساخت pipelineهای هوشمند برای اسناد، پروژه جالبیه بنچمارک هاشم هست:
github.com/jerryjliu/docjev
@Linuxor
پروژه freebuff.com روکه میشناسید میتونید رایگان از مدلایی که میده استفاده کنید شعارشه
یکی اومده api رو ریورس کرده تا بشه توی هارنسهای دیگه هم استفاده کرد!
github.com/trefeon/freebucks-proxy
@Linuxor ~ maanimis
یکی اومده api رو ریورس کرده تا بشه توی هارنسهای دیگه هم استفاده کرد!
github.com/trefeon/freebucks-proxy
@Linuxor ~ maanimis
This media is not supported in your browser
VIEW IN TELEGRAM
یه مدل جدید از Viggle روی Hugging Face منتشر شده که برای تولید و ادیت تصویر ساخته شده: Qwen-Image-2.1 Viggle Turbo که 6 برابر از مدل اصلی سریع تره!
این نسخه با تکنیک distillation از مدل اصلی Qwen-Image-2.1، تعداد مراحل تولید رو از حدود 40 step به فقط 4 step رسونده. یعنی هدفش اینه که خروجیهای مدل رو با محاسبات خیلی کمتر و سرعت بالاتر تولید کنه، تست آنلاین:
huggingface.co/spaces/Viggle/Qwen-Image-2.1-viggle-turbo
@Linuxor
این نسخه با تکنیک distillation از مدل اصلی Qwen-Image-2.1، تعداد مراحل تولید رو از حدود 40 step به فقط 4 step رسونده. یعنی هدفش اینه که خروجیهای مدل رو با محاسبات خیلی کمتر و سرعت بالاتر تولید کنه، تست آنلاین:
huggingface.co/spaces/Viggle/Qwen-Image-2.1-viggle-turbo
@Linuxor
برای اینکه دانش کلی Jev رو ببینم چطوره 122 سؤال کنکور تجربی 1405 رو دادم به اون و 5 مدل دیگه. مدلهای بزرگ بهتر، کندتر و گرونتر هستن اما مهم برام مدلهای کوچیک بود. مثلا از لونا 25 درصد بهتر عمل کرد در حالی که 4.5 برابر ارزونتر و 3.7 برابر سریعتره. دیپسیک و Qwen رو هم لوله کرد.
@Linuxor ~ VForMhrlife
@Linuxor ~ VForMhrlife
آدرس سایتتون رو اینجا وارد کنید بهتون میگه چند درصد ساخته آشغال هوش مصنوعی یا AI Slop هستش
تکنیک کارش هم اینه هم عکس میگیره با مدل ویژن بررسیش میکنه هم سوالاتی با Jev رو میپرسه همچنین با یه مرورگر هدلس سایتتون رو باز میکنه و المان هاشو برسی میکنه اگه چیز های کلیشه ای و تکراری ببینه میگه با AI ساخته شده:
madewithjev.com/free-tools/ai-slop-detector
@Linuxor
تکنیک کارش هم اینه هم عکس میگیره با مدل ویژن بررسیش میکنه هم سوالاتی با Jev رو میپرسه همچنین با یه مرورگر هدلس سایتتون رو باز میکنه و المان هاشو برسی میکنه اگه چیز های کلیشه ای و تکراری ببینه میگه با AI ساخته شده:
madewithjev.com/free-tools/ai-slop-detector
@Linuxor