This media is not supported in your browser
VIEW IN TELEGRAM
اگه با Claude Code، Codex یا OpenCode کار میکنی، احتمالاً یه عالمه session قدیمی داری که پیدا کردنشون خودش یه پروژهست Chat Seek یه افزونه برای VS Code هست که چتهای قبلیت رو بهصورت آفلاین و local ایندکس میکنه و با سرچ معمولی یا معنایی کمک میکنه سریع session موردنظرت رو پیدا کنی.
حتی میتونی session پیدا شده رو دوباره Resume کنی و ادامه همون کاری که قبلاً داشتی انجام میدادی رو بگیری. سرچ و رتبهبندی هم میتونه کاملاً روی سیستم خودت انجام بشه.
گیتهاب پروژه:
github.com/fstandhartinger/chat-seek-vscode
@Linuxor
حتی میتونی session پیدا شده رو دوباره Resume کنی و ادامه همون کاری که قبلاً داشتی انجام میدادی رو بگیری. سرچ و رتبهبندی هم میتونه کاملاً روی سیستم خودت انجام بشه.
گیتهاب پروژه:
github.com/fstandhartinger/chat-seek-vscode
@Linuxor
1
This media is not supported in your browser
VIEW IN TELEGRAM
یه AI Upscaler خیلی کاربردی پیدا کردم.
تصاویر و ویدیوها رو 2x یا 4x آپاسکیل میکنه، بدون نصب، بدون آپلود به سرور و کاملاً محلی و رایگان روی مرورگرتون اجرا میشه.
هر وقت رزولوشن تصویر یا ویدیوتون ناامیدکننده بود، مستقیم از مرورگر استفاده کنید:
freeupscaler.app
@Linuxor ~ ai_ba_reza
تصاویر و ویدیوها رو 2x یا 4x آپاسکیل میکنه، بدون نصب، بدون آپلود به سرور و کاملاً محلی و رایگان روی مرورگرتون اجرا میشه.
هر وقت رزولوشن تصویر یا ویدیوتون ناامیدکننده بود، مستقیم از مرورگر استفاده کنید:
freeupscaler.app
@Linuxor ~ ai_ba_reza
This media is not supported in your browser
VIEW IN TELEGRAM
اینو ببینید چه سرعت خوبی داره! این خودِ Jev نیست، djev-run هستش؛ پروژهای که برای اجرای مدل djev بر پایهی DiffusionGemma ساخته شده. باهاش میتونین djev رو خیلی راحت روی Google Cloud Run دیپلوی کنین و در چند مرحله یه endpoint سازگار با Jev API داشته باشین و خودتون باهاش بازی کنین:
ایدهی djev هم مثل Jev یه مقدار با LLMهای معمولی فرق داره؛ بهجای اینکه صرفاً متن تولید کنه، برای تصمیمگیری ساختاریافته ساخته شده. مثلاً میتونین یه پیام کاربر رو بدین و ازش بخواین مشخص کنه مربوط به کدوم دسته هست، شدت مشکل چقدره، آیا درخواست refund داره یا نه و حتی برای جوابها probability بگیرین. یعنی خروجی مستقیماً میتونه وارد منطق اپلیکیشن بشه.
github.com/taeold/djev-run
@Linuxor
ایدهی djev هم مثل Jev یه مقدار با LLMهای معمولی فرق داره؛ بهجای اینکه صرفاً متن تولید کنه، برای تصمیمگیری ساختاریافته ساخته شده. مثلاً میتونین یه پیام کاربر رو بدین و ازش بخواین مشخص کنه مربوط به کدوم دسته هست، شدت مشکل چقدره، آیا درخواست refund داره یا نه و حتی برای جوابها probability بگیرین. یعنی خروجی مستقیماً میتونه وارد منطق اپلیکیشن بشه.
github.com/taeold/djev-run
@Linuxor
This media is not supported in your browser
VIEW IN TELEGRAM
دیروز یه نفر یه افزونه برای Chrome ساخته که یه سایدپنل داره و میتونه ابزارهای WebMCP سایتها رو با Jev کنترل کنه. با هر چیزی که تایپ میکنی، ابزار مناسب رو انتخاب میکنه، ورودیها رو پر میکنه و میزان اطمینانش رو هم نشون میده.
مثلاً برای خرید، سوالی مثل «چیزی بدون گلوتن زیر 2 دلار دارید؟» دیگه نیاز به چت و مکالمه نداره؛ افزونه مستقیماً ابزار search_products رو صدا میزنه. یعنی همهچیز لزوماً به چتبات نیاز نداره.
نکته جالبتر اینه که همین ابزار میتونه برای تست WebMCP هم استفاده بشه. اگه 2 ابزار مدام برای یه جمله با هم رقابت کنن، احتمالاً توضیحاتشون همپوشانی داره؛ اگه یه آرگومان رو با اطمینان پایین تشخیص بده، ممکنه schema مبهم باشه. در نتیجه میتونه به بهتر نوشتن توضیحات ابزارها کمک کنه:
github.com/sdras/jev-webmcp-extension
@Linxuor
مثلاً برای خرید، سوالی مثل «چیزی بدون گلوتن زیر 2 دلار دارید؟» دیگه نیاز به چت و مکالمه نداره؛ افزونه مستقیماً ابزار search_products رو صدا میزنه. یعنی همهچیز لزوماً به چتبات نیاز نداره.
نکته جالبتر اینه که همین ابزار میتونه برای تست WebMCP هم استفاده بشه. اگه 2 ابزار مدام برای یه جمله با هم رقابت کنن، احتمالاً توضیحاتشون همپوشانی داره؛ اگه یه آرگومان رو با اطمینان پایین تشخیص بده، ممکنه schema مبهم باشه. در نتیجه میتونه به بهتر نوشتن توضیحات ابزارها کمک کنه:
github.com/sdras/jev-webmcp-extension
@Linxuor
This media is not supported in your browser
VIEW IN TELEGRAM
یه هارنس ایجنت اوپن سورس برای Jev ! بیینید هوش مصنوعی چطوری داره باهاش قارچ خور بازی میکنه :)
این هارنس که اختصاصی برای Jev طراحی شده محیط رو میبینه، کارهایی که در اون لحظه امکان انجامشون وجود داره رو به گزینههای مشخص تبدیل میکنه و مدل در هر مرحله فقط یک بار تصمیم میگیره. مدل قرار نیست خودش متن یا Action جدید تولید کنه؛ فقط از بین گزینههایی که محیط در اختیارش گذاشته با سرعت بالا انتخاب میکنه. برای هر تصمیم هم احتمال مشخصی ثبت میشه.
github.com/HarnessRouter/SystemOneHarness
@Linuxor
این هارنس که اختصاصی برای Jev طراحی شده محیط رو میبینه، کارهایی که در اون لحظه امکان انجامشون وجود داره رو به گزینههای مشخص تبدیل میکنه و مدل در هر مرحله فقط یک بار تصمیم میگیره. مدل قرار نیست خودش متن یا Action جدید تولید کنه؛ فقط از بین گزینههایی که محیط در اختیارش گذاشته با سرعت بالا انتخاب میکنه. برای هر تصمیم هم احتمال مشخصی ثبت میشه.
github.com/HarnessRouter/SystemOneHarness
@Linuxor
چند سال پیش یادمه با یکی صحبت میکردم سنش توی رنج 30-35 بود بعد ایشون دنبال یه رود مپی میگشت می گفت من قدیما برنامه نویس بودم و الان همش یادم رفته میخوام از اول شروع کنم به یاد گیری؛ منم همون موقع در حد توانم کمکش کردم ولی ته دلم خندیدم بهش با خودم گفتم چه چاخانی داره میبنده مگه میشه آدم یه چیزی یادش بره!
دقیقا همون اتفاق طرف برای خودم افتاد ولی با این تفاوت من همزمان اکتیو در حال یادگیری هم هستم ولی یه بخش بزرگی از چیزارو که قدیم کار میکردم کامل فراموش کردم انگار اصلا ندیدمشون. بعدش فهمیدم طرف چه راستی گفته فشار و استرس های زندگی به راحتی حافظه رو پاک میکنه.
@Linuxor
دقیقا همون اتفاق طرف برای خودم افتاد ولی با این تفاوت من همزمان اکتیو در حال یادگیری هم هستم ولی یه بخش بزرگی از چیزارو که قدیم کار میکردم کامل فراموش کردم انگار اصلا ندیدمشون. بعدش فهمیدم طرف چه راستی گفته فشار و استرس های زندگی به راحتی حافظه رو پاک میکنه.
@Linuxor
This media is not supported in your browser
VIEW IN TELEGRAM
یه مدل اوپن سورس و لوکال دیگه اومده که میگه Jev در برابر ما آشغالی بیش نیست!
اسمش laya-mlx هستش و توی ویدیو روی مک بوک ایر 16 گیگ ران شده. و فقط 1 گیگ رم مصرف میکنه.
github.com/mizorewww/laya-mlx
@Linuxor
اسمش laya-mlx هستش و توی ویدیو روی مک بوک ایر 16 گیگ ران شده. و فقط 1 گیگ رم مصرف میکنه.
github.com/mizorewww/laya-mlx
@Linuxor
Media is too big
VIEW IN TELEGRAM
یه نفر به مدل لوکال Laya و Jev بازی دایناسور گوگل کروم رو میده و در کمال تعجب Laya از Jev بهتر بازی میکنه:
github.com/virajbhartiya/laya-vs-jev
خدابیامرز Jev سه روز بیشتر عمر نکرد😁
@Linuxor
github.com/virajbhartiya/laya-vs-jev
خدابیامرز Jev سه روز بیشتر عمر نکرد😁
@Linuxor
This media is not supported in your browser
VIEW IN TELEGRAM
با این پروژه میتونید از طریق هوش مصنوعی Jev موبایل اندرویدتون رو کنترل کنید، بهش یه هدف میدی، خودش UI گوشی رو بررسی میکنه، تصمیم میگیره قدم بعدی چی باشه و actionهایی مثل باز کردن اپ، Tap، تایپ کردن، اسکرول و Back رو اجرا میکنه؛ بدون اینکه لازم باشه مسیر از قبل بهش دیکته شده باشه.
جالبتر اینه که بعد از انجام هر action، وضعیت گوشی دوباره بررسی میشه تا Agent فقط با فکر کردن که انجام شد کار رو تموم نکنه.
github.com/droidrun/mobile-jev
@Linuxor
جالبتر اینه که بعد از انجام هر action، وضعیت گوشی دوباره بررسی میشه تا Agent فقط با فکر کردن که انجام شد کار رو تموم نکنه.
github.com/droidrun/mobile-jev
@Linuxor
This media is not supported in your browser
VIEW IN TELEGRAM
یه پروژه جالب به اسم Jev Ultrafast که توسط Browser Use منتشر شده که هدفش ساختن Browser Agentهای سریعتر و کمهزینهتره. ایدهش اینه که برای هر حرکت، مدل مجبور نباشه screenshot صفحه رو ببینه و کل UI رو دوباره تحلیل کنه. Jev بهجای screenshot، ساختار صفحه و المنتهای قابل تعامل رو به شکل ساده و شمارهگذاریشده در اختیار مدل میذاره؛ مثلاً [3] textbox یا [7] button. مدل فقط تصمیم میگیره روی کدوم المنت چه کاری انجام بشه. یعنی بهجای اینکه LLM مستقیماً browser رو کنترل کنه، بیشتر شبیه یه decision maker عمل میکنه:
hgithub.com/browser-use/jev-ultrafast
@Linuxor
hgithub.com/browser-use/jev-ultrafast
@Linuxor
مقایسه و بنچمارک بین مدل های تصمیم گیرنده
البته توی این مقایسه jev به عنوان رفرنس در نظر گرفته شده
huggingface.co/spaces/multimodalart/jev-decision-index
@Linuxor
البته توی این مقایسه jev به عنوان رفرنس در نظر گرفته شده
huggingface.co/spaces/multimodalart/jev-decision-index
@Linuxor
This media is not supported in your browser
VIEW IN TELEGRAM
مدل Jev میدونیم که ورودی متن قبول میکنه حالا چی میشه اگه بتونه تصویر و صدا هم بگیره و بر اساس اونا تصمیم بگیره؟ یه عده دارن Jev-Omni رو توسعه میدن که یه مدل چند وجهی تصمیم گیرنده به حساب میآد
برای مثال وصلش میکنید به دوربین خونتون با سرعت بالا اگه صحنه خطرناکی رو ببینه بهتون اعلام میکنه! خودشون ادعا کردن از Jev بنچمارکش بالا تره.
huggingface.co/akhilaaa3/Jev-Omni
@Linuxor
برای مثال وصلش میکنید به دوربین خونتون با سرعت بالا اگه صحنه خطرناکی رو ببینه بهتون اعلام میکنه! خودشون ادعا کردن از Jev بنچمارکش بالا تره.
huggingface.co/akhilaaa3/Jev-Omni
@Linuxor
کلاد از مدل Opus 5.5 رونمایی کرد، به گفته خودشون 40 درصد هزینه استفاده کمتری داره.
همچنین گفتن که : داریم محدودیتهای استفاده 5 ساعته رو برای پلنهای Pro، Max و Team افزایش میدیم.
همچنین برای کاربرهای دارای اشتراک، امکان ریست شدن محدودیت نرخ استفاده (Rate Limit) رو فراهم میکنیم؛ یعنی یه ریست در اختیارتون قرار میگیره که میتونید ذخیرهش کنید و هر موقع که خودتون خواستید ازش استفاده کنید.
@Linuxor
همچنین گفتن که : داریم محدودیتهای استفاده 5 ساعته رو برای پلنهای Pro، Max و Team افزایش میدیم.
همچنین برای کاربرهای دارای اشتراک، امکان ریست شدن محدودیت نرخ استفاده (Rate Limit) رو فراهم میکنیم؛ یعنی یه ریست در اختیارتون قرار میگیره که میتونید ذخیرهش کنید و هر موقع که خودتون خواستید ازش استفاده کنید.
@Linuxor
This media is not supported in your browser
VIEW IN TELEGRAM
یه نفر یه تم لیکویید گلس برای وب با React ساخته
تست آنلاین :
cruxgarden.github.io/plasma-ui
سورس کد :
github.com/CruxGarden/plasma-ui
@Linuxor
تست آنلاین :
cruxgarden.github.io/plasma-ui
سورس کد :
github.com/CruxGarden/plasma-ui
@Linuxor
This media is not supported in your browser
VIEW IN TELEGRAM
آپدیت جدید کلاد Opus 5.5 چه شکلیه؟
یه نفر ازش خواسته که مفهوم فوکوس دوربین رو با ساختن یه آزمایشگاه تعاملی لنز توضیح بده.
این چیزیه که بعد از 1 ساعت و 26 دقیقه، با یه بار اجرا و با هزینه 25.66 دلار برای API ساخته، حلقهی فوکوس رو حرکت بدید تا ببینید عناصر شیشهای داخل لنز چطور جابهجا میشن و صفحهی فوکوسِ واضح رو در سرتاسر صحنه تغییر میدن:
lens.lab.sael.net
@Linuxor
یه نفر ازش خواسته که مفهوم فوکوس دوربین رو با ساختن یه آزمایشگاه تعاملی لنز توضیح بده.
این چیزیه که بعد از 1 ساعت و 26 دقیقه، با یه بار اجرا و با هزینه 25.66 دلار برای API ساخته، حلقهی فوکوس رو حرکت بدید تا ببینید عناصر شیشهای داخل لنز چطور جابهجا میشن و صفحهی فوکوسِ واضح رو در سرتاسر صحنه تغییر میدن:
lens.lab.sael.net
@Linuxor
This media is not supported in your browser
VIEW IN TELEGRAM
جالب ترین چیزی که امروز دیدم اینه، یه نفر یه رابط کاربری ساخته هرچیزی که توش تایپ میکنید براتون به صورت ui نشونش میده پشت صحنه مدل هوش مصنوعی Jev هستش.
البته این نکته هم بگم سورس کدش رو دیدم چیز جدیدی خلق نمیشه همش از قبل ساخته شده و وظیفه Jev اینه که متنی که مینویسید رو با سرعت بالا به ui تبدیل کنه.
تست آنلاین:
shapeshiftui.vercel.app
سورس کد:
github.com/anishfn/shapeshift
@Linuxor
البته این نکته هم بگم سورس کدش رو دیدم چیز جدیدی خلق نمیشه همش از قبل ساخته شده و وظیفه Jev اینه که متنی که مینویسید رو با سرعت بالا به ui تبدیل کنه.
تست آنلاین:
shapeshiftui.vercel.app
سورس کد:
github.com/anishfn/shapeshift
@Linuxor
Media is too big
VIEW IN TELEGRAM
توی آمریکا یه نفر یه سیستم ساخته داره از مدل Jev برای مسائل حقوقی استفاده میکنه، برای مثال ازش پرسیده: صاحبخونه چقدر وقت داره که ودیعهی مستأجر رو برگردونه؟
این سیستم با سرعت بالا 134 بخش قانونی از قوانین 45 ایالت رو بررسی کرده، توی 42 ایالت همون قانون مشابه رو پیدا کرده و مهلت دقیق قانونی رو از 12 قانون مختلف عیناً نقل کرده، تازه هزینه کل این جستجو هم ناچیز در میاد.
@Linuxor
این سیستم با سرعت بالا 134 بخش قانونی از قوانین 45 ایالت رو بررسی کرده، توی 42 ایالت همون قانون مشابه رو پیدا کرده و مهلت دقیق قانونی رو از 12 قانون مختلف عیناً نقل کرده، تازه هزینه کل این جستجو هم ناچیز در میاد.
@Linuxor