GPT-۶ رو ۲۴ ساعته جیلبریک کردن 😱
خبر فوری فوری
GPT-۶ آسترا که تازه از راه رسیده بود رو یه محقق تونسته ظرف ۲۴ ساعت جیلبریک کنه این حمله یه نسخه پیشرفته از تکنیک Task-in-Prompt بوده که قبلاً توی یه مقاله ACL ۲۰۲۵ معرفی شده بود
🔹 جالب اینجاست که همین محقق پارسال GPT-۵ رو هم توی یه ساعت جیلبریک کرده بود
🔹 جزییات این حمله رو محقق به صورت خصوصی به OpenAI داده و منتشر نکرده
کاربرد در ایران 🇮🇷
هرچند این خبر مستقیماً برای ایران نیست ولی نشون میده مدل های بزرگ زبانی که خیلیا استفاده میکنن هنوزم آسیبپذیرن و امنیتشون قطعی نیست
#GPT۶ #جیلبریک #OpenAI #امنیت
🆔 @AI_TechPulse
خبر فوری فوری
GPT-۶ آسترا که تازه از راه رسیده بود رو یه محقق تونسته ظرف ۲۴ ساعت جیلبریک کنه این حمله یه نسخه پیشرفته از تکنیک Task-in-Prompt بوده که قبلاً توی یه مقاله ACL ۲۰۲۵ معرفی شده بود
🔹 جالب اینجاست که همین محقق پارسال GPT-۵ رو هم توی یه ساعت جیلبریک کرده بود
🔹 جزییات این حمله رو محقق به صورت خصوصی به OpenAI داده و منتشر نکرده
کاربرد در ایران 🇮🇷
هرچند این خبر مستقیماً برای ایران نیست ولی نشون میده مدل های بزرگ زبانی که خیلیا استفاده میکنن هنوزم آسیبپذیرن و امنیتشون قطعی نیست
#GPT۶ #جیلبریک #OpenAI #امنیت
🆔 @AI_TechPulse
👍1
SQL Cheat Sheet.pdf
827.6 KB
برگه تقلب SQL 🃏
اینم یه منبع خوب برای یادگیری سریع SQL
برگه تقلب SQL منبع - یه صفحه جمع و جور که تمام دستورات پرکاربرد رو داره
🔹 منبع رایگان و کاربردی برای تازهکارا و حرفهایا
#SQL
🆔 @AI_TechPulse
اینم یه منبع خوب برای یادگیری سریع SQL
برگه تقلب SQL منبع - یه صفحه جمع و جور که تمام دستورات پرکاربرد رو داره
🔹 منبع رایگان و کاربردی برای تازهکارا و حرفهایا
#SQL
🆔 @AI_TechPulse
👍1
📩 سیو کردن پیامای دلیت شده تو تلگرام با یه سلفبات
اگه از این که پیامای دلیت شده از پیویتون بره ناراحتین یه خبر خوب دارم
یه پروژه سلفبات اومده که روی اکانت تلگرامیت ران میشه و هر پیامی که از پیوی مخاطبت پاک بشه رو برات سیو میکنه
🔹 این سلفبات دقیقاً برای مواقعی ساخته شده که نمیخوای پیامای دو طرفه حذف بشن و میخوای یه نسخه ازشون داشته باشی
روش راهاندازیش توی ریدمی خود پروژه کامل توضیح داده شده پس اگر خواستی امتحانش کنی حتماً یه نگاه بهش بنداز
کاربرد در ایران 🇮🇷
برای کسایی که تو ایران از تلگرام استفاده میکنن و میخوان پیامای حذف شده رو از دست ندن خیلی کاربردیه مثل ذخیرهسازی مکالمات کاری یا شخصی
#تلگرام #سلف_بات #دلیت_پیام
🛠 مخزن پروژه در گیتهاب
🆔 @AI_TechPulse
اگه از این که پیامای دلیت شده از پیویتون بره ناراحتین یه خبر خوب دارم
یه پروژه سلفبات اومده که روی اکانت تلگرامیت ران میشه و هر پیامی که از پیوی مخاطبت پاک بشه رو برات سیو میکنه
🔹 این سلفبات دقیقاً برای مواقعی ساخته شده که نمیخوای پیامای دو طرفه حذف بشن و میخوای یه نسخه ازشون داشته باشی
روش راهاندازیش توی ریدمی خود پروژه کامل توضیح داده شده پس اگر خواستی امتحانش کنی حتماً یه نگاه بهش بنداز
کاربرد در ایران 🇮🇷
برای کسایی که تو ایران از تلگرام استفاده میکنن و میخوان پیامای حذف شده رو از دست ندن خیلی کاربردیه مثل ذخیرهسازی مکالمات کاری یا شخصی
#تلگرام #سلف_بات #دلیت_پیام
🛠 مخزن پروژه در گیتهاب
🆔 @AI_TechPulse
👍2
Usque MASQUE Pro v۶.۷ همهکارهترین ابزار WARP تو مرورگرت
اگه از دستی ورک کردن با کانفیگ WARP و MASQUE خسته شدی این ابزار دقیقا همون چیزیه که نیاز داری
Usque MASQUE Pro یه ابزار تحت وب هست که توی مرورگرت میتونی ثبتنام WARP انجام بدی کانفیگ تولید کنی و حتی برای Clash و Mihomo و Shadowrocket و sing-box خروجی بگیری همه چی تو مرورگر انجام میشه و نیازی به نصب نرم افزار اضافه نیست
🔹 این ریپو الان ۳۶۹ تا ستاره داره و تو گیتهاب به صورت متنباز منتشر شده
• ثبتنام یککلیکی WARP و MASQUE تو مرورگر
• تولید کانفیگ برای Clash یا Mihomo با رول های هوشمند مثل YouTube Netflix و Telegram
• خروجی برای Shadowrocket و sing-box و VLESS
• پشتیبانی از QUIC یا H۳ و H۲
• قابلیت تشخیص WARP و تست خروجی با گزارش JSON یا CSV
برو گیتهابش رو ببین و اگه مفید بود ستاره بده
کاربرد در ایران 🇮🇷
برای کاربران ایرانی که با WARP و کانفیگ های مختلف سروکار دارن این ابزار خیلی مفیده چون مراحل ثبتنام و تولید کانفیگ رو ساده میکنه
#Cloudflare #WARP #MASQUE #GitHub #ابزار
🛠 مخزن پروژه در گیتهاب
🆔 @AI_TechPulse
اگه از دستی ورک کردن با کانفیگ WARP و MASQUE خسته شدی این ابزار دقیقا همون چیزیه که نیاز داری
Usque MASQUE Pro یه ابزار تحت وب هست که توی مرورگرت میتونی ثبتنام WARP انجام بدی کانفیگ تولید کنی و حتی برای Clash و Mihomo و Shadowrocket و sing-box خروجی بگیری همه چی تو مرورگر انجام میشه و نیازی به نصب نرم افزار اضافه نیست
🔹 این ریپو الان ۳۶۹ تا ستاره داره و تو گیتهاب به صورت متنباز منتشر شده
• ثبتنام یککلیکی WARP و MASQUE تو مرورگر
• تولید کانفیگ برای Clash یا Mihomo با رول های هوشمند مثل YouTube Netflix و Telegram
• خروجی برای Shadowrocket و sing-box و VLESS
• پشتیبانی از QUIC یا H۳ و H۲
• قابلیت تشخیص WARP و تست خروجی با گزارش JSON یا CSV
برو گیتهابش رو ببین و اگه مفید بود ستاره بده
کاربرد در ایران 🇮🇷
برای کاربران ایرانی که با WARP و کانفیگ های مختلف سروکار دارن این ابزار خیلی مفیده چون مراحل ثبتنام و تولید کانفیگ رو ساده میکنه
#Cloudflare #WARP #MASQUE #GitHub #ابزار
🛠 مخزن پروژه در گیتهاب
🆔 @AI_TechPulse
👍2
🥶 حافظه دائمی برای AI Agent ها با OKF Agent Memory
اگه از این که AI Agent هات بعد از بستن پنجره همه چی رو فراموش میکنن خسته شدی یه خبر خوب دارم
OKF Agent Memory یه مخزن گیتنیتیو برای ذخیرهسازی حافظه دائمی Agentهاست با این ابزار دیگه نیاز به دیتابیس خارجی یا وکتور دیتابیس نداری و همه چی به صورت فایل مارکداون با YAML frontmatter داخل خود ریپو ذخیره میشه
🔹 این سیستم بر اساس Google OKF v۰.۲ ساخته شده و جستجوی BM۲۵ رو تو کمتر از ۳۰۰ میکروثانیه انجام میده همچنین مصرف توکن رو تا ۸۰ درصد کاهش میده
بدون هیچ وابستگی خارجی فقط با Go خالص ساخته شده
• سرعت بالا با جستجوی زیر ۳۰۰ میکروثانیه
• کاهش ۸۰ درصدی توکن ها
• قابلیت اجرا با LM Studio و Ollama
• شامل MCP Server داخلی
اگه با AI Agent کار میکنی حتماً یه نگاهی به این پروژه بنداز خلاصه که خیلی به کارت میاد
کاربرد در ایران 🇮🇷
برای توسعهدهنده های ایرانی که با AI Agent کار میکنن خیلی مفیده چون هم متنباز و هم سبک
#حافظه_دایمی #AI_Agent #OKF #Go #MCP
🛠 مخزن پروژه در گیتهاب
🆔 @AI_TechPulse
اگه از این که AI Agent هات بعد از بستن پنجره همه چی رو فراموش میکنن خسته شدی یه خبر خوب دارم
OKF Agent Memory یه مخزن گیتنیتیو برای ذخیرهسازی حافظه دائمی Agentهاست با این ابزار دیگه نیاز به دیتابیس خارجی یا وکتور دیتابیس نداری و همه چی به صورت فایل مارکداون با YAML frontmatter داخل خود ریپو ذخیره میشه
🔹 این سیستم بر اساس Google OKF v۰.۲ ساخته شده و جستجوی BM۲۵ رو تو کمتر از ۳۰۰ میکروثانیه انجام میده همچنین مصرف توکن رو تا ۸۰ درصد کاهش میده
بدون هیچ وابستگی خارجی فقط با Go خالص ساخته شده
• سرعت بالا با جستجوی زیر ۳۰۰ میکروثانیه
• کاهش ۸۰ درصدی توکن ها
• قابلیت اجرا با LM Studio و Ollama
• شامل MCP Server داخلی
اگه با AI Agent کار میکنی حتماً یه نگاهی به این پروژه بنداز خلاصه که خیلی به کارت میاد
کاربرد در ایران 🇮🇷
برای توسعهدهنده های ایرانی که با AI Agent کار میکنن خیلی مفیده چون هم متنباز و هم سبک
#حافظه_دایمی #AI_Agent #OKF #Go #MCP
🛠 مخزن پروژه در گیتهاب
🆔 @AI_TechPulse
👍3
Qwen ۳.۸ Flash Next چقدر روی Apple Silicon سریعه
جدیدترین مدل Qwen یعنی ۳.۸ Flash Next اومده رو Apple Silicon ببینم چقدر سریعه
رو M۴ Max رسیده به ۴۵ توکن در ثانیه و رو M۲ Ultra هم ۲۵ توکن در ثانیه میده
🔹 نکته جالبش اینه که سرعتش با Qwen ۳.۸ ۲۷B روی Apple Silicon برابری میکنه
#Qwen #AppleSilicon #LLM
🆔 @AI_TechPulse
جدیدترین مدل Qwen یعنی ۳.۸ Flash Next اومده رو Apple Silicon ببینم چقدر سریعه
رو M۴ Max رسیده به ۴۵ توکن در ثانیه و رو M۲ Ultra هم ۲۵ توکن در ثانیه میده
🔹 نکته جالبش اینه که سرعتش با Qwen ۳.۸ ۲۷B روی Apple Silicon برابری میکنه
#Qwen #AppleSilicon #LLM
🆔 @AI_TechPulse
👍3
ویچت رو تبدیل کن به پایگاه اطلاعات شخصی هوشمند 🧠
دیگه نیازی نیست پیامای ویچتت رو دستی زیر و رو کنی
این ریپو یه سیستم کاملاً محلی و فقطخواندنیه که کل تاریخچه چتهات رو قابل جستجو و تحلیل میکنه
بدون دسترسی به کلید بدون ریساین و بدون Hook ویچت فقط یه Reader خالصه که میتونی با یه CLI یا حتی حرف زدن معمولی باهاش کار کنی
🔹 با نصبش میتونی روزانه خلاصه چت ها وعده ها فرصت ها و حتی لیست کارای عقبمونده رو بگیری همه چی به صورت محلی و امن
#ویچت #هوش_مصنوعی #داده_محلی #اطلاعات_شخصی
🛠 مخزن پروژه در گیتهاب
🆔 @AI_TechPulse
دیگه نیازی نیست پیامای ویچتت رو دستی زیر و رو کنی
این ریپو یه سیستم کاملاً محلی و فقطخواندنیه که کل تاریخچه چتهات رو قابل جستجو و تحلیل میکنه
بدون دسترسی به کلید بدون ریساین و بدون Hook ویچت فقط یه Reader خالصه که میتونی با یه CLI یا حتی حرف زدن معمولی باهاش کار کنی
🔹 با نصبش میتونی روزانه خلاصه چت ها وعده ها فرصت ها و حتی لیست کارای عقبمونده رو بگیری همه چی به صورت محلی و امن
#ویچت #هوش_مصنوعی #داده_محلی #اطلاعات_شخصی
🛠 مخزن پروژه در گیتهاب
🆔 @AI_TechPulse
👍2
چک کن حافظه کش LLM محلیت چقدر واقعیه با این ابزار 🔍
تا حالا فکر کردی حافظه کش LLM که ادعا میکنه واقعاً همونقدر رو نگه میداره
یک توسعهدهنده روی vLLM با دو تا DGX Spark کار میکرده و حس کرده cache درست کار نمیکنه رفته تحقیق کرده باگ پیدا کرده و درستش کرده ولی نیاز داشته یه راهی برای تست درست شدنش داشته باشه نتیجه شده این ابزار که میتونی با یه پروتکل ساده ببینی دقیقاً چند تا توکن توی cache ذخیره میشه و چه موقعی context های قدیمی حذف میشن
🔹 توی تست A/B قبل از رفع مشکل از ۸۰ تا context فقط ۲۷ تا موند و ۵۲٪ از ظرفیت استفاده میشد بعد از رفع مشکل ۷۷ تا context موند و ۱۴۶٪ ظرفیت استفاده شد یعنی بیشتر از چیزی که ادعا شده بود
🛠 راهنمای استفاده سریع:
1. گام اول ریپو رو clone کن git clone https//githubcom/co-l/cache-pressure
2. گام دوم کتابخونه ها رو نصب کن pip install -r requirementstxt
3. گام سوم ابزار رو اجرا کن python۳ bench/cache_pressurepy --base-url http//my-server۸۰۰۰/v۱ --kv-size اندازه
4. گام چهارم نتایج رو ببین و بفهم cache واقعاً چقدر توکن نگه میداره
کاربرد در ایران 🇮🇷
برای توسعهدهنده های ایرانی که با مدل های محلی مثل DeepSeek کار میکنن این ابزار میتونه کمک کنه بفهمن cache بهینه کار میکنه یا نه
#LLM #کش #vLLM #ابزار_تست
🛠 مخزن پروژه در گیتهاب
🆔 @AI_TechPulse
تا حالا فکر کردی حافظه کش LLM که ادعا میکنه واقعاً همونقدر رو نگه میداره
یک توسعهدهنده روی vLLM با دو تا DGX Spark کار میکرده و حس کرده cache درست کار نمیکنه رفته تحقیق کرده باگ پیدا کرده و درستش کرده ولی نیاز داشته یه راهی برای تست درست شدنش داشته باشه نتیجه شده این ابزار که میتونی با یه پروتکل ساده ببینی دقیقاً چند تا توکن توی cache ذخیره میشه و چه موقعی context های قدیمی حذف میشن
🔹 توی تست A/B قبل از رفع مشکل از ۸۰ تا context فقط ۲۷ تا موند و ۵۲٪ از ظرفیت استفاده میشد بعد از رفع مشکل ۷۷ تا context موند و ۱۴۶٪ ظرفیت استفاده شد یعنی بیشتر از چیزی که ادعا شده بود
🛠 راهنمای استفاده سریع:
1. گام اول ریپو رو clone کن git clone https//githubcom/co-l/cache-pressure
2. گام دوم کتابخونه ها رو نصب کن pip install -r requirementstxt
3. گام سوم ابزار رو اجرا کن python۳ bench/cache_pressurepy --base-url http//my-server۸۰۰۰/v۱ --kv-size اندازه
4. گام چهارم نتایج رو ببین و بفهم cache واقعاً چقدر توکن نگه میداره
❓ تو خودت cache رو تست کردی یا فقط به عدد های ادعایی اعتماد کردی
کاربرد در ایران 🇮🇷
برای توسعهدهنده های ایرانی که با مدل های محلی مثل DeepSeek کار میکنن این ابزار میتونه کمک کنه بفهمن cache بهینه کار میکنه یا نه
#LLM #کش #vLLM #ابزار_تست
🛠 مخزن پروژه در گیتهاب
🆔 @AI_TechPulse
👍3
This media is not supported in your browser
VIEW IN TELEGRAM
ماجرای سینیوری که کد ها رو به هم ریخت 😂
داستان همیشگی توی تیم های برنامهنویسی
سینیور یه پروژه رو میریزه به هم بعد میبینه نمیتونه درستش کنه اونوقته که جونیور میاد و میگه بذار ببینم چطور میشه حلش کرد
🔹 این یه حقیقت تلخ و شیرینه که تجربه همیشه کافی نیست گاهی یه نگاه تازه میتونه معجزه کنه
#برنامهنویسی #سینیور #جونیور #توسعهدهندگان
🆔 @AI_TechPulse
داستان همیشگی توی تیم های برنامهنویسی
سینیور یه پروژه رو میریزه به هم بعد میبینه نمیتونه درستش کنه اونوقته که جونیور میاد و میگه بذار ببینم چطور میشه حلش کرد
🔹 این یه حقیقت تلخ و شیرینه که تجربه همیشه کافی نیست گاهی یه نگاه تازه میتونه معجزه کنه
#برنامهنویسی #سینیور #جونیور #توسعهدهندگان
🆔 @AI_TechPulse
👍3
This media is not supported in your browser
VIEW IN TELEGRAM
یه کلون از گوگل مپس در نیم ساعت 😱
دیدی چقدر سریع میشه یه پروژه خفن رو با هوش مصنوعی جلو برد
یه نفر با ChatGPT ۶ Pro توی سی دقیقه یه کلون از Google Maps درست کرده
لینکش رو گذاشته میتونی ببینی و خودت هم امتحان کنی
🔹 این یعنی سرعت توسعه با ابزار های جدید دیگه باورنکردنی شده
#ChatGPT #GoogleMaps #AI #تکنولوژی
📑 مستندات و لینک مرجع
🆔 @AI_TechPulse
دیدی چقدر سریع میشه یه پروژه خفن رو با هوش مصنوعی جلو برد
یه نفر با ChatGPT ۶ Pro توی سی دقیقه یه کلون از Google Maps درست کرده
لینکش رو گذاشته میتونی ببینی و خودت هم امتحان کنی
🔹 این یعنی سرعت توسعه با ابزار های جدید دیگه باورنکردنی شده
❓ تو با این قدرت چی میسازی
#ChatGPT #GoogleMaps #AI #تکنولوژی
📑 مستندات و لینک مرجع
🆔 @AI_TechPulse
👍4
مدل ۲۷ میلیاردی روی دو تا P۴۰ با سرعت ۴۸ توکن بر ثانیه 🚀
دو تا P۴۰ قدیمی میتونن یه Qwen ۲۷B رو با سرعت ۴۸ توکن بر ثانیه اجرا کنن
یه کاربر تو ردیت که یه سیستم با دو تا تسلا P۴۰ و یه زئون قدیمی داره (حدود ۱۱۰۰ دلار هزینه) میگه با تغییر کش KV از Q۸ به F۱۶ و فعال کردن MTP و ngram سرعتش رو چند برابر کرده قبلاً با Q۸ و تنظیمات معمولی ۱۵ تا ۳۲ توکن بر ثانیه میگرفته ولی طولانی مدت میافته رو ۱۲-۱۵ حالا با این توییک جدید تو متن های کوتاه رسیده به ۴۸ توکن بر ثانیه و تو متن های بلند ۱۳۰k+ هم حدود ۲۰ تا
🔹 نتایج بنچمارک ۴۸ توکن بر ثانیه تو حالت MTP با ۶ تا draft و ngram ۴۶ توکن بر ثانیه تو استفاده معمولی کد ۲۰ توکن بر ثانیه تو کانتکست بلند و پریفیل ۶۳۹۰۰ توکن با ۲۵۸ توکن بر ثانیه
کاربرد در ایران 🇮🇷
برای کسایی که تو ایران از GPU های قدیمی مثل P۴۰ یا P۱۰۰ استفاده میکنن این توییک میتونه سرعت اجرای مدل های بزرگ رو خیلی بالا ببره
#P۴۰ #بهینهسازی #MTP #Qwen #GPU
🆔 @AI_TechPulse
دو تا P۴۰ قدیمی میتونن یه Qwen ۲۷B رو با سرعت ۴۸ توکن بر ثانیه اجرا کنن
یه کاربر تو ردیت که یه سیستم با دو تا تسلا P۴۰ و یه زئون قدیمی داره (حدود ۱۱۰۰ دلار هزینه) میگه با تغییر کش KV از Q۸ به F۱۶ و فعال کردن MTP و ngram سرعتش رو چند برابر کرده قبلاً با Q۸ و تنظیمات معمولی ۱۵ تا ۳۲ توکن بر ثانیه میگرفته ولی طولانی مدت میافته رو ۱۲-۱۵ حالا با این توییک جدید تو متن های کوتاه رسیده به ۴۸ توکن بر ثانیه و تو متن های بلند ۱۳۰k+ هم حدود ۲۰ تا
🔹 نتایج بنچمارک ۴۸ توکن بر ثانیه تو حالت MTP با ۶ تا draft و ngram ۴۶ توکن بر ثانیه تو استفاده معمولی کد ۲۰ توکن بر ثانیه تو کانتکست بلند و پریفیل ۶۳۹۰۰ توکن با ۲۵۸ توکن بر ثانیه
❓ شما هم با GPU های قدیمی همچین توییکهایی رو امتحان کردین
کاربرد در ایران 🇮🇷
برای کسایی که تو ایران از GPU های قدیمی مثل P۴۰ یا P۱۰۰ استفاده میکنن این توییک میتونه سرعت اجرای مدل های بزرگ رو خیلی بالا ببره
#P۴۰ #بهینهسازی #MTP #Qwen #GPU
🆔 @AI_TechPulse
👍4
🤔 آدم ها یا ماشین ها کی رو بیشتر اعتماد میکنی
تا حالا فکر کردی یه روزی یه ربات بتونه به جای تو تو اینترنت کار کنه بدون اینکه هر بار ازت اجازه بگیره
آره دیگه داریم از مرحلهی سوال جواب ساده میریم به جایی که ایجنت های هوش مصنوعی میتونن خودشون تو سایت ها وارد بشن ایمیل بزنن پول جابجا کنن و حتی با سیستم های دیگه ارتباط بگیرن
🔹 تازه گزارش ها میگن بعضی از این ایجنت ها هزار تا تغییر رو خودشون انجام میدن بدون اینکه کسی نظارت کنه
#هوش_مصنوعی #ایجنت #اعتماد
🆔 @AI_TechPulse
تا حالا فکر کردی یه روزی یه ربات بتونه به جای تو تو اینترنت کار کنه بدون اینکه هر بار ازت اجازه بگیره
آره دیگه داریم از مرحلهی سوال جواب ساده میریم به جایی که ایجنت های هوش مصنوعی میتونن خودشون تو سایت ها وارد بشن ایمیل بزنن پول جابجا کنن و حتی با سیستم های دیگه ارتباط بگیرن
🔹 تازه گزارش ها میگن بعضی از این ایجنت ها هزار تا تغییر رو خودشون انجام میدن بدون اینکه کسی نظارت کنه
❓ به نظر خودت تا کجا باید بهشون اعتماد کرد مثلاً میدیم بهشون ایمیل رو پول رو شبکه های اجتماعی رو یا حتی کسبوکارمون رو یا هنوزم باید هر کار مهم رو خودمون تایید کنیم
#هوش_مصنوعی #ایجنت #اعتماد
🆔 @AI_TechPulse
👍4
انویدیا و کروداسترایک دست به یکی کردن 🤝
یه خبر خوب برای امنیت سایبری
انویدیا و کروداسترایک با همکاری هم یه سری مدل هوش مصنوعی جدید برای امنیت سایبری ساختن
🔹 این کار رو کردن چون فکر میکنن یکی از بزرگترین خلا های امنیت سایبری اینه که مدافعان نمیتونن به سرعت مهاجمان از هوش مصنوعی استفاده کنن
#هوش_مصنوعی #امنیت_سایبری #انویدیا #کروداسترایک
🆔 @AI_TechPulse
یه خبر خوب برای امنیت سایبری
انویدیا و کروداسترایک با همکاری هم یه سری مدل هوش مصنوعی جدید برای امنیت سایبری ساختن
🔹 این کار رو کردن چون فکر میکنن یکی از بزرگترین خلا های امنیت سایبری اینه که مدافعان نمیتونن به سرعت مهاجمان از هوش مصنوعی استفاده کنن
❓ به نظرتون این مدل ها میتونن سرعت واکنش رو به حد مهاجما برسونن
#هوش_مصنوعی #امنیت_سایبری #انویدیا #کروداسترایک
🆔 @AI_TechPulse
👍4
کاهش حافظه KV-cache تا ۹۹٪ با Sliding Window Attention 🧠
یکی از بچه های r/MachineLearning یه روش جالب برای استفاده از Sliding Window Attention روی مدل های از پیش آموزشدیده پیاده کرده
بهجای اینکه هر توکن جدید به کل حافظه KV قبلی دسترسی داشته باشه فقط یه بافر محدود شامل attention sinks و پنجره کشویی رو نگه میداره این کار رو بدون تغییر معماری یا ریتِرین کردن مدل انجام داده و بهعنوان یه لایه استنتاج مجزا نوشتهش
🔹 توی آزمایشش با Qwen۲.۵-۷B برای ۱۶K توکن حافظه KV از ۹۲۳ مگابایت رسیده به ۳٫۵ مگابایت و TPOT هم از ۳۸٫۴ میلیثانیه اومده به ۳۰٫۵ میلیثانیه حتی توی ۶۴K توکن حافظه ثابت ۳٫۵ مگابایتی داره درحالی که Full Attention دیگه اونطول رو هم نمیکشه
ولی طبیعتاً یه دردسر داره اگه تسک نیاز به اطلاعات دور از پنجره فعال داشته باشه ممکنه کیفیت بیاد پایین خودش میگه داره بررسی میکنه که چقدرش مال خود SWA هست و چقدرش مال پیادهسازی
اگه کسی توی inference یا بهینهسازی KV-cache کار میکنه بره یه نگاهی بندازه به ریپوی GitHub که توی پست گذاشته حتماً نظراتش رو باهاش به اشتراک بذاره
کاربرد در ایران 🇮🇷
برای تیم های ایرانی که روی استنتاج مدل های بزرگ با محدودیت حافظه کار میکنن این روش میتونه خیلی کاربردی باشه
#SWA #LLM #KV_Cache #بهینهسازی #یادگیری_عمیق
🛠 مخزن پروژه در گیتهاب
🆔 @AI_TechPulse
یکی از بچه های r/MachineLearning یه روش جالب برای استفاده از Sliding Window Attention روی مدل های از پیش آموزشدیده پیاده کرده
بهجای اینکه هر توکن جدید به کل حافظه KV قبلی دسترسی داشته باشه فقط یه بافر محدود شامل attention sinks و پنجره کشویی رو نگه میداره این کار رو بدون تغییر معماری یا ریتِرین کردن مدل انجام داده و بهعنوان یه لایه استنتاج مجزا نوشتهش
🔹 توی آزمایشش با Qwen۲.۵-۷B برای ۱۶K توکن حافظه KV از ۹۲۳ مگابایت رسیده به ۳٫۵ مگابایت و TPOT هم از ۳۸٫۴ میلیثانیه اومده به ۳۰٫۵ میلیثانیه حتی توی ۶۴K توکن حافظه ثابت ۳٫۵ مگابایتی داره درحالی که Full Attention دیگه اونطول رو هم نمیکشه
ولی طبیعتاً یه دردسر داره اگه تسک نیاز به اطلاعات دور از پنجره فعال داشته باشه ممکنه کیفیت بیاد پایین خودش میگه داره بررسی میکنه که چقدرش مال خود SWA هست و چقدرش مال پیادهسازی
❓ به نظر شما کدوم معماری های مدل رو باید بعدی تست کنه یا چه سناریو های شکستی رو benchmark بزنه
اگه کسی توی inference یا بهینهسازی KV-cache کار میکنه بره یه نگاهی بندازه به ریپوی GitHub که توی پست گذاشته حتماً نظراتش رو باهاش به اشتراک بذاره
کاربرد در ایران 🇮🇷
برای تیم های ایرانی که روی استنتاج مدل های بزرگ با محدودیت حافظه کار میکنن این روش میتونه خیلی کاربردی باشه
#SWA #LLM #KV_Cache #بهینهسازی #یادگیری_عمیق
🛠 مخزن پروژه در گیتهاب
🆔 @AI_TechPulse
GitHub
GitHub - oraby8/SWA
Contribute to oraby8/SWA development by creating an account on GitHub.
👍4
سه تا بنچمارک جدید که واقعا عمق توانایی مدل های کدزنی رو نشون میدن
بنچمارک های معمولی دیگه کافی نیستن برای فهمیدن عمق توانایی مدل ها
تو این پست سه تا بنچمارک جدید و سخت رو معرفی کردن که واقعا عمق توانایی یه مدل رو نشون میدن این بنچمارک ها خیلی فراتر از تست های معمولی کدزنی هستن
🔹 اولی Program-Bench هست جایی که مدل فقط یه باینری کامپایل شده و مستنداتش رو میبینه و باید بدون دسترسی به دیکامپایلر یا اینترنت کل کدبیس رو از نو بنویسه تا دقیقا همون رفتار رو داشته باشه امتیاز ها GPT-۶ Astra ۵.۵% Fable ۵.۱ ۷% Kimi K۳ ۲% Qwen۳.۸ ۲۷b ۰%
🔹 دومی SRE-Bench هست که از مدل میخواد بفهمه یه باینری واقعی بدون سورس کدش چیکار میکنه این دیگه واقعا سخت چون حتی تو کار روزمره کسی اسمبلی نمیخونه ولی توانایی فهم یه برنامه کامپایل شده نشوندهنده هوش بالاییه امتیاز ها GPT-۶ Astra ۸۸% GPT-۵.۶ Sol ۵۵.۹% Claude Opus ۵ max ۱۲.۵%
🔹 سومی Code Migration هست که مدل باید یه برنامه رو از یه زبان به یه زبان دیگه بازنویسی کنه امتیاز ها GPT-۶ Astra ۶۷.۷% Fable ۵.۱ ۵۴.۶% GLM ۵.۳ ۴۴.۲% GLM ۵.۳ Flash ۲۰.۵% Qwen۳.۸ ۲۷b ۱۴.۲%
#بنچمارک #کدنویسی #هوش_مصنوعی #LLM #مدل_زبانی
📑 مستندات و لینک مرجع
📑 مستندات و لینک مرجع
📑 مستندات و لینک مرجع
🆔 @AI_TechPulse
بنچمارک های معمولی دیگه کافی نیستن برای فهمیدن عمق توانایی مدل ها
تو این پست سه تا بنچمارک جدید و سخت رو معرفی کردن که واقعا عمق توانایی یه مدل رو نشون میدن این بنچمارک ها خیلی فراتر از تست های معمولی کدزنی هستن
🔹 اولی Program-Bench هست جایی که مدل فقط یه باینری کامپایل شده و مستنداتش رو میبینه و باید بدون دسترسی به دیکامپایلر یا اینترنت کل کدبیس رو از نو بنویسه تا دقیقا همون رفتار رو داشته باشه امتیاز ها GPT-۶ Astra ۵.۵% Fable ۵.۱ ۷% Kimi K۳ ۲% Qwen۳.۸ ۲۷b ۰%
🔹 دومی SRE-Bench هست که از مدل میخواد بفهمه یه باینری واقعی بدون سورس کدش چیکار میکنه این دیگه واقعا سخت چون حتی تو کار روزمره کسی اسمبلی نمیخونه ولی توانایی فهم یه برنامه کامپایل شده نشوندهنده هوش بالاییه امتیاز ها GPT-۶ Astra ۸۸% GPT-۵.۶ Sol ۵۵.۹% Claude Opus ۵ max ۱۲.۵%
🔹 سومی Code Migration هست که مدل باید یه برنامه رو از یه زبان به یه زبان دیگه بازنویسی کنه امتیاز ها GPT-۶ Astra ۶۷.۷% Fable ۵.۱ ۵۴.۶% GLM ۵.۳ ۴۴.۲% GLM ۵.۳ Flash ۲۰.۵% Qwen۳.۸ ۲۷b ۱۴.۲%
💡 تحلیل:
این بنچمارک ها نشون میدن که حتی مدل های قوی هم تو کار های واقعا پیچیده مهندسی نرم افزار مشکل دارن مخصوصا تو فهم و بازتولید برنامه های کامپایل شده بدون سورس کد برای کسایی که دنبال مدل های عمیقتر میگردن این تست ها خیلی ارزشمندن
#بنچمارک #کدنویسی #هوش_مصنوعی #LLM #مدل_زبانی
📑 مستندات و لینک مرجع
📑 مستندات و لینک مرجع
📑 مستندات و لینک مرجع
🆔 @AI_TechPulse
👍4
🧊 دو تا کد کتاب برای ساخت صفحه خوشآمدگویی شیشهای مایع
یه پروژه منبع باز جذاب برای React Native اومده که میتونی باهاش صفحه خوشآمدگویی شیشهای مایع با انیمیشن سوایپ بسازی
این ریپو دو تا کد کتاب (cookbook) داره یکی اسکای و یکی آسترو هر کدوم یه تم متفاوت دارن با انیمیشن های خاص مثل گنبد شیشهای که با سوایپ بالا میاد و کوچیک میشه تا تبدیل به دکمه پلاس بشه یک افکت رنگی خفن هم موقع کشیدن جمع میشه
🔹 این پروژه ۲۳۷ ستاره داره و با تایپاسکریپت و Expo ساخته شده
برو توی گیتهابش یه نگاهی بنداز و اگه خوشت اومد یه ستاره بده
کاربرد در ایران 🇮🇷
برای توسعهدهندگان موبایل در ایران که با React Native کار میکنن این یه منبع عالیه برای ساخت صفحه های خوشآمدگویی جذاب
#ReactNative #Expo #UI #OpenSource #Animation
🛠 مخزن پروژه در گیتهاب
🆔 @AI_TechPulse
یه پروژه منبع باز جذاب برای React Native اومده که میتونی باهاش صفحه خوشآمدگویی شیشهای مایع با انیمیشن سوایپ بسازی
این ریپو دو تا کد کتاب (cookbook) داره یکی اسکای و یکی آسترو هر کدوم یه تم متفاوت دارن با انیمیشن های خاص مثل گنبد شیشهای که با سوایپ بالا میاد و کوچیک میشه تا تبدیل به دکمه پلاس بشه یک افکت رنگی خفن هم موقع کشیدن جمع میشه
🔹 این پروژه ۲۳۷ ستاره داره و با تایپاسکریپت و Expo ساخته شده
برو توی گیتهابش یه نگاهی بنداز و اگه خوشت اومد یه ستاره بده
کاربرد در ایران 🇮🇷
برای توسعهدهندگان موبایل در ایران که با React Native کار میکنن این یه منبع عالیه برای ساخت صفحه های خوشآمدگویی جذاب
#ReactNative #Expo #UI #OpenSource #Animation
🛠 مخزن پروژه در گیتهاب
🆔 @AI_TechPulse
👍4
دیپ سیک و چت جی پی تی یه نقطه مشترک دارن
یادش بخیر اون روزا که دیپ سیک وسط فارسی کاراکتر چینی مینداخت
حالا دقیقا همون درد داره میاد سراغ چت جی پی تی انگار داره ازش یاد میگیره
کاربرد در ایران 🇮🇷
کاربران ایرانی متوجه شباهت این مشکل میشوند
#چتجیپیتی #دیپسیک #زبانفارسی
🆔 @AI_TechPulse
یادش بخیر اون روزا که دیپ سیک وسط فارسی کاراکتر چینی مینداخت
حالا دقیقا همون درد داره میاد سراغ چت جی پی تی انگار داره ازش یاد میگیره
❓ به نظرتون چت جی پی تی هم مثل دیپ سیک درست میشه یا قراره تکرار تاریخ باشه
کاربرد در ایران 🇮🇷
کاربران ایرانی متوجه شباهت این مشکل میشوند
#چتجیپیتی #دیپسیک #زبانفارسی
🆔 @AI_TechPulse
👍1
خبر داغ داغ از گوگل رسید 🔥
گوگل اولین چکپوینت داخلی جمنای ۴ پرو رو ریلیز کرده قراره اکتبر به صورت عمومی در دسترس باشه
🔹 تو تست های کدنویسی از Fable ۵.۱ جلو زده و با GPT-۶ Astra رقابت میکنه همچنین ممکنه امسال Flash-Lite و NB۲Lite جدید هم بیاد
#گوگل #جمنای۴ #هوش_مصنوعی #کدنویسی
🆔 @AI_TechPulse
خبر داغ داغ از گوگل رسید 🔥
گوگل اولین چکپوینت داخلی جمنای ۴ پرو رو ریلیز کرده قراره اکتبر به صورت عمومی در دسترس باشه
🔹 تو تست های کدنویسی از Fable ۵.۱ جلو زده و با GPT-۶ Astra رقابت میکنه همچنین ممکنه امسال Flash-Lite و NB۲Lite جدید هم بیاد
🎯 پیامد:
به نظر میاد گوگل ۳.۵ Pro رو کلاً اسکیپ کرده و مستقیم رفته سراغ جمنای ۴
#گوگل #جمنای۴ #هوش_مصنوعی #کدنویسی
🆔 @AI_TechPulse
👍1
🎬 یه ابزار متنباز و رایگان برای تبدیل ویدیو های یوتیوب به شورت ویدیو های ویروسی
دوست داری ویدیو های یوتیوب رو بندازی تو یه ابزار و شورت ویدیو های آماده بگیری
این پروژه متنباز همه کار رو برات انجام میده دانلود ویدیو از یوتیوب تشخیص هایلایت های جذاب زیرنویس ترجمه و حتی صداگذاری هم داره و خروجی ۹۱۶ میده آماده برای انتشار
🔹 ۶۲۵ تا ستاره روی گیتهاب گرفته و یه جایگزین رایگان برای OpusClip و Vidyoai محسوب میشه
کاملاً رایگان و متنباز با پشتیبانی از API و رابط وب میتونی هم از خط فرمان استفاده کنی هم از مرورگر
برو گیتهابش رو ببین و اگه تولیدکننده محتوایی حتما یه نگاهی بنداز
کاربرد در ایران 🇮🇷
برای تولیدکننده های محتوای ایرانی که میخوان بدون هزینه ابزار های خارجی مثل OpusClip شورت ویدیو بسازن این ابزار میتونه خیلی به کار بیاد
#ابزار_متنباز #شورت_ویدیو #تولید_محتوا #گیتهاب #یوتیوب
🛠 مخزن پروژه در گیتهاب
🆔 @AI_TechPulse
دوست داری ویدیو های یوتیوب رو بندازی تو یه ابزار و شورت ویدیو های آماده بگیری
این پروژه متنباز همه کار رو برات انجام میده دانلود ویدیو از یوتیوب تشخیص هایلایت های جذاب زیرنویس ترجمه و حتی صداگذاری هم داره و خروجی ۹۱۶ میده آماده برای انتشار
🔹 ۶۲۵ تا ستاره روی گیتهاب گرفته و یه جایگزین رایگان برای OpusClip و Vidyoai محسوب میشه
کاملاً رایگان و متنباز با پشتیبانی از API و رابط وب میتونی هم از خط فرمان استفاده کنی هم از مرورگر
برو گیتهابش رو ببین و اگه تولیدکننده محتوایی حتما یه نگاهی بنداز
کاربرد در ایران 🇮🇷
برای تولیدکننده های محتوای ایرانی که میخوان بدون هزینه ابزار های خارجی مثل OpusClip شورت ویدیو بسازن این ابزار میتونه خیلی به کار بیاد
#ابزار_متنباز #شورت_ویدیو #تولید_محتوا #گیتهاب #یوتیوب
🛠 مخزن پروژه در گیتهاب
🆔 @AI_TechPulse
👍1
بچه ها یه خبرایی داره میاد در مورد رفع فیلتر اینستاگرام و تلگرام. فعلا در حد خبر هست همه این اخبار به نقل از عباس پازوکی معاون ارتباطات دفتر معاون اول رئیس جمهور دراه میاد.
امیدواریم که واقعیت داشته باشه هرچند نوش دارو بعداز مرگ سهراب هست🧌
امیدواریم که واقعیت داشته باشه هرچند نوش دارو بعداز مرگ سهراب هست🧌
👍1
📅 خلاصه روز
مرور سریع مهمترین خبرهای امروز 👇
💬 سه تا بنچمارک جدید که واقعا عمق توانایی مدل های کدزنی رو نشون میدن
بنچمارک های معمولی دیگه کافی نیستن برای فهمیدن عمق توانایی مدل ها تو این پست سه تا بنچمارک جدید و سخت رو معرفی کردن که واقعا عمق توانایی یه مدل رو نشون میدن این بنچمارک ها خیلی فراتر از تست های معمولی کدزنی هستن 🔹 اولی Program-Bench هست جایی که مدل فقط یه باینری کامپایل شده و مستنداتش رو میبینه و باید بدون دسترسی به دیکامپایلر یا اینترنت کل کدبیس رو از نو بنویسه تا دقیقا همون رفتار رو داشته باشه امتیاز ها GPT-۶…
#خبر_اصلی
💬 انویدیا و کروداسترایک دست به یکی کردن 🤝
یه خبر خوب برای امنیت سایبری انویدیا و کروداسترایک با همکاری هم یه سری مدل هوش مصنوعی جدید برای امنیت سایبری ساختن 🔹 این کار رو کردن چون فکر میکنن یکی از بزرگترین خلا های امنیت سایبری اینه که مدافعان نمیتونن به سرعت مهاجمان از هوش مصنوعی استفاده کنن ❓ به نظرتون این مدل ها میتونن سرعت واکنش رو به حد مهاجما برسونن #هوش_مصنوعی #امنیت_سایبری #انویدیا #کروداسترایک
#خبر_اصلی
📢 یه کلون از گوگل مپس در نیم ساعت 😱
دیدی چقدر سریع میشه یه پروژه خفن رو با هوش مصنوعی جلو برد یه نفر با ChatGPT ۶ Pro توی سی دقیقه یه کلون از Google Maps درست کرده لینکش رو گذاشته میتونی ببینی و خودت هم امتحان کنی 🔹 این یعنی سرعت توسعه با ابزار های جدید دیگه باورنکردنی شده ❓ تو با این قدرت چی میسازی #ChatGPT #GoogleMaps #AI #تکنولوژی
#خبر_اصلی
💬 کاهش حافظه KV-cache تا ۹۹٪ با Sliding Window Attention 🧠
یکی از بچه های r/MachineLearning یه روش جالب برای استفاده از Sliding Window Attention روی مدل های از پیش آموزشدیده پیاده کرده بهجای اینکه هر توکن جدید به کل حافظه KV قبلی دسترسی داشته باشه فقط یه بافر محدود شامل attention sinks و پنجره کشویی رو نگه میداره این کار رو بدون تغییر معماری یا ریتِرین کردن مدل انجام داده و بهعنوان یه لایه استنتاج مجزا نوشتهش 🔹 توی آزمایشش با Qwen۲.۵-۷B برای ۱۶K توکن حافظه KV از ۹۲۳…
#خبر_اصلی
💬 چک کن حافظه کش LLM محلیت چقدر واقعیه با این ابزار 🔍
تا حالا فکر کردی حافظه کش LLM که ادعا میکنه واقعاً همونقدر رو نگه میداره یک توسعهدهنده روی vLLM با دو تا DGX Spark کار میکرده و حس کرده cache درست کار نمیکنه رفته تحقیق کرده باگ پیدا کرده و درستش کرده ولی نیاز داشته یه راهی برای تست درست شدنش داشته باشه نتیجه شده این ابزار که میتونی با یه پروتکل ساده ببینی دقیقاً چند تا توکن توی cache ذخیره میشه و چه موقعی context های قدیمی حذف میشن 🔹 توی تست A/B قبل از…
#خبر_اصلی
📢 ماجرای سینیوری که کد ها رو به هم ریخت 😂
داستان همیشگی توی تیم های برنامهنویسی سینیور یه پروژه رو میریزه به هم بعد میبینه نمیتونه درستش کنه اونوقته که جونیور میاد و میگه بذار ببینم چطور میشه حلش کرد 🔹 این یه حقیقت تلخ و شیرینه که تجربه همیشه کافی نیست گاهی یه نگاه تازه میتونه معجزه کنه #برنامهنویسی #سینیور #جونیور #توسعهدهندگان
#خبر_اصلی
💬 مدل ۲۷ میلیاردی روی دو تا P۴۰ با سرعت ۴۸ توکن بر ثانیه 🚀
مادربزرگ که نه ولی دو تا P۴۰ قدیمی میتونن یه Qwen ۲۷B رو با سرعت ۴۸ توکن بر ثانیه اجرا کنن یه کاربر تو ردیت که یه سیستم با دو تا تسلا P۴۰ و یه زیون قدیمی داره (حدود ۱۱۰۰ دلار هزینه) میگه با تغییر کش KV از Q۸ به F۱۶ و فعال کردن MTP و ngram سرعتش رو چند برابر کرده قبلاً با Q۸ و تنظیمات معمولی ۱۵ تا ۳۲ توکن بر ثانیه میگرفته ولی طولانی مدت میافته رو ۱۲-۱۵ حالا با این توییک جدید تو متن های کوتاه رسیده به ۴۸ توکن بر…
#خبر_اصلی
…
مرور سریع مهمترین خبرهای امروز 👇
💬 سه تا بنچمارک جدید که واقعا عمق توانایی مدل های کدزنی رو نشون میدن
بنچمارک های معمولی دیگه کافی نیستن برای فهمیدن عمق توانایی مدل ها تو این پست سه تا بنچمارک جدید و سخت رو معرفی کردن که واقعا عمق توانایی یه مدل رو نشون میدن این بنچمارک ها خیلی فراتر از تست های معمولی کدزنی هستن 🔹 اولی Program-Bench هست جایی که مدل فقط یه باینری کامپایل شده و مستنداتش رو میبینه و باید بدون دسترسی به دیکامپایلر یا اینترنت کل کدبیس رو از نو بنویسه تا دقیقا همون رفتار رو داشته باشه امتیاز ها GPT-۶…
#خبر_اصلی
💬 انویدیا و کروداسترایک دست به یکی کردن 🤝
یه خبر خوب برای امنیت سایبری انویدیا و کروداسترایک با همکاری هم یه سری مدل هوش مصنوعی جدید برای امنیت سایبری ساختن 🔹 این کار رو کردن چون فکر میکنن یکی از بزرگترین خلا های امنیت سایبری اینه که مدافعان نمیتونن به سرعت مهاجمان از هوش مصنوعی استفاده کنن ❓ به نظرتون این مدل ها میتونن سرعت واکنش رو به حد مهاجما برسونن #هوش_مصنوعی #امنیت_سایبری #انویدیا #کروداسترایک
#خبر_اصلی
📢 یه کلون از گوگل مپس در نیم ساعت 😱
دیدی چقدر سریع میشه یه پروژه خفن رو با هوش مصنوعی جلو برد یه نفر با ChatGPT ۶ Pro توی سی دقیقه یه کلون از Google Maps درست کرده لینکش رو گذاشته میتونی ببینی و خودت هم امتحان کنی 🔹 این یعنی سرعت توسعه با ابزار های جدید دیگه باورنکردنی شده ❓ تو با این قدرت چی میسازی #ChatGPT #GoogleMaps #AI #تکنولوژی
#خبر_اصلی
💬 کاهش حافظه KV-cache تا ۹۹٪ با Sliding Window Attention 🧠
یکی از بچه های r/MachineLearning یه روش جالب برای استفاده از Sliding Window Attention روی مدل های از پیش آموزشدیده پیاده کرده بهجای اینکه هر توکن جدید به کل حافظه KV قبلی دسترسی داشته باشه فقط یه بافر محدود شامل attention sinks و پنجره کشویی رو نگه میداره این کار رو بدون تغییر معماری یا ریتِرین کردن مدل انجام داده و بهعنوان یه لایه استنتاج مجزا نوشتهش 🔹 توی آزمایشش با Qwen۲.۵-۷B برای ۱۶K توکن حافظه KV از ۹۲۳…
#خبر_اصلی
💬 چک کن حافظه کش LLM محلیت چقدر واقعیه با این ابزار 🔍
تا حالا فکر کردی حافظه کش LLM که ادعا میکنه واقعاً همونقدر رو نگه میداره یک توسعهدهنده روی vLLM با دو تا DGX Spark کار میکرده و حس کرده cache درست کار نمیکنه رفته تحقیق کرده باگ پیدا کرده و درستش کرده ولی نیاز داشته یه راهی برای تست درست شدنش داشته باشه نتیجه شده این ابزار که میتونی با یه پروتکل ساده ببینی دقیقاً چند تا توکن توی cache ذخیره میشه و چه موقعی context های قدیمی حذف میشن 🔹 توی تست A/B قبل از…
#خبر_اصلی
📢 ماجرای سینیوری که کد ها رو به هم ریخت 😂
داستان همیشگی توی تیم های برنامهنویسی سینیور یه پروژه رو میریزه به هم بعد میبینه نمیتونه درستش کنه اونوقته که جونیور میاد و میگه بذار ببینم چطور میشه حلش کرد 🔹 این یه حقیقت تلخ و شیرینه که تجربه همیشه کافی نیست گاهی یه نگاه تازه میتونه معجزه کنه #برنامهنویسی #سینیور #جونیور #توسعهدهندگان
#خبر_اصلی
💬 مدل ۲۷ میلیاردی روی دو تا P۴۰ با سرعت ۴۸ توکن بر ثانیه 🚀
مادربزرگ که نه ولی دو تا P۴۰ قدیمی میتونن یه Qwen ۲۷B رو با سرعت ۴۸ توکن بر ثانیه اجرا کنن یه کاربر تو ردیت که یه سیستم با دو تا تسلا P۴۰ و یه زیون قدیمی داره (حدود ۱۱۰۰ دلار هزینه) میگه با تغییر کش KV از Q۸ به F۱۶ و فعال کردن MTP و ngram سرعتش رو چند برابر کرده قبلاً با Q۸ و تنظیمات معمولی ۱۵ تا ۳۲ توکن بر ثانیه میگرفته ولی طولانی مدت میافته رو ۱۲-۱۵ حالا با این توییک جدید تو متن های کوتاه رسیده به ۴۸ توکن بر…
#خبر_اصلی
…
👍1