AI TechPulse 📱
2.19K subscribers
919 photos
109 videos
43 files
1.14K links
🚀 مرجع داغ ترین اخبار هوش مصنوعی، ابزارهای کاربردی برنامه‌نویسی و مخازن ترند گیت‌هاب و ردیت خوراک Vibe Code
بدون حاشیه، سریع و کاربردی برای توسعه‌دهندگان و عاشقان تکنولوژی!
📌 ارتباط با ادمین: @captainjohnpric
📌 کانال رسمی: @AI_TechPulse
Download Telegram
‏GPT-۶ رو ۲۴ ساعته جیلبریک کردن 😱

‏خبر فوری فوری

‏GPT-۶ آسترا که تازه از راه رسیده بود رو یه محقق تونسته ظرف ۲۴ ساعت جیلبریک کنه این حمله یه نسخه پیشرفته از تکنیک Task-in-Prompt بوده که قبلاً توی یه مقاله ACL ۲۰۲۵ معرفی شده بود

🔹 جالب اینجاست که همین محقق پارسال GPT-۵ رو هم توی یه ساعت جیلبریک کرده بود

🔹 جزییات این حمله رو محقق به صورت خصوصی به OpenAI داده و منتشر نکرده

‏کاربرد در ایران 🇮🇷
‏هرچند این خبر مستقیماً برای ایران نیست ولی نشون میده مدل های بزرگ زبانی که خیلیا استفاده می‌کنن هنوزم آسیب‌پذیرن و امنیتشون قطعی نیست

#GPT۶ #جیلبریک #OpenAI #امنیت

🆔 @AI_TechPulse
👍1
SQL Cheat Sheet.pdf
827.6 KB
‏برگه تقلب SQL 🃏

‏اینم یه منبع خوب برای یادگیری سریع SQL

‏برگه تقلب SQL منبع - یه صفحه جمع و جور که تمام دستورات پرکاربرد رو داره

🔹 منبع رایگان و کاربردی برای تازه‌کارا و حرفه‌ایا

#SQL

🆔 @AI_TechPulse
👍1
📩 سیو کردن پیامای دلیت شده تو تلگرام با یه سلف‌بات

‏اگه از این که پیامای دلیت شده از پیویتون بره ناراحتین یه خبر خوب دارم

‏یه پروژه سلف‌بات اومده که روی اکانت تلگرامیت ران میشه و هر پیامی که از پیوی مخاطبت پاک بشه رو برات سیو می‌کنه

🔹 این سلف‌بات دقیقاً برای مواقعی ساخته شده که نمی‌خوای پیامای دو طرفه حذف بشن و می‌خوای یه نسخه ازشون داشته باشی

‏روش راه‌اندازیش توی ریدمی خود پروژه کامل توضیح داده شده پس اگر خواستی امتحانش کنی حتماً یه نگاه بهش بنداز

‏کاربرد در ایران 🇮🇷
‏برای کسایی که تو ایران از تلگرام استفاده می‌کنن و می‌خوان پیامای حذف شده رو از دست ندن خیلی کاربردیه مثل ذخیره‌سازی مکالمات کاری یا شخصی

#تلگرام #سلف_بات #دلیت_پیام

🛠 مخزن پروژه در گیت‌هاب
🆔 @AI_TechPulse
👍2
‏Usque MASQUE Pro v۶.۷ همه‌کاره‌ترین ابزار WARP تو مرورگرت

‏اگه از دستی ورک کردن با کانفیگ WARP و MASQUE خسته شدی این ابزار دقیقا همون چیزیه که نیاز داری

‏Usque MASQUE Pro یه ابزار تحت وب هست که توی مرورگرت می‌تونی ثبت‌نام WARP انجام بدی کانفیگ تولید کنی و حتی برای Clash و Mihomo و Shadowrocket و sing-box خروجی بگیری همه چی تو مرورگر انجام می‌شه و نیازی به نصب نرم افزار اضافه نیست

🔹 این ریپو الان ۳۶۹ تا ستاره داره و تو گیت‌هاب به صورت متن‌باز منتشر شده

‏• ثبت‌نام یک‌کلیکی WARP و MASQUE تو مرورگر
‏• تولید کانفیگ برای Clash یا Mihomo با رول های هوشمند مثل YouTube Netflix و Telegram
‏• خروجی برای Shadowrocket و sing-box و VLESS
‏• پشتیبانی از QUIC یا H۳ و H۲
‏• قابلیت تشخیص WARP و تست خروجی با گزارش JSON یا CSV

‏برو گیت‌هابش رو ببین و اگه مفید بود ستاره بده

‏کاربرد در ایران 🇮🇷
‏برای کاربران ایرانی که با WARP و کانفیگ های مختلف سروکار دارن این ابزار خیلی مفیده چون مراحل ثبت‌نام و تولید کانفیگ رو ساده می‌کنه

#Cloudflare #WARP #MASQUE #GitHub #ابزار

🛠 مخزن پروژه در گیت‌هاب
🆔 @AI_TechPulse
👍2
🥶 حافظه دائمی برای AI Agent ها با OKF Agent Memory

‏اگه از این که AI Agent هات بعد از بستن پنجره همه چی رو فراموش می‌کنن خسته شدی یه خبر خوب دارم

‏OKF Agent Memory یه مخزن گیت‌نیتیو برای ذخیره‌سازی حافظه دائمی Agent‌هاست با این ابزار دیگه نیاز به دیتابیس خارجی یا وکتور دیتابیس نداری و همه چی به صورت فایل مارک‌داون با YAML frontmatter داخل خود ریپو ذخیره می‌شه

🔹 این سیستم بر اساس Google OKF v۰.۲ ساخته شده و جستجوی BM۲۵ رو تو کمتر از ۳۰۰ میکروثانیه انجام می‌ده همچنین مصرف توکن رو تا ۸۰ درصد کاهش می‌ده

‏بدون هیچ وابستگی خارجی فقط با Go خالص ساخته شده

‏• سرعت بالا با جستجوی زیر ۳۰۰ میکروثانیه
‏• کاهش ۸۰ درصدی توکن ها
‏• قابلیت اجرا با LM Studio و Ollama
‏• شامل MCP Server داخلی

‏اگه با AI Agent کار می‌کنی حتماً یه نگاهی به این پروژه بنداز خلاصه که خیلی به کارت میاد

‏کاربرد در ایران 🇮🇷
‏برای توسعه‌دهنده های ایرانی که با AI Agent کار می‌کنن خیلی مفیده چون هم متن‌باز و هم سبک

#حافظه_دایمی #AI_Agent #OKF #Go #MCP

🛠 مخزن پروژه در گیت‌هاب
🆔 @AI_TechPulse
👍3
‏Qwen ۳.۸ Flash Next چقدر روی Apple Silicon سریعه

‏جدیدترین مدل Qwen یعنی ۳.۸ Flash Next اومده رو Apple Silicon ببینم چقدر سریعه

‏رو M۴ Max رسیده به ۴۵ توکن در ثانیه و رو M۲ Ultra هم ۲۵ توکن در ثانیه می‌ده

🔹 نکته جالبش اینه که سرعتش با Qwen ۳.۸ ۲۷B روی Apple Silicon برابری می‌کنه

#Qwen #AppleSilicon #LLM

🆔 @AI_TechPulse
👍3
‏وی‌چت رو تبدیل کن به پایگاه اطلاعات شخصی هوشمند 🧠

‏دیگه نیازی نیست پیامای وی‌چتت رو دستی زیر و رو کنی

‏این ریپو یه سیستم کاملاً محلی و فقط‌خواندنیه که کل تاریخچه چت‌هات رو قابل جستجو و تحلیل می‌کنه

‏بدون دسترسی به کلید بدون ری‌ساین و بدون Hook وی‌چت فقط یه Reader خالصه که می‌تونی با یه CLI یا حتی حرف زدن معمولی باهاش کار کنی

🔹 با نصبش می‌تونی روزانه خلاصه چت ها وعده ها فرصت ها و حتی لیست کارای عقب‌مونده رو بگیری همه چی به صورت محلی و امن

#وی‌چت #هوش_مصنوعی #داده_محلی #اطلاعات_شخصی

🛠 مخزن پروژه در گیت‌هاب
🆔 @AI_TechPulse
👍2
‏چک کن حافظه کش LLM محلیت چقدر واقعیه با این ابزار 🔍

‏تا حالا فکر کردی حافظه کش LLM که ادعا می‌کنه واقعاً همونقدر رو نگه می‌داره

‏یک توسعه‌دهنده روی vLLM با دو تا DGX Spark کار می‌کرده و حس کرده cache درست کار نمی‌کنه رفته تحقیق کرده باگ پیدا کرده و درستش کرده ولی نیاز داشته یه راهی برای تست درست شدنش داشته باشه نتیجه شده این ابزار که می‌تونی با یه پروتکل ساده ببینی دقیقاً چند تا توکن توی cache ذخیره می‌شه و چه موقعی context های قدیمی حذف می‌شن

🔹 توی تست A/B قبل از رفع مشکل از ۸۰ تا context فقط ۲۷ تا موند و ۵۲٪ از ظرفیت استفاده می‌شد بعد از رفع مشکل ۷۷ تا context موند و ۱۴۶٪ ظرفیت استفاده شد یعنی بیشتر از چیزی که ادعا شده بود

🛠 راهنمای استفاده سریع:
‏1. گام اول ریپو رو clone کن git clone https//githubcom/co-l/cache-pressure
‏2. گام دوم کتابخونه ها رو نصب کن pip install -r requirementstxt
‏3. گام سوم ابزار رو اجرا کن python۳ bench/cache_pressurepy --base-url http//my-server۸۰۰۰/v۱ --kv-size اندازه
‏4. گام چهارم نتایج رو ببین و بفهم cache واقعاً چقدر توکن نگه می‌داره

‏تو خودت cache رو تست کردی یا فقط به عدد های ادعایی اعتماد کردی


‏کاربرد در ایران 🇮🇷
‏برای توسعه‌دهنده های ایرانی که با مدل های محلی مثل DeepSeek کار می‌کنن این ابزار می‌تونه کمک کنه بفهمن cache بهینه کار می‌کنه یا نه

#LLM #کش #vLLM #ابزار_تست

🛠 مخزن پروژه در گیت‌هاب

🆔 @AI_TechPulse
👍3
This media is not supported in your browser
VIEW IN TELEGRAM
‏ماجرای سینیوری که کد ها رو به هم ریخت 😂

‏داستان همیشگی توی تیم های برنامه‌نویسی

‏سینیور یه پروژه رو می‌ریزه به هم بعد می‌بینه نمی‌تونه درستش کنه اونوقته که جونیور میاد و می‌گه بذار ببینم چطور می‌شه حلش کرد

🔹 این یه حقیقت تلخ و شیرینه که تجربه همیشه کافی نیست گاهی یه نگاه تازه می‌تونه معجزه کنه

#برنامه‌نویسی #سینیور #جونیور #توسعه‌دهندگان

🆔 @AI_TechPulse
👍3
This media is not supported in your browser
VIEW IN TELEGRAM
‏یه کلون از گوگل مپس در نیم ساعت 😱

‏دیدی چقدر سریع میشه یه پروژه خفن رو با هوش مصنوعی جلو برد

‏یه نفر با ChatGPT ۶ Pro توی سی دقیقه یه کلون از Google Maps درست کرده

‏لینکش رو گذاشته میتونی ببینی و خودت هم امتحان کنی

🔹 این یعنی سرعت توسعه با ابزار های جدید دیگه باورنکردنی شده

‏تو با این قدرت چی میسازی


#ChatGPT #GoogleMaps #AI #تکنولوژی

📑 مستندات و لینک مرجع
🆔 @AI_TechPulse
👍4
‏مدل ۲۷ میلیاردی روی دو تا P۴۰ با سرعت ۴۸ توکن بر ثانیه 🚀

دو تا P۴۰ قدیمی می‌تونن یه Qwen ۲۷B رو با سرعت ۴۸ توکن بر ثانیه اجرا کنن

‏یه کاربر تو ردیت که یه سیستم با دو تا تسلا P۴۰ و یه زئون قدیمی داره (حدود ۱۱۰۰ دلار هزینه) می‌گه با تغییر کش KV از Q۸ به F۱۶ و فعال کردن MTP و ngram سرعتش رو چند برابر کرده قبلاً با Q۸ و تنظیمات معمولی ۱۵ تا ۳۲ توکن بر ثانیه می‌گرفته ولی طولانی مدت می‌افته رو ۱۲-۱۵ حالا با این توییک جدید تو متن های کوتاه رسیده به ۴۸ توکن بر ثانیه و تو متن های بلند ۱۳۰k+ هم حدود ۲۰ تا

🔹 نتایج بنچمارک ۴۸ توکن بر ثانیه تو حالت MTP با ۶ تا draft و ngram ۴۶ توکن بر ثانیه تو استفاده معمولی کد ۲۰ توکن بر ثانیه تو کانتکست بلند و پریفیل ۶۳۹۰۰ توکن با ۲۵۸ توکن بر ثانیه

‏شما هم با GPU های قدیمی همچین توییک‌هایی رو امتحان کردین


‏کاربرد در ایران 🇮🇷
‏برای کسایی که تو ایران از GPU های قدیمی مثل P۴۰ یا P۱۰۰ استفاده می‌کنن این توییک می‌تونه سرعت اجرای مدل های بزرگ رو خیلی بالا ببره

#P۴۰ #بهینه‌سازی #MTP #Qwen #GPU

🆔 @AI_TechPulse
👍4
🤔 آدم ها یا ماشین ها کی رو بیشتر اعتماد می‌کنی

‏تا حالا فکر کردی یه روزی یه ربات بتونه به جای تو تو اینترنت کار کنه بدون اینکه هر بار ازت اجازه بگیره

‏آره دیگه داریم از مرحله‌ی سوال جواب ساده می‌ریم به جایی که ایجنت های هوش مصنوعی می‌تونن خودشون تو سایت ها وارد بشن ایمیل بزنن پول جابجا کنن و حتی با سیستم های دیگه ارتباط بگیرن

🔹 تازه گزارش ها می‌گن بعضی از این ایجنت ها هزار تا تغییر رو خودشون انجام می‌دن بدون اینکه کسی نظارت کنه

‏به نظر خودت تا کجا باید بهشون اعتماد کرد مثلاً می‌دیم بهشون ایمیل رو پول رو شبکه های اجتماعی رو یا حتی کسب‌وکارمون رو یا هنوزم باید هر کار مهم رو خودمون تایید کنیم


#هوش_مصنوعی #ایجنت #اعتماد

🆔 @AI_TechPulse
👍4
‏انویدیا و کروداسترایک دست به یکی کردن 🤝

‏یه خبر خوب برای امنیت سایبری

‏انویدیا و کروداسترایک با همکاری هم یه سری مدل هوش مصنوعی جدید برای امنیت سایبری ساختن

🔹 این کار رو کردن چون فکر میکنن یکی از بزرگترین خلا های امنیت سایبری اینه که مدافعان نمیتونن به سرعت مهاجمان از هوش مصنوعی استفاده کنن

‏به نظرتون این مدل ها میتونن سرعت واکنش رو به حد مهاجما برسونن


#هوش_مصنوعی #امنیت_سایبری #انویدیا #کروداسترایک

🆔 @AI_TechPulse
👍4
‏کاهش حافظه KV-cache تا ۹۹٪ با Sliding Window Attention 🧠

‏یکی از بچه های r/MachineLearning یه روش جالب برای استفاده از Sliding Window Attention روی مدل های از پیش آموزش‌دیده پیاده کرده

‏به‌جای اینکه هر توکن جدید به کل حافظه KV قبلی دسترسی داشته باشه فقط یه بافر محدود شامل attention sinks و پنجره کشویی رو نگه می‌داره این کار رو بدون تغییر معماری یا ریتِرین کردن مدل انجام داده و به‌عنوان یه لایه استنتاج مجزا نوشتهش

🔹 توی آزمایشش با Qwen۲.۵-۷B برای ۱۶K توکن حافظه KV از ۹۲۳ مگابایت رسیده به ۳٫۵ مگابایت و TPOT هم از ۳۸٫۴ میلی‌ثانیه اومده به ۳۰٫۵ میلی‌ثانیه حتی توی ۶۴K توکن حافظه ثابت ۳٫۵ مگابایتی داره درحالی که Full Attention دیگه اونطول رو هم نمی‌کشه

‏ولی طبیعتاً یه دردسر داره اگه تسک نیاز به اطلاعات دور از پنجره فعال داشته باشه ممکنه کیفیت بیاد پایین خودش می‌گه داره بررسی می‌کنه که چقدرش مال خود SWA هست و چقدرش مال پیاده‌سازی

‏به نظر شما کدوم معماری های مدل رو باید بعدی تست کنه یا چه سناریو های شکستی رو benchmark بزنه


‏اگه کسی توی inference یا بهینه‌سازی KV-cache کار می‌کنه بره یه نگاهی بندازه به ریپوی GitHub که توی پست گذاشته حتماً نظراتش رو باهاش به اشتراک بذاره

‏کاربرد در ایران 🇮🇷
‏برای تیم های ایرانی که روی استنتاج مدل های بزرگ با محدودیت حافظه کار می‌کنن این روش می‌تونه خیلی کاربردی باشه

#SWA #LLM #KV_Cache #بهینه‌سازی #یادگیری_عمیق

🛠 مخزن پروژه در گیت‌هاب
🆔 @AI_TechPulse
👍4
‏سه تا بنچمارک جدید که واقعا عمق توانایی مدل های کدزنی رو نشون میدن

‏بنچمارک های معمولی دیگه کافی نیستن برای فهمیدن عمق توانایی مدل ها

‏تو این پست سه تا بنچمارک جدید و سخت رو معرفی کردن که واقعا عمق توانایی یه مدل رو نشون میدن این بنچمارک ها خیلی فراتر از تست های معمولی کدزنی هستن

🔹 اولی Program-Bench هست جایی که مدل فقط یه باینری کامپایل شده و مستنداتش رو می‌بینه و باید بدون دسترسی به دیکامپایلر یا اینترنت کل کدبیس رو از نو بنویسه تا دقیقا همون رفتار رو داشته باشه امتیاز ها GPT-۶ Astra ۵.۵% Fable ۵.۱ ۷% Kimi K۳ ۲% Qwen۳.۸ ۲۷b ۰%

🔹 دومی SRE-Bench هست که از مدل می‌خواد بفهمه یه باینری واقعی بدون سورس کدش چیکار می‌کنه این دیگه واقعا سخت چون حتی تو کار روزمره کسی اسمبلی نمی‌خونه ولی توانایی فهم یه برنامه کامپایل شده نشون‌دهنده هوش بالاییه امتیاز ها GPT-۶ Astra ۸۸% GPT-۵.۶ Sol ۵۵.۹% Claude Opus ۵ max ۱۲.۵%

🔹 سومی Code Migration هست که مدل باید یه برنامه رو از یه زبان به یه زبان دیگه بازنویسی کنه امتیاز ها GPT-۶ Astra ۶۷.۷% Fable ۵.۱ ۵۴.۶% GLM ۵.۳ ۴۴.۲% GLM ۵.۳ Flash ۲۰.۵% Qwen۳.۸ ۲۷b ۱۴.۲%

💡 ‏تحلیل:
‏این بنچمارک ها نشون میدن که حتی مدل های قوی هم تو کار های واقعا پیچیده مهندسی نرم افزار مشکل دارن مخصوصا تو فهم و بازتولید برنامه های کامپایل شده بدون سورس کد برای کسایی که دنبال مدل های عمیق‌تر می‌گردن این تست ها خیلی ارزشمندن


#بنچمارک #کدنویسی #هوش_مصنوعی #LLM #مدل_زبانی

📑 مستندات و لینک مرجع
📑 مستندات و لینک مرجع
📑 مستندات و لینک مرجع
🆔 @AI_TechPulse
👍4
🧊 دو تا کد کتاب برای ساخت صفحه خوش‌آمدگویی شیشه‌ای مایع

‏یه پروژه منبع باز جذاب برای React Native اومده که می‌تونی باهاش صفحه خوش‌آمدگویی شیشه‌ای مایع با انیمیشن سوایپ بسازی

‏این ریپو دو تا کد کتاب (cookbook) داره یکی اسکای و یکی آسترو هر کدوم یه تم متفاوت دارن با انیمیشن های خاص مثل گنبد شیشه‌ای که با سوایپ بالا میاد و کوچیک می‌شه تا تبدیل به دکمه پلاس بشه یک افکت رنگی خفن هم موقع کشیدن جمع می‌شه

🔹 این پروژه ۲۳۷ ستاره داره و با تایپ‌اسکریپت و Expo ساخته شده

‏برو توی گیت‌هابش یه نگاهی بنداز و اگه خوشت اومد یه ستاره بده

‏کاربرد در ایران 🇮🇷
‏برای توسعه‌دهندگان موبایل در ایران که با React Native کار می‌کنن این یه منبع عالیه برای ساخت صفحه های خوش‌آمدگویی جذاب

#ReactNative #Expo #UI #OpenSource #Animation

🛠 مخزن پروژه در گیت‌هاب
🆔 @AI_TechPulse
👍4
‏دیپ سیک و چت جی پی تی یه نقطه مشترک دارن

‏یادش بخیر اون روزا که دیپ سیک وسط فارسی کاراکتر چینی مینداخت

‏حالا دقیقا همون درد داره میاد سراغ چت جی پی تی انگار داره ازش یاد می‌گیره

‏به نظرتون چت جی پی تی هم مثل دیپ سیک درست میشه یا قراره تکرار تاریخ باشه


‏کاربرد در ایران 🇮🇷
‏کاربران ایرانی متوجه شباهت این مشکل می‌شوند

#چت‌جی‌پی‌تی #دیپ‌سیک #زبان‌فارسی

🆔 @AI_TechPulse
👍1


‏خبر داغ داغ از گوگل رسید 🔥

‏گوگل اولین چک‌پوینت داخلی جمنای ۴ پرو رو ریلیز کرده قراره اکتبر به صورت عمومی در دسترس باشه

🔹 تو تست های کدنویسی از Fable ۵.۱ جلو زده و با GPT-۶ Astra رقابت می‌کنه همچنین ممکنه امسال Flash-Lite و NB۲Lite جدید هم بیاد

🎯 ‏پیامد:
‏به نظر میاد گوگل ۳.۵ Pro رو کلاً اسکیپ کرده و مستقیم رفته سراغ جمنای ۴

#گوگل #جمنای۴ #هوش_مصنوعی #کدنویسی

🆔 @AI_TechPulse
👍1
🎬 یه ابزار متن‌باز و رایگان برای تبدیل ویدیو های یوتیوب به شورت ویدیو های ویروسی

‏دوست داری ویدیو های یوتیوب رو بندازی تو یه ابزار و شورت ویدیو های آماده بگیری

‏این پروژه متن‌باز همه کار رو برات انجام میده دانلود ویدیو از یوتیوب تشخیص هایلایت های جذاب زیرنویس ترجمه و حتی صداگذاری هم داره و خروجی ۹۱۶ می‌ده آماده برای انتشار

🔹 ۶۲۵ تا ستاره روی گیت‌هاب گرفته و یه جایگزین رایگان برای OpusClip و Vidyoai محسوب می‌شه

‏کاملاً رایگان و متن‌باز با پشتیبانی از API و رابط وب می‌تونی هم از خط فرمان استفاده کنی هم از مرورگر

‏برو گیت‌هابش رو ببین و اگه تولیدکننده محتوایی حتما یه نگاهی بنداز

‏کاربرد در ایران 🇮🇷
‏برای تولیدکننده های محتوای ایرانی که می‌خوان بدون هزینه ابزار های خارجی مثل OpusClip شورت ویدیو بسازن این ابزار می‌تونه خیلی به کار بیاد

#ابزار_متن‌باز #شورت_ویدیو #تولید_محتوا #گیت‌هاب #یوتیوب

🛠 مخزن پروژه در گیت‌هاب
🆔 @AI_TechPulse
👍1
بچه ها یه خبرایی داره میاد در مورد رفع فیلتر اینستاگرام و تلگرام. فعلا در حد خبر هست همه این اخبار به نقل از عباس پازوکی معاون ارتباطات دفتر معاون اول رئیس جمهور دراه میاد.
امیدواریم که واقعیت داشته باشه هرچند نوش دارو بعداز مرگ سهراب هست🧌
👍1
📅 خلاصه روز

مرور سریع مهم‌ترین خبرهای امروز 👇

💬 ‏سه تا بنچمارک جدید که واقعا عمق توانایی مدل های کدزنی رو نشون میدن
‏بنچمارک های معمولی دیگه کافی نیستن برای فهمیدن عمق توانایی مدل ها ‏تو این پست سه تا بنچمارک جدید و سخت رو معرفی کردن که واقعا عمق توانایی یه مدل رو نشون میدن این بنچمارک ها خیلی فراتر از تست های معمولی کدزنی هستن ‏🔹 اولی Program-Bench هست جایی که مدل فقط یه باینری کامپایل شده و مستنداتش رو می‌بینه و باید بدون دسترسی به دیکامپایلر یا اینترنت کل کدبیس رو از نو بنویسه تا دقیقا همون رفتار رو داشته باشه امتیاز ها GPT-۶…
#خبر_اصلی

💬 ‏انویدیا و کروداسترایک دست به یکی کردن 🤝
‏یه خبر خوب برای امنیت سایبری ‏انویدیا و کروداسترایک با همکاری هم یه سری مدل هوش مصنوعی جدید برای امنیت سایبری ساختن ‏🔹 این کار رو کردن چون فکر میکنن یکی از بزرگترین خلا های امنیت سایبری اینه که مدافعان نمیتونن به سرعت مهاجمان از هوش مصنوعی استفاده کنن ‏به نظرتون این مدل ها میتونن سرعت واکنش رو به حد مهاجما برسونن ‏#هوش_مصنوعی #امنیت_سایبری #انویدیا #کروداسترایک
#خبر_اصلی

📢 ‏یه کلون از گوگل مپس در نیم ساعت 😱
‏دیدی چقدر سریع میشه یه پروژه خفن رو با هوش مصنوعی جلو برد ‏یه نفر با ChatGPT ۶ Pro توی سی دقیقه یه کلون از Google Maps درست کرده ‏لینکش رو گذاشته میتونی ببینی و خودت هم امتحان کنی ‏🔹 این یعنی سرعت توسعه با ابزار های جدید دیگه باورنکردنی شده ‏تو با این قدرت چی میسازی ‏#ChatGPT #GoogleMaps #AI #تکنولوژی
#خبر_اصلی

💬 ‏کاهش حافظه KV-cache تا ۹۹٪ با Sliding Window Attention 🧠
‏یکی از بچه های r/MachineLearning یه روش جالب برای استفاده از Sliding Window Attention روی مدل های از پیش آموزش‌دیده پیاده کرده ‏به‌جای اینکه هر توکن جدید به کل حافظه KV قبلی دسترسی داشته باشه فقط یه بافر محدود شامل attention sinks و پنجره کشویی رو نگه می‌داره این کار رو بدون تغییر معماری یا ریتِرین کردن مدل انجام داده و به‌عنوان یه لایه استنتاج مجزا نوشتهش ‏🔹 توی آزمایشش با Qwen۲.۵-۷B برای ۱۶K توکن حافظه KV از ۹۲۳…
#خبر_اصلی

💬 ‏چک کن حافظه کش LLM محلیت چقدر واقعیه با این ابزار 🔍
‏تا حالا فکر کردی حافظه کش LLM که ادعا می‌کنه واقعاً همونقدر رو نگه می‌داره ‏یک توسعه‌دهنده روی vLLM با دو تا DGX Spark کار می‌کرده و حس کرده cache درست کار نمی‌کنه رفته تحقیق کرده باگ پیدا کرده و درستش کرده ولی نیاز داشته یه راهی برای تست درست شدنش داشته باشه نتیجه شده این ابزار که می‌تونی با یه پروتکل ساده ببینی دقیقاً چند تا توکن توی cache ذخیره می‌شه و چه موقعی context های قدیمی حذف می‌شن ‏🔹 توی تست A/B قبل از…
#خبر_اصلی

📢 ‏ماجرای سینیوری که کد ها رو به هم ریخت 😂
‏داستان همیشگی توی تیم های برنامه‌نویسی ‏سینیور یه پروژه رو می‌ریزه به هم بعد می‌بینه نمی‌تونه درستش کنه اونوقته که جونیور میاد و می‌گه بذار ببینم چطور می‌شه حلش کرد ‏🔹 این یه حقیقت تلخ و شیرینه که تجربه همیشه کافی نیست گاهی یه نگاه تازه می‌تونه معجزه کنه ‏#برنامه‌نویسی #سینیور #جونیور #توسعه‌دهندگان
#خبر_اصلی

💬 ‏مدل ۲۷ میلیاردی روی دو تا P۴۰ با سرعت ۴۸ توکن بر ثانیه 🚀
‏مادربزرگ که نه ولی دو تا P۴۰ قدیمی می‌تونن یه Qwen ۲۷B رو با سرعت ۴۸ توکن بر ثانیه اجرا کنن ‏یه کاربر تو ردیت که یه سیستم با دو تا تسلا P۴۰ و یه زیون قدیمی داره (حدود ۱۱۰۰ دلار هزینه) می‌گه با تغییر کش KV از Q۸ به F۱۶ و فعال کردن MTP و ngram سرعتش رو چند برابر کرده قبلاً با Q۸ و تنظیمات معمولی ۱۵ تا ۳۲ توکن بر ثانیه می‌گرفته ولی طولانی مدت می‌افته رو ۱۲-۱۵ حالا با این توییک جدید تو متن های کوتاه رسیده به ۴۸ توکن بر…
#خبر_اصلی

👍1