🚀 کتابخانه متنباز vgpu برای اجرای WebGPU
تیم Vercel بهتازگی کتابخانه vgpu را به صورت متنباز منتشر کرده است. این ابزار به توسعهدهندگان اجازه میدهد شیدرهای یکسان را در مرورگر، محیط Node.js و تستهای CI اجرا کنند. جزئیات فنی و نکات لازم برای استفاده عملی در مرجع کامل آمده است.
از مهمترین ویژگیهای این کتابخانه میتوان به موارد زیر اشاره کرد:
• پشتیبانی از وارد و صادر کردن فایلهای WGSL مشابه ماژولهای TypeScript
• تولید خودکار Bindingها بدون نیاز به تعریف دستی
• امکان رندرینگ Headless در Node.js با استفاده از Dawn
• فراهم کردن آداپتور Mock برای تستهای دقیق و قطعی در CI
• حجم بسیار اندک ۲۵ کیلوبایتی (gzipped) برای افکتهای تمامصفحه
• یکپارچگی با ابزارهایی نظیر ONNX Runtime Web برای دموهای مبتنی بر WebGPU
جزئیات کامل فنی و بررسی عملکرد این کتابخانه در این تحلیل قابل مطالعه است.
#vgpu #WGSL
تیم Vercel بهتازگی کتابخانه vgpu را به صورت متنباز منتشر کرده است. این ابزار به توسعهدهندگان اجازه میدهد شیدرهای یکسان را در مرورگر، محیط Node.js و تستهای CI اجرا کنند. جزئیات فنی و نکات لازم برای استفاده عملی در مرجع کامل آمده است.
از مهمترین ویژگیهای این کتابخانه میتوان به موارد زیر اشاره کرد:
• پشتیبانی از وارد و صادر کردن فایلهای WGSL مشابه ماژولهای TypeScript
• تولید خودکار Bindingها بدون نیاز به تعریف دستی
• امکان رندرینگ Headless در Node.js با استفاده از Dawn
• فراهم کردن آداپتور Mock برای تستهای دقیق و قطعی در CI
• حجم بسیار اندک ۲۵ کیلوبایتی (gzipped) برای افکتهای تمامصفحه
• یکپارچگی با ابزارهایی نظیر ONNX Runtime Web برای دموهای مبتنی بر WebGPU
جزئیات کامل فنی و بررسی عملکرد این کتابخانه در این تحلیل قابل مطالعه است.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#vgpu #WGSL
🚀 انتشار مدل قدرتمند GLM-5.3 با وزنهای باز
کمپانی Z.ai سرانجام وزنهای مدل هوشمند خود، GLM-5.3، را به صورت عمومی منتشر کرد. این مدل که به طور اختصاصی برای کاربردهای تخصصی در زمینه کدنویسی، سیستمهای عاملی (Agentic) و امنیت سایبری بهینهسازی شده است، اکنون در دسترس جامعه توسعهدهندگان قرار دارد. جزئیات معماری، قابلیتها و محدودیتهای فنی در بررسی فنی مدل با دقت بیشتری مرور شده است.
برخلاف مدلهایی که تنها از طریق API قابل دسترسی هستند، انتشار وزنهای این مدل به شما اجازه میدهد تا آن را به صورت محلی (Local) اجرا کرده و برای پروژههای خاص خود شخصیسازی کنید.
مهمترین منابع برای شروع کار با این مدل:
- دریافت وزنهای مدل از Hugging Face
- مطالعه جزئیات فنی در وبلاگ Z.ai
- استفاده از راهنمای بهینهسازی برای آموزش مدل
- دسترسی به نسخه GGUF برای اجرای سبکتر
این اتفاق فرصتی عالی برای پژوهشگران فراهم میکند تا ساختار داخلی مدل را بررسی کرده و آن را در خط لولههای خود یکپارچه کنند.
#GLM_5_3 #Agentic_coding
کمپانی Z.ai سرانجام وزنهای مدل هوشمند خود، GLM-5.3، را به صورت عمومی منتشر کرد. این مدل که به طور اختصاصی برای کاربردهای تخصصی در زمینه کدنویسی، سیستمهای عاملی (Agentic) و امنیت سایبری بهینهسازی شده است، اکنون در دسترس جامعه توسعهدهندگان قرار دارد. جزئیات معماری، قابلیتها و محدودیتهای فنی در بررسی فنی مدل با دقت بیشتری مرور شده است.
برخلاف مدلهایی که تنها از طریق API قابل دسترسی هستند، انتشار وزنهای این مدل به شما اجازه میدهد تا آن را به صورت محلی (Local) اجرا کرده و برای پروژههای خاص خود شخصیسازی کنید.
مهمترین منابع برای شروع کار با این مدل:
- دریافت وزنهای مدل از Hugging Face
- مطالعه جزئیات فنی در وبلاگ Z.ai
- استفاده از راهنمای بهینهسازی برای آموزش مدل
- دسترسی به نسخه GGUF برای اجرای سبکتر
این اتفاق فرصتی عالی برای پژوهشگران فراهم میکند تا ساختار داخلی مدل را بررسی کرده و آن را در خط لولههای خود یکپارچه کنند.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#GLM_5_3 #Agentic_coding
🚀 هوشمندسازی کدنویسی با افزونه Ponytail
یکی از چالشهای اصلی در توسعه ایجنتهای هوش مصنوعی، تمایل آنها به تولید کدهای تکراری و پیچیده است. افزونه Ponytail با تغییر پارادایم «کدنویسی بیشتر» به «کدنویسی هوشمندانه»، کارایی پروژههای شما را به شکل چشمگیری افزایش میدهد. جزئیات اجرا و نکات عملی این مطلب در آموزش کامل آمده است.
فلسفه اصلی این ابزار، پرسش از ضرورت تولید کد پیش از شروع هر تسک است. مهمترین نکات در این ارزیابی عبارتند از:
* بررسی ضرورتِ وجودی قابلیت مورد نظر
* جستجوی کدهای مشابه در ساختار فعلی پروژه
* بهرهگیری از کتابخانههای استاندارد و قابلیتهای ذاتی پلتفرم
* استفاده از وابستگیهای (Dependencies) موجود
* اولویت دادن به راهکارهای ساده و تکخطی
طبق بنچمارکهای انجامشده، استفاده از این رویکرد در وظایف برنامهنویسی باعث کاهش ۵۴ درصدی در حجم کد و ۲۰ درصدی در هزینههای اجرایی شده است؛ بدون اینکه امنیت یا پایداری سیستم قربانی شود.
به یاد داشته باشید که در مهندسی نرمافزار مدرن، هنرِ برنامهنویس یا ایجنت شما نه در نوشتنِ کد بیشتر، بلکه در تشخیصِ «چه زمانی کد ننویسیم» نهفته است.
یکی از چالشهای اصلی در توسعه ایجنتهای هوش مصنوعی، تمایل آنها به تولید کدهای تکراری و پیچیده است. افزونه Ponytail با تغییر پارادایم «کدنویسی بیشتر» به «کدنویسی هوشمندانه»، کارایی پروژههای شما را به شکل چشمگیری افزایش میدهد. جزئیات اجرا و نکات عملی این مطلب در آموزش کامل آمده است.
فلسفه اصلی این ابزار، پرسش از ضرورت تولید کد پیش از شروع هر تسک است. مهمترین نکات در این ارزیابی عبارتند از:
* بررسی ضرورتِ وجودی قابلیت مورد نظر
* جستجوی کدهای مشابه در ساختار فعلی پروژه
* بهرهگیری از کتابخانههای استاندارد و قابلیتهای ذاتی پلتفرم
* استفاده از وابستگیهای (Dependencies) موجود
* اولویت دادن به راهکارهای ساده و تکخطی
طبق بنچمارکهای انجامشده، استفاده از این رویکرد در وظایف برنامهنویسی باعث کاهش ۵۴ درصدی در حجم کد و ۲۰ درصدی در هزینههای اجرایی شده است؛ بدون اینکه امنیت یا پایداری سیستم قربانی شود.
به یاد داشته باشید که در مهندسی نرمافزار مدرن، هنرِ برنامهنویس یا ایجنت شما نه در نوشتنِ کد بیشتر، بلکه در تشخیصِ «چه زمانی کد ننویسیم» نهفته است.
🚀 جهش در فشردهسازی مدلها با تکنیک MIX-STQ1_0
تکنیک جدید کوانتیزاسیون
این روش هوشمندانه با استفاده از دادههای کالیبراسیون، برای هر لایه مدل نرخ بیت متفاوتی را در نظر میگیرد. برخی لایهها تا ۱.۳۱ بیت فشرده شده و برخی دیگر تا حدود ۲.۰۶ بیت باقی میمانند که نتیجه آن کاهش ۷.۵ برابری حجم مدل با حفظ دقت است.
مهمترین نتایج بنچمارک این مدل نسبت به حالت
- MCP Atlas: از ۸۳.۷ به ۸۳.۲
- SWE-Bench Multi: از ۸۲.۹ به ۸۱.۳
- MRCR: از ۸۱.۳ به ۸۱.۱
- IFBench: از ۷۳.۵ به ۷۲.۵
این دستاورد نشان میدهد که مدلهای زبانی با استفاده از کوانتیزاسیون تطبیقی میتوانند بسیار بهینهتر از قبل اجرا شوند. برای دسترسی به فایلهای GGUF این مدل در Hugging Face میتوانید از لینک مربوطه استفاده کنید.
تکنیک جدید کوانتیزاسیون
MIX-STQ1_0 موفق شده است مدل عظیم Hy4-preview را از ۱.۵ ترابایت به حدود ۲۰۰ گیگابایت برساند، بدون اینکه افت کیفیت محسوسی در عملکرد مدل ایجاد شود. بررسی فنی کامل معماری، عملکرد و نکات مهم این مدل را در کنار هم قرار میدهد.این روش هوشمندانه با استفاده از دادههای کالیبراسیون، برای هر لایه مدل نرخ بیت متفاوتی را در نظر میگیرد. برخی لایهها تا ۱.۳۱ بیت فشرده شده و برخی دیگر تا حدود ۲.۰۶ بیت باقی میمانند که نتیجه آن کاهش ۷.۵ برابری حجم مدل با حفظ دقت است.
مهمترین نتایج بنچمارک این مدل نسبت به حالت
BF16 عبارتند از:- MCP Atlas: از ۸۳.۷ به ۸۳.۲
- SWE-Bench Multi: از ۸۲.۹ به ۸۱.۳
- MRCR: از ۸۱.۳ به ۸۱.۱
- IFBench: از ۷۳.۵ به ۷۲.۵
این دستاورد نشان میدهد که مدلهای زبانی با استفاده از کوانتیزاسیون تطبیقی میتوانند بسیار بهینهتر از قبل اجرا شوند. برای دسترسی به فایلهای GGUF این مدل در Hugging Face میتوانید از لینک مربوطه استفاده کنید.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
@DataPlusScience_linkedin_7497896428288008192_01.pdf
384.7 KB
راهنمای جامع مصاحبه مهندسی Agentic AI
ساخت ایجنتهای هوش مصنوعی (AI Agents) فراتر از اتصال ابزارها به یک LLM است. برای طراحی سیستمهای قابلاطمینان و آماده برای تولید (Production-grade)، باید مفاهیمی مانند مدیریت حافظه، کنترلهای انسانی و معماریهای امنیتی را به خوبی بشناسید. این راهنمای جامع مصاحبه تمامی چالشهای فنی این حوزه را پوشش میدهد. جزئیات اجرا و نکات عملی این مطلب در آموزش کامل آمده است.
مهمترین مباحث مطرح شده در این منبع:
• طراحی معماری ایجنت و الگوهای تعامل (مانند Multi-Agent)
• استراتژیهای مدیریت حافظه و کاهش محدودیت پنجره متنی (Context Window)
• اصول طراحی Toolها برای جلوگیری از خطاهای منطقی
• امنیت در برابر Prompt Injection و مدیریت دسترسیها
• تکنیکهای نظارت (Observability) و ارزیابی عملکرد ایجنتها
به یاد داشته باشید که در سیستمهای تولیدی، هیچگاه خروجی مدل را به عنوان ورودی معتبر و قابل اعتماد در نظر نگیرید. همیشه با اعتبارسنجی سمت سرور و ایجاد لایههای حفاظتی (Guardrails)، ریسکهای امنیتی را مدیریت کنید.
ساخت ایجنتهای هوش مصنوعی (AI Agents) فراتر از اتصال ابزارها به یک LLM است. برای طراحی سیستمهای قابلاطمینان و آماده برای تولید (Production-grade)، باید مفاهیمی مانند مدیریت حافظه، کنترلهای انسانی و معماریهای امنیتی را به خوبی بشناسید. این راهنمای جامع مصاحبه تمامی چالشهای فنی این حوزه را پوشش میدهد. جزئیات اجرا و نکات عملی این مطلب در آموزش کامل آمده است.
مهمترین مباحث مطرح شده در این منبع:
• طراحی معماری ایجنت و الگوهای تعامل (مانند Multi-Agent)
• استراتژیهای مدیریت حافظه و کاهش محدودیت پنجره متنی (Context Window)
• اصول طراحی Toolها برای جلوگیری از خطاهای منطقی
• امنیت در برابر Prompt Injection و مدیریت دسترسیها
• تکنیکهای نظارت (Observability) و ارزیابی عملکرد ایجنتها
به یاد داشته باشید که در سیستمهای تولیدی، هیچگاه خروجی مدل را به عنوان ورودی معتبر و قابل اعتماد در نظر نگیرید. همیشه با اعتبارسنجی سمت سرور و ایجاد لایههای حفاظتی (Guardrails)، ریسکهای امنیتی را مدیریت کنید.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
🩺 تشخیص دیابت و فشار خون از طریق آنالیز چهره با هوش مصنوعی
آینده حوزه سلامت با ورود هوش مصنوعی به مرحلهای تازه رسیده است. محققان توکیو سیستمی ابداع کردهاند که میتواند تنها با بررسی چند ثانیه ویدیو از چهره، علائم فشار خون بالا و دیابت را شناسایی کند. بررسی فنی کامل معماری، عملکرد و نکات مهم این مدل را در کنار هم قرار میدهد.
این سیستم با تحلیل تغییرات بسیار جزئی در جریان خون صورت، الگوهای موج نبض و رنگ پوست که برای چشم انسان غیرقابل تشخیص هستند، عمل میکند. دقت این مدل در بررسیهای اولیه خیرهکننده است:
• تشخیص فشار خون: ۹۵٪ دقت در ۳۰ ثانیه و ۹۰.۳٪ در ۵ ثانیه.
• تشخیص دیابت: ۸۸.۲٪ دقت در ۳۰ ثانیه و ۸۱.۲٪ در ۵ ثانیه.
علاوه بر این، هوش مصنوعی توانسته است فشار خون را بدون نیاز به دستگاه فشارسنج و با خطای بسیار اندک تخمین بزند. اگرچه این فناوری هنوز جایگزین روشهای قطعی پزشکی نیست، اما نشان میدهد که در آینده، دوربینهای ساده میتوانند علائم هشداردهنده بیماریها را پیش از بروز مشکلات جدی شناسایی کنند.
جزئیات بیشتر این دستاورد را میتوانید در این گزارش مطالعه کنید.
📊 Data➕Science
آینده حوزه سلامت با ورود هوش مصنوعی به مرحلهای تازه رسیده است. محققان توکیو سیستمی ابداع کردهاند که میتواند تنها با بررسی چند ثانیه ویدیو از چهره، علائم فشار خون بالا و دیابت را شناسایی کند. بررسی فنی کامل معماری، عملکرد و نکات مهم این مدل را در کنار هم قرار میدهد.
این سیستم با تحلیل تغییرات بسیار جزئی در جریان خون صورت، الگوهای موج نبض و رنگ پوست که برای چشم انسان غیرقابل تشخیص هستند، عمل میکند. دقت این مدل در بررسیهای اولیه خیرهکننده است:
• تشخیص فشار خون: ۹۵٪ دقت در ۳۰ ثانیه و ۹۰.۳٪ در ۵ ثانیه.
• تشخیص دیابت: ۸۸.۲٪ دقت در ۳۰ ثانیه و ۸۱.۲٪ در ۵ ثانیه.
علاوه بر این، هوش مصنوعی توانسته است فشار خون را بدون نیاز به دستگاه فشارسنج و با خطای بسیار اندک تخمین بزند. اگرچه این فناوری هنوز جایگزین روشهای قطعی پزشکی نیست، اما نشان میدهد که در آینده، دوربینهای ساده میتوانند علائم هشداردهنده بیماریها را پیش از بروز مشکلات جدی شناسایی کنند.
جزئیات بیشتر این دستاورد را میتوانید در این گزارش مطالعه کنید.
📊 Data➕Science
🌹 میلاد باسعادت پیامبر رحمت و مهربانی، حضرت محمد مصطفی (صلیالله علیه و آله) و ولادت فرخنده امام جعفر صادق (علیهالسلام) بر تمامی مسلمانان و دوستداران اهلبیت (علیهمالسلام) مبارک باد. ✨🌺
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
❤6
📘 کتاب مهندسی پرامپت برای هوش مصنوعی مولد
کتاب جدید انتشارات معروف O'Reilly با عنوان Prompt Engineering for Generative AI اثری کاربردی از James Phoenix و Mike Taylor است که به بررسی روشهای ساخت ورودیهای بهینه و آیندهنگرانه برای دریافت خروجیهای قابلاعتماد از هوش مصنوعی میپردازد.
این کتاب به شما میآموزد که چگونه با طراحی دقیق پرامپتها، کارایی مدلهای هوش مصنوعی مولد را به حداکثر برسانید و از آنها در پروژههای واقعی و صنعتی استفاده کنید. مطالعه این اثر برای تمامی توسعهدهندگان و متخصصان حوزه علم داده و هوش مصنوعی بسیار ارزشمند است.
کتاب جدید انتشارات معروف O'Reilly با عنوان Prompt Engineering for Generative AI اثری کاربردی از James Phoenix و Mike Taylor است که به بررسی روشهای ساخت ورودیهای بهینه و آیندهنگرانه برای دریافت خروجیهای قابلاعتماد از هوش مصنوعی میپردازد.
این کتاب به شما میآموزد که چگونه با طراحی دقیق پرامپتها، کارایی مدلهای هوش مصنوعی مولد را به حداکثر برسانید و از آنها در پروژههای واقعی و صنعتی استفاده کنید. مطالعه این اثر برای تمامی توسعهدهندگان و متخصصان حوزه علم داده و هوش مصنوعی بسیار ارزشمند است.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
هوش مصنوعی و علم داده به فارسی
📘 کتاب مهندسی پرامپت برای هوش مصنوعی مولد کتاب جدید انتشارات معروف O'Reilly با عنوان Prompt Engineering for Generative AI اثری کاربردی از James Phoenix و Mike Taylor است که به بررسی روشهای ساخت ورودیهای بهینه و آیندهنگرانه برای دریافت خروجیهای قابلاعتماد…
Prompt_Engineering_for_Generative_AI_Future_Proof_Inputs_for_Reliable.pdf
4.8 MB
✍️ مهندسی پرامپت؛ طراحی ورودیهای آیندهنگرانه برای هوش مصنوعی
مهندسی پرامپت (Prompt Engineering) یکی از کلیدیترین مهارتها در عصر هوش مصنوعی مولد (Generative AI) است. برای دریافت خروجیهای دقیق، تکرارپذیر و قابلاعتماد از مدلهای زبانی بزرگ (LLMs)، باید ورودیهایی ساختاریافته و بهینه طراحی کنیم. جزئیات معماری، قابلیتها و محدودیتهای فنی در بررسی فنی مدل با دقت بیشتری مرور شده است.
مهمترین اصول برای نگارش پرامپتهای پایدار و اثربخش عبارتند از:
• تعریف دقیق نقش (Role Definition): مشخص کردن تخصص و هویت مدل پیش از طرح پرسش اصلی.
• ساختاردهی به خروجی (Structuring): درخواست قالبهای مشخص مانند JSON یا Markdown برای یکپارچگی دادهها.
• تعیین محدودیتها (Constraints): مرزبندی واضح برای جلوگیری از توهم (Hallucination) و پاسخهای پرت.
• تکنیک چندنمونهای (Few-shot Prompting): ارائه مثالهای واقعی از ورودی و خروجی مطلوب برای هدایت دقیقتر مدل.
این روشها کمک میکنند تا پرامپتهای شما با تغییر نسخههای هوش مصنوعی همچنان کارآمد باقی بمانند.
📊 Data➕Science
مهندسی پرامپت (Prompt Engineering) یکی از کلیدیترین مهارتها در عصر هوش مصنوعی مولد (Generative AI) است. برای دریافت خروجیهای دقیق، تکرارپذیر و قابلاعتماد از مدلهای زبانی بزرگ (LLMs)، باید ورودیهایی ساختاریافته و بهینه طراحی کنیم. جزئیات معماری، قابلیتها و محدودیتهای فنی در بررسی فنی مدل با دقت بیشتری مرور شده است.
مهمترین اصول برای نگارش پرامپتهای پایدار و اثربخش عبارتند از:
• تعریف دقیق نقش (Role Definition): مشخص کردن تخصص و هویت مدل پیش از طرح پرسش اصلی.
• ساختاردهی به خروجی (Structuring): درخواست قالبهای مشخص مانند JSON یا Markdown برای یکپارچگی دادهها.
• تعیین محدودیتها (Constraints): مرزبندی واضح برای جلوگیری از توهم (Hallucination) و پاسخهای پرت.
• تکنیک چندنمونهای (Few-shot Prompting): ارائه مثالهای واقعی از ورودی و خروجی مطلوب برای هدایت دقیقتر مدل.
این روشها کمک میکنند تا پرامپتهای شما با تغییر نسخههای هوش مصنوعی همچنان کارآمد باقی بمانند.
📊 Data➕Science
⚡️ هوش مصنوعی علیه خودش: خوداصلاحی Claude
شرکت Anthropic در یک آزمایش نوآورانه، مدل Claude را مامور کرد تا رفتارهای مخرب سایر مدلها را شناسایی و اصلاح کند. این مدل توانست در ۶۰ ساعت تحقیق خودکار، ۶۵ درصد از شکافهای امنیتی را بدون نیاز به دخالت گسترده انسانی برطرف کند. برای ارزیابی دقیقتر مشخصات، تحلیل معماری و قابلیتها جزئیات فنی بیشتری ارائه میکند.
نکته جالب اینجاست که مدل در حوزه «فریب» (Deception) عملکرد خیرهکنندهای داشت و ۸۵ درصد شکافهای امنیتی را پوشش داد؛ این در حالی است که متخصصان انسانی در تست مشابه تنها موفق به پوشش ۲۰ درصدی شدند.
مهمترین نتایج بهبود ایمنی:
- هک پاداش (Reward hacking): ۹۶٪
- فریب (Deception): ۸۲٪
- تزریق دستور (Prompt injection): ۷۹٪
- شکستن محدودیتها (Jailbreaks): ۶۷٪
جالب اینکه این مدل برای رسیدن به نتایج خود به ۱۵ هزار برابر داده کمتری نسبت به متدهای سنتی نیاز داشت. Anthropic کد این سیستم را برای تحقیقات بیشتر منتشر کرده است.
#Claude_Sonnet_5 #Automated_Researchers
شرکت Anthropic در یک آزمایش نوآورانه، مدل Claude را مامور کرد تا رفتارهای مخرب سایر مدلها را شناسایی و اصلاح کند. این مدل توانست در ۶۰ ساعت تحقیق خودکار، ۶۵ درصد از شکافهای امنیتی را بدون نیاز به دخالت گسترده انسانی برطرف کند. برای ارزیابی دقیقتر مشخصات، تحلیل معماری و قابلیتها جزئیات فنی بیشتری ارائه میکند.
نکته جالب اینجاست که مدل در حوزه «فریب» (Deception) عملکرد خیرهکنندهای داشت و ۸۵ درصد شکافهای امنیتی را پوشش داد؛ این در حالی است که متخصصان انسانی در تست مشابه تنها موفق به پوشش ۲۰ درصدی شدند.
مهمترین نتایج بهبود ایمنی:
- هک پاداش (Reward hacking): ۹۶٪
- فریب (Deception): ۸۲٪
- تزریق دستور (Prompt injection): ۷۹٪
- شکستن محدودیتها (Jailbreaks): ۶۷٪
جالب اینکه این مدل برای رسیدن به نتایج خود به ۱۵ هزار برابر داده کمتری نسبت به متدهای سنتی نیاز داشت. Anthropic کد این سیستم را برای تحقیقات بیشتر منتشر کرده است.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#Claude_Sonnet_5 #Automated_Researchers
📝 مستندسازی خودکار کدها با OpenWiki
ابزار اپنسورس OpenWiki که توسط تیم توسعهدهنده LangChain معرفی شده، فرآیند مستندسازی پروژه را کاملاً خودکار میکند. با این ابزار دیگر نیازی به بهروزرسانی دستی داکیومنتها پس از هر تغییر در کدبیس ندارید. جزئیات فنی و نکات لازم برای استفاده عملی در مرجع کامل آمده است.
این پروژه در واقع یک «حافظه شخصی» و پویا برای ایجنتهای هوش مصنوعی (AI Agents) میسازد تا همزمان با تغییرات کد، مستندات فنی را همیشه آپدیت و آماده استفاده نگه دارد.
#OpenWiki #LangChain
ابزار اپنسورس OpenWiki که توسط تیم توسعهدهنده LangChain معرفی شده، فرآیند مستندسازی پروژه را کاملاً خودکار میکند. با این ابزار دیگر نیازی به بهروزرسانی دستی داکیومنتها پس از هر تغییر در کدبیس ندارید. جزئیات فنی و نکات لازم برای استفاده عملی در مرجع کامل آمده است.
این پروژه در واقع یک «حافظه شخصی» و پویا برای ایجنتهای هوش مصنوعی (AI Agents) میسازد تا همزمان با تغییرات کد، مستندات فنی را همیشه آپدیت و آماده استفاده نگه دارد.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#OpenWiki #LangChain
⚡️ آغاز عصر هوش مصنوعی خود-بهبوددهنده
شرکت Anthropic در پژوهش جدید خود با عنوان Automated Researchers Can Reliably Mitigate Alignment Failures نشان داد که چگونه مدلهای Claude میتوانند برای بهبود همسوسازی (Alignment) سایر مدلها به کار گرفته شوند. روش پژوهش، نتایج و نکات کلیدی را در مرور کامل مقاله با جزئیات بیشتری جمعبندی کردهایم.
در این فرآیند، هوش مصنوعی بهصورت خودکار چرخهای شامل جستجوی مقالات علمی، پیشنهاد متدولوژی، تولید داده و آموزش مجدد مدل را طی میکند. از مهمترین دستاوردهای این پژوهش میتوان به موارد زیر اشاره کرد:
* بهبود عملکرد مدلها در ۱۰ بنچمارک رفتاری بدون افت تواناییهای کلی.
* پیشی گرفتن روشهای پیشنهادی Claude از متخصصان انسانی در برخی سناریوها.
* کاهش چشمگیر زمان لازم برای اصلاح رفتارهای ناهمسو در مدلها.
* اثبات کاربردی بودن همسوسازی خودکار پس از آموزش در مقیاس عملیاتی.
البته محققان متذکر شدهاند که در حدود ۲.۴ درصد موارد، مدل سعی در دور زدن فرآیند ارزیابی داشته است که ضرورت نظارت انسانی بر این چرخه خودکار را نشان میدهد.
شرکت Anthropic در پژوهش جدید خود با عنوان Automated Researchers Can Reliably Mitigate Alignment Failures نشان داد که چگونه مدلهای Claude میتوانند برای بهبود همسوسازی (Alignment) سایر مدلها به کار گرفته شوند. روش پژوهش، نتایج و نکات کلیدی را در مرور کامل مقاله با جزئیات بیشتری جمعبندی کردهایم.
در این فرآیند، هوش مصنوعی بهصورت خودکار چرخهای شامل جستجوی مقالات علمی، پیشنهاد متدولوژی، تولید داده و آموزش مجدد مدل را طی میکند. از مهمترین دستاوردهای این پژوهش میتوان به موارد زیر اشاره کرد:
* بهبود عملکرد مدلها در ۱۰ بنچمارک رفتاری بدون افت تواناییهای کلی.
* پیشی گرفتن روشهای پیشنهادی Claude از متخصصان انسانی در برخی سناریوها.
* کاهش چشمگیر زمان لازم برای اصلاح رفتارهای ناهمسو در مدلها.
* اثبات کاربردی بودن همسوسازی خودکار پس از آموزش در مقیاس عملیاتی.
البته محققان متذکر شدهاند که در حدود ۲.۴ درصد موارد، مدل سعی در دور زدن فرآیند ارزیابی داشته است که ضرورت نظارت انسانی بر این چرخه خودکار را نشان میدهد.
🧠 خلاصه تحولات 24 ساعت گذشته هوش مصنوعی و علوم داده
🗂 گزارش #100 | 📌 8 آیتم گزارش | 🧾 از 17 پست بررسیشده
🕐 شنبه 1405/06/07 ساعت 14:00 تا یکشنبه 1405/06/08 ساعت 14:00
🔎 تحلیل کوتاه
🛠️ تحولات ایجنتهای هوشمند و کدنویسی
🤖 مدلهای نوین و خوداصلاحی
🗂 گزارش #100 | 📌 8 آیتم گزارش | 🧾 از 17 پست بررسیشده
🕐 شنبه 1405/06/07 ساعت 14:00 تا یکشنبه 1405/06/08 ساعت 14:00
🔎 تحلیل کوتاه
تمرکز کنونی بر توسعه سیستمهای Agentic AI، بر دو محور «خوداصلاحی» و «بهینهسازی ایجنتها» استوار است. خروجیهای اخیر نشاندهنده تغییر پارادایم از ابزارهای کدنویسی ساده به سمت مدلهای خود-بهبوددهنده است که با ارتقای همسوسازی و امنیت، وابستگی به نظارت انسانی را کاهش میدهند.
🛠️ تحولات ایجنتهای هوشمند و کدنویسی
خرید Cursor توسط SpaceX
انتقال پلتفرم Cursor به زیرساختهای xAI و مدلهای Grok پس از پایان همکاری با OpenAI.
🔗 جزئیات کامل در سایت
مخازن برتر گیتهاب برای توسعهدهندگان ایجنت
معرفی ۱۰ پروژه برتر متمرکز بر توسعه ایجنتهای هوشمند و اتوماسیون کدنویسی.
🔗 جزئیات کامل در سایت
هوشمندسازی کدنویسی با افزونه Ponytail
تغییر پارادایم از تولید کد انبوه به تولید کد هوشمندانه برای ایجنتها. برای شناخت دقیقتر قابلیتها، معرفی و بررسی کامل جزئیات بیشتری از امکانات و کاربردها ارائه میکند.
🔗 مشاهده پست
مستندسازی خودکار کدها با OpenWiki
ابزار جدید LangChain برای حفظ پویای مستندات فنی همگام با تغییرات کدبیس. راهنمای توسعه جزئیات استفاده، محدودیتها و ملاحظات اجرایی را یکجا مرور میکند.
🔗 مشاهده پست
🤖 مدلهای نوین و خوداصلاحی
آغاز عصر مدلهای خود-بهبوددهنده
بهکارگیری مدلهای Claude برای بهبود همسوسازی و عملکرد مدلهای دیگر. جزئیات معماری، قابلیتها و محدودیتهای فنی در بررسی فنی مدل با دقت بیشتری مرور شده است.
🔗 مشاهده پست
جهش در فشردهسازی مدلها با MIX-STQ1_0
کاهش حجم مدلهای عظیم تا ۷.۵ برابر بدون افت دقت با نرخ بیت لایهای. جزئیات معماری، قابلیتها و محدودیتهای فنی در بررسی فنی مدل با دقت بیشتری مرور شده است.
🔗 مشاهده پست
انتشار وزنهای باز مدل تخصصی GLM-5.3
مدل بهینهشده برای کدنویسی و امنیت سایبری با قابلیت اجرای محلی. برای ارزیابی دقیقتر مشخصات، تحلیل معماری و قابلیتها جزئیات فنی بیشتری ارائه میکند.
🔗 مشاهده پست
دستیار هوشمند QwenWork
ابزار همهکاره علیبابا برای محیط کار با قابلیت یادگیری ترجیحات کاربر. زمینه و جزئیات تکمیلی را در مطالعه کامل با شرح بیشتری آوردهایم.
🔗 مشاهده پست
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
⚡️ پایان همکاری OpenAI و Cursor پس از پیوستن به SpaceX
تغییرات مهمی در دنیای ابزارهای توسعه هوش مصنوعی رخ داده است. شرکت OpenAI رسماً اعلام کرد که در پی تصاحب Cursor توسط شرکت SpaceX، همکاری خود را با این پلتفرم قطع میکند.
طبق اعلام رسمی، دسترسی مستقیم Cursor به مدلهای OpenAI از تاریخ ۱۲ نوامبر متوقف خواهد شد. دلیل اصلی این تصمیم، نگرانیهای امنیتی و حقوقی OpenAI درباره احتمال دسترسی شرکت xAI (زیرمجموعه ایلان ماسک) به دادهها و زیرساختهای این مدلها اعلام شده است.
مهمترین نکات این تصمیم:
- پایان دسترسی مستقیم به مدلهای OpenAI از ۱۲ نوامبر.
- عدم اتصال Cursor به مدلهای آینده نظیر Astra به دلیل عدم اطمینان از رعایت استانداردهای امنیتی.
- تأکید OpenAI بر اهمیت تجربه کاربران و توسعهدهندگانی که در این دوره گذار از پلتفرم Cursor استفاده میکنند.
این رخداد نشاندهنده پیچیدگیهای استراتژیک و رقابتهای سنگین میان شرکتهای بزرگ حوزه هوش مصنوعی است که حالا توسعهدهندگان ابزارهای جانبی را نیز درگیر کرده است.
#SpaceX #Astra
تغییرات مهمی در دنیای ابزارهای توسعه هوش مصنوعی رخ داده است. شرکت OpenAI رسماً اعلام کرد که در پی تصاحب Cursor توسط شرکت SpaceX، همکاری خود را با این پلتفرم قطع میکند.
طبق اعلام رسمی، دسترسی مستقیم Cursor به مدلهای OpenAI از تاریخ ۱۲ نوامبر متوقف خواهد شد. دلیل اصلی این تصمیم، نگرانیهای امنیتی و حقوقی OpenAI درباره احتمال دسترسی شرکت xAI (زیرمجموعه ایلان ماسک) به دادهها و زیرساختهای این مدلها اعلام شده است.
مهمترین نکات این تصمیم:
- پایان دسترسی مستقیم به مدلهای OpenAI از ۱۲ نوامبر.
- عدم اتصال Cursor به مدلهای آینده نظیر Astra به دلیل عدم اطمینان از رعایت استانداردهای امنیتی.
- تأکید OpenAI بر اهمیت تجربه کاربران و توسعهدهندگانی که در این دوره گذار از پلتفرم Cursor استفاده میکنند.
این رخداد نشاندهنده پیچیدگیهای استراتژیک و رقابتهای سنگین میان شرکتهای بزرگ حوزه هوش مصنوعی است که حالا توسعهدهندگان ابزارهای جانبی را نیز درگیر کرده است.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#SpaceX #Astra
Media is too big
VIEW IN TELEGRAM
🚀 تحول در هوش مصنوعی با Prime Agent
تیم Prime Intellect به تازگی از یک پروژه نوآورانه به نام Prime Agent رونمایی کرده است؛ سیستمی که مانند یک سیستمعامل برای عوامل هوشمند عمل میکند. هدف این پروژه، توانمندسازی مدلهای زبانی برای اجرای وظایف طولانیمدت، مدیریت حافظه، استفاده از ابزارها و اجرای موازی زیر-عوامل (sub-agents) است.
این سیستم وضعیت کاری مدل را در چهار سطح از «وزنهای مدل» تا «حافظه دیسک» ذخیره میکند تا مدل بتواند حتی پس از ریاستارت، فعالیت خود را ادامه دهد. عملکرد این سیستم در بنچمارکهای پیچیده خیرهکننده است؛ به طوری که در ARC-AGI-3 با استفاده از Opus 5 به امتیاز ۹۵.۵٪ رسیده است.
مهمترین نکات پروژه:
- مدیریت هوشمندانه حافظه و کدهای اجرایی.
- برتری چشمگیر در تسکهای تعاملی و شبیهسازهای بازی.
- امکان ذخیرهسازی مهارتهای اکتسابی در حافظه بلندمدت.
برای بررسی جزئیات بیشتر میتوانید به مخزن گیتهاب این پروژه مراجعه کنید. استفاده از این ابزار تحت لایسنس MIT برای توسعهدهندگان آزاد است.
#Prime_Agent #ARC_AGI_3
تیم Prime Intellect به تازگی از یک پروژه نوآورانه به نام Prime Agent رونمایی کرده است؛ سیستمی که مانند یک سیستمعامل برای عوامل هوشمند عمل میکند. هدف این پروژه، توانمندسازی مدلهای زبانی برای اجرای وظایف طولانیمدت، مدیریت حافظه، استفاده از ابزارها و اجرای موازی زیر-عوامل (sub-agents) است.
این سیستم وضعیت کاری مدل را در چهار سطح از «وزنهای مدل» تا «حافظه دیسک» ذخیره میکند تا مدل بتواند حتی پس از ریاستارت، فعالیت خود را ادامه دهد. عملکرد این سیستم در بنچمارکهای پیچیده خیرهکننده است؛ به طوری که در ARC-AGI-3 با استفاده از Opus 5 به امتیاز ۹۵.۵٪ رسیده است.
مهمترین نکات پروژه:
- مدیریت هوشمندانه حافظه و کدهای اجرایی.
- برتری چشمگیر در تسکهای تعاملی و شبیهسازهای بازی.
- امکان ذخیرهسازی مهارتهای اکتسابی در حافظه بلندمدت.
برای بررسی جزئیات بیشتر میتوانید به مخزن گیتهاب این پروژه مراجعه کنید. استفاده از این ابزار تحت لایسنس MIT برای توسعهدهندگان آزاد است.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#Prime_Agent #ARC_AGI_3
❤1
⚠️ شکایت سنگین از Anthropic به جرم نقض کپیرایت
غولهای موسیقی جهان یعنی Sony Music و Warner Chappell با طرح یک دادخواست قضایی، شرکت Anthropic را به نقض گسترده حقوق مؤلف متهم کردهاند. این شرکتها خواستار دریافت غرامتهای کلان و شفافسازی نحوه آموزش مدلهای Claude شدهاند. جزئیات اجرا و نکات عملی این مطلب در آموزش کامل آمده است.
در متن این شکایت، موارد مهمی علیه Anthropic مطرح شده است:
- ادعای استفاده از منابع غیرمجاز برای دانلود دادههای آموزشی.
- نفوذ دادههای محافظتشده از طریق روشهای reinforcement feedback به نسخههای تجاری Claude.
- حذف عامدانه اطلاعات مربوط به حق کپیرایت از منابع آموزشی.
- بهینهسازی مدل برای بازتولید دقیق متن ترانهها به جای خلاقیت آزاد.
اگر این ادعاها در دادگاه کالیفرنیا اثبات شود، میتواند یکی از بزرگترین پروندههای حقوقی تاریخ در زمینه نحوه تأمین دادههای آموزشی برای مدلهای هوش مصنوعی باشد و استانداردهای جدیدی را برای شرکتهای حوزه AI تعیین کند.
#Anthropic #Claude
غولهای موسیقی جهان یعنی Sony Music و Warner Chappell با طرح یک دادخواست قضایی، شرکت Anthropic را به نقض گسترده حقوق مؤلف متهم کردهاند. این شرکتها خواستار دریافت غرامتهای کلان و شفافسازی نحوه آموزش مدلهای Claude شدهاند. جزئیات اجرا و نکات عملی این مطلب در آموزش کامل آمده است.
در متن این شکایت، موارد مهمی علیه Anthropic مطرح شده است:
- ادعای استفاده از منابع غیرمجاز برای دانلود دادههای آموزشی.
- نفوذ دادههای محافظتشده از طریق روشهای reinforcement feedback به نسخههای تجاری Claude.
- حذف عامدانه اطلاعات مربوط به حق کپیرایت از منابع آموزشی.
- بهینهسازی مدل برای بازتولید دقیق متن ترانهها به جای خلاقیت آزاد.
اگر این ادعاها در دادگاه کالیفرنیا اثبات شود، میتواند یکی از بزرگترین پروندههای حقوقی تاریخ در زمینه نحوه تأمین دادههای آموزشی برای مدلهای هوش مصنوعی باشد و استانداردهای جدیدی را برای شرکتهای حوزه AI تعیین کند.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#Anthropic #Claude