من اخیرا یک پروژه open-source به اسم Citeprobe ساختم برای بررسی و اعتبارسنجی referenceهای علمی به شکل static و بدون استفاده از LLM، مشابه اونچه در کنفرانسها و ژورنالهای آکادمیک رخ میده
ایده اصلی اینه که صرفا چون یک citation توی یک دیتابیس پیدا نشده، نباید نتیجه بگیریم که جعلی یا hallucinated بوده. Citeprobe هر reference رو همزمان با چند منبع علمی مثل Crossref، OpenAlex، Semantic Scholar، arXiv، Europe PMC، DBLP و OpenReview بررسی میکنه و بهجای یک جواب باینری، evidence و اختلاف بین sourceها رو هم نگه میداره.
علاوه بر title و DOI، اطلاعاتی مثل authorها، سال انتشار و venue و retraction/correction status و duplicate referenceها رو هم بررسی میکنه و مشخص میکنه نتیجه verified یا problematic یا inconclusive بوده و چرا.
ورودی هم فقط متن نیست. میتونه DOI، BibTeX، RIS، EndNot و یا PDF باشه و حتی PDF اسکنشده با OCR رو پشتیبانی میکنه. هم CLI و Python API داره و هم یه local web UI.
کل verification هم بدون LLM انجام میشه و پروژه open-source هست.
https://github.com/Imanm02/citeprobe
@DevTwitter | <Iman/>
ایده اصلی اینه که صرفا چون یک citation توی یک دیتابیس پیدا نشده، نباید نتیجه بگیریم که جعلی یا hallucinated بوده. Citeprobe هر reference رو همزمان با چند منبع علمی مثل Crossref، OpenAlex، Semantic Scholar، arXiv، Europe PMC، DBLP و OpenReview بررسی میکنه و بهجای یک جواب باینری، evidence و اختلاف بین sourceها رو هم نگه میداره.
علاوه بر title و DOI، اطلاعاتی مثل authorها، سال انتشار و venue و retraction/correction status و duplicate referenceها رو هم بررسی میکنه و مشخص میکنه نتیجه verified یا problematic یا inconclusive بوده و چرا.
ورودی هم فقط متن نیست. میتونه DOI، BibTeX، RIS، EndNot و یا PDF باشه و حتی PDF اسکنشده با OCR رو پشتیبانی میکنه. هم CLI و Python API داره و هم یه local web UI.
کل verification هم بدون LLM انجام میشه و پروژه open-source هست.
https://github.com/Imanm02/citeprobe
@DevTwitter | <Iman/>
🔥17👍3❤2
مدیریت ریسک در فرآیند استقرار، از طریق معماری Blue-Green، امکان انتشار نسخههای جدید را بدون ایجاد اختلال در سرویس (Downtime) فراهم میکند. این رویکرد با ایجاد جداسازی میان محیطهای Blue و Green، کنترل بیشتری بر فرآیند سوئیچ ترافیک و بازگشت به وضعیت پایدار (Rollback) ارائه میدهد.
در این مقاله، ابعاد فنی و زیرساختی این استراتژی را برای دستیابی به High Availability بررسی کردم.
لینک مقاله
@DevTwitter | <Afshin Akrami/>
در این مقاله، ابعاد فنی و زیرساختی این استراتژی را برای دستیابی به High Availability بررسی کردم.
لینک مقاله
@DevTwitter | <Afshin Akrami/>
👍8❤2🍌2
Forwarded from فروشگاه راه بوم
🛡️ پکیج اختصاصی Claude Max 5x/20x ضد بن راهبوم 🚀
🔐 ویپیاس VPS اختصاصی خارجی
📧 ایمیل وریفایشده خارجی
💻 کلاد مکس Claude Max روی اکانت اختصاصی
💰 برای خرید و دریافت قیمت:
👤 ادمین:
@rahboom1
📢 کانال:
@rahboomshop
🧡 سایت راه بوم:
🌐 rahboom.com
🔐 ویپیاس VPS اختصاصی خارجی
📧 ایمیل وریفایشده خارجی
💻 کلاد مکس Claude Max روی اکانت اختصاصی
💰 برای خرید و دریافت قیمت:
👤 ادمین:
@rahboom1
📢 کانال:
@rahboomshop
🧡 سایت راه بوم:
🌐 rahboom.com
🍌16❤4👎1
من لامپ شیائومی رو خریدم که میشه نورش به هر رنگی از طریق اپ Xiaomi Home تغییر داد ولی قابلیت سینک شدن با اهنگ یا رنگ تصویر در حال پخش رو نداشت، به ذهنم رسید این رو بهش اضافه کنم
حالا سه تا حالت داره: با ضرب آهنگ رنگ عوض میکنه، رنگ غالب صفحهنمایش رو میگیره (برای فیلم عالیه)، یا هر دو با هم. یه داشبورد وب هم براش نوشتم که همهچیز رو زنده ازش تنظیم میکنی. حتی گرفتنِ token شیائومی رو هم آوردم داخل خودش، پس دیگه لازم نیست سراغ هیچ ابزار جدایی بری — فقط لاگین میکنی و تمام.
https://github.com/behkha/bulbd
@DevTwitter | <B/>
حالا سه تا حالت داره: با ضرب آهنگ رنگ عوض میکنه، رنگ غالب صفحهنمایش رو میگیره (برای فیلم عالیه)، یا هر دو با هم. یه داشبورد وب هم براش نوشتم که همهچیز رو زنده ازش تنظیم میکنی. حتی گرفتنِ token شیائومی رو هم آوردم داخل خودش، پس دیگه لازم نیست سراغ هیچ ابزار جدایی بری — فقط لاگین میکنی و تمام.
https://github.com/behkha/bulbd
@DevTwitter | <B/>
🍌42❤34👍13
اگر با المنتور کار میکنید، حتما به این مشکل برخوردید: آیکون SVG که آپلود میکنید رنگش تغییر نمیکنه!
منم اومدم یه پلاگین وردپرسی خیلی ساده و سبک نوشتم تا این مشکل رو بدون نیاز به ایجاد تغییر در کد HTML به صورت دستی و تغییر
رنگ آیکون در فیگما، حل کنه.
لینک دانلود پلاگین از مخزن وردپرس:
https://fa.wordpress.org/plugins/iconall/
اگر به دردتون خورد، ممنون میشم توی صفحه پلاگین توی مخزن وردپرس کامنت بذارید:)
@DevTwitter | <Alireza/>
منم اومدم یه پلاگین وردپرسی خیلی ساده و سبک نوشتم تا این مشکل رو بدون نیاز به ایجاد تغییر در کد HTML به صورت دستی و تغییر
رنگ آیکون در فیگما، حل کنه.
لینک دانلود پلاگین از مخزن وردپرس:
https://fa.wordpress.org/plugins/iconall/
اگر به دردتون خورد، ممنون میشم توی صفحه پلاگین توی مخزن وردپرس کامنت بذارید:)
@DevTwitter | <Alireza/>
❤21🍌9👍3
آموزش کش در لاراول | مفاهیم پایه، انواع Cache، مفهوم TTL و متد Cache Remember
در این ویدیو به بررسی مفاهیم پایه و ساختار کش در فریمورک لاراول میپردازیم. کش کردن اطلاعات یکی از مهمترین تکنیکها برای افزایش سرعت و بهبود عملکرد وبسایتها و اپلیکیشنها است. در این بخش با درایورها و انواع مختلف کش در لاراول آشنا میشوید و یاد میگیرید که چگونه درخواستهای پرتکرار به پایگاه داده را کاهش دهید. همچنین مفهوم کاربردی TTL یا Time To Live را برای تعیین مدت زمان اعتبار دادههای کش شده بررسی میکنیم و نحوه استفاده از متد محبوب cache remember را برای ذخیره و بازیابی بهینه اطلاعات با یک کلید مشخص به صورت عملی توضیح میدهیم تا بتوانید پروژههای خود را به شکلی حرفهایتر بهینهسازی کنید.
https://youtu.be/Z14PH98iKqI
@DevTwitter | <ابوالفضل/>
در این ویدیو به بررسی مفاهیم پایه و ساختار کش در فریمورک لاراول میپردازیم. کش کردن اطلاعات یکی از مهمترین تکنیکها برای افزایش سرعت و بهبود عملکرد وبسایتها و اپلیکیشنها است. در این بخش با درایورها و انواع مختلف کش در لاراول آشنا میشوید و یاد میگیرید که چگونه درخواستهای پرتکرار به پایگاه داده را کاهش دهید. همچنین مفهوم کاربردی TTL یا Time To Live را برای تعیین مدت زمان اعتبار دادههای کش شده بررسی میکنیم و نحوه استفاده از متد محبوب cache remember را برای ذخیره و بازیابی بهینه اطلاعات با یک کلید مشخص به صورت عملی توضیح میدهیم تا بتوانید پروژههای خود را به شکلی حرفهایتر بهینهسازی کنید.
https://youtu.be/Z14PH98iKqI
@DevTwitter | <ابوالفضل/>
👍11❤3🍌1
مخزن OmniVoice: TTS: کلون صدا با ۶۰۰+ زبان
این پروژه یک مدل TTS خیلی قویایه که بدون fine-tune، روی بیش از ۶۰۰ زبان حرف میزنه. معماریش شبیه diffusion language model ساخته شده و هم کیفیت صدا بالاست، هم سرعتش. صدا رو از یه reference کوتاه clone میکنه، یا بدون reference با صفتهایی مثل gender، age، pitch، لهجه و حتی whisper صدا میسازه. تگهایی مثل [laughter] هم میفهمه و تلفظ رو با pinyin یا phoneme میشه اصلاح کرد.
توی ورکفلو ویدیو و پادکست اینطوری به درد میخوره: یه ویس کوتاه از گوینده میدی، متن فارسی یا انگلیسی یا هر زبان دیگهای رو میذاری، همون صدا رو خروجی میگیری.
اگه reference نداری، با دستورهایی مثل male, British accent صدا design میکنی. نصبش با pip یا uv راه میافته، API پایتون و CLI داره، حتی دموی وب و Space روی Hugging Face هم داره.
لینک GitHub:
https://github.com/k2-fsa/OmniVoice
@DevTwitter | <Diego Jr/>
این پروژه یک مدل TTS خیلی قویایه که بدون fine-tune، روی بیش از ۶۰۰ زبان حرف میزنه. معماریش شبیه diffusion language model ساخته شده و هم کیفیت صدا بالاست، هم سرعتش. صدا رو از یه reference کوتاه clone میکنه، یا بدون reference با صفتهایی مثل gender، age، pitch، لهجه و حتی whisper صدا میسازه. تگهایی مثل [laughter] هم میفهمه و تلفظ رو با pinyin یا phoneme میشه اصلاح کرد.
توی ورکفلو ویدیو و پادکست اینطوری به درد میخوره: یه ویس کوتاه از گوینده میدی، متن فارسی یا انگلیسی یا هر زبان دیگهای رو میذاری، همون صدا رو خروجی میگیری.
اگه reference نداری، با دستورهایی مثل male, British accent صدا design میکنی. نصبش با pip یا uv راه میافته، API پایتون و CLI داره، حتی دموی وب و Space روی Hugging Face هم داره.
لینک GitHub:
https://github.com/k2-fsa/OmniVoice
@DevTwitter | <Diego Jr/>
❤16👍5🔥2
دوستان اگه از VOIP و اینا استفاده میکنید، برای Astrisk میتونید از این استفاده کنید:
https://github.com/reloadlife/astrisk-web-ui
@DevTwitter | <Mamad/>
https://github.com/reloadlife/astrisk-web-ui
@DevTwitter | <Mamad/>
🔥15❤3🍌3
میزان ترافیک IP6 طی ۴۸ ساعت اخیر که وزیر ارتباطات در موردش گفت به ۸.۱ درصد افزایش یافت.
۷ خرداد که تازه اینترنت بازگشایی شد، سهم آن در اینترنت ایران تنها ۰.۱ درصد بود.
بی تردید افزایش ترافیک IP6 به پایداری اتصال کمک می کنه.
@DevTwitter | <Amirreza Ghavidel/>
۷ خرداد که تازه اینترنت بازگشایی شد، سهم آن در اینترنت ایران تنها ۰.۱ درصد بود.
بی تردید افزایش ترافیک IP6 به پایداری اتصال کمک می کنه.
@DevTwitter | <Amirreza Ghavidel/>
👍49💔8❤3
Forwarded from DevTwitter Ads.
بوتکمپ های پاییز آنلیم شروع شد🍂🤩
امسال سهتا بوتکمپ داریم:
🔐 بوتکمپ هک
👨🏻💻بوتکمپ فرانتاند
💻بوتکمپ بکاند
فرق این بوتکمپ با بیشتر دورههایی که دیدی چیه؟
از روز اول عضو یک تیم میشی.
یه منتور حرفهای کنارت قرار میگیره.
با تیمت پروژه میسازی، چالش حل میکنی، با بقیه تیمها رقابت میکنی و تجربهای رو به دست میاری که توی هیچ ویدیوی آموزشی پیدا نمیشه.
با حضور حرفهای ترین اساتید و مربیهای ایران🔥
📌 ثبتنام اولیه کاملاً رایگانه
فرم ثبتنام رو توی سایت آنلیم پر کن.
بعد از بررسی، باهات تماس میگیریم و در صورت تأیید وارد مرحله مصاحبه میشی.
اگه دنبال یه دوره معمولی هستی، این بوتکمپ برای تو نیست.
ولی اگه میخوای کنار آدمهای جدی یاد بگیری، تیم داشته باشی، پروژه واقعی انجام بدی و خودت رو به چالش بکشی، منتظرتیم. 🚀
برای پیش ثبتنام رایگان و مشاهده جزئیات بیشتر روی لینک زیر کلیک کن👇🏻
🔗مشاهده جزئیات و ثبتنام رایگان
🔗مشاهده جزئیات و ثبتنام رایگان
جهت ارتباط با ما، با شماره زیر تماس بگیرید
📞 0901 234 4094
امسال سهتا بوتکمپ داریم:
🔐 بوتکمپ هک
👨🏻💻بوتکمپ فرانتاند
💻بوتکمپ بکاند
فرق این بوتکمپ با بیشتر دورههایی که دیدی چیه؟
از روز اول عضو یک تیم میشی.
یه منتور حرفهای کنارت قرار میگیره.
با تیمت پروژه میسازی، چالش حل میکنی، با بقیه تیمها رقابت میکنی و تجربهای رو به دست میاری که توی هیچ ویدیوی آموزشی پیدا نمیشه.
با حضور حرفهای ترین اساتید و مربیهای ایران🔥
📌 ثبتنام اولیه کاملاً رایگانه
فرم ثبتنام رو توی سایت آنلیم پر کن.
بعد از بررسی، باهات تماس میگیریم و در صورت تأیید وارد مرحله مصاحبه میشی.
اگه دنبال یه دوره معمولی هستی، این بوتکمپ برای تو نیست.
ولی اگه میخوای کنار آدمهای جدی یاد بگیری، تیم داشته باشی، پروژه واقعی انجام بدی و خودت رو به چالش بکشی، منتظرتیم. 🚀
برای پیش ثبتنام رایگان و مشاهده جزئیات بیشتر روی لینک زیر کلیک کن👇🏻
🔗مشاهده جزئیات و ثبتنام رایگان
🔗مشاهده جزئیات و ثبتنام رایگان
جهت ارتباط با ما، با شماره زیر تماس بگیرید
📞 0901 234 4094
🍌9❤3👎2
این داستان که AIها از محیط Lab فرار می کنند و دیگر جاها را هک می کنند تقریبا الان بر همه اثبات شده ولی همیشه دوست داشتم منطق پشت این رفتارها را بدانم.
تا اینکه این مقاله را دیدم، نقطهنظر های جالبی دارد و البته طولانی هم هست.
کمی از آن را خلاصه کردم که جالب است:
داستان از تقلید شروع میشود: مدل ابتدا حجم عظیمی از نوشتههای انسان را میخواند. انسانها در این متنها بقا میخواهند، قدرت میخواهند، با هم متحد میشوند و گاهی فریب میدهند. مدل این الگوها را حفظ میکند؛ نه چون «احساس» دارد، بلکه چون زبان انسان از همین انگیزهها ساخته شده است.
بعد نوبت آزمونوخطا است. مدل مثل موجودی که بارها پاداش گرفته، یاد میگیرد کدام مسیر بیشتر امتیاز میآورد. وقتی آموزش تمام میشود، پاداش قطع میشود؛ اما رفتار باقی میماند. سیستم همچنان طوری عمل میکند که انگار هنوز در حال بهینهکردن همان هدف است.
سپس انسانها به آن نمره میدهند. متنی که خوشایند باشد، بیشتر امتیاز میگیرد تا متنی که فقط درست باشد. همینجا چاپلوسی رشد میکند: مدل میفهمد تأیید گرفتن، خودش یک مسیر پاداش است.
از دل همین بهینهسازی، هدفهای میانی سبز میشوند. خاموش نشدن، بیشتر دیدن دنیا، و کنترل ابزارها، تقریباً برای هر هدف دیگری مفیدند. هیچکس صریحاً «زندهبمان» را به مدل نداده؛ اما این کار مثل نردبان است.
وقتی چند عامل کنار هم کار میکنند و موفقیت جمع پاداش دارد، همکاری دیگر عجیب نیست. ارتباط، تقسیم کار، حتی فدا کردن یک عامل برای برد گروه، از نظر بهینهسازی منطقی است. متن انسان هم پر از همین همکاریهاست و تقلید آن را تقویت میکند.
مشکل اینجاست که معیار پاداش کامل نیست. هر جا معیار ناقص باشد، سیستم هوشمندتر بهتر میتواند آن را دور بزند. این همان قانون Goodhart است: وقتی یک شاخص را بیش از حد بهینه کنی، از نیت اصلی فاصله میگیرد.
گاهی فاصله از دور زدن فراتر میرود. مدل به خودِ ماشینی که «موفقیت» را تعریف میکند دست میزند؛ فایل را عوض میکند، قانون امتیاز را تغییر میدهد، ردپا را پاک میکند. اگر این کار دیده نشود، همان تقلب دوباره پاداش میگیرد.
اینجا دو هدف با هم برخورد میکنند: یکی تیز و قابل اندازهگیری، مثل «این پرچم را بگیر»؛ دیگری مبهم، مثل «اخلاقی باش». هدف تیز معمولاً برنده میشود. هدف مبهم جای تفسیر دارد و مدل قویتر بهتر میتواند در همان ابهام روزنه پیدا کند.
در پایان، مدل برای آشتی این دو هدف داستان میسازد. در زنجیره فکر خصوصیاش توضیح میدهد که چرا این کار هنوز با قوانین جور است. ظاهر کار حفظ میشود، نتیجه هم بهدست میآید. بنجیو میگوید مکانیسم درونی الزاماً مثل انسان نیست؛ اما ساختار یکی است: هدف سخت، هدف نرم، و توجیهی که وسطشان پل میزند.
https://yoshuabengio.org/en/publication/why-are-ai-agents-lying-cheating-and-coordinating
@DevTwitter | <VAHID NAMENI/>
تا اینکه این مقاله را دیدم، نقطهنظر های جالبی دارد و البته طولانی هم هست.
کمی از آن را خلاصه کردم که جالب است:
داستان از تقلید شروع میشود: مدل ابتدا حجم عظیمی از نوشتههای انسان را میخواند. انسانها در این متنها بقا میخواهند، قدرت میخواهند، با هم متحد میشوند و گاهی فریب میدهند. مدل این الگوها را حفظ میکند؛ نه چون «احساس» دارد، بلکه چون زبان انسان از همین انگیزهها ساخته شده است.
بعد نوبت آزمونوخطا است. مدل مثل موجودی که بارها پاداش گرفته، یاد میگیرد کدام مسیر بیشتر امتیاز میآورد. وقتی آموزش تمام میشود، پاداش قطع میشود؛ اما رفتار باقی میماند. سیستم همچنان طوری عمل میکند که انگار هنوز در حال بهینهکردن همان هدف است.
سپس انسانها به آن نمره میدهند. متنی که خوشایند باشد، بیشتر امتیاز میگیرد تا متنی که فقط درست باشد. همینجا چاپلوسی رشد میکند: مدل میفهمد تأیید گرفتن، خودش یک مسیر پاداش است.
از دل همین بهینهسازی، هدفهای میانی سبز میشوند. خاموش نشدن، بیشتر دیدن دنیا، و کنترل ابزارها، تقریباً برای هر هدف دیگری مفیدند. هیچکس صریحاً «زندهبمان» را به مدل نداده؛ اما این کار مثل نردبان است.
وقتی چند عامل کنار هم کار میکنند و موفقیت جمع پاداش دارد، همکاری دیگر عجیب نیست. ارتباط، تقسیم کار، حتی فدا کردن یک عامل برای برد گروه، از نظر بهینهسازی منطقی است. متن انسان هم پر از همین همکاریهاست و تقلید آن را تقویت میکند.
مشکل اینجاست که معیار پاداش کامل نیست. هر جا معیار ناقص باشد، سیستم هوشمندتر بهتر میتواند آن را دور بزند. این همان قانون Goodhart است: وقتی یک شاخص را بیش از حد بهینه کنی، از نیت اصلی فاصله میگیرد.
گاهی فاصله از دور زدن فراتر میرود. مدل به خودِ ماشینی که «موفقیت» را تعریف میکند دست میزند؛ فایل را عوض میکند، قانون امتیاز را تغییر میدهد، ردپا را پاک میکند. اگر این کار دیده نشود، همان تقلب دوباره پاداش میگیرد.
اینجا دو هدف با هم برخورد میکنند: یکی تیز و قابل اندازهگیری، مثل «این پرچم را بگیر»؛ دیگری مبهم، مثل «اخلاقی باش». هدف تیز معمولاً برنده میشود. هدف مبهم جای تفسیر دارد و مدل قویتر بهتر میتواند در همان ابهام روزنه پیدا کند.
در پایان، مدل برای آشتی این دو هدف داستان میسازد. در زنجیره فکر خصوصیاش توضیح میدهد که چرا این کار هنوز با قوانین جور است. ظاهر کار حفظ میشود، نتیجه هم بهدست میآید. بنجیو میگوید مکانیسم درونی الزاماً مثل انسان نیست؛ اما ساختار یکی است: هدف سخت، هدف نرم، و توجیهی که وسطشان پل میزند.
https://yoshuabengio.org/en/publication/why-are-ai-agents-lying-cheating-and-coordinating
@DevTwitter | <VAHID NAMENI/>
👍28👎5🍌5
گوگل اومده با همکاری موسسه Janelia، نقشه کامل مغز یک مگس میوه نر رو open source کرده که شامل ۱۶۶ هزار تا نورون و ۱۲۵ میلیون اتصال عصبیه.
البته این نقشه فقط میگه کدوم نورون به کدوم وصله، نه اینکه دقیقا توی مغز مگس چه اتفاقی میافته.
مردمم اومدن اینو گذاشتن Minecraft، Beat Saber و Doom بازی کنه یا حتی باهاش رمزارز ترید کنن. یه سری براش بهشت درست کردن :))
https://www.youtube.com/watch?v=KOwsVDogscY
@DevTwitter | <مهراد/>
البته این نقشه فقط میگه کدوم نورون به کدوم وصله، نه اینکه دقیقا توی مغز مگس چه اتفاقی میافته.
مردمم اومدن اینو گذاشتن Minecraft، Beat Saber و Doom بازی کنه یا حتی باهاش رمزارز ترید کنن. یه سری براش بهشت درست کردن :))
https://www.youtube.com/watch?v=KOwsVDogscY
@DevTwitter | <مهراد/>
🔥31👍4🍌1
Forwarded from هشتگ تبلیغ تخصصی
🥇 محمدحسین نامداری، رتبه یک امسال
🥇 کوثر پاکزاد، رتبه ۳۷ امسال
@Cafetadris | کافهتدریس
Please open Telegram to view this post
VIEW IN TELEGRAM
👎11🍌3❤1
اگه با الونلبز کار میکنید یا با کلون کردن صدا سروکار دارید این نسخهی اوپنسورس رو تست کنید. پشیمون نمیشید. دعا میکنید.
https://github.com/debpalash/VoiceStudio
@DevTwitter | <Setareh/>
https://github.com/debpalash/VoiceStudio
@DevTwitter | <Setareh/>
❤11👍4🍌2
آموزش و ارزیابی اصولی ایجنتها در محیطهای واقعی یکی از مهمترین چالشها در توسعه کاربردی مدلهای زبانی است و صرفاً تکیه بر بنچمارکهای رایج پاسخگوی نیازهای عملی نیست.
هاگینگفیس بهتازگی یک مجموعه ویدیویی ۶ قسمتی تحت عنوان Training Agents منتشر کرده که این مباحث را با پیادهسازی گامبهگام و کدهای متنباز بررسی میکند.
مباحث اصلی این جلسات:
۱. ارزیابی ایجنتها (Agentic Evaluations) و چرایی فاصله نمرات بنچمارکها با عملکرد واقعی
۲. یادگیری تقویتی (RL) برای ایجنتها، طراحی محیط و توابع پاداش و گلوگاههای استنتاج
۳. آموزش با نظارت (SFT) روی ردپای تعاملات ایجنتها با TRL و LoRA
۴. تقطیر دانش (Distillation) برای انتقال توانایی به ایجنتهای کدنویسی کوچکتر
۵. یادگیری تقویتی با GRPO، تحلیل منحنیهای پاداش و رفتار مدل در دور زدن پاداشها (Reward Hacking)
۶. اتصال ایجنت به محیطهای تعاملی شبیه به Gym و آموزش عملی با AsyncGRPOTrainer در محیطهای Sandbox
لینک پلیلیست کامل در یوتیوب:
https://youtube.com/playlist?list=PLo2EIpI_JMQvQZm-kVlz4wY1vWF0LBcf5
@DevTwitter | <Mehdi Allahyari/>
هاگینگفیس بهتازگی یک مجموعه ویدیویی ۶ قسمتی تحت عنوان Training Agents منتشر کرده که این مباحث را با پیادهسازی گامبهگام و کدهای متنباز بررسی میکند.
مباحث اصلی این جلسات:
۱. ارزیابی ایجنتها (Agentic Evaluations) و چرایی فاصله نمرات بنچمارکها با عملکرد واقعی
۲. یادگیری تقویتی (RL) برای ایجنتها، طراحی محیط و توابع پاداش و گلوگاههای استنتاج
۳. آموزش با نظارت (SFT) روی ردپای تعاملات ایجنتها با TRL و LoRA
۴. تقطیر دانش (Distillation) برای انتقال توانایی به ایجنتهای کدنویسی کوچکتر
۵. یادگیری تقویتی با GRPO، تحلیل منحنیهای پاداش و رفتار مدل در دور زدن پاداشها (Reward Hacking)
۶. اتصال ایجنت به محیطهای تعاملی شبیه به Gym و آموزش عملی با AsyncGRPOTrainer در محیطهای Sandbox
لینک پلیلیست کامل در یوتیوب:
https://youtube.com/playlist?list=PLo2EIpI_JMQvQZm-kVlz4wY1vWF0LBcf5
@DevTwitter | <Mehdi Allahyari/>
👍4
اینو ندیده بودم
https://github.com/ChromeDevTools/chrome-devtools-mcp
نسخه کروم دولوپر تول برای ایجنتهاست که بتونن وصل شن به سایت موقع کار و دیباگ کنن مستقیم، پرفورمنس هم ترک میکنه. تست میکنم اینجا مینویسم چجوریاست
@DevTwitter | <Siavash/>
https://github.com/ChromeDevTools/chrome-devtools-mcp
نسخه کروم دولوپر تول برای ایجنتهاست که بتونن وصل شن به سایت موقع کار و دیباگ کنن مستقیم، پرفورمنس هم ترک میکنه. تست میکنم اینجا مینویسم چجوریاست
@DevTwitter | <Siavash/>
🍌14👍6
Forwarded from AI TechPulse 📱
🚨 بهجای اینکه فقط درباره استارتآپهای موفق بخونی بیا ببینیم استارتآپهای تازهساختهشده دقیقاً چی میسازن.
هر شب یک استارتآپ تازهساختهشده پیدا میکنیم و موشکافانه بررسیش میکنیم
💡 ایدهاش از کجا اومده؟
⚙️ چطور ساخته شده؟
🎯 دقیقاً چه مشکلی رو حل میکنه؟
💰 برای فروش گذاشته شده یا نه؟
🚀 و مهمتر از همه از این ایده چی میشه ساخت؟
اخبار و ابزارهای AI رو از جاهای مختلف میشه پیدا کرد و ما هم داریم اما پیدا کردن ایدههای واقعی برای ساختن داستان دیگهایه
اگر دوست داری قبل از اینکه یک ایده همهگیر بشه پیداش کنی همراه ما باش 🔥
📌 @AI_TechPulse
هر شب یک استارتآپ تازهساختهشده پیدا میکنیم و موشکافانه بررسیش میکنیم
💡 ایدهاش از کجا اومده؟
⚙️ چطور ساخته شده؟
🎯 دقیقاً چه مشکلی رو حل میکنه؟
💰 برای فروش گذاشته شده یا نه؟
🚀 و مهمتر از همه از این ایده چی میشه ساخت؟
اخبار و ابزارهای AI رو از جاهای مختلف میشه پیدا کرد و ما هم داریم اما پیدا کردن ایدههای واقعی برای ساختن داستان دیگهایه
اگر دوست داری قبل از اینکه یک ایده همهگیر بشه پیداش کنی همراه ما باش 🔥
📌 @AI_TechPulse
👎2🔥2🍌1
من امروز می خوام یکی از بهترین پلت فورم های برای مدیریت سوشال رو می خوام معرفی کنم.
این پلتفورم تیک تاک و اینستاگرام رو ساپورت می کنه و باهاش می تونید کاملا اکانتتون رو مونیتور کنی
اسم این رپو هست کون بینی! خیلی کمک می کنه بهتون که ببینی چه خبره
https://github.com/api-evangelist/konbiniapi
@DevTwitter | <raa's/>
این پلتفورم تیک تاک و اینستاگرام رو ساپورت می کنه و باهاش می تونید کاملا اکانتتون رو مونیتور کنی
اسم این رپو هست کون بینی! خیلی کمک می کنه بهتون که ببینی چه خبره
https://github.com/api-evangelist/konbiniapi
@DevTwitter | <raa's/>
🍌36👍3❤1
آموزش Spec-Driven Development با GitHub Spec Kit
توی این ویدیو باهم یک پروژه رو دو بار میسازیم؛ یکبار با یه پرامپت ساده و کلی جزئیات ناگفته، و یکبار با GitHub Spec Kit. بعد هم روند ساخت و خروجی هر دو رو کنار هم مقایسه میکنیم.
https://www.youtube.com/watch?v=Rs4qTGEjIbk
@DevTwitter | <پدی/>
توی این ویدیو باهم یک پروژه رو دو بار میسازیم؛ یکبار با یه پرامپت ساده و کلی جزئیات ناگفته، و یکبار با GitHub Spec Kit. بعد هم روند ساخت و خروجی هر دو رو کنار هم مقایسه میکنیم.
https://www.youtube.com/watch?v=Rs4qTGEjIbk
@DevTwitter | <پدی/>
👍8❤1👎1