AI Coding Agent Benchmarks & Leaderboard | Artificial Analysis
https://artificialanalysis.ai/agents/coding-agents
https://artificialanalysis.ai/agents/coding-agents
artificialanalysis.ai
AI Coding Agent Benchmarks & Leaderboard | Artificial Analysis
We measure real-world performance of coding agents on software engineering tasks, including cost, token usage, and execution time. We compare how performance changes across agents, models, and execution settings.
🔬 وقتی AI به ابزارهای واقعی پژوهش علمی مجهز میشه، دیگه فقط یک مدل زبانی نیست.
پروژه Scientific Agent Skills مجموعهای Open Source با بیش از 160 مهارت علمی و تحقیقاتی برای AI Agentهاست که میتونه ابزارهایی مثل Claude Code، Codex، Cursor و Antigravity رو وارد Workflowهای تخصصی پژوهشی کنه.
🧬 10 حوزه مهمی که پوشش میده:
1️⃣ Genomics و Bioinformatics
تحلیل ژن، Sequence و دادههای زیستی
2️⃣ Drug Discovery
طراحی و بررسی مولکولها و فرایندهای کشف دارو
3️⃣ Computational Chemistry
تحلیل ساختارهای شیمیایی و مدلسازی مولکولی
4️⃣ Scientific Literature
جستجو، بررسی و تحلیل مقالات و منابع علمی
5️⃣ Machine Learning & Deep Learning
استفاده از ML و مدلهای پیشرفته در تحقیقات علمی
6️⃣ Statistical Analysis
تحلیل آماری و بررسی دادههای پژوهشی
7️⃣ Protein Engineering
تحلیل ساختار، Sequence و طراحی پروتئین
8️⃣ GIS & Remote Sensing
پردازش دادههای جغرافیایی و تصاویر ماهوارهای
9️⃣ Physics & Astronomy
ابزارهای محاسباتی برای فیزیک و تحلیل دادههای نجومی
🔟 Research Workflows
ساخت فرایندهای چندمرحلهای برای تحقیق، تحلیل داده و انجام وظایف علمی با AI Agentها
در واقع این Repository یک کتابخانه از Skillهای تخصصیه که میتونه فاصله بین «از AI سؤال پرسیدن» و «استفاده از AI در یک Workflow علمی واقعی» رو کمتر کنه.
https://github.com/K-Dense-AI/scientific-agent-skills
پروژه Scientific Agent Skills مجموعهای Open Source با بیش از 160 مهارت علمی و تحقیقاتی برای AI Agentهاست که میتونه ابزارهایی مثل Claude Code، Codex، Cursor و Antigravity رو وارد Workflowهای تخصصی پژوهشی کنه.
🧬 10 حوزه مهمی که پوشش میده:
1️⃣ Genomics و Bioinformatics
تحلیل ژن، Sequence و دادههای زیستی
2️⃣ Drug Discovery
طراحی و بررسی مولکولها و فرایندهای کشف دارو
3️⃣ Computational Chemistry
تحلیل ساختارهای شیمیایی و مدلسازی مولکولی
4️⃣ Scientific Literature
جستجو، بررسی و تحلیل مقالات و منابع علمی
5️⃣ Machine Learning & Deep Learning
استفاده از ML و مدلهای پیشرفته در تحقیقات علمی
6️⃣ Statistical Analysis
تحلیل آماری و بررسی دادههای پژوهشی
7️⃣ Protein Engineering
تحلیل ساختار، Sequence و طراحی پروتئین
8️⃣ GIS & Remote Sensing
پردازش دادههای جغرافیایی و تصاویر ماهوارهای
9️⃣ Physics & Astronomy
ابزارهای محاسباتی برای فیزیک و تحلیل دادههای نجومی
🔟 Research Workflows
ساخت فرایندهای چندمرحلهای برای تحقیق، تحلیل داده و انجام وظایف علمی با AI Agentها
در واقع این Repository یک کتابخانه از Skillهای تخصصیه که میتونه فاصله بین «از AI سؤال پرسیدن» و «استفاده از AI در یک Workflow علمی واقعی» رو کمتر کنه.
https://github.com/K-Dense-AI/scientific-agent-skills
GitHub
GitHub - K-Dense-AI/scientific-agent-skills: Turn any AI agent into an AI Scientist. The #1 Agent Skills library for science, used…
Turn any AI agent into an AI Scientist. The #1 Agent Skills library for science, used by 190,000+ scientists worldwide. 165 ready-to-use validated skills plus 100+ scientific databases covering bio...
Forwarded from Zoomit | زومیت
خبر فوری: عصر هوش مصنوعی انسانگونه با رونمایی GPT-6 Astra شروع شد
کمپانی OpenAI از مدل جدید خود با نام GPT-6 Astra پردهبرداری کرد. این مدل توانمندیهای جدیدی در حوزههای مهندسی نرمافزار و امنیت سایبری ارائه میدهد.
مدیران OpenAI این فناوری را آغازگر عصر AGI میدانند. دسترسی به این مدل از امروز برای مشتریان سازمانی فراهم شده است.
هوش مصنوعی عمومی AGI به سیستمی گفته میشود که میتواند تقریبا در تمام فعالیتهای فکری، همسطح یا بهتر از یک انسان عمل کند؛ یعنی برخلاف هوش مصنوعی امروزی که فقط در کارهای خاصی (مثل ترجمه یا بازی شطرنج) مهارت دارد، توانایی یادگیری، استدلال و حل مسئله در هر زمینهای را داراست.
⚡ متن کامل در زومیت
🆔 @thezoomit
کمپانی OpenAI از مدل جدید خود با نام GPT-6 Astra پردهبرداری کرد. این مدل توانمندیهای جدیدی در حوزههای مهندسی نرمافزار و امنیت سایبری ارائه میدهد.
مدیران OpenAI این فناوری را آغازگر عصر AGI میدانند. دسترسی به این مدل از امروز برای مشتریان سازمانی فراهم شده است.
هوش مصنوعی عمومی AGI به سیستمی گفته میشود که میتواند تقریبا در تمام فعالیتهای فکری، همسطح یا بهتر از یک انسان عمل کند؛ یعنی برخلاف هوش مصنوعی امروزی که فقط در کارهای خاصی (مثل ترجمه یا بازی شطرنج) مهارت دارد، توانایی یادگیری، استدلال و حل مسئله در هر زمینهای را داراست.
⚡ متن کامل در زومیت
🆔 @thezoomit
❤1
Forwarded from Zoomit | زومیت
Zoomit | زومیت
خبر فوری: عصر هوش مصنوعی انسانگونه با رونمایی GPT-6 Astra شروع شد کمپانی OpenAI از مدل جدید خود با نام GPT-6 Astra پردهبرداری کرد. این مدل توانمندیهای جدیدی در حوزههای مهندسی نرمافزار و امنیت سایبری ارائه میدهد. مدیران OpenAI این فناوری را آغازگر عصر…
اپنایآی میگه که عصر AGI از راه رسید و مدل هوش مصنوعی جدید این شرکت یعنی GPT-6 Astra همین حالا نمرههای دیوانهواری ثبت کرد:
امتیاز 98.6% در ARC-AGI-3
امتیاز 97.6% در ریاضیات سخت
امتیاز 95.9% در CAD
امتیاز 100% در بنچمارک ExploitBench
این یک آپدیت عادی نیست.
🆔 @thezoomit
امتیاز 98.6% در ARC-AGI-3
امتیاز 97.6% در ریاضیات سخت
امتیاز 95.9% در CAD
امتیاز 100% در بنچمارک ExploitBench
این یک آپدیت عادی نیست.
🆔 @thezoomit
Forwarded from Zoomit | زومیت
Zoomit | زومیت
اپنایآی میگه که عصر AGI از راه رسید و مدل هوش مصنوعی جدید این شرکت یعنی GPT-6 Astra همین حالا نمرههای دیوانهواری ثبت کرد: امتیاز 98.6% در ARC-AGI-3 امتیاز 97.6% در ریاضیات سخت امتیاز 95.9% در CAD امتیاز 100% در بنچمارک ExploitBench این یک آپدیت…
تفاوت ChatGPT 6 Astra با دیگر مدلهای پیشر رو در آزمایش AGI رو ببینید! باور کردنی نیست
هوش مصنوعی عمومی (AGI) به سیستمی گفته میشود که میتواند تقریبا در تمام فعالیتهای فکری، همسطح یا بهتر از یک انسان عمل کند؛ یعنی برخلاف هوش مصنوعی امروزی که فقط در کارهای خاصی (مثل ترجمه یا بازی شطرنج) مهارت دارد، توانایی یادگیری، استدلال و حل مسئله در هر زمینهای را داراست.
🆔 @thezoomit
هوش مصنوعی عمومی (AGI) به سیستمی گفته میشود که میتواند تقریبا در تمام فعالیتهای فکری، همسطح یا بهتر از یک انسان عمل کند؛ یعنی برخلاف هوش مصنوعی امروزی که فقط در کارهای خاصی (مثل ترجمه یا بازی شطرنج) مهارت دارد، توانایی یادگیری، استدلال و حل مسئله در هر زمینهای را داراست.
🆔 @thezoomit
Forwarded from Zoomit | زومیت
Zoomit | زومیت
اپنایآی میگه که عصر AGI از راه رسید و مدل هوش مصنوعی جدید این شرکت یعنی GPT-6 Astra همین حالا نمرههای دیوانهواری ثبت کرد: امتیاز 98.6% در ARC-AGI-3 امتیاز 97.6% در ریاضیات سخت امتیاز 95.9% در CAD امتیاز 100% در بنچمارک ExploitBench این یک آپدیت…
This media is not supported in your browser
VIEW IN TELEGRAM
این تصاویر سهبعدی با GPT-6 Astra ساخته شدند
کاربر تصویری از یک خانه را به عنوان ورودی داده و خواسته آن را به صورت سهبعدی با تمام جزئیات از جمله اسباببازیها، لوازم خانگی و مبلمان بسازد. این یک بازسازی کامل مدل سهبعدی در Blender است با هندسهای که میتوانید به صورت دستی تغییرش دهید و به عنوان یک «بازی» با رندر محلی روی دستگاه با نرخ ۶۰ فریم بر ثانیه اجرا کنید.
🆔 @thezoomit
کاربر تصویری از یک خانه را به عنوان ورودی داده و خواسته آن را به صورت سهبعدی با تمام جزئیات از جمله اسباببازیها، لوازم خانگی و مبلمان بسازد. این یک بازسازی کامل مدل سهبعدی در Blender است با هندسهای که میتوانید به صورت دستی تغییرش دهید و به عنوان یک «بازی» با رندر محلی روی دستگاه با نرخ ۶۰ فریم بر ثانیه اجرا کنید.
🆔 @thezoomit
شرکت OpenAI رسما نسل بعدی مدلهای خودش یعنی GPT-6 Astra رو معرفی کرده؛ مدلی که تمرکز اصلی اون روی اتوماسیون، حل مسائل علمی و کار با رابطهای کاربری و نرمافزارهای مختلفه.
استرا در کنترل رابط کاربری و کار با نرمافزارها پیشرفت قابل توجهی داشته و OpenAI میگه علاوه بر افزایش دقت، سرعت انجام کارها در این مدل تقریبا دو برابر شده و میتونه بسیاری از وظایف رو در نصف زمان مدلهای قبلی به پایان برسونه. این بهبود مخصوصا در نرمافزارهایی با رابطهای پیچیده، مثل ابزارهای مهندسی و فنی، بیشتر خودش رو نشون میده.
در بخش بنچمارکهای علمی هم Astra نتایج بسیار بالایی ثبت کرده. در حالی که مدل Sol در تست ARC-AGI-3 امتیاز 7.8 درصد رو کسب کرده بود، استرا با امتیاز 98.6 درصد عملا این تست رو اشباع کرده و بالاترین نتیجه ثبتشده تا امروز رو به دست آورده. این مدل در FrontierMath Tier 4 هم امتیاز 97.6 درصد رو کسب کرده که باز هم با اختلاف قابل توجهی بالاتر از سایر مدلهاست.
در تستهای امنیتی هم OpenAI ادعا میکنه استرا عملکرد بسیار قدرتمندی داره. این مدل در بنچمارک ExploitBench که توانایی توسعه و سوءاستفاده از حفرههای امنیتی رو بررسی میکنه، امتیاز کامل 100 درصد رو به دست آورده و در Exploit Gym هم بالاترین امتیاز بین مدلهای موجود رو ثبت کرده.
در بخش کدنویسی هم به گفته OpenAI، قدرت Astra در سطح Fable 5.1 و حتی فراتر از اون قرار میگیره. هرچند قیمت API این مدل نسبت به Sol بالاتره، اما به دلیل مصرف توکن کمتر برای انجام وظایف، هزینه نهایی اجرای بسیاری از کارها با Astra تقریبا در همون سطح Sol باقی میمونه.
در حال حاضر این مدل در اختیار تعداد محدودی از سازمانها برای آزمایش قرار گرفته و طبق اعلام OpenAI، طی روزهای آینده برای کاربران اشتراک جی پی تی پلاس و پلنهای بالاتر هم در دسترس قرار خواهد گرفت.
📥 @GptPlusEshtrakiSupport
@gptpluseshtrakibot
@gptpluseshtraki
استرا در کنترل رابط کاربری و کار با نرمافزارها پیشرفت قابل توجهی داشته و OpenAI میگه علاوه بر افزایش دقت، سرعت انجام کارها در این مدل تقریبا دو برابر شده و میتونه بسیاری از وظایف رو در نصف زمان مدلهای قبلی به پایان برسونه. این بهبود مخصوصا در نرمافزارهایی با رابطهای پیچیده، مثل ابزارهای مهندسی و فنی، بیشتر خودش رو نشون میده.
در بخش بنچمارکهای علمی هم Astra نتایج بسیار بالایی ثبت کرده. در حالی که مدل Sol در تست ARC-AGI-3 امتیاز 7.8 درصد رو کسب کرده بود، استرا با امتیاز 98.6 درصد عملا این تست رو اشباع کرده و بالاترین نتیجه ثبتشده تا امروز رو به دست آورده. این مدل در FrontierMath Tier 4 هم امتیاز 97.6 درصد رو کسب کرده که باز هم با اختلاف قابل توجهی بالاتر از سایر مدلهاست.
در تستهای امنیتی هم OpenAI ادعا میکنه استرا عملکرد بسیار قدرتمندی داره. این مدل در بنچمارک ExploitBench که توانایی توسعه و سوءاستفاده از حفرههای امنیتی رو بررسی میکنه، امتیاز کامل 100 درصد رو به دست آورده و در Exploit Gym هم بالاترین امتیاز بین مدلهای موجود رو ثبت کرده.
در بخش کدنویسی هم به گفته OpenAI، قدرت Astra در سطح Fable 5.1 و حتی فراتر از اون قرار میگیره. هرچند قیمت API این مدل نسبت به Sol بالاتره، اما به دلیل مصرف توکن کمتر برای انجام وظایف، هزینه نهایی اجرای بسیاری از کارها با Astra تقریبا در همون سطح Sol باقی میمونه.
در حال حاضر این مدل در اختیار تعداد محدودی از سازمانها برای آزمایش قرار گرفته و طبق اعلام OpenAI، طی روزهای آینده برای کاربران اشتراک جی پی تی پلاس و پلنهای بالاتر هم در دسترس قرار خواهد گرفت.
برای تهیه اکانت های اشتراکی و اختصاصی چت جی پی تی و بقیه هوش مصنوعی ها میتونید با پشتیبانی ما و یا ربات تلگرامی ما در ارتباط باشید
📥 @GptPlusEshtrakiSupport
@gptpluseshtrakibot
@gptpluseshtraki
Forwarded from پرامپتکده
چگونه متن نوشته شده توسط هوش مصنوعی را در عرض چند ثانیه انسانیتر کنیم؟
1. به humanizethis.io مراجعه کنید.
2. متن خود را کپی و پیست کنید یا فایل را آپلود کنید.
3. HumanizeThis متن شما را در عرض چند ثانیه انسانیتر میکند.
4. پس از این، آن را از طریق 8 سیستم تشخیص هوش مصنوعی بررسی میکند:
- TurnItIn
- GPTZero
- Originality AI
- CopyLeaks و غیره
5. این سیستمها تأیید میکنند که متن انسانی شده است.
6. شما همچنین میتوانید تغییرات اعمال شده را مشاهده کنید.
1. به humanizethis.io مراجعه کنید.
2. متن خود را کپی و پیست کنید یا فایل را آپلود کنید.
3. HumanizeThis متن شما را در عرض چند ثانیه انسانیتر میکند.
4. پس از این، آن را از طریق 8 سیستم تشخیص هوش مصنوعی بررسی میکند:
- TurnItIn
- GPTZero
- Originality AI
- CopyLeaks و غیره
5. این سیستمها تأیید میکنند که متن انسانی شده است.
6. شما همچنین میتوانید تغییرات اعمال شده را مشاهده کنید.
❤4
Forwarded from هوش مصنوعی و علم داده به فارسی
🤖 ابزار Hyperresearch برای تبدیل Claude Code به محقق هوشمند
⚡ ابزار Hyperresearch یک فریمورک متنباز است که قابلیتهای Claude Code را برای انجام تحقیقات عمیق ارتقا میدهد. این ابزار با استفاده از یک پایپلاین ۱۶ مرحلهای، فرآیند جستجو و جمعآوری منابع وب را کاملاً خودکار میکند.
🔬 خروجی نهایی این مدل، گزارشهایی است که به صورت adversarially-audited (بازبینیشده با رویکرد مقابلهای برای کاهش توهم) تولید شده و دارای منشأ دقیق منابع برای هر بخش از محتوا هستند. اطلاعات گردآوری شده در یک persistent vault (مخزن داده ماندگار) ذخیره میشود تا در مراحل بعدی تحلیل در دسترس باشد.
#ابزار #AgentAI
⚡ ابزار Hyperresearch یک فریمورک متنباز است که قابلیتهای Claude Code را برای انجام تحقیقات عمیق ارتقا میدهد. این ابزار با استفاده از یک پایپلاین ۱۶ مرحلهای، فرآیند جستجو و جمعآوری منابع وب را کاملاً خودکار میکند.
🔬 خروجی نهایی این مدل، گزارشهایی است که به صورت adversarially-audited (بازبینیشده با رویکرد مقابلهای برای کاهش توهم) تولید شده و دارای منشأ دقیق منابع برای هر بخش از محتوا هستند. اطلاعات گردآوری شده در یک persistent vault (مخزن داده ماندگار) ذخیره میشود تا در مراحل بعدی تحلیل در دسترس باشد.
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#ابزار #AgentAI
❤2
Forwarded from هوش مصنوعی و علم داده به فارسی
🤖 فریمورک OpenResearcher معرفی شد
⚡️ ️ آزمایشگاه TIGER-AI از ابزار OpenResearcher رونمایی کرد. این پروژه یک خطلوله (مجموعهای از مراحل پردازش داده) کاملاً متنباز برای آموزش عوامل تحقیقات عمیق (Deep Research Agents) است که تمام کدهای آموزش، ارزیابی و محیط جستجوی آفلاین را ارائه میدهد.
🧠 این ابزار با تکیه بر حدود ۹۶ هزار مسیر تحقیقاتی به مدلها یاد میدهد که بهجای تولید پاسخهای فرضی، فرآیند کامل پژوهش شامل جستجو در وب، استخراج شواهد و استدلال چندمرحلهای را برای رسیدن به پاسخ نهایی طی کنند.
🔗 مخزن GitHub
#ابزار #AgentAI
⚡️ ️ آزمایشگاه TIGER-AI از ابزار OpenResearcher رونمایی کرد. این پروژه یک خطلوله (مجموعهای از مراحل پردازش داده) کاملاً متنباز برای آموزش عوامل تحقیقات عمیق (Deep Research Agents) است که تمام کدهای آموزش، ارزیابی و محیط جستجوی آفلاین را ارائه میدهد.
🧠 این ابزار با تکیه بر حدود ۹۶ هزار مسیر تحقیقاتی به مدلها یاد میدهد که بهجای تولید پاسخهای فرضی، فرآیند کامل پژوهش شامل جستجو در وب، استخراج شواهد و استدلال چندمرحلهای را برای رسیدن به پاسخ نهایی طی کنند.
🔗 مخزن GitHub
📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
#ابزار #AgentAI
❤2