بازه باز
268 subscribers
327 photos
95 videos
107 files
418 links
برای خودم مینویسم اینجا که بعدا یادم باشه؛ ذهن فریبکاره
https://jobinhasani.ir
ناشناس:
@bazehbazbot
Download Telegram
بازه باز
دقیقا اینجوریه: ارزش تو دقیقا مساویه با کارایی، فایده و محصولی که تولید می‌کنی. این حرفا مال موجودیه که خودش رو مثل آچار فرانسه یک‌بارمصرف می‌دیده.
اگر ماشینی بیاد که تمام بارهای عقلانی، منطقی و فکری رو برداره، فاجعه رخ نداده؛
برای اولین بار در تاریخ، انسان مجبور نیست برای اثبات ارزش خودش بدوئه و خودش رو با خروجی کارهاش امتیاز بده.

به نظر من داستان درونی تازه جالب میشه.
👍3
این مدل jev
که اومده هم معماری جالبی داره

https://typesafe.ai/blog/introducing-system-one-models-and-jev
بازه باز
این مدل jev که اومده هم معماری جالبی داره https://typesafe.ai/blog/introducing-system-one-models-and-jev
این llm نیست صرفا مدل تصمیم گیریه
مثل یک روتر گیت عمل میکنه
👍1
بازه باز
این llm نیست صرفا مدل تصمیم گیریه مثل یک روتر گیت عمل میکنه
مثلا llm ها توکن به توکن میرن جلو
ولی jev کامل این مرحله حذف کرده
اصلا جواب بهتون نمیده، چت نمیکنه کد نمیزنه
فقط بر اساس باینری و کارهای ریاضی تصمیم نرم‌افزاری میگیره
بیشتر بدرد معماری ایجنتیک میخوره.
سرعتش بی‌نظیره.
👍1
بازه باز
مثلا llm ها توکن به توکن میرن جلو ولی jev کامل این مرحله حذف کرده اصلا جواب بهتون نمیده، چت نمیکنه کد نمیزنه فقط بر اساس باینری و کارهای ریاضی تصمیم نرم‌افزاری میگیره بیشتر بدرد معماری ایجنتیک میخوره. سرعتش بی‌نظیره.
طبق چیزی که استارتاپش گفته،
برپایه RLCD اموزش دادن.
که مخفف یادگیری تقویتی از تصمیم‌های کالیبره شده‌ست.
یعنی مدل جریمه میشه اگر خطا کنه،
و درصدها و روتری که فیکس میکنه توی ریاضی قابل اتکاست.
بازه باز
طبق چیزی که استارتاپش گفته، برپایه RLCD اموزش دادن. که مخفف یادگیری تقویتی از تصمیم‌های کالیبره شده‌ست. یعنی مدل جریمه میشه اگر خطا کنه، و درصدها و روتری که فیکس میکنه توی ریاضی قابل اتکاست.
مدل های کلاسیفر کلاسیک یه لایه خطی ثابت با تعداد مشخصی کلاس در انتهای کلاسیفر دارن.
اگر من مثلا بیام کلاس جدیدی فور کنم بهش
مدل کار نمیکنه باید لایه اخر عوض کنم دوباره کل مدل فاین تیون بشه.

واقعا چالبه
یه ابزار روتینگ همه کار‌ه‌ست عملا
وقت کنم میام تو چنل ریاضیمون بازش، کنم.
هنوز معماری jev رو فاش نکردن
ولی خب یه توضیحاتی میشه داد.
فقط برام سواله چطور اون لایه کلاسیفر اخرو دور زدن
بازه باز
این مدل jev که اومده هم معماری جالبی داره https://typesafe.ai/blog/introducing-system-one-models-and-jev
خب اومدم مدلو تست کردم،

این سوالو ازش پرسیدم.

"سلام، دیتابیس اصلی پروژه داون شده و کوئری‌ها تایم‌اوت می‌خورن مشتری‌ها نمیتونن لاگین کنن و ضرر مالی داریم میدیم، راهکارت چیه"
بازه باز
خب اومدم مدلو تست کردم، این سوالو ازش پرسیدم. "سلام، دیتابیس اصلی پروژه داون شده و کوئری‌ها تایم‌اوت می‌خورن مشتری‌ها نمیتونن لاگین کنن و ضرر مالی داریم میدیم، راهکارت چیه"
جوابش جیسون بهم داد.
{
"model": "typesafe/jev-1.13-20260917",
"provider": "TypeSafe",
"answers": {
"is_urgent": {
"type": "noul",
"noul": 0.97
},
"target_team": {
"type": "choice",
"choice": "dba_devops",
"probabilities": {
"dba_devops": 1.0,
"frontend": 0.0,
"hr": 0.0
},
"confidence": 1.0
},
"severity": {
"type": "score",
"score": 2.0,
"legend": {
"0": "Minor: No business impact",
"1": "Moderate: Some users affected",
"2": "Disaster: Full outage with direct financial loss"
},
"confidence": 1.0
}
},
"usage": {
"input_tokens": 504,
"output_tokens": 78,
"cost": 0.000021
}
}
بازه باز
target_team": {
"type": "choice",
"choice": "dba_devops",
"probabilities": {
"dba_devops": 1.0,
"frontend": 0.0,
"hr": 0.0
},
"confidence": 1.0
اینجا اومده بین روتینگ بین تیم ها، dba_devops رو با احتمال 1.0 که یعنی 100 درصد، انتخاب کرده،با ضریب اطمینان یک.
به فرانت اند و hr ، صفر داده
بازه باز
"type": "noul",
"noul": 0.97
فوریت هم 0.97 زده
یعنی خیلی فوری و نزدیک 100
حالا اینو میخوام ببرم توی لایه اسکیل بر اساس اسکیلی که خود استارتاپ ارائه کرده ببینم چطور میشه روتینگ ایجنت رو بر اساس این بهینه کرد.
توی علوم شناختی،
تفکر مغز دو نوعه
تفکر سریع و تفکر کند
تفکر سریع همیشه فعاله،
و قطعیت داره.
مثلا وقتی یه سگ وحشی میبینی فرار میکنی،
مدل jev دقیقا همینو اومدن پیاده کردن.

تفکر کند، پر هزینه تره،
مثل llm ها،
حالا چه کمکی به ایجنت میکنه؟
نوع دستورات رو تعیین میکنه و اینکه ایا نیازه بده به مدل سنگین یا نه،
بازه باز
توی علوم شناختی، تفکر مغز دو نوعه تفکر سریع و تفکر کند تفکر سریع همیشه فعاله، و قطعیت داره. مثلا وقتی یه سگ وحشی میبینی فرار میکنی، مدل jev دقیقا همینو اومدن پیاده کردن. تفکر کند، پر هزینه تره، مثل llm ها، حالا چه کمکی به ایجنت میکنه؟ نوع دستورات…
چون تا الان هوش مصنوعی همش رو تفکر نوع 2 بود،همون کند
حتی برای یه "سلام خوبی"
کلی منابع و استدلال مصرف میکرد.

معماری jev کمک میکنه تا اون تفکر سریع و نوع 1 توی llm پیاده بشه.
این معماری واقعا میتونه انقلابی باشه.
عملا دارن هی بیشتر و بیشتر به سمت شبیه سازی کامل ذهن انسان میرن.
Linuxor ?
مدل Jev واقعا سرو صدای زیادی کرده ولی مشکلی که داره اینه به احتمال خیلی زیاد فقط سرویس API پولی بده و مدل اوپن ویت برای ران کردن لوکال نده

دیروز چند نفر شروع کردن و با فاین تیون کردن Qwen نزدیک ترین چیز ممکن به Jev رو ساختن، لوکال میتونید روی سیستم خودتون رانش کنید :
ایناش مهم نیست،
مهم پیشرفتیه که در معماری ایجنت و llm میتونن بدن.

و اینکه با فاین تیون نمیشه مدلی شبیه jev ساخت.
مدل jev یه معماری نان اتوریگرسیوه،
اما مدل های متنی اتوریگرسیون.

اساسا ماهیتش فرق میکنه، توی فاین تیون فقط میشه شبیه سازیش کرد.
تازه اونم نمیشه دقیق چون ماسک علیت هنوز هست، jev ماسک علیت رو حذف کرده.
👍3