سه زبانه مرورگر، یک پرسش که در هر سه چسبانده شده و کلی جابهجایی با Alt+Tab برای قاطی نکردن پاسخها. این روشی عادی برای مقایسه مدلهای هوش مصنوعی است و خیلیها چند چتبات رایگان را کنار هم میگذارند تا هرگز بابت یکی از آنها پولی نپردازند.
Msty Studio همین کار را در یک پنجره انجام میدهد. چند مدل را با یک درخواست واحد به کار میگیرد، پاسخها را کنار هم میچیند و طرح رایگانش نیز همه نیازهای مرا پوشش میدهد. این مقایسه بیش از آنکه پاسخهای دریافتیام را تغییر دهد، میزان اعتمادم به آنها را دگرگون کرد.
امستی استودیو همه مدلها را در یک پنجره گرد میآورد
هر بخش زمینه مستقل خود را نگه میدارد؛ و این مهم است





Msty Studio فضای کاری دسکتاپی از CloudStack است که از راه یک رابط واحد به مدلهای محلی و ارائهدهندگان ابری دسترسی پیدا میکند. این برنامه روی Windows، macOS و Linux اجرا میشود و برای آغاز کار نیازی به ساخت حساب ندارد.
هنگام راهاندازی از مدل محلی پیشنهادیاش صرفنظر کردم، چون مدلهای کوچک روی لپتاپی میانرده آنقدر کند هستند که آدم را کلافه میکنند. در عوض، کلید OpenRouter را وارد کردم که با یک اعتبارنامه، دسترسی به دهها ارائهدهنده را فراهم میکند. ابزارهای رایگان دیگری هم هستند که بدون اشتراک، هوش مصنوعی را روی رایانه شخصی اجرا میکنند و شماری از آنها یک مدل را بهخوبی به کار میاندازند؛ اما Msty Studio در مقایسه مدلها بهتر است.
سه مدل از سه آزمایشگاه متفاوت افزودم: Google Gemma ۴ 31B، NVIDIA Nemotron ۳ Ultra و Z.ai GLM ۵.۲. قابلیت Split Chats برای هر مدل بخش و تاریخچه گفتوگوی جداگانهای در نظر میگیرد؛ بنابراین هرکدام مستقل پاسخ میدهد و از خروجی دو مدل دیگر خبر ندارد.
این استقلال نکتهای جزئی نیست. ابتدا آزمونهایم را در یک رشته گفتوگوی واحد پیش بردم و پنل استدلال یکی از مدلها آشکارا نشان داد که صرفاً برای ایجاد تنوع، پاسخی متفاوت از دفعه پیش برگزیده است. مدل بهجای مخالفت واقعی، از تکرار دوری میکرد و من ممکن بود آن را بهاشتباه اختلافنظری جدی قلمداد کنم.
مدلها کجا همنظرند و کجا راهشان جدا میشود
آنچه ارزش توجه دارد، اختلافنظرهاست




پس یک پرسش یکسان را پیش روی هر سه گذاشتم.
برای خرید لپتاپی ۶۰۰ دلاری با هدف نویسندگی، وبگردی و ویرایش سبک عکس چگونه هزینه کنیم؟ هر مدل باید در سه جمله میگفت چه چیزهایی در اولویتاند و از چه امکاناتی باید چشم پوشید.
هر سه درباره آنچه باید کنار گذاشت، همنظر بودند: کارت گرافیک مجزا، بدنه فلزی گرانقیمت و نمایشگر با نرخ نوسازی بالا. سه مدل از سه آزمایشگاه به یک پاسخ رسیدند و چنین توافقی را میتوان نشانه معقولی دانست که تکلیف پرسش روشن است.
اما بر سر حافظه اختلاف پیدا کردند. GLM و Gemma هر دو 16GB را پیشنهاد دادند. Nemotron گفت 8GB کافی است و از دو مدل دیگر هم دقیقتر شد: یک لپتاپ فوقسبک ۱۳ تا ۱۴ اینچی با Core i5 یا Ryzen ۵، حافظه SSD با ظرفیت 256GB و نمایشگر IPS با وضوح 1080p که به برآوردش با بودجه ۶۰۰ دلاری جور درمیآید.
این اختلاف در چنین بودجهای مهم است، زیرا لپتاپی با مشخصاتی که Nemotron توصیف کرد واقعاً در بازار پیدا میشود.
نسخه رایگان ChatGPT از پس بیشتر پرسشها بهخوبی برمیآید و امکاناتی را هم به دست آورده که پیشتر تنها با پرداخت اشتراک در دسترس بودند. محدودیت آن نه به کیفیت، بلکه به ساختارش بازمیگردد: یک مدل در یک رشته گفتوگو نمیتواند به شما بگوید که مدلی دیگر پاسخی متفاوت میداد.
پنلهای اندیشه، مسیر رسیدن به پاسخ را نشان میدهند
یک مدل پیش از پاسخ دادن نظرش را عوض کرد

پنلهای استدلال از خود پاسخها جالبتر از کار درآمدند. GLM ابتدا پاسخ خود را بر پایه 8GB رم تنظیم کرد، اما سپس دست نگه داشت. در پنلش نوشته بود که 8GB برای ویرایش عکس کمی اندک است؛ بنابراین پیش از نهایی کردن پاسخ، این مقدار را به 16GB افزایش داد.
در پاسخ نهایی هیچ نشانهای از این فرایند دیده نمیشود. اما با خواندن پنل درمییابید که پیشنهاد 16GB نه برداشت نخست، بلکه حاصل بازنگری بوده است؛ نکتهای که وقتی مدلی دیگر به نتیجهای کاملاً متفاوت رسیده، ارزش دانستن دارد.
این پنلها همچنین نشان میدهند که شیوه کار مدلها تا چه اندازه با یکدیگر فرق دارد. GLM چهارده ثانیه صرف کرد تا محدودیتها و اولویتها را بهصورت شمارهگذاریشده بررسی کند. Nemotron اندکی تأمل کرد و سه جمله نوشت. Gemma نیز هیچ بخشی از استدلالش را نمایش نداد و با سرعت ۱۹.۹۰ توکن در ثانیه پاسخ داد؛ در حالی که سرعت GLM به ۵۶.۸۵ توکن در ثانیه رسید.
پشتههای دانش و مرزهای واقعی طرح رایگان
بیشتر امکانات دلخواهتان اینجاست؛ اما برخی قطعاً نیستند

پشتههای دانش کار بازیابی اطلاعات را بر عهده میگیرند. میتوانید سندها، پوشهها یا یادداشتها را بیفزایید، یک مدل تعبیهسازی برگزینید و پاسخ مدلها را بهجای اتکای صرف به دادههای آموزشی، بر پایه محتوای خودتان دریافت کنید. وقتی یک سند را همزمان در اختیار سه مدل میگذارید، هرکدام جنبههای متفاوتی از منبعی را برجسته میکنند که مهارش در دست خودتان است؛ درست همینجاست که راهاندازی یک هوش مصنوعی خصوصی و در دسترس همگان، معنا و ارزش بیشتری پیدا میکند.
Prompt Studio بسیار مهمتر از آن چیزی است که در نگاه نخست به نظر میرسد. اگر یکبار پرسش مقایسهای خود را ذخیره کنید، همه آزمایشهای بعدی با عبارتی کاملاً یکسان اجرا میشوند؛ و تنها همین یکسانی بیان است که پاسخها را واقعاً سنجشپذیر نگه میدارد. هم پشتههای دانش و هم Prompt Studio در طرح رایگان در دسترساند؛ در کنار گفتوگو با مدلهای محلی و برخط، Split Chats، Agent Mode و استودیوهای Persona، Skill و Media.
Aurum سالانه ۱۴۹ دلار یا با پرداخت یکباره ۳۴۹ دلار هزینه دارد و امکانات Msty Studio Web، Turnstiles، Forge Mode، Insights و Live Contexts را میافزاید. البته مدلهای رایگان نیز محدودیتهای خودشان را دارند. OpenRouter تا پیش از خرید اعتبار، استفاده را به ۲۰ درخواست در دقیقه و ۵۰ درخواست در روز محدود میکند؛ افزون بر این، ارائهدهندگان ممکن است ظرفیت رایگان را بیهیچ هشداری پس بگیرند.
Gemma سه بار ناکام ماند تا اینکه کسری از یک سنت پرداختم و از راهی دیگر به همان مدل دسترسی پیدا کردم. مدلها همچنین ممکن است بیسروصدا و پشت صحنه تغییر کنند؛ دلیلی دیگر برای اینکه همواره بیش از یک مدل را زیر نظر داشته باشیم.
مجوز رایگان Msty Studio استفاده شخصی و غیرتجاری را پوشش میدهد. برای کار حرفهای و درآمدزا باید مجوز Aurum تهیه کنید.
حالا پرسشهایم را جور دیگری مطرح میکنم
یک پرسش، سه پاسخ و دلیلی برای اعتماد به یکی از آنها
گام بعدی که از این فضای کاری میخواهم، مجموعهای ثابت از پرسشهاست که هرگاه تصمیمی هزینه واقعی در پی دارد، آنها را اجرا کنم؛ آن هم با تکیه بر پشته دانشی از منابع مرجع خودم، نه اینترنت آزاد. آمادهسازی چنین سامانهای یک آخر هفته زمان میبرد، اما پس از آن هر مقایسهای دقیقتر و سنجیدهتر خواهد بود.
هرجا که یک پاسخ نادرست میتواند وقت یا پولتان را هدر دهد، ارزش دارد چند دقیقه برای فرستادن یک پرسش به سه مدل و بررسی نقاط اختلافشان زمان بگذارید. اما برای یافتن دستوری که فقط بخشی از آن را به یاد دارید، هنوز هم پرسیدن از یک چتبات سریعترین راه است.
منبع: این مطلب ترجمه و بومیسازی مقالهای از MakeUseOf به قلم Yasir Mahmood است. مشاهده مقاله اصلی