مدل زبانی grok ۴.۷ رونمایی شد | مدل جدید xAI برای کدنویسی سریع‌تر و کار‌های پیچیده

  • کد خبر: ۴۴۷۲۰۳
  • ۳۱ شهريور ۱۴۰۵ - ۲۱:۱۸
هوش مصنوعی گروک
«شهرآرانیوز-گروه علم‌وفناوری» Grok ۴.۷ دستاورد جدید مدل‌های استدلالی xAI است که تمرکز اصلی آن روی برنامه‌نویسی، کار‌های چندمرحله‌ای و پردازش مسائل پیچیده قرار گرفته است. xAI می‌گوید این مدل نسبت به Grok ۴.۶ از یک مدل پایه بزرگ‌تر استفاده می‌کند و آموزش تقویتی آن برای مدت طولانی‌تری روی مسائل دشوار انجام شده است.
شهاب راعی
خبرنگار شهاب راعی

به گزارش شهرآرانیوز، شرکت xAI متعلق به ایلان ماسک روز گذشته ۲۱ سپتامبر ۲۰۲۶ (۳۰ شهریور ۱۴۰۵) در تازه‌ترین دستاورد خود از مدل زبانی «Grok ۴.۷» رونمایی کرد. این مدل زبانی که تمرکز ویژه‌ی آن روی برنامه‌نویسی، کار‌های چند مرحله‌ای و حل مسائل پیچیده است، فقط ۴۰ روز پس از عرضه رسمی نسخه قبلی «Grok ۴.۶» روانه‌ی دنیای هوش مصنوعی شده است.

این مدل به گفته xAI قوی‌ترین نسخه برای کدنویسی و کار‌های دانش‌محور است، از ویژگی‌های دیگر Grok ۴.۶ می‌توان به وظایف طولانی‌مدت، خود تاییدی بهتر و ایمنی پیشرفته‌تر اشاره کرد. البته هنوز فقط نسخه‌ی API برای استفاده توسعه دهندگان در دسترس قرار گرفته و هنوز برای استفاده کاربران عادی خبری از وجود Grok ۴.۷ در چت‌بات گروک نیست.

مقایسه قیمت و عملکرد کلی

xAI این مدل را با قیمت ثابت ۲ دلار به ازای هر یک میلیون توکن ورودی و ۶ دلار بابت هر میلیون توکن خروجی عرضه کرده، مقایسه خبرنگار شهرآرانیوز از نرخ‌های رسمی API شرکت‌های معروف نشان می‌دهد که این قیمت رقابتی باعث شده تا استفاده از گروک ۴.۷ نسبت به مدل‌های پرچمدار ChatGPT و Claude حدود ۴ تا ۲۲ دلار به به‌صرفه‌تر باشد.

مدل زبانی grok ۴.۷ رونمایی شد | مدل جدید xAI برای کدنویسی سریع‌تر و کار‌های پیچیده

البته باید در نظر بگیریم که عملکرد دستاورد جدید این شرکت در مقایسه با پرچمداران دیگر از نظر شاخص کلی هوش با امتیاز ۴۶ در رتبه پنجم، پایین‌تر از Claude Fable ۵.۱ و GPT-۶ Astra و دیگر مدل‌های openAI و آنتروپیک قرار گرفته است.

در ادامه باید گفت که این مدل نسبت به نسخه قبلی خود یعنی Grok ۴.۶ در همین شاخص ۲ امتیاز بیشتر کسب است.

مدل زبانی grok ۴.۷ رونمایی شد | مدل جدید xAI برای کدنویسی سریع‌تر و کار‌های پیچیده

نظر کاربران در فضای مجازی چه بود؟

واکنش‌ کاربران و توسعه دهندگان در ساعات اولیه انتشار، بسیار دوگانه و پر از بحث بوده، برخی کاربران از بهبود کیفیت کدنویسی و نگه‌داشتن زمینه طولانی‌تر تعریف کرده‌اند. یکی از کاربران نوشته: «کیفیت کدنویسی دو برابر شده و در همان سرعت ۴.۶ کار می‌کند. دیگر نیازی به سوئیچ به Opus ندارم و هزینه یک‌دهم شده.»

در مقابل بخش قابل‌توجهی از کاربران، به‌ویژه توسعه‌دهندگان، از عملکرد واقعی مدل ناراضی هستند. کاربری نوشته: «در استفاده عملی بدتر از ۴.۶ است. همه بازخورد صادقانه همین است. هیچ‌کس راضی نیست. مدل بعدی را زودتر منتشر کنید.»

شکایت‌های پرتکراری درباره کندی و مصرف بالای توکن هم مطرح شده است. کاربری گفته: «خیلی کند است و توکن زیادی می‌خورد. حتی با اشتراک ۳۰۰ دلاری هم بدتر از Codex یا Claude است.»

بنابراین شاید این مدل از نظر قیمتی اقتصادی‌تر از رقبا باشد، اما با توجه به نظر کاربران، عملکرد کلی و امتیاز بنچمارک‌های مختلف هنوز نمی‌توان به آن اتکا کرد و باید منتظر تست‌های گسترده‌تر و بازخورد‌های عملی بیشتر در هفته‌های آینده باشیم.

گزارش خطا
ارسال نظرات
دیدگاه های ارسال شده توسط شما، پس از تائید توسط شهرآرانیوز در سایت منتشر خواهد شد.
نظراتی که حاوی توهین و افترا باشد منتشر نخواهد شد.