به گزارش شهرآرانیوز، شرکت xAI متعلق به ایلان ماسک روز گذشته ۲۱ سپتامبر ۲۰۲۶ (۳۰ شهریور ۱۴۰۵) در تازهترین دستاورد خود از مدل زبانی «Grok ۴.۷» رونمایی کرد. این مدل زبانی که تمرکز ویژهی آن روی برنامهنویسی، کارهای چند مرحلهای و حل مسائل پیچیده است، فقط ۴۰ روز پس از عرضه رسمی نسخه قبلی «Grok ۴.۶» روانهی دنیای هوش مصنوعی شده است.
این مدل به گفته xAI قویترین نسخه برای کدنویسی و کارهای دانشمحور است، از ویژگیهای دیگر Grok ۴.۶ میتوان به وظایف طولانیمدت، خود تاییدی بهتر و ایمنی پیشرفتهتر اشاره کرد. البته هنوز فقط نسخهی API برای استفاده توسعه دهندگان در دسترس قرار گرفته و هنوز برای استفاده کاربران عادی خبری از وجود Grok ۴.۷ در چتبات گروک نیست.
xAI این مدل را با قیمت ثابت ۲ دلار به ازای هر یک میلیون توکن ورودی و ۶ دلار بابت هر میلیون توکن خروجی عرضه کرده، مقایسه خبرنگار شهرآرانیوز از نرخهای رسمی API شرکتهای معروف نشان میدهد که این قیمت رقابتی باعث شده تا استفاده از گروک ۴.۷ نسبت به مدلهای پرچمدار ChatGPT و Claude حدود ۴ تا ۲۲ دلار به بهصرفهتر باشد.

البته باید در نظر بگیریم که عملکرد دستاورد جدید این شرکت در مقایسه با پرچمداران دیگر از نظر شاخص کلی هوش با امتیاز ۴۶ در رتبه پنجم، پایینتر از Claude Fable ۵.۱ و GPT-۶ Astra و دیگر مدلهای openAI و آنتروپیک قرار گرفته است.
در ادامه باید گفت که این مدل نسبت به نسخه قبلی خود یعنی Grok ۴.۶ در همین شاخص ۲ امتیاز بیشتر کسب است.

واکنش کاربران و توسعه دهندگان در ساعات اولیه انتشار، بسیار دوگانه و پر از بحث بوده، برخی کاربران از بهبود کیفیت کدنویسی و نگهداشتن زمینه طولانیتر تعریف کردهاند. یکی از کاربران نوشته: «کیفیت کدنویسی دو برابر شده و در همان سرعت ۴.۶ کار میکند. دیگر نیازی به سوئیچ به Opus ندارم و هزینه یکدهم شده.»
در مقابل بخش قابلتوجهی از کاربران، بهویژه توسعهدهندگان، از عملکرد واقعی مدل ناراضی هستند. کاربری نوشته: «در استفاده عملی بدتر از ۴.۶ است. همه بازخورد صادقانه همین است. هیچکس راضی نیست. مدل بعدی را زودتر منتشر کنید.»
شکایتهای پرتکراری درباره کندی و مصرف بالای توکن هم مطرح شده است. کاربری گفته: «خیلی کند است و توکن زیادی میخورد. حتی با اشتراک ۳۰۰ دلاری هم بدتر از Codex یا Claude است.»
بنابراین شاید این مدل از نظر قیمتی اقتصادیتر از رقبا باشد، اما با توجه به نظر کاربران، عملکرد کلی و امتیاز بنچمارکهای مختلف هنوز نمیتوان به آن اتکا کرد و باید منتظر تستهای گستردهتر و بازخوردهای عملی بیشتر در هفتههای آینده باشیم.