xAI ընկերությունը սեպտեմբերի 21-ին պաշտոնապես թողարկել է Grok 4.7 մոդելը, որը նախատեսված է ծրագրավորման, գիտելիքահեն աշխատանքների և գործակալային (agent) համակարգերի համար։ NeoTeo-ի փոխանցմամբ՝ մոդելն օգտագործում է ավելի մեծ բազային ճարտարապետություն և երկարատև ուսուցման գործընթացներ, ինչը թույլ է տալիս ավելի արդյունավետ կառավարել բարդ և բազմափուլ առաջադրանքները։
Արդյունավետության ցուցանիշները
Պաշտոնական թեստավորման արդյունքներով՝ Grok 4.7-ը զգալի առաջընթաց է գրանցել նախորդ՝ 4.6 տարբերակի համեմատ։ Terminal-Bench 4.0 թեստում մոդելը գրանցել է 38.0% արդյունք՝ նախկին 20.3%-ի դիմաց։ Այն նաև բարելավումներ է ցույց տվել CursorBench 4.0 և իրավական գործակալների համար նախատեսված Harvey թեստերում։ Այնուամենայնիվ, TechRepublic-ը նշում է, որ որոշ ոլորտներում մրցակիցները, մասնավորապես Fable 5.1 Max-ը, շարունակում են գերազանցել Grok 4.7-ին, ինչը նշանակում է, որ մոդելի ընտրությունը պետք է հիմնված լինի կոնկրետ աշխատանքային խնդիրների վրա։
Ծախսերի կառավարում
Չնայած API-ի գները մնացել են նույնը (2 դոլար՝ 1 միլիոն մուտքային թոքենի և 6 դոլար՝ 1 միլիոն ելքային թոքենի դիմաց), իրական ծախսերը կարող են տարբերվել թոքենների բարձր սպառման պատճառով։ Artificial Analysis-ի տվյալներով՝ Grok 4.7-ը մեկ առաջադրանքի համար օգտագործում է մոտ 81,000 ելքային թոքեն, ինչը զգալիորեն ավելին է, քան նախորդ սերնդի մոդելներում։ Կազմակերպություններին խորհուրդ է տրվում գնահատել ծախսերը ոչ թե ըստ թոքենների գնի, այլ ըստ մեկ հաջող ավարտված աշխատանքի արժեքի։
Անվտանգություն և հասանելիություն
Grok 4.7-ը ներառում է անվտանգության նոր համակարգ, որը նվազեցնում է չթույլատրված գործողությունների հավանականությունը։ Մոդելը հասանելի է Cursor, Grok API և երրորդ կողմի այլ գործիքների միջոցով։ Ընկերությունը նաև անվտանգության փորձարկումների համար հրավիրված գործընկերների միջոցով շարունակում է կատարելագործել համակարգը։

