
Grok 4.7 хямд хэвээр үлдэв: урт кодчиллын үр дүн жигд биш

SpaceXAI есдүгээр сарын 21-ний API хувилбарын тэмдэглэлдээ Grok 4.7-г grok-4.7 нэрээр ашиглах боломжтой болгож, 500 мянган токены контексттэй, 200 мянгаас бага оролтын токентой хүсэлтэд сая оролтын токеныг 2, сая гаралтын токеныг 6 ам.доллараар үнэлснээ мэдээлэв. Энэ нь өмнөх Grok 4.6-гийн суурь үнэтэй ижил боловч урт хүсэлт илүү өндөр тарифын шатлалд орно.
GitHub мөн өдрийн Copilot өөрчлөлтийн бүртгэлдээ Grok 4.7-г Pro, Pro+, Max, Business, Enterprise багцад үе шаттай нэвтрүүлж эхэлснээ зарлав. API-д загвар бэлэн байгаа ч Copilot дахь сонголт бүх хэрэглэгчид зэрэг харагдахгүй. Кодчиллын сорилууд ч нэгэн жигд давуу байдлыг харуулахгүй: өмнөх Grok-оос ахисан дүнтэй зэрэгцэн өрсөлдөгчөөс хоцорсон мөрүүд бий.
Урт контекстийн үнэ хаана өөрчлөгдөх вэ
500 мянган токен бол нэг хүсэлтэд багтааж болох контекстийн дээд хэмжээ; суурь тарифын хамрах хэмжээ үүнээс бага. 200 мянган оролтын токеноос давсан хүсэлтэд сая оролтын токен 4, кэшлэгдсэн оролт 1, гаралтын токен 12 ам.доллар болно. Харин доод шатлалд кэшлэгдсэн оролтын үнэ 0.50 ам.доллар. Урт хүсэлтийн өртгийг зөвхөн хямд суурь үнээр тооцвол бодит төлбөрийг дутуу үнэлнэ.
Контекстийн багтаамж нь олон файлтай кодын сан, даалгаврын түүх, тестийн хариуг нэг хүсэлтэд хадгалах боломж олгоно. Агент ажиллахдаа шинэ файл уншиж, өөрчлөлт хийж, тестийн алдаанд дахин хариулах бүрт токены хэрэглээ нэмэгдэнэ. Иймээс нэг токены тариф бага байсан ч дууссан нэг даалгаврын үнэ нь хэдэн хүсэлт илгээсэн, хариунд хэр их текст гаргасан, өмнөх оролтыг кэшээр ашигласан эсэхээс шалтгаална.
Өндөр контекст ашигтай байх нөхцөл нь мэдээллийг дахин дахин тасалж өгөхөөс үүдэх ажил багасах явдал. Жишээ нь урт кодын санг хэд хэдэн жижиг хүсэлтэд хуваахад өмнөх өөрчлөлтийн утга алдагдвал илүү олон давталт шаардагдаж болно. Гэвч энэ нь нөхцөлт давуу тал: урт контекст өөрөө загвар олон алхамтай ажлыг зөв дуусгана гэсэн баталгаа биш бөгөөд дээд үнийн шатлал зардлыг өсгөнө.
Кодчиллын гурван сорилд байрлал солигдов
SpaceXAI-ийн нээлтийн харьцуулалтад Grok 4.7-г xHigh, Grok 4.6-г High, GPT-5.6 Sol болон Fable 5.1-ийг Max тохиргоотойгоор зэрэгцүүлсэн. Энэ нь үйлдвэрлэгчийн нийтэлсэн үр дүн бөгөөд тохиргоо нь бүх баганад ижил биш. Кодчилолд хамаарах гурван мөрийг зэрэгцүүлэхэд ялгаа тод харагдана:
- CursorBench 4.0: Grok 4.7 46.3%, Grok 4.6 40.4%, GPT-5.6 Sol 41.7%, Fable 5.1 51.8%. Удаан үргэлжлэх кодчиллын ажлыг онцолдог энэ сорилд шинэ Grok өмнөх хувилбараа давсан ч Fable-ийн оноонд хүрээгүй.
- DeepSWE v1.1: Grok 4.7 71.0%, Grok 4.6 65.2%, GPT-5.6 Sol 72.7%, Fable 5.1 70.0%. Энэ мөрийн Grok 4.7-ийн үр дүнг тусгайлан high effort гэж тэмдэглэсэн; Fable-ээс өндөр боловч Sol-оос доогуур байна.
- Terminal-Bench 4.0: Grok 4.7 37.6%, Grok 4.6 20.3%, GPT-5.6 Sol 37.3%, Fable 5.1 57.9%. Олон цаг үргэлжлэх терминалын ажилд шинэ Grok өмнөхөөсөө өсөж, Sol-той ойролцоо гарсан ч Fable-ээс мэдэгдэхүйц хоцорчээ.
Энд хэмжсэн зүйлс нь өөр өөр: CursorBench удаан кодчиллын ажлыг, DeepSWE програм хангамжийн инженерчлэлийн даалгаврыг, Terminal-Bench терминалын олон алхамтай ажлыг онцолдог. Нэг сорилын амжилтыг нөгөөд шууд шилжүүлэн дүгнэх боломжгүй. Түүнчлэн үйлдвэрлэгчийн хүснэгтэд загваруудын хүчин чармайлтын түвшин зөрсөн тул онооны ялгааг дан ганц загвар солигдсоны үр нөлөө гэж үзэхэд болгоомжтой хандах хэрэгтэй.
Terminal-Bench-ийн мөр онцгой анхаарал татна. Grok 4.7-ийн оноо Grok 4.6-гаас их өссөн мэт харагдах боловч харьцуулсан тохиргоо нь xHigh ба High. Илүү их тооцоолол зарцуулсан байж болох нөхцөлийг салгахгүйгээр өмнөх хувилбарын эсрэг цэвэр ахицын хэмжээг тогтоох аргагүй. Мөн терминалын агентын ажиллагаа, ашигласан орчин эцсийн дүнд нөлөөлж болох учраас уг мөрийг API-д шууд нэг удаа илгээсэн хүсэлтийн чанартай адилтгаж болохгүй.
Үнийн хүснэгтэд Grok 4.7-ийн суурь оролт, гаралтын тариф нь Sol болон Fable-ийнхээс бага. Гэвч сорилын хувь нь шийдсэн нэг даалгаварт зарцуулсан нийт токен эсвэл төлбөрийг хэлэхгүй. Ялангуяа олон удаа оролддог агентын ажилд хямд нэгж үнэ, өндөр давталтын тоо хоёр зэрэг тохиолдож болно; үнийн давуу талыг дууссан ажлын зардалтай андуурахгүй байх шалтгаан энэ.
Copilot дахь түгээлт хэрэглэгч бүрт зэрэг хүрэхгүй
Copilot-ийн загвар сонгох цэсэнд Grok 4.7 Visual Studio Code, Visual Studio, Copilot CLI, Copilot cloud agent, Copilot app, JetBrains, Xcode болон Eclipse орчинд гарна. Түгээлт аажмаар явагдах тул тохирох багцтай хэрэглэгчийн цэсэнд одоохондоо харагдахгүй байж болно. Business болон Enterprise багцын администраторууд загварт хандах эрхийг Copilot-ийн загварын бодлогоор удирдана.
Copilot дахь хэрэглээг үйлчилгээ үзүүлэгчийн зарласан үнэд тулгуурласан хэрэглээний тооцоогоор нэхэмжилнэ. Энэ нь xAI API-гийн шууд токены төлбөртэй нэг данс биш; нэг загварыг хоёр сувгаар ашиглахад төлбөрийн орчин өөр байна. Монгол дахь хөгжүүлэгчид ч загварын бодит хүртээмжийг өөрийн Copilot багц, байгууллагын тохиргоо, түгээлтийн үе шат тодорхойлно.
API талд загварын танигч grok-4.7 бөгөөд оролтод текст, зураг авч, хариуг текстээр гаргана. Түүний reasoning effort тохиргоо low, medium, high, xhigh гэсэн сонголттой, high нь анхдагч утга. Иймээс үйлдвэрлэгчийн xHigh сорилын оноог API-ийн анхдагч тохиргоотой ижил нөхцөлийн үр дүн гэж үзэж болохгүй. Copilot-д үе шаттай түгээлт дуусах тусам хэрэглэгчид загварыг сонгох боломж нэмэгдэнэ; бодит ажлын өртөг, үр дүн нь өөрийн хэрэглэдэг орчинд илүү тодорно.
Холбоотой нийтлэлүүд


Local LLM үргэлж хямд биш: cache хийсэн API нэгж өртгөөр ялжээ

GitHub Copilot эсвэл Amazon Q: хуучин benchmark өнөөгийн агентыг шийдэхгүй

Google Workspace эсвэл Microsoft 365: AI багтсан үнэ бүхнийг шийдэхгүй

AI API-ийн зардлыг 50% бууруул: яаралгүй ажлыг batch-д шилжүүл

OBS эсвэл Streamlabs: 1080p60 дээр CPU-ийн 11 пунктын зөрүү гарчээ
Мэдээллийн товхимолд бүртгүүлэх
Web3, AI болон криптоны шинэ мэдээг шууд имэйл хайрцагтаа аваарай.