xAI heeft de release van Grok 4.7 uitgesteld. Elon Musk zegt dat het model nog ‘een paar dagen’ nodig heeft, omdat het tijdens reinforcement learning te hard een penalty kreeg voor lange antwoorden.
Door die lengte-penalty leerde het model te vroeg op te geven bij moeilijke taken die het wél kon, en zijn de eigen zelfchecks onvoldoende grondig geworden. In plaats van snelheid boven kwaliteit te zetten, houdt xAI het nu even vast om die gedragingen weer af te stellen.
Grok 4.6 blijft derhalve het actuele vlaggenschip. De vertraging valt op een moment van druk, want concurrenten lopen al warm voor nieuwe releases. De vraag is of ‘een paar dagen’ genoeg is, of dat de oorzaak dieper zit dan een klein retune van de beloningsfunctie.