DeepSeek udostępnił model V4 Pro w wersji ogólnodostępnej (GA). Wstępne pomiary wykazują, że zużycie tokenów rozumowania (reasoning tokens) spadło o 18% do 62% w porównaniu z wersją preview. Ma to znaczenie dla każdego, kto płaci za tokeny: te same prompty kosztują teraz zauważalnie mniej, generując przy tym porównywalne wyniki.

Co skłoniło do porównania

Wersja GA pojawiła się bez wpisu na blogu czy dziennika zmian (changelog), więc programiści musieli sami odkryć różnice. Test przeprowadzony przez społeczność polegał na wykonaniu identycznych zadań na obu wersjach i wykazał największą zmianę – gwałtowny spadek liczby tokenów, które model poświęca na „myślenie” (thinking) przed udzieleniem odpowiedzi. Przy trywialnych zapytaniach model GA zużył o 62% mniej tokenów rozumowania; w przypadku bardziej złożonych zapytań redu