Het Chinese AI-bedrijf DeepSeek heeft V4.1-Flash uitgebracht, een nieuwe versie van zijn AI-model. Wie vanaf komende week nog V4-Pro wil gebruiken, komt automatisch uit bij V4.1-Flash, dat volgens het bedrijf beter presteert en veel goedkoper is.
Het gaat om een mixture-of-experts-model met 552 miljard parameters, meldt DeepSeek. Daarvan zijn er telkens acht miljard actief bij input en zestien miljard bij output. Daardoor gebruikt V4.1-Flash volgens DeepSeek een kwart van het geheugen en een achtste van de opslag om prompts uit te voeren.
Omdat V4.1-Flash sneller en goedkoper is dan V4-Pro, stopt DeepSeek met V4-Pro totdat V4.1-Pro uitkomt. Wanneer dat is, zegt het bedrijf niet. V4-Flash en V4-Flash-Vision-Exp zijn gelijk niet meer beschikbaar. Verzoeken aan die modellen komen direct uit bij V4.1-Flash. V4.1-Flash is fors goedkoper bij gebruik van de api. Klanten betalen 60 dollarcent per miljoen outputtokens, tegenover 1,98 dollar voor V4-Pro.
Source: Tweakers.net