En chip til hastighed
Inferens er den del af AI, der sker efter en model er trænet, når den faktisk behandler en anmodning og genererer et svar. For mange applikationer er den hastighed forskellen mellem et værktøj, der føles responsivt, og et der føles langsomt. Groq 3 LPX sigter mod den høje ende af det spektrum, hvor hver millisekund tæller.
Fuld produ


