Kog développe à Paris un moteur d'inférence LLM haute performance pour GPU de datacenter, fondé sur une co-conception matériel-logiciel et des technologies propriétaires de communication et d'architecture de modèles.
1 Emploi