real-time inference
Categoria: modelos e inferência
Inferência com latência suficientemente baixa para suportar interações em tempo real, onde o usuário espera uma resposta conversacional sem atrasos perceptíveis.
Experimente 5 minutos
Comece com um caso seu ou escolha na nossa biblioteca e comece a praticar.