Ed
há 3 meses
Vamos analisar cada afirmativa: I - O rate limiting por sessão impede requisições sequenciais duplicadas. Verdadeiro. Rate limiting por sessão limita o número de requisições por usuário/sessão, ajudando a evitar requisições duplicadas e excessivas. II - O controle de max_tokens reduz consumo em respostas longas. Verdadeiro. Limitar max_tokens controla o tamanho da resposta gerada, reduzindo o custo associado a respostas muito longas. III - O processamento em batch reduz custo em requisições individuais de fluxo conversacional. Falso. Processamento em batch é eficiente para agrupar múltiplas requisições, mas em fluxos conversacionais que dependem de respostas imediatas e sequenciais, o batch não é adequado e não reduz custo em requisições individuais. IV - A ausência de cache contribui para requisições repetidas ao provedor. Verdadeiro. Sem cache, requisições idênticas são enviadas repetidamente ao provedor, aumentando custo. Portanto, os itens corretos são: I, II e IV. A alternativa correta é: II, IV e I, mas como as opções são: - I, III e IV, apenas. (III é falso) - I, II e III, apenas. (III é falso) - I e III, apenas. (III é falso) - II e IV, apenas. (I é verdadeiro) - II, III e IV, apenas. (III é falso) Nenhuma alternativa contém exatamente I, II e IV. Como a alternativa "II e IV, apenas" está correta para II e IV, mas deixa de fora o I que também é verdadeiro, e as outras opções incluem o III que é falso, a melhor resposta é: II e IV, apenas.