A janela de contexto de um LLM define o número máximo de tokens que o modelo pode processar em uma única chamada, incluindo tanto o prompt quanto a resposta gerada.
A janela de contexto de um LLM define o número máximo de tokens que o modelo pode processar em uma única chamada, incluindo tanto o prompt quanto a resposta gerada.