Motor de traducción
Tamaño de segmento, concurrencia, temperatura, reintentos y caché del prompt.
Tamaño de los segmentos
CHUNK_TOKEN_SIZE vale 1000 de forma predeterminada y acepta valores de 200 a 10000. Un valor bajo facilita la reanudación y reduce el contexto; uno alto puede mejorar la continuidad, pero aumenta el coste, la latencia y el riesgo de desbordamiento.
Concurrencia
CONCURRENCY vale 1 de forma predeterminada y acepta de 1 a 32. Auméntala gradualmente: el proveedor, el servidor local, la VRAM y el límite de solicitudes deben soportar la carga paralela.
Temperatura
El valor predeterminado es 0.15, dentro de un intervalo de 0 a 2. Para una traducción fiel y reproducible, suele ser mejor mantenerla baja. Una temperatura alta aumenta la variación y puede perjudicar la coherencia terminológica.
Reintentos y tiempo de espera
MAX_RETRIES=3: número máximo de intentos controlados.REQUEST_TIMEOUT=180.0: espera en segundos, de10a1800.
Una desconexión o una interrupción del proveedor puede pausar el proyecto para preservar los resultados ya escritos.
Caché del prompt
Un proyecto puede activar un indicador de caché del prompt. Su eficacia depende del proveedor y del modelo; no garantiza un ahorro si la API elegida no admite este mecanismo.