Los diales que deciden si el modelo es un robot fiable o un poeta caótico
Un LLM no "decide" la siguiente palabra — obtiene una distribución de probabilidades sobre todo el vocabulario. Temperature, top_p y frequency_penalty controlan cómo se muestrea de esa distribución.
casi siempre gana la opción top → determinista
reparte peso entre varias buenas opciones
casi uniforme → tan probable "el sol" como "unicornios"
| Temperature | Uso empresarial | Ejemplo |
|---|---|---|
| 0.0-0.2 | Deterministas | FAQ, clasificación, código |
| 0.3-0.5 | Consistencia + leve variación | Instrucciones técnicas, emails |
| 0.7-0.9 | Creatividad controlada | Marketing, resúmenes ejecutivos |
| 1.0-1.5 | Alta creatividad | Brainstorming, storytelling |
| 1.5+ | Experimental | Riesgo de incoherencia |
Prompt: "El nuevo producto será…" — probabilidades del modelo:
top_p = 0.9 → incluye las 4 primeras, descarta el resto.
top_p = 0.5 → necesita llegar a 70% para cruzar el umbral, solo deja "revolucionario" e "innovador".
Regla de oro: <300 palabras → 0 · 300-1000 → 0.4-0.6 · >1000 → 0.5-0.7. pasado ~1.0-1.5 empieza a sonar forzado
["\n\n"] Fin de párrafo["###"] Separador de sección["```"] Cerrar bloque de código["}"] Finalizar JSON["FIN","STOP"] Palabras clave custom| Caso | Temp | top_p | freq_pen | Stop | Razón |
|---|---|---|---|---|---|
| FAQ / Soporte | 0.1-0.2 | 0.7 | 0 | ["\n\n"] | Consistencia crítica |
| Clasificación | 0.0 | 0.5 | 0 | ["\n"] | Determinismo 100% |
| Código | 0.2 | 0.8 | 0 | ["```"] | Sintaxis > creatividad |
| Marketing | 0.8-1.0 | 0.9 | 0.4 | — | Creatividad, evita clichés |
| Artículos/blogs | 0.7 | 0.9 | 0.5 | — | Balance |
| Brainstorming | 1.2-1.5 | 1.0 | 0.7 | — | Máxima creatividad |
| Extracción JSON | 0.0 | 0.3 | 0 | ["}"] | Determinismo de estructura |
| Emails | 0.5-0.7 | 0.85 | 0.2 | — | Profesional, no robótico |
Repeat Penalty ≠ frequency_penalty: LM Studio expone "Repeat Penalty" como multiplicador (~1.0-1.3), no el aditivo (-2.0 a 2.0) de la tabla maestra. Busca el efecto, no el número.
temperature = 0.0 no es sinónimo de idéntico: pequeñas diferencias de hardware/batching en GPU pueden dar variación mínima incluso en "modo determinista".
Corre cada prompt 3 veces cambiando solo el parámetro indicado.
| Caso | Prompt corto | Compara | Qué observar |
|---|---|---|---|
| A. Soporte | "¿Cómo reseteo mi contraseña?" | temp 0.0 vs 1.0 vs 1.5 | ¿Idéntico, variado o confuso? |
| B. Marketing | 3 slogans app productividad | temp 0.3 vs 0.9 + repeat penalty | ¿Deja de sonar a cliché? |
| C. Código | función factorial con errores | temp 0.2 vs 1.0 | ¿Sigue correcto el manejo de errores? |
| D. Artículo | 300 palabras, tema libre | repeat penalty bajo vs alto | ¿Repite la palabra clave? |