¿Qué es?
si . La serie que todo el mundo sabe sumar en forma cerrada, y la que hay detrás de los arrays dinámicos, las recurrencias de divide y vencerás y las recompensas descontadas del aprendizaje por refuerzo.
Intuición
Multiplica por y resta: todo se cancela salvo el 1, así que . Con : ; el total lo dominan los primeros términos, y por eso el primer nivel de una recursión que divide por dos cuesta tanto como todo el resto.
Fórmulas
- retorno descontado en aprendizaje por refuerzo
Ejemplo
Un array dinámico duplica su capacidad cuando se llena. Insertar elementos copia en total como mucho elementos: amortizado por inserción. Con factor de crecimiento 1,5 la cota es copias por elemento.
Aplicaciones en informática
El análisis amortizado de los arrays dinámicos y los casos del teorema maestro son sumas geométricas.
En una cola M/M/1 el número de clientes es geométrico: .
Dónde aparece en IA
Descontar con convierte el retorno infinito en una serie convergente de tipo geométrico.
¿Dónde se utiliza?
Temas de informática a los que se llega desde aquí, con la cadena de ideas que lleva a ellos:
Qué depende de él
Ejercicios
Un agente recibe recompensa 1 en cada paso para siempre, con . ¿Cuál es el retorno? ¿Cuál es el «horizonte efectivo»?
Solución
. Las recompensas más allá de unos pasos aportan poco: el horizonte efectivo es de unos 100 pasos.