P59 — Agentes inteligentes

Ruta de fundamentos · Fija qué es un agente y qué lo hace racional. La respuesta no está en el agente: está en la medida de desempeño y en el entorno.

Nivel: L2 · Motor: agente_racional · Notebook: P59_agente_racional.ipynb · Anexo: probabilidad y verosimilitud

1. Identificación

Campo Valor
Título original Intelligent Agents: Theory and Practice
Autoría Michael Wooldridge, Nicholas R. Jennings
Año 1995
Venue The Knowledge Engineering Review, 10(2), 115–152
Fuente primaria doi:10.1017/S0269888900008122
Acceso Restringido
Fecha de consulta 2026-08-17

2. Problema anterior

A principios de los noventa «agente» se usaba para cosas incompatibles: un asistente de correo, un robot móvil, un proceso en un sistema distribuido, un módulo con creencias y deseos. Cada comunidad lo definía a su manera y las publicaciones no eran comparables.

Sin una definición operativa no se puede evaluar nada: no hay forma de decir si una arquitectura es mejor que otra, ni siquiera de saber si están resolviendo el mismo problema.

3. Propuesta

Un survey que ordena el campo en tres niveles —teorías de agentes, arquitecturas y lenguajes— y que fija una definición mínima con propiedades comprobables:

Y el punto que sostiene esta ficha: la racionalidad se juzga siempre respecto de una medida de desempeño y de un entorno. Un agente no es racional en abstracto. Racional tampoco es sinónimo de omnisciente ni de perfecto: es maximizar el desempeño esperado dado lo que se ha percibido.

4. Intuición sin fórmulas

Dos aspiradoras en un piso de dos habitaciones. Una reacciona a lo que ve: si hay suciedad, aspira; si no, se mueve. La otra recuerda dónde ha estado y se detiene cuando sabe que ya no queda nada.

Si solo cuentas las habitaciones limpias, las dos empatan. Si además cobras por cada movimiento, la primera pierde. Nada cambió en las aspiradoras: cambió lo que decidiste contar.

Dónde deja de funcionar la analogía: la aspiradora reflexiva «sabe» porque le dimos memoria. En un entorno donde la suciedad reaparece, esa memoria pasa de ventaja a defecto, porque el agente dejaría de mirar. La racionalidad depende también de si el entorno es estático.

5. Matemática mínima

agente:  f : secuencia de percepciones → acción

racional ≠ omnisciente ≠ perfecto
racional = maximiza el valor esperado de la MEDIDA DE DESEMPEÑO,
           dada la secuencia de percepciones y el conocimiento disponible

Especificación completa = medida + entorno + actuadores + sensores

La miniatura ejecuta los dos agentes sobre los cuatro mundos posibles:

Agente Medida A (solo limpieza) Medida B (limpieza − ½·movimientos)
reflejo simple 8 −2,0
con modelo 8 6,0

Con la medida A empatan. Con la medida B, uno gana y el otro pierde. El código de los agentes es idéntico en las dos columnas.

💡 Consejo

Puente matemático. Esta sección da por sabido lo siguiente. Si algo no te suena, léelo primero: está explicado una sola vez, en un solo sitio, y sirve para todas las fichas.

Dónde Qué necesitas de ahí
A02 §1 · Softmax cómo se convierte una puntuación en una decisión, que es lo que hace la política de un agente

6. Arquitectura o flujo

flowchart LR
    E["entorno"] -->|percepciones| S["sensores"]
    S --> A{"agente"}
    A --> AC["actuadores"]
    AC -->|acciones| E
    M["medida de<br/>desempeño"] -.->|"juzga el ESTADO<br/>del entorno"| E
    style M fill:#1a3a2a,stroke:#3fb950,color:#f0f6fc

7. Qué observar en el paper original

8. Evidencia y resultados

Es un survey: su evidencia es la literatura que revisa, no un experimento propio. Lo que aporta es organización conceptual y vocabulario compartido.

Un survey se juzga por la calidad de sus distinciones, no por sus números. Este es citado masivamente porque las suyas resistieron.

La miniatura de este eje no reproduce nada del artículo: ilustra el punto que hoy es más útil, que es la dependencia de la racionalidad respecto de la medida de desempeño.

9. Impacto

10. Limitaciones

  1. Es un survey de 1995: las arquitecturas concretas que revisa están superadas, aunque las distinciones sigan valiendo.
  2. La noción fuerte de agencia —creencias, deseos, intenciones— es discutible como descripción de un sistema artificial, y el artículo lo reconoce.
  3. No aporta método de evaluación. Dice que hay que especificar la medida, no cómo elegirla, que es la parte difícil.
  4. El entorno multiagente queda esbozado. La coordinación real es materia de la parte 10 del programa, no de aquí.
  5. No anticipa el aprendizaje como fuente de la política. En 1995 la política se diseña; hoy se entrena.

11. Errores comunes

Error Corrección
«Un agente es cualquier programa que hace cosas solo» Autonomía es una de las cuatro propiedades. Sin reactividad, proactividad y capacidad de interacción, es un proceso automatizado, no un agente.
«Racional significa que toma la mejor decisión posible» Significa que maximiza el desempeño ESPERADO con lo que ha percibido. Con información incompleta, la decisión racional puede salir mal.
«La medida de desempeño se puede decidir después» Es parte de la especificación. La miniatura muestra dos agentes que empatan con una medida y se separan con otra: sin medida no hay veredicto.
«La medida debe evaluar lo que hace el agente» Debe evaluar el ESTADO DEL ENTORNO. Si se puntúa la actividad, un agente que ensucia para volver a limpiar puntúa alto.
«Un agente con más información siempre es mejor» Depende del entorno y de la medida. En un entorno dinámico, un agente con memoria que deja de mirar es peor que uno reactivo.

12. Relación con trabajos anteriores

13. Relación con trabajos posteriores

14. Notebook asociado

P59_agente_racional.ipynb

Qué implementa: dos agentes —reflejo y con modelo— ejecutados sobre los cuatro mundos posibles, evaluados bajo dos medidas de desempeño distintas, con el conteo de movimientos y aspiraciones.

Qué NO implementa: no hay incertidumbre, ni acciones que fallen, ni otros agentes, ni aprendizaje de la política. Son las tres cosas que hacen difícil el diseño de agentes reales.

ai-evolution paper-lab P59 --seed 7

15. Actividades Bloom

Nivel Actividad
Recordar Enumera las cuatro propiedades que definen a un agente según el survey.
Explicar Explica por qué racional no es lo mismo que omnisciente.
Aplicar Ejecuta el notebook y define una tercera medida que penalice las aspiraciones innecesarias.
Analizar Analiza por qué el agente reflejo no puede detenerse.
Evaluar «Este agente es mejor que aquel». Evalúa qué falta para que la afirmación tenga sentido.
Crear Especifica con las cuatro dimensiones —medida, entorno, actuadores, sensores— un agente para una tarea real, y construye dos versiones para compararlas.

16. Autoevaluación

  1. ¿Qué cuatro propiedades definen a un agente en la noción débil?
  2. ¿Qué diferencia hay entre la noción débil y la fuerte de agencia?
  3. ¿Respecto de qué se juzga la racionalidad?
  4. ¿Por qué el agente reflejo no puede parar?
  5. ¿Sobre qué debe definirse la medida de desempeño?
  6. ¿Qué cuatro cosas hay que especificar para diseñar un agente?
  7. ¿Dónde reaparece este marco en los agentes actuales?

17. Respuestas esperadas

  1. Autonomía, reactividad, proactividad y habilidad social. Es una definición mínima y comprobable, pensada para que dos trabajos se puedan comparar.
  2. La débil se queda en propiedades observables del comportamiento. La fuerte atribuye además estados mentales —creencias, deseos, intenciones—, lo que compromete mucho más y es discutible en un sistema artificial.
  3. Respecto de una medida de desempeño y de un entorno. No hay racionalidad en abstracto: la miniatura muestra dos agentes que empatan bajo una medida y se separan bajo otra.
  4. Porque no recuerda haber visto las dos casillas limpias. Su límite está en la percepción, no en la decisión: con lo que percibe, moverse es lo mejor que puede hacer.
  5. Sobre el estado del entorno, no sobre la actividad del agente. Si se puntúa la actividad, se premia a un agente que genera trabajo para hacerlo.
  6. La medida de desempeño, el entorno, los actuadores y los sensores. Sin las cuatro, no hay especificación y no hay evaluación posible.
  7. Íntegro: el contexto es percepción, las herramientas son actuadores, la política es el modelo y el criterio de parada es la medida. El vocabulario cambió; el marco no.

18. Fuentes primarias


⬅️ Anterior: P58 Símbolos y búsqueda · 📇 Índice · 📝 Evaluación · 🏫 Clase 004 · Agentes racionales, entornos y medidas de desempeño · ➡️ Siguiente: P60 Valor predictivo