Вы находитесь на странице: 1из 3

2.

- Es capaz de percibir su medioambiente con la ayuda de sensores y actuar en ese medio


utilizando actuadores (elementos que reaccionan a un estímulo realizando una acción).

Un agente es cualquier cosa capaz de percibir su medioambiente con la ayuda de sensores

y actuar en ese medio utilizando actuadores

4.- e (infinita a menos

que se limite el tamaño de la secuencia de percepciones que se quiera considerar).

5.- Para ilustrar esta idea se utilizará un ejemplo muy simple, el mundo de la aspiradora
presentado en la Figura 2.2. Este mundo es tan simple que se puede describir todo lo que en él
sucede; es un mundo hecho a medida, para el que se pueden inventar otras variaciones. Este
mundo en particular tiene solamente dos localizaciones: cuadrícula A y B. La aspiradora puede
percibir en qué cuadrante se encuentra y si hay suciedad en él. Puede elegir si se mueve hacia
la izquierda, derecha, aspirar la suciedad o no hacer nada. Una función muy simple para el
agente vendría dada por: si la cuadrícula en la que se encuentra está sucia, entonces aspirar,
de otra forma cambiar de cuadrícula. Una muestra parcial de la función del agente
representada en forma de tabla aparece en la Figura 2.3. Un programa de agente simple para
esta función de agente se mostrará posteriormente en la Figura 2.8.

8.- ¿qué significa hacer lo correcto? Como primera aproximación, se puede decir que lo
correcto es aquello que permite al agente obtener un resultado mejor

9.- es posible definir de forma más precisa qué significa la racionalidad

. Obviamente, no hay una única medida adecuada para todos los agentes. Se puede preguntar
al agente por su opinión subjetiva acerca de su propia actuación, pero muchos agentes serían
incapaces de contestar, y otros podrían engañarse a sí mismos3 . Por tanto hay que insistir en
la importancia de utilizar medidas de rendimiento objetivas

10.Si retomamos el ejemplo de la aspiradora de la sección anterior, se puede proponer utilizar


como medida de rendimiento la cantidad de suciedad limpiada en un período de ocho horas.
Con agentes racionales, por supuesto, se obtiene lo que se demanda. Un agente racional
puede maximizar su medida de rendimiento limpiando la suciedad, tirando la basura al suelo,
limpiándola de nuevo, y así sucesivamente

Un agente racional puede maximizar su medida de rendimiento limpiando la suciedad, tirando


la basura al suelo, limpiándola de nuevo, y así sucesivamente. Una medida de rendimiento más
adecuada recompensaría al agente por tener el suelo limpio

11.- Considerando que el agente aspiradora limpia una cuadrícula si está sucia y se mueve a

la otra si no lo está (ésta es la función del agente que aparece en la tabla de la Figura

2.3), ¿se puede considerar racional? ¡Depende! Primero, se debe determinar cuál es

la medida de rendimiento, qué se conoce del entorno, y qué sensores y actuadores tiene

el agente. Si asumimos que:

• La medida de rendimiento premia con un punto al agente por cada recuadro limpio

en un período de tiempo concreto, a lo largo de una «vida» de 1.000 períodos.


• La «geografía» del medio se conoce a priori (Figura 2.2), pero que la distribución

de la suciedad y la localización inicial del agente no se conocen. Las cuadrículas

se mantienen limpias y aspirando se limpia la cuadrícula en que se encuentre el

agente. Las acciones Izquierda y Derecha mueven al agente hacia la izquierda y

derecha excepto en el caso de que ello pueda llevar al agente fuera del recinto, en

este caso el agente permanece donde se encuentra.

• Las únicas acciones permitidas son Izquierda, Derecha, Aspirar y NoOp (no hacer

nada).

• El agente percibe correctamente su localización y si esta localización contiene suciedad.

12 Considerando el siguiente ejemplo: estoy paseando por los Campos Elíseos y veo un amigo
al otro lado de la calle. No hay tráfico alrededor y no tengo ningún compromiso, entonces,
actuando racionalmente, comenzaría a cruzar la calle. Al mismo tiempo, a 33.000 pies de
altura, se desprende la puerta de un avión4 , y antes de que termine de cruzar al otro lado de
la calle me encuentro aplastado. ¿Fue irracional cruzar la calle? Sería de extrañar que en mi
nota necrológica apareciera «Un idiota intentando cruzar la calle». Este ejemplo muestra que
la racionalidad no es lo mismo que la perfección

13.- Un segundo ejemplo de recopilación de información lo

proporciona la exploración que debe llevar a cabo el agente aspiradora en un medio


inicialmente

desconocido

15.- Por ejemplo, el agente aspiradora que

aprenda a prever dónde y cuándo aparecerá suciedad adicional lo hará mejor que otro

que no aprenda.

20.- Siguiente, ¿cuál es el entorno en el que se encontrará el taxi? Cualquier taxista debe estar
preparado para circular por distintas carreteras, desde caminos rurales y calles urbanas hasta
autopistas de 12 carriles. En las carreteras se pueden encontrar con tráfico, peatones,
animales, obras, coches de policía, charcos y baches. El taxista también tiene que comunicarse
tanto con pasajeros reales como potenciales. Hay también elecciones opcionales. El taxi puede
operar en California del Sur, donde la nieve es raramente un problema, o en Alaska, donde
raramente no lo es. Puede conducir siempre por la derecha, o puede ser lo suficientemente
flexible como para que circule por la izquierda cuando se encuentre en el Reino Unido o en
Japón. Obviamente, cuanto más restringido esté el entorno, más fácil será el problema del
diseño

21.- se puede identificar un pequeño número de dimensiones en

las que categorizar estos entornos. Estas dimensiones determinan, hasta cierto punto, el

diseño más adecuado para el agente


23.- Por ejemplo, un agente que tenga que seleccionar partes defectuosas en una cadena de
montaje basa sus decisiones en la parte que está evaluando en cada momento, sin tener en
cuenta decisiones previas; más aún, a la decisión presente no le afecta el que la próxima fase
sea defectuosa

• 24.- El taxista es claramente dinámico: tanto los otros coches como el taxi se están
moviendo mientras el algoritmo que guía la conducción indica qué es lo próximo a
hacer. El ajedrez, cuando se juega con un reloj, es semideterminista. Los crucigramas
son estáticos.

26.- . ¿Tiene el agente A (por ejemplo el agente taxista) que tratar un objeto B (otro vehículo)
como un agente, o puede tratarse méramente como un objeto con un comportamiento
estocástico, como las olas de la playa o las hojas que mueve el viento? La distinción clave está
en identificar si el comportamiento de B está mejor descrito por la maximización de una
medida de rendimiento cuyo valor depende del comportamiento de A.

Вам также может понравиться