INTERVIEW
Entre le robot et l'homme ...
prédiction s'avère presque toujours
exacte (situations simples), il n'y aura
pas de surpri se, il suffira d'entériner
les conc lusions. On pourrait alors penser, à l'inverse, à faire en sorte que ce
soient les situations les plu s complexes
(où les prédictions sont toujours mauvai ses) qui éve illent au maximum sa
curiosité. C' est une mauvai se idée. Elle
déboucherait sur un comportement qui
ne ferait pas fo rcément faire de progrès.
La mesure choi sie, plus sophi stiquée,
repose sur l'étude de la dérivée d ' une
fonction mesurant l'évolution des erreurs de prédiction dan s le temps. On
part d ' une situation imprédictible, pui s
on mesure les progrès. S ' il s sont signi -
fi catifs, cela crée de l' intérêt. Quand le
progrès ralentit, on s' intéresse à autre
chose.
• C'est l' objet du troisième module :
optimiser son plaisir ! Le système optimi se le cho ix de ses actions, donc des
situati ons qu ' il va ex plorer, de manière
à provoquer le plus de prog rès en apprentissage, donc de curios ité et de
plaisir. Les acti vités sont automatiquement ordonnées sui vant une échelle de
complex ité croissante, les plus simples
et les plu s complexes étant éliminées.
Vo ilà qui remet en selle la prox imi té
entre sc ience et art : comprendre, mais
auss i créer une nouvelle représe ntation
du monde. « Si on rempl ace dans le
modèle le mot intérêt par le mot esthétique, on construit une relation mathé matique entre objets ex térieurs et
modèles subjectifs du monde. En parti -
culier, l'esthétique d' un résultat sc ientifique pourrait déri ve r d ' une combi -
naison entre simplic ité et amélioration
des théories ex istantes. »
Propos recueillis par G.C.
Le de,ign
des têks des
rohoh a rté
conçu par
Da\ id 1 ~ nrh.
Les rohot~ apprennent à interagir a\ef leur
Cil\ ironnement.
Enfcrmrs dans un espace confiné, les rohots
apprennent il comn11111iqucr t·n drHl011pant un
langage.
Tangente Hors-série n°52. Mathématiques & informatique
Entre le robot et l'homme ...
prédiction s'avère presque toujours
exacte (situations simples), il n'y aura
pas de surpri se, il suffira d'entériner
les conc lusions. On pourrait alors penser, à l'inverse, à faire en sorte que ce
soient les situations les plu s complexes
(où les prédictions sont toujours mauvai ses) qui éve illent au maximum sa
curiosité. C' est une mauvai se idée. Elle
déboucherait sur un comportement qui
ne ferait pas fo rcément faire de progrès.
La mesure choi sie, plus sophi stiquée,
repose sur l'étude de la dérivée d ' une
fonction mesurant l'évolution des erreurs de prédiction dan s le temps. On
part d ' une situation imprédictible, pui s
on mesure les progrès. S ' il s sont signi -
fi catifs, cela crée de l' intérêt. Quand le
progrès ralentit, on s' intéresse à autre
chose.
• C'est l' objet du troisième module :
optimiser son plaisir ! Le système optimi se le cho ix de ses actions, donc des
situati ons qu ' il va ex plorer, de manière
à provoquer le plus de prog rès en apprentissage, donc de curios ité et de
plaisir. Les acti vités sont automatiquement ordonnées sui vant une échelle de
complex ité croissante, les plus simples
et les plu s complexes étant éliminées.
Vo ilà qui remet en selle la prox imi té
entre sc ience et art : comprendre, mais
auss i créer une nouvelle représe ntation
du monde. « Si on rempl ace dans le
modèle le mot intérêt par le mot esthétique, on construit une relation mathé matique entre objets ex térieurs et
modèles subjectifs du monde. En parti -
culier, l'esthétique d' un résultat sc ientifique pourrait déri ve r d ' une combi -
naison entre simplic ité et amélioration
des théories ex istantes. »
Propos recueillis par G.C.
Le de,ign
des têks des
rohoh a rté
conçu par
Da\ id 1 ~ nrh.
Les rohot~ apprennent à interagir a\ef leur
Cil\ ironnement.
Enfcrmrs dans un espace confiné, les rohots
apprennent il comn11111iqucr t·n drHl011pant un
langage.
Tangente Hors-série n°52. Mathématiques & informatique
