Toutes les news taguées avec ce sujet.
Des chercheurs proposent une nouvelle politique qui dépasse la borne classique en 1/√N pour une famille de processus de décision markoviens couplés.
Un nouveau cadre théorique permet à des agents en équipe d'apprendre des politiques quasi-optimales sans coordinateur central ni modèle connu du système.