Stokastisk kontroll och optimalt lärande

Tidsperiod:
1 januari 2024 – 31 december 2027
Projektledare:
Erik Ekström
Finansiär:
Vetenskapsrådet
Bidragstyp:
Projektbidrag
Budget:
3 632 000 SEK

Vi studerar optimala strategier för olika optimeringsproblem som innefattar sekventiella beslut, det vill säga strategier som ändrar sig med tiden allteftersom observationer görs av det underliggande systemet. Låt oss ta ett enkelt kortspel som exempel. Strategin för en enskild spelare beror förstås på vilka kort hen själv har på handen från början, men allteftersom spelet fortskrider utvinns mer och mer information om övriga spelares kort och den spelade strategin uppdateras därmed sekventiellt. De formulerade problemen kommer från olika tillämpningsområden, såsom statistik, spelteori och ekonomi. I dessa problem är systemen ofta stokastiska, det vill säga det underliggande systemet är stört av brus och den precisa effekten av en viss strategi är inte möjlig att förutse (även exemplet med kortspelet ovan är stokastiskt: varken motspelarens kort eller de kort som man själv kommer få i framtiden är kända från början). Finansiella exempel inkluderar frågor om när en viss affärsöverenskommelse ska ingås, och statistiska exempel när ett visst försök ska avslutas för att kostnaden av att förlänga experimentet överstiger den förväntade ökningen i statistisk precision. I detta projekt studeras stokastiska optimeringsproblem under ytterligare osäkerhet, det vill säga osäkerhet som inte bara beror på slumpmässigt brus utan också på osäkerhet om de precisa förutsättningarna. Ett finansiellt exempel utgörs av en investerare som inväntar rätt tidpunkt för att ingå en viss affärsuppgörelse, men där parametrarna i den underliggande modellen är okända. I en sådan situation behöver investeraren lära sig om parametrarna och utföra finansiell optimering simultant. För att återknyta tilI kortspelsexemplet ovan motsvaras detta av att man spelar spelet med en okänd kortlek, det vill säga att själva förutsättningarna för fördelningen av olika kort är okänd. Ett speciellt fokus är på optimalt lärande där strategin väljs för att maximera hastigheten med vilken information utvinns.

FÖLJ UPPSALA UNIVERSITET PÅ

Uppsala universitet på facebook
Uppsala universitet på Instagram
Uppsala universitet på Youtube
Uppsala universitet på Linkedin