Hamilton .Jacobi .Bellman Vergelijking in Financiën Uitgelegd
Begrijpen hoe dynamische programmering de HJB vergelijking voor stochastische controle, portefeuillekeuze, verificatie, beperkingen en numerieke beleidsontwerp produceert
Direct antwoord
De Hamilton . Jacobi . Bellman vergelijking is de lokale optimaliteit voorwaarde voor continue-tijd controle . Het maakt optimale huidige en toekomstige actie voldoen aan een niet-lineaire achteruit vergelijking over beloning en de gecontroleerde generator van waarde
Een waardefunctie vat het controleprobleem samen
Laat X een toestandsproces zijn dat wordt beïnvloed door een controle a, zoals verbruik, portfoliogewicht, inventaris, of uitvoeringssnelheid
De waarde V(t,x) is de best verwachte toekomstige doelstelling die vanuit staat x op tijd t over alle toegestane beleidsmaatregelen kan worden bereikt
Het vaststellen van de ontvankelijkheid is essentieel omdat hefboomwerking, informatie, integreerbaarheid en marktbeperkingen bepalen welke controles kunnen worden vergeleken
Dynamische programmering levert de recursie
Bellman's principe zegt dat een optimaal plan optimaal blijft na het eerste korte interval, afhankelijk van de staat die dan bereikt
Dus de waarde van vandaag is gelijk aan de beste onmiddellijke beloning plus de optimale blijvende waarde na een kleine stap
Door deze recursie in de tijd uit te breiden en door gebruik te maken van de gecontroleerde generator produceert HJB-vergelijking continutijd
De HJB vergelijking optimaliseert lokaal
Een gemeenschappelijke eindige-horizon vorm is
Hier is r de lopende beloning en L^a is de staat generator wanneer actie a wordt gehouden lokaal
Het supremum maakt de vergelijking niet lineair, zelfs als elke vergelijking met vaste controle lineair is
Portfoliokeuze is een canonisch voorbeeld
In Mertons probleem verandert rijkdom met consumptie en toewijzingen aan risicovrije en risicovrije activa
De HJB balanceert het huidige verbruiksdoel tegen de manier waarop elke keuze de drift en variatie van toekomstige rijkdom waarde verandert
Speciale nut en constante investeringsmogelijkheden kunnen gesloten vormen opleveren, maar stochastische mogelijkheden of beperkingen voegen meestal staatdimensies toe
Een kandidaat-oplossing moet nog worden geverifieerd
Het oplossen van de eerste orde voorwaarden binnen de HJB leidt tot een kandidaatbeleid, niet automatisch een toelaatbaar optimaal
Een verificatiestelling controleert de regelmatigheid, de grens- en terminalomstandigheden, de integreerbaarheid en het bereiken van de grens door de kandidaat
Wanneer de waarde niet glad is, vervangen viscositeitsoplossingen klassieke derivaten met behoud van de dynamische programmeerbare betekenis
Beperkingen veranderen zowel beleid als vergelijking
Positielimieten, transactiekosten, geen-handelsgebieden, regels voor het opstellen van de regels en markteffecten kunnen hoeken of extra staatvariabelen creëren
Impulse-acties kunnen leiden tot quasi-variationele ongelijkheden, terwijl model ambiguïteit kan een tweede optimalisatie over ongunstige dynamiek toe te voegen
De ongeremde first-order oplossing mag nooit mechanisch worden geknipt zonder het beperkte controleprobleem te controleren.
Numerieke oplossingen vereisen beleidsdiagnostiek
Finietverschillen, beleidsiteratie, semi-Lagragiaanse schema's, en bij benadering dynamische programmering aanvallen verschillende staat en controlestructuren
Een geloofwaardig resultaat controleert monotone, stabiliteit, grensgevoeligheid, netconvergentie en of het teruggevorderde beleid ontvankelijk is
HJB-output is afhankelijk van het doel en het model; een optimaal beleid voor verkeerde voorkeuren of dynamiek is geen robuuste handelsregel
Veelgestelde vragen
Wat is de HJB vergelijking?
Het is de voorwaarde dat geen enkele ontvankelijke onmiddellijke actie gevolgd door een optimale voortzetting de waardefunctie kan verbeteren
Waarom is de HJB vergelijking niet lineair?
Het vergt een supremum of infimum over controles, dus de beste lokale generator en beloning zijn afhankelijk van derivaten van de onbekende waarde
Hoe wordt HJB gebruikt in financiën?
Het wordt gebruikt in portefeuille en consumptiekeuze, optimale uitvoering, marktmaking, afdekking onder kosten, en robuuste controle
Bewees het oplossen van de HJB dat een strategie optimaal is?
Nee. Een verificatieargument moet aantonen dat de kandidaatwaarde en het beleid voldoen aan de ontvankelijkheid, regelmatigheid, grens en integreerbaarheidsvoorwaarden
Bronnen en verder lezen
Snelle check
De gids gelezen? Test jezelf met 3 vragen
Vraag 01
Welke verklaring past het beste bij deze handleiding . . Een waarde functie vat het controleprobleem samen?
Kies een antwoord om de uitleg te zien
Optiewoordenlijst
Necessary optimal-control conditions using a Hamiltonian and backward costate along a candidate path, complementary to HJB's value-function view across states.
Lees de uitgebreide gidsExtrinsic valueThe portion of premium above intrinsic value, reflecting remaining time, expected uncertainty, rates, dividends, and supply and demand.
Lees de uitgebreide gidsGammaAn estimate of how much delta may change for a small move in the underlying, all else equal; it often becomes more concentrated near expiration and near the money.
Lees de uitgebreide gids