Hawkes Processes for Order Arrival and Market Event Modeling
Der Artikel zum digitalen Fingerabdruck verwendet einen Vektor aus drei Zahlen – hawkes_mu, hawkes_alpha, hawkes_beta – als zeitliche Komponente der Verhaltenssignatur eines Teilnehmers und besagt, dass Market Maker eine starke Selbsterregung aufweisen. Es wird nie gesagt, woher diese drei Zahlen kommen, worauf sie geschätzt werden oder wie sehr man ihnen vertrauen sollte. Dieser Artikel ist die fehlende Hälfte: der Schätzer, die Anpassungsdiagnose und die eine abgeleitete Größe, die wichtiger ist als die drei Parameter selbst – das Verzweigungsverhältnis .
Die hier geprüfte Behauptung ist eng gefasst und überprüfbar. Der Auftragsfluss ist selbsterregend: Ein aggressiver Verkauf erhöht die Wahrscheinlichkeit des nächsten aggressiven Verkaufs, und zwar in einer Weise, die ein Poisson-Modell mit einer zeitlich variierenden Rate nicht reproduzieren kann. Wenn dies zutrifft, sollte ein Hawkes-Prozess, der an rohe Handelszeitstempel angepasst wird, (a) eine Poisson-Basislinie bei der Hold-out-Likelihood übertreffen, (b) ein Verzweigungsverhältnis genau zwischen 0 und 1 erzeugen und (c) einen zeitlich neu skalierenden Test auf Güte der Anpassung bestehen. Die Punkte (a) und (b) werden häufig für Aktien-Futures angegeben. Punkt (c) ist der Punkt, an dem veröffentlichte Hawkes-Artikel normalerweise still bleiben, und an diesem Punkt wurde das Kryptoband in diesem Blog noch nie überprüft.
Zwei Hintergrundinformationen sind in diesem Blog bereits vorhanden und werden daher hier nicht erneut abgeleitet. Die selbsterregende Rückkopplungsstruktur – Ereignisse, die weitere Ereignisse der gleichen Art auslösen, unterhalb eines Schwellenwerts unterkritisch und darüber hinaus außer Kontrolle geraten – wird konkret als Reproduktionszahl abgeleitet in Liquidationskaskaden als Handelssignal, einschließlich der geometrischen Reihen-Gesamtbewegung, des überkritischen Flash-Crash-Regimes und Leistungsschaltern als eines der drei Dinge, die es verbanden. Das Verzweigungsverhältnis Unten ist das Punktprozess-Analogon davon . Was hier wirklich additiv ist: ist in Echtzeit allein anhand der Handelszeitstempel schätzbar, ohne Liquidationskarte, ohne Orderbuchtiefe und ohne Leverage-Annahmen. Das ist der ganze Grund, sich mit der Punktprozessmaschinerie zu befassen.
Die Prämisse, dass die Uhrzeit die falsche Abtastachse ist, ist das Grundargument von beyond time bars, das dieses Problem durch den Bau besserer Balken löst. In diesem Artikel wird das Problem anders gelöst: indem überhaupt keine Stichproben entnommen werden und die Ereigniszeiten direkt modelliert werden.
Punkt Prozessgrundlagen, kurz

Ein Punktprozess ist eine zufällige Menge von Ereigniszeiten, definiert durch seine bedingte Intensität — die momentane Ankunftsrate angesichts der vollständigen Historie :
Der homogene Poisson-Prozess ist der Fall . Der inhomogene Poisson-Prozess lässt folgt einer deterministischen Form (z. B. einer U-förmigen Intraday-Kurve), geht aber immer noch von bedingter Unabhängigkeit aus: Wenn man weiß, dass gerade ein Trade stattgefunden hat, sagt man nichts darüber, ob ein weiterer unmittelbar bevorsteht. Gegen diese Annahme verstößt der reale Auftragsfluss, und dieser Verstoß ist das gesamte Thema dieses Artikels. Das Sternchen drin ist der ganze Unterschied – er markiert die Abhängigkeit von der Geschichte.
Der Hawkes-Prozess

Ein univariater Hawkes-Prozess hat Intensität
mit die Hintergrundintensität (exogene Ankünfte) und der Anregungskern. Jedes Ereignis erhöht die Intensität um ein Vielfaches , das dann in die Form zerfällt . Eine Häufung aktueller Ereignisse erzeugt eine hohe Intensität, wodurch weitere Ereignisse wahrscheinlicher werden – der Prozess erinnert sich an seine eigene Geschichte.
Das Verzweigungsverhältnis
ist die durchschnittliche Anzahl untergeordneter Ereignisse, die von einem übergeordneten Element ausgelöst werden. Stationarität erfordert ; die stationäre mittlere Intensität ist , was divergiert als . Also spaltet die Gesamtaktivität in einen exogenen Anteil auf und eine endogene Fraktion : bei Siebzig Prozent der Ereignisse sind Reaktionen auf andere Ereignisse und nicht Reaktionen auf etwas außerhalb des Marktes.
Dies ist genau die unterkritische/überkritische Aufteilung des Kaskadenmultiplikators in Liquidationskaskaden, die aus einer anderen Richtung erreicht wird. Der Unterschied in den Berechnungskosten: erfordert eine Vorwärtskarte der Zwangsverkaufsdichte und der Live-Book-Tiefe, wobei es sich bei beiden Werten um Schätzungen handelt, die auf Annahmen über die Leverage-Verteilung basieren. erfordert eine Liste von Zeitstempeln.
Filimonov und Sornette (2012) berichteten stieg zwischen 1998 und 2007 von etwa 0,3 auf über 0,7 in E-Mini-S&P-500-Futures. Hardiman, Bercot und Bouchaud (2013) schätzen den gleichen Kontrakt nahe mit einem Potenzgesetzkern des Exponenten ungefähr bei kurzen Verzögerungen. Bei beiden handelt es sich um Aktien-Futures-Ergebnisse von vor über einem Jahrzehnt, und keines von beiden wird ohne Messung in Krypto übertragen. Es geht in diesem Artikel nicht darum, sie zu reproduzieren; Es wird überprüft, ob auf einem 24/7-Perpetual-Futures-Band mit unterschiedlichen Teilnehmern das gleiche Regime gilt und keine marktoffene Diskontinuität besteht.
Kernel-Auswahlmöglichkeiten
Exponentiell, , mit . Markovian, also hat die Wahrscheinlichkeit eine -pro-Ereignis-Rekursion (unten). Hier beginnt jede praktische Passform.
Potenzgesetz, . Reproduziert Clustering mit langem Speicher, verliert aber die Rekursion – die Wahrscheinlichkeitsauswertung wird oder erfordert eine Kürzung.
Summe der Exponentialfunktionen, . Nähert den Zerfall des Potenzgesetzes mit Zeitskalen unter Beibehaltung der Rekursion. Zu reicht normalerweise aus, mit von Millisekunden bis Minuten.
Ob die Krypto-Handelsankünfte exponentiell oder als Potenzgesetz abnehmen, ist eine empirische Frage mit einer Likelihood-Ratio-Antwort und wird im Folgenden gemessen und nicht zitiert.
Multivariate Hawkes-Prozesse

Für Veranstaltungsarten,
Wo beschreibt, wie Typ erregt den Typ . Bei exponentiellen Kerneln ist die Verzweigungsmatrix und Stationarität erfordert einen Spektralradius . Der Eigenvektor von Der mit dem größten Eigenwert verknüpfte Wert identifiziert den dominanten Anregungsmodus – welche Gruppe von Ereignistypen dazu neigt, gemeinsam auszulösen.
Die interessante Instanziierung für ein Auftragsbuch ist : Marktkauf, Marktverkauf, Limitkauf, Limitverkauf, Kauf stornieren, Verkauf stornieren. Diese Matrix hat 36 Einträge und ist Teil des Hawkes-Toolkits, das dieser Blog nirgendwo sonst hat. Beachten Sie, dass einer seiner vorhergesagten Eintritte bereits empirisch dokumentiert ist, ohne dass das Vokabular fehlt: Die korrelierte Massenauslöschung über aufeinanderfolgende Ebenen hinweg – Wall Pulls – wird direkt in der Warteschlangenpositions- und Orderbuchwandanalyse gemessen. A ausgestattet ist das gleiche Phänomen, ausgedrückt als Kernel, und die beiden Messungen sollten übereinstimmen. Wenn nicht, liegt einer von ihnen falsch.
Cross-Asset- und Multi-Venue-Versionen sind die gleiche Maschinerie mit unterschiedlichen Bezeichnungen: Off-diagonale Kernel erfassen Lead-Lag und Ansteckung, und Shi, Broussard und Booth (2019) nutzten genau dies bei den 30 Dow-Aktien während des Flash-Crashs 2010 und fanden eine asymmetrische Kreuzanregung mit identifizierbaren Ansteckungsquellen.
Kalibrierung

Maximale Wahrscheinlichkeit
Für Veranstaltungszeiten An :
Der erste Begriff belohnt die Intensität dort, wo Ereignisse stattgefunden haben. der zweite bestraft die Intensität, die nichts hervorgebracht hat.
Für den exponentiellen Kernel die Rekursion
gibt bei pro Ereignis, und der Kompensator schließt:
Gesamtkosten , was Millionen-Event-Anfälle zur Routine macht. Optimieren Sie mit L-BFGS-B unter Positivitätseinschränkungen.
Zwei Fehlermodi, die Sie kennen sollten, bevor Sie einer Ausgabe vertrauen. Die Wahrscheinlichkeitsoberfläche wird stark abgeflacht , sodass eine nahezu kritische Anpassung eine sicher aussehende Punktschätzung liefern kann, die in einem Tal liegt, das nahezu eben ist In – Profilieren Sie immer die Wahrscheinlichkeit in anstatt das Hessische des Optimierers zu lesen. Und im multivariaten Fall wächst die Parameteranzahl mit , so vorbei Sie benötigen ein Gruppen-Lasso für die Kernel-Normen, oder die Matrix passt Rauschen an.
EM und nichtparametrische Schätzung
EM behandelt die Verzweigungsstruktur als latent: Jedes Ereignis ist entweder ein Einwanderer aus oder ein Nachkomme eines früheren Ereignisses. Die generische E-Schritt-/M-Schritt-Mechanik, der Vorbehalt des lokalen Optimums und die Disziplin der Mehrfachinitialisierung werden im Baum-Welch-Abschnitt von Regimeerkennung mit HMMs behandelt und sind hier identisch. Der Hawkes-spezifische Teil ist die E-Schrittgröße selbst:
ist ein Posterior über welches Ereignis welches verursacht hat – eine interpretierbare Ausgabe, nicht nur ein Optimierungszwischenprodukt. Nach Ereignistyp summiert ergibt sich eine Zuordnung des Bandes: Dieser Bruchteil der Verkäufe der letzten Stunde wurde durch frühere Verkäufe ausgelöst, dieser Bruchteil kam von außen. Sie können damit auch schätzen nichtparametrisch als stückweise konstant auf einem Gitter, wodurch Sie die Exponentialannahme überprüfen, ohne sich auf eine Alternative festzulegen. Kosten: für das volle Matrix, so dass es nicht grob darüber hinaus skaliert Ereignisse ohne Annäherung.
Die Spektralmethode von Bacry und Muzy ist der andere modellfreie Weg – die spektrale Leistungsdichte eines stationären Hawkes-Prozesses wird als Faktor berücksichtigt Das Schätzen der Kovarianzdichte und das Lösen der Faktorisierung stellt also die Kernel wieder her, ohne dass eine parametrische Form angenommen wird.
Anbringen eines echten Kryptobandes

Jede Zahl in diesem Abschnitt muss aus einer tatsächlichen Anpassung an reale Daten stammen. Das Wiederherstellen von Parametern, die Sie in einen Simulator eingegeben haben, ist kein Beweis für irgendetwas anderes als dafür, dass der Optimierer funktioniert.
Die Daten: Binance BTC/USDT aggTrade Zeitstempel über ein definiertes Fenster, wobei die Fenster-, Symbol- und Ereignisanzahl explizit neben jeder gemeldeten Zahl angegeben wird. aggTrade aggregiert Ausführungen zum gleichen Preis von einer Taker-Order in einem einzigen Datensatz, was hier die richtige Einheit ist – eine aggressive Order ist ein Ereignis, nicht ein Ereignis pro Ausführung durch die Gegenpartei.
Univariate Anpassung
import numpy as np
import pandas as pd
from tick.hawkes import HawkesExpKern
trades = pd.read_parquet("binance_btcusdt_aggtrades.parquet")
t0 = trades["transact_time"].iloc[0]
ts = ((trades["transact_time"] - t0) / 1000.0).to_numpy(dtype=np.float64)
T = ts[-1]
learner = HawkesExpKern(decays=BETA_GRID, penalty="none", verbose=False)
learner.fit([ts])
mu_hat = learner.baseline[0]
alpha_hat = learner.adjacency[0, 0]
n_hat = alpha_hat / BETA_CHOSEN
print(f"events = {len(ts)}")
print(f"window = {T/3600:.2f} h")
print(f"mu = {mu_hat:.4f} events/s")
print(f"n = {n_hat:.4f}")
print(f"lambda_bar (model) = {mu_hat/(1-n_hat):.4f} events/s")
print(f"lambda_bar (data) = {len(ts)/T:.4f} events/s")
Die letzten beiden Ausdrucke sind die erste Plausibilitätsprüfung, die nichts kostet: wenn die stationäre mittlere Intensität des Modells vorliegt nicht in der Nähe der empirischen Ereignisrate landet, ist die Anpassung falsch, unabhängig davon, was der Optimierer gemeldet hat.
sollte nicht von Hand repariert werden. Profilieren Sie die Wahrscheinlichkeit über ein Raster von Zerfällen und melden Sie das Profil, weil Und stark abwägen und kann stabil sein, während keiner der Parameter stabil ist.
Zerfällt der Kernel tatsächlich exponentiell?
Die Potenzgesetz-Behauptung in der Literatur stammt aus Aktien-Futures-Papieren aus dem Jahr 2013. Testen Sie es direkt: Passen Sie einen exponentiellen Kernel und einen Potenzgesetz-Kernel an dasselbe Band an, vergleichen Sie anhand der Log-Likelihood auf zurückgehaltenen Daten (nicht in der Stichprobe, da das Potenzgesetz einen zusätzlichen Parameter hat) und betrachten Sie separat den empirischen Intensitätsabfall nach großen Trades.
large = ts[trades["quantity"].to_numpy() > LARGE_TRADE_THRESHOLD]
lags = np.logspace(-3, 2, 60) # 1 ms .. 100 s
rate = np.empty(len(lags) - 1)
for k in range(len(lags) - 1):
lo, hi = lags[k], lags[k + 1]
counts = [
np.searchsorted(ts, t0_ + hi) - np.searchsorted(ts, t0_ + lo)
for t0_ in large
]
rate[k] = np.mean(counts) / (hi - lo)
Log-log aufgetragen, eine exponentielle Kernelbiegung; Ein Potenzgesetz ist gerade. Dieses Diagramm ist ein aussagekräftigeres Beweisstück als beide Wahrscheinlichkeitszahlen, da es zeigt, wo die Fehlanpassung liegt – typischerweise passen Exponentialzahlen zu wenig zum Ende und zu viel in den ersten paar Millisekunden.
Die Verzweigungsmatrix
Minimum Viable Multivariate-Modell: zwei Dimensionen, aggressiver Kauf und aggressiver Verkauf, getrennt durch is_buyer_maker. Wenn L3-Daten verfügbar sind, erweitern Sie diese auf Abbrüche.
buys = ts[~trades["is_buyer_maker"].to_numpy()] # taker bought
sells = ts[ trades["is_buyer_maker"].to_numpy()] # taker sold
mv = HawkesExpKern(decays=BETA_CHOSEN, penalty="l2", C=C_CV, verbose=False)
mv.fit([buys, sells])
G = mv.adjacency / BETA_CHOSEN # branching matrix
rho = np.max(np.abs(np.linalg.eigvals(G)))
print("G =\n", G)
print(f"spectral radius = {rho:.4f}") # must be < 1
Die beiden zu veröffentlichenden Größen sind die Matrix selbst und ihr Spektralradius. Die Asymmetrie ist der interessante Teil: Ob „Verkaufen-erregt-verkaufen“ größer ist als „Kauf-erregt-kaufen“ und ob die Kreuzterme symmetrisch sind, sind überprüfbare Aussagen über Krypto-Tape, die hier niemand gemessen hat.
Güte der Anpassung: Neuskalierung der Zeit
Der Zeitskalierungssatz: Wenn das Modell korrekt ist, werden die transformierten Zeiten bilden einen Poisson-Prozess mit Einheitsrate, also die Differenzen Sind .
from scipy.stats import kstest, expon
compensator = np.empty(len(ts))
for i, ti in enumerate(ts):
compensator[i] = mu_hat * ti + (alpha_hat / BETA_CHOSEN) * np.sum(
1 - np.exp(-BETA_CHOSEN * (ti - ts[:i]))
)
tau = np.diff(compensator)
stat, pval = kstest(tau, expon(scale=1.0).cdf)
print(f"KS = {stat:.4f}, p = {pval:.4g}, N = {len(tau)}")
Eine Warnung beim Lesen dieses Tests: mit Bei Hunderttausenden lehnt der KS-Test triviale Fehlspezifikationen ab. Ein winziger p-Wert bei bedeutet für sich genommen fast nichts; Die informative Ausgabe ist das QQ-Diagramm von gegen und die KS-Statistik selbst, bei der es sich um eine skalenfreie Effektgröße handelt. Melden Sie beides, und zwar ehrlich – wenn der exponentielle Kernel auf Kryptoband abgelehnt wird, ist das ein Ergebnis, das es wert ist, veröffentlicht und nicht vergraben zu werden, im gleichen Sinne wie das ehrliche negative Ergebnis auf robusten Kanten.
Bewegt sich N tatsächlich mit Zerbrechlichkeit?
Die Behauptung, dass ist ein Echtzeit-Fragilitätsindikator, der ständig zitiert und selten getestet wird. Der Test ist einfach: Schätzung auf rollierenden Fenstern über eine ruhige Periode und über ein bekanntes Krypto-Kaskadendatum hinweg und sehen Sie, ob es vor oder nur während des Ereignisses ansteigt. Eine Menge, die nur gleichzeitig mit dem Absturz ansteigt, ist eine Beschreibung und keine Warnung.
Stabilität und Robustheit

A ausgestattet ist kein Maß, bis man weiß, wie sehr es sich bewegt, wenn man Dinge ändert, die keine Rolle spielen sollten. Vier spezifische Fallen, grob geordnet nach ihrem Schaden.
Zeitstempelauflösung erzeugt Selbsterregung. Binance aggTrade Zeitstempel haben eine Auflösung von Millisekunden. Trades, die wirklich Mikrosekunden auseinander lagen, fallen auf identische Millisekunden-Briefmarken, und eine Hawkes-Wahrscheinlichkeit liest zusammenfallende Ereignisse als maximale Erregung – mit genau null Verzögerung ausgewertet. Das ist voreingenommen nach oben, und die Verzerrung wächst mit der Aktivität, was bedeutet, dass sie genau in den Ausbrüchen am schlimmsten ist, in denen Sie sich am meisten wünschen, dass die Zahl vertrauenswürdig ist. Quantifizieren Sie es: Zählen Sie den Anteil der Ereignisse, die einen Zeitstempel mit einem Nachbarn teilen, passen Sie es dann mit den Ereignissen an, die innerhalb ihres Millisekundenbereichs gleichmäßig jittern, und geben Sie an, wie viel bewegt sich. Wenn sich der Jitter ändert um mehr als das Konfidenzintervall, die Schlagzeilenzahl misst die Uhr, nicht den Markt.
Batching von Exchanges. Exchanges geben keine Ereignisse aus, wenn sie auftreten. Sie geben sie ab, wenn ihre Matching- und Dissemination-Pipeline leer wird. Binances Drosselung des Liquidationsstroms um eine Sekunde pro Sekunde ist der dokumentierte Präzedenzfall – ein Strom, der wie gehäufte Ankünfte aussieht, ist teilweise ein Artefakt des Herausgebers. Jede Stapelung im Handels-Feed prägt der Verteilung zwischen den Ankunftszeiten eine Periodizität ein, die ein Hawkes-Kernel gerne aufnimmt . Überprüfen Sie dies direkt: Erstellen Sie ein Histogramm der Zwischenankunftszeiten und suchen Sie nach Spitzen in der Chargenperiode, bevor Sie etwas anbringen.
Empfindlichkeit gegenüber dem angenommenen Zerfall. hängt davon ab , Und ist in der Regel fest oder rastergestützt und nicht gemeinsam geschätzt. Bericht als Funktion von über dem plausiblen Bereich, nicht als Punkt. Wenn die Kurve flach ist, ist die Zahl reell; Wenn Spuren genau, Sie haben Ihre Antwort gewählt.
Schätzfenster. Schätzungen über eine Stunde, einen Tag und eine Woche werden unterschiedlich sein, teils weil der Prozess tatsächlich instationär ist, teils weil ein längeres Zeitfenster Regime vermischt, was die scheinbare Erregung erhöht, indem es Variationen zwischen Regimen mit Häufungen innerhalb von Regimen vermischt. Melden Sie den Fensterlängen-Sweep. Die richtige Art, einen Aufstand zu lesen wird gegen die gleiche Fensterlänge gemessen, die zu anderen Zeiten gemessen wurde, niemals gegen eine Zahl aus einem anderen Fenster.
Das Muster hier ist das in der GPU-Präzisionsfalle festgelegte Muster: Eine Pipeline, die sauber läuft und eine plausible Zahl zurückgibt, ist kein Beweis für eine korrekte Zahl, und die einzige Verteidigung besteht darin, die Eingaben zu stören, die keine Rolle spielen sollten, und zu bestätigen, dass sich die Ausgabe nicht bewegt.
Was Sie dadurch kaufen und was nicht

Drei Verbindungen zur Mikrostrukturtheorie, kurz gehalten, da der Blog sie an anderer Stelle ausführlich behandelt.
Preisbildung. In Kyle (1985) berechnet der Market Maker die Preise anhand der Mischung von Netto-Orderflüssen und Noise-Trading; der Stoßkoeffizient und Tiefe werden mit der Folgeliteratur – einschließlich der Beweise gegen Kyles Linearität – in Slippage-Cost-Modelle dargelegt. Die Hawkes lesen Karten auf wirklich neue Informationen und die selbsterregten Ereignisse auf mechanische Reaktion, Herstellung ein messbarer Indikator für den lärmbedingten Strömungsanteil.
Volatilitäts-Clustering. Clustering, Persistenz, die Stationaritätsbedingung und die langfristige Varianz — strukturell das genaue Analogon von Und – werden in GARCH-Volatilitätsprognose für Krypto behandelt. Die wirklich neue Behauptung stammt von Bacry, Delattre, Hoffmann und Muzy (2013): Ein nahezu kritischer Hawkes-Prozess erzeugt Renditereihen, deren Volatilitätsautokorrelation als Potenzgesetz zerfällt, ohne dass es irgendwo ein explizites Volatilitätsmodell gibt. Die Häufung von Volatilität stellt sich eher als eine entstehende Eigenschaft eines selbsterregenden Auftragsflusses heraus, als dass sie angenommen wird.
Epps-Effekt. Bacry und Muzy zeigten, dass ein bivariates Hawkes-Modell den Abfall der gemessenen Korrelation bei hoher Abtastfrequenz ausschließlich aus der endlichen Ausbreitungszeit der Anregung zwischen den beiden Prozessen reproduziert – kein zusätzlicher Mechanismus erforderlich.
Bei der Ausführung ist die Vorschrift, die sich aus der Selbsterregung ergibt – nach einem Slice langsamer werden, in ruhigen Phasen beschleunigen – bereits der Kern des POV-Feedback-Loop-Abschnitts in TWAP-, VWAP- und POV-Ausführungsalgorithmen, und die Kritik am naiven Equal-Slicing ist es Almgren-Chriss. Was eine Hawkes-Anpassung hinzufügt, ist nicht der Rat, sondern eine Zahl: die angepasste Kernel-Halbwertszeit Gibt an, wie lange es dauert, bis die Anregung Ihres eigenen Slice abklingt, was „ein bisschen warten“ in eine bestimmte Pausenlänge umwandelt.
Einschränkungen

Keine Hemmung. Das klassische Modell erlaubt nur eine Steigerung der Intensität von Ereignissen. Auf den Märkten ist das Gegenteil der Fall: Eine große Limitorder, die Druck absorbiert, kann aggressiven Handel abschrecken. Hawkes-Prozesse mit Inhibition erlauben negative Kernelwerte, allerdings auf Kosten der Durchsetzung . Ob dies für eine bestimmte Anpassung von Bedeutung ist, ist in der nichtparametrischen Kernelschätzung sichtbar – wenn die stückweise Konstante vorliegt Fällt der Wert mit einiger Verzögerung unter Null, kämpft das eingeschränkte Modell mit den Daten.
Nichtstationarität. Das Standardmodell geht von Stationarität aus, und Krypto ist rund um die Uhr verfügbar, aber nicht einheitlich: Liquidität, Teilnehmermix und Ereignisrate ändern sich alle im Laufe des Tages und rund um die Finanzierungszeitstempel. Eine zeitlich variierende Grundlinie bewältigt dies auf Kosten weiterer Parameter, und anhand der oben genannten Empfindlichkeit des Schätzfensters können Sie herausfinden, ob Sie diese benötigen.
Zusammenfassung

Der Hawkes-Prozess lohnt sich aus einem Grund: Er fasst die Bündelung des Auftragsflusses in einer einzigen interpretierbaren Zahl zusammen, dem Verzweigungsverhältnis , berechenbar allein aus Zeitstempeln, ohne Rekonstruktion des Orderbuchs und ohne Annahmen über Leverage oder Positionierung. Damit ist es die günstigste verfügbare Schätzung, wie endogen ein Markt derzeit ist – die gleiche Frage Liquidation Cascades beantwortet teuer durch .
Die Maschinerie ist unkompliziert: Exponentielle Kernel ergeben einen Wahrscheinlichkeit über die Durch die Rekursion liefert EM ein interpretierbares Posterior darüber, welches Ereignis welches verursacht hat, und die Neuskalierung der Zeit liefert einen echten Anpassungstest und kein Plausibilitätsargument. Was nicht einfach ist, ist, der Ausgabe zu vertrauen. Rundungsverzerrungen bei Millisekunden-Zeitstempeln Genau während der Bursts wird die Struktur der Austausch-Batching-Eindrücke nach oben gedrückt, die der Kernel absorbiert, und bewegt sich sowohl mit dem angenommenen Zerfall als auch mit dem Schätzfenster. Ein ohne diese vier Empfindlichkeiten gemeldetes Verzweigungsverhältnis ist eine Zahl und kein Maß.
Referenzen und weiterführende Literatur
- Hawkes, A. G. (1971). „Spektren einiger selbsterregender und sich gegenseitig erregender Punktprozesse.“ Biometrika, 58(1), 83-90.
- Bacry, E., Mastromatteo, I. und Muzy, J.-F. (2015). „Hawkes-Prozesse im Finanzwesen.“ Marktmikrostruktur und Liquidität.
- Shi, F., Broussard, J. P. und Booth, G. G. (2019). „Modellierung des Flash-Crash-Verhaltens an einer Börse mithilfe multivariater Hawkes-Prozesse.“
- Hardiman, S., Bercot, N. und Bouchaud, J.-P. (2013). „Kritische Reflexivität auf Finanzmärkten: eine Hawkes-Prozessanalyse.“
- Bacry, E. und Muzy, J.-F. (2014). „Hawkes-Modell für Preis- und Handels-Hochfrequenzdynamik.“ Quantitative Finanzen.
- Bompaire, M., Bacry, E. und Gaiffas, S. (2017). „tick: eine Python-Bibliothek für statistisches Lernen mit Schwerpunkt auf Hawkes-Prozessen.“ JMLR.
- Filimonov, V. und Sornette, D. (2012). „Quantifizierung der Reflexivität auf Finanzmärkten.“
- Kumar, P. (2021). „Deep-Hawkes-Prozess für Hochfrequenz-Market-Making.“
- Bibliotheksdokumentation ankreuzen: Hawkes-Modul.
- Morse, S. „Python-Klasse für Hawkes-Prozesse.“ (Tutorial und Code)
Authors
Trading-systems engineer
Trading-systems engineer building bots since 2017: cross-exchange arbitrage (connected up to 30 venues), cointegration-based pairs arbitrage across spot and futures, scalping, news and sentiment-driven strategies, trend algorithms, and portfolio management and balancing algorithms. Also builds sub-millisecond order execution, big-data warehouses, backtesting engines, AI agents, and trading interfaces (incl. open-source profitmaker.cc). Stack: JS/TS, Python, Rust/Zig/Go, DevOps, backend, frontend, architecture.