amBrain
FinTechOct 1, 20269 Min. Lesezeit

Softwareentwicklungsunternehmen für niedrige Latenz: Welche Art Sie brauchen und wie Sie eines an Ihrem eigenen System testen

Niedrige LatenzPartnerprüfungLatenzmessungTail-Latenz
Bild konnte nicht geladen werden

Für ein Trading- oder AdTech-System, in dem eine verspätete Antwort als falsche Antwort zählt, arbeitet die richtige externe Firma im selben Bereich wie Ihre Deadline und kann zeigen, wie ihre Geschwindigkeitszahlen gemessen wurden. Ihre favorisierte Firma sollte Ihr laufendes System messen, bevor sie irgendetwas baut.

Keine Liste von Softwareentwicklungsunternehmen für niedrige Latenz passt zu jedem Auftraggeber, denn der Begriff umfasst Deadlines, die um den Faktor eine Million auseinanderliegen können. Bei Trading-Hardware kann er Dutzende oder Hunderte von Nanosekunden bedeuten. In einer App oder auf einer Webseite fühlt sich eine Antwort innerhalb von etwa einer Zehntelsekunde für die Person, die sie nutzt, bereits unmittelbar an. Die erste Frage ist also, wo Ihre eigene Deadline liegt.

Die kurze Antwort: Halten Sie Ihre Deadline und die zwei Punkte, zwischen denen sie gemessen wird, schriftlich fest, und fragen Sie jede Firma, welche der von ihr gebauten Systeme bereits in diesem Bereich in Produktion laufen. Bevor irgendjemand etwas baut, bezahlen Sie Ihre favorisierte Firma dafür, Ihr laufendes System zu messen, und behalten Sie ihren Bericht, wie auch immer Sie sich entscheiden.

Was bedeutet „niedrige Latenz“ für unser System?

Für Ihr System ist niedrige Latenz eine Deadline, gemessen zwischen zwei Punkten, die Sie benennen können. Deadlines fallen in vier grobe Bereiche:

  • Trading-Hardware, im Bereich von Dutzenden oder Hunderten von Nanosekunden. STAC-T0, ein Benchmark, der in Abstimmung mit Trading-Firmen im STAC Benchmark Council entwickelt wurde, misst, wie schnell Netzwerkhardware und -software eines Systems simulierte Marktdaten in eine simulierte Order umsetzen, ohne Handelslogik dazwischen. STACs Überblick vom 5. November 2020 sagt, dass der Benchmark das System als Blackbox behandelt und „mit ihm ausschließlich über Netzwerkpakete interagiert, die er in Hardware mit Zeitstempeln versieht“, und dass Software-Zeitstempel bei Dutzenden oder Hunderten von Nanosekunden einen erheblichen Fehler enthalten können. Der „Stack under Test“, wie STAC das gemessene System nennt, kann eine FPGA-Karte sein, die einen Chip trägt, dessen Schaltungen für eine einzige Aufgabe programmiert sind
  • Handelsplätze, von Mikrosekunden bis etwa zu einer Millisekunde. Die EU-Vorschrift dazu, wie genau die Uhren eines Handelsplatzes gehen müssen, knüpft diese Genauigkeit daran, wie lange das Handelssystem des Handelsplatzes braucht, um eine Order zu verarbeiten und eine Bestätigung zurückzuschicken. Seit dem 2. März 2026 ist diese Vorschrift die Delegierte Verordnung (EU) 2025/1155 der Kommission, die die frühere, als RTS 25 bekannte Vorschrift ersetzt hat und diese Zeit Gateway-to-Gateway-Latenz nennt: „die Zeit, gemessen ab dem Moment, in dem eine Nachricht an einem äußeren Gateway des Systems des Handelsplatzes eingeht, über das Auftragsübermittlungsprotokoll gesendet, von der Matching-Engine verarbeitet und dann zurückgesendet wird, bis eine Bestätigung vom Gateway versendet wird“. Wo das 1 Millisekunde oder weniger dauert, dürfen die Uhren des Handelsplatzes um höchstens 100 Mikrosekunden von der koordinierten Weltzeit (UTC) abweichen, und Zeitstempel müssen eine Granularität von 0,1 Mikrosekunden oder feiner haben
  • AdTech, von Dutzenden von Millisekunden bis zu einer Sekunde. OpenRTB 2.6, der Standard des IAB Tech Lab für Real-Time Bidding, erlaubt einer Exchange, in jedem Bid Request eine Deadline zu setzen, und die Zeit, die auf dem Weg durch das Internet vergeht, wird darauf angerechnet. Die Entwicklerdokumentation von Google Authorized Buyers, zuletzt aktualisiert am 17. September 2026, sagt, dass die Antwort-Deadline „je nach Format und Auktionstyp zwischen 80 und 1000 ms liegt“
  • Apps und Webseiten, die Menschen nutzen, im Bereich von etwa einer Zehntelsekunde. Jakob Nielsen schrieb 1993, dass „0,1 Sekunden ungefähr die Grenze dafür sind, dass der Nutzer das Gefühl hat, das System reagiere unmittelbar“. Für Webseiten bewertet der Leitfaden web.dev von Google, zuletzt aktualisiert im September 2025, die Reaktionsfähigkeit als gut, wenn Interaction to Next Paint (INP) 200 Millisekunden oder weniger beträgt. INP misst, wie lange eine Seite braucht, um auf Klicks, Tippen und Tastendrücke zu reagieren

Ein Produkt kann Teile in verschiedenen Bereichen haben. Ein Trader liest Kurse auf einem Bildschirm, während die Order, die dieser Trader sendet, auf ihrem Weg zum Handelsplatz womöglich eine viel engere Deadline einhalten muss. Halten Sie jede Deadline mit den zwei Punkten fest, zwischen denen sie gemessen wird. Der Bereich, in den sie jeweils fällt, sagt Ihnen, welche Art von Firma Sie anrufen sollten.

Mit welchen Softwareentwicklungsunternehmen für niedrige Latenz sollten wir sprechen?

Dieser Artikel erstellt keine Rangliste von Firmen. Welche Art von Firma die richtige ist, hängt von Ihrem Bereich ab und von der Arbeit, die erledigt werden muss:

  • Hardware- und Netzwerkspezialisten, für Deadlines, die in Nanosekunden oder wenigen Mikrosekunden gezählt werden. Sie arbeiten an FPGA-Karten, Netzwerkkarten, Switches und den Leitungen zu einer Börse. Fragen Sie, welche ihrer Zahlen aus Zeitstempeln stammen, die Hardware direkt am Netzwerkkabel erfasst hat, und auf wessen Ausrüstung die Tests liefen
  • Engineering-Firmen für Trading-Technologie, für Deadlines in Mikrosekunden oder Millisekunden, wenn die Zeit in Ihrer eigenen Software verloren geht oder auf dem Weg zu Ihrem Broker oder Handelsplatz. Sie schreiben die Software, die Orders sendet, Marktdaten verarbeitet, das Risiko jeder Order prüft, bevor sie hinausgeht, und an einem Handelsplatz Kauf- und Verkaufsorders zusammenführt. Fragen Sie, welche der von ihnen gebauten Systeme heute in Produktion sind und welche Anbindungen an Broker oder Handelsplätze sie geschrieben haben
  • AdTech-Engineering-Firmen, wenn eine Exchange Ihre Deadline Request für Request festlegt und Ihre Serverrechnung mit Ihrem Traffic wächst. Sie bauen Bidder und Ad Exchanges. Fragen Sie, welcher von ihnen gebaute Bidder oder welche Exchange noch live ist und ob die Timeout-Zahlen dazu aus der Zählung der Exchange stammen oder aus der eigenen
  • Unabhängige Performance-Engineers, wenn Sie die Ursache noch nicht kennen oder wenn Ihre eigenen Engineers die Änderungen vornehmen werden. Sie arbeiten meist allein oder in einer kleinen Gruppe, messen ein laufendes System und berichten, wohin die Zeit geht. Lassen Sie sich einen früheren Bericht zeigen, aus dem Name und Daten des Kunden entfernt wurden, und erwarten Sie eine Diagnose statt eines Neubaus
  • Komponentenanbieter, wenn der Teil, den Sie brauchen, für alle gleich funktioniert und Ihr Vorteil woanders liegt. Sie verkaufen einen fertigen Baustein, etwa eine Matching-Engine oder eine Börsenanbindung, den Sie betreiben, statt einen eigenen in Auftrag zu geben. Fragen Sie, von wo bis wo ihre Latenzzahlen gemessen wurden und was Sie an dem Code ändern dürfen, den Sie lizenzieren
  • Allgemeine Outsourcing-Unternehmen mit einem ausgewiesenen Team für niedrige Latenz, wenn Sie viele Engineers brauchen und der schnelle Pfad nur ein kleiner Teil der Arbeit ist. Fragen Sie nach den Namen der Leute in diesem Team und danach, was jeder von ihnen in Ihrem Bereich gebaut hat, und lassen Sie sich schriftlich zusichern, dass sie an Ihrem Projekt arbeiten werden
  • Eigene Neueinstellungen, wenn Sie über Geschwindigkeit konkurrieren und das auch künftig tun werden und wenn Sie Engineers gewinnen und halten können, die bereits ein solches System ausgeliefert haben. Acuiti, ein Research-Unternehmen, hat 50 systematische Hedgefonds, also Fonds, die nach Computermodellen handeln, gefragt, wie sie ihre Trading-Technologie aufbauen. Im Januar 2023 berichtete es, dass Latenz „der Schlüsselfaktor für die Haltung zum Outsourcing von Front-Office-Technologie ist, wobei Firmen, für die Latenz entscheidend ist, eher im eigenen Haus entwickeln“

Viele Firmen passen in mehr als eine Kategorie, fragen Sie also, welche Art von Arbeit die Engineers, die Ihnen zugeteilt werden, bereits gemacht haben.

Wie prüfen wir, ob eine Firma schon schnelle Systeme gebaut hat?

Der oben verlinkte Artikel über dedizierte Teams führt auf, was zu jeder Leistungszahl gehört, und enthält eine Checkliste, die Sie in eine Ausschreibung kopieren können. Die folgenden Fragen klären, wie die eigenen Zahlen einer Firma zustande gekommen sind.

Fragen Sie, wo die Uhr startet und wo sie stoppt. OPRA, die konsolidierte Trades und Quotes der US-Optionsbörsen veröffentlicht, startet ihre Uhr, wenn eine eingehende Nachricht „am Anwendungseingang der OPRA-Umgebung ankommt“, und stoppt sie, wenn die ausgehende Nachricht „am Anwendungsausgang der OPRA-Umgebung ankommt“. Die oben zitierte EU-Definition ist bei beiden Punkten ebenso präzise. Eine Zahl ohne benannte Endpunkte lässt sich nicht mit Ihren vergleichen.

Sehen Sie sich die langsamsten Antworten ebenso an wie die typische. In den von OPRA veröffentlichten Kennzahlen lag die Median-Latenz, also der mittlere Wert, im Januar 2024 bei 19,5 Mikrosekunden und im Februar bei 20,5. In denselben zwei Monaten fiel das 99. Perzentil, also die Zeit, die nur das langsamste 1 Prozent der Nachrichten überschritt, von 543,5 Mikrosekunden auf 57,5. Ein Bericht nur mit dem Median hätte fast keine Veränderung gezeigt.

Auch Durchschnittswerte verbergen die langsamen Antworten. Das Buch „Site Reliability Engineering“ von Google, 2016 bei O'Reilly erschienen, beschreibt einen Webdienst mit einer durchschnittlichen Latenz von 100 Millisekunden bei 1.000 Requests pro Sekunde, bei dem „1% der Requests leicht 5 Sekunden dauern können“. Verlangen Sie das 99. Perzentil jedes Pfads und, wenn Ihr System genug Requests verarbeitet, um es zu messen, das 99,9. Perzentil, das nur 1 von 1.000 Antworten überschreitet.

Prüfen Sie die Last hinter jeder Zahl. In STACs Überblick von 2020 sendet STAC-T0 seinen Testtraffic mit drei Raten. Die niedrigste ist „darauf ausgelegt, zu sehen, wie sich Systeme verhalten, wenn sie überwiegend im Leerlauf sind“, und die höchste, typischerweise nahe am Maximum dessen, was das getestete System bewältigen kann, dient dazu, „zu sehen, wie sich Systeme verhalten, wenn sie sehr stark ausgelastet sind“. Verlangen Sie Zahlen aus Ihrer eigenen Minute mit der höchsten Last oder aus einem Test, der sie nachbildet.

Fragen Sie, wie der Lasttest durchgeführt wurde. Viele Lasttest-Tools senden einen Request, warten auf die Antwort und senden erst dann den nächsten. Wenn das System ins Stocken gerät, hört ein solches Tool auf zu senden, sodass die Requests, die während des Stillstands eingetroffen wären, nie gemessen werden.

Gil Tene, der Autor des Lasttest-Tools wrk2, nennt diesen Effekt coordinated omission. In der Dokumentation des Tools, zuletzt geändert im September 2019, schreibt er, dass „Antworten mit hoher Latenz dazu führen, dass sich der Lastgenerator mit dem Server abstimmt, um Messungen in Phasen hoher Latenz zu vermeiden“. Sein Tool sendet Requests mit fester Rate und misst jede Antwort „ab dem Zeitpunkt, zu dem die Übertragung hätte erfolgen sollen“. Fragen Sie, ob das Tool der Firma so arbeitet oder wie seine Ergebnisse korrigiert wurden.

Fragen Sie, wo jeder Zeitstempel genommen wurde. Für Latenzen im Mikrosekundenbereich nennt STACs Überblick einen Benchmark mit Software-Zeitstempeln „die beste Option“. Außerdem warnt er, dass die kleinen, ungleichmäßigen Verzögerungen bei Software-Zeitstempeln „bei der Messung von Latenzen im Bereich von Dutzenden oder Hunderten von Nanosekunden einen erheblichen Fehler darstellen können“, und STAC-T0 nimmt seine Zeitstempel stattdessen in Hardware. Eine Firma, die Nanosekunden angibt, sollte zeigen können, wo ihre Hardware-Zeitstempel genommen wurden.

Welchen Test sollten wir durchführen, bevor wir jemanden beauftragen?

Wenn Sie noch nicht wissen, was falsch läuft, nur dass das System langsamer wirkt oder mehr kostet, als es sollte, beginnen Sie hier. Bezahlen Sie Ihre favorisierte Firma für eine Messung Ihres laufenden Systems mit festem Umfang, mit einem Bericht, der Ihnen gehört, wie auch immer Sie danach entscheiden. Vereinbaren Sie schriftlich, was die Firma installieren oder ändern darf, um ihre Messungen vorzunehmen, und wie ihre Tools danach entfernt werden.

Der Bericht sollte zeigen:

  • Wohin die Zeit in Ihrer Minute mit der höchsten Last geht, Schritt für Schritt entlang des Pfads, den Sie festgehalten haben
  • Für jeden Pfad die Antwortzeiten im 99. und 99,9. Perzentil
  • Die Korrekturen, geordnet nach ihren Kosten und danach, was sie jeweils beseitigen – ob Zeit auf dem Pfad oder Server, die hinzugefügt wurden, um einen langsamen Pfad zu kaschieren
  • Was die Firma nicht anfassen würde, und warum

Für Trading-Systeme führt der oben verlinkte Artikel über langsame Orderausführung die vier Zeitstempel auf, die für jede Order zu erfassen sind. Im AdTech-Bereich behandeln die Artikel über Traffic-Spitzen und über DSP-Timeouts, was bei einer Lastspitze und für jede Exchange-Verbindung zu messen ist.

Beurteilen Sie die Firma nach ihrem Bericht. Wenn Ihre eigenen Engineers ohne die Firma danach handeln könnten, können Sie anhand echter Zahlen wählen, wer die Arbeit als Nächstes macht, ob diese Firma oder eine andere.

Was sind Warnzeichen bei der Wahl einer Firma für niedrige Latenz?

  • Geschwindigkeit, die in Worten beschrieben wird, ohne Zahl und ohne Endpunkte
  • Nur Durchschnittswerte, nichts über die langsamsten Antworten
  • Ein Benchmark aus dem eigenen Labor der Firma, auf ihrer Hardware mit selbst erzeugtem Traffic gefahren und als Beleg für Ihr System angeboten
  • Ein Rewrite oder der Wechsel zu einer neuen Programmiersprache, vorgeschlagen, bevor jemand Ihr System gemessen hat
  • Ein Latenzwert, der im ersten Gespräch versprochen wird
  • Derselbe Pitch für Trading-Arbeit, die in Mikrosekunden gemessen wird, und für einen Ad-Bidder mit einer Deadline von 100 Millisekunden

Wenn eine Firma eine neue Sprache vorschlägt, zeigt der unten verlinkte Artikel, wie Engineers prüfen, ob die Sprache die Ursache ist.

Wo passt amBrain ins Bild?

amBrain diagnostiziert langsame Trading- und AdTech-Systeme: Die laufende Plattform wird durchgängig vermessen, und der Bericht benennt, wohin die Zeit geht. Seine Arbeit im Trading umfasst die Entwicklung von Trading-Terminals, Order-Management-Systeme und die Börsenanbindung über das FIX-Protokoll.

Im Bereich AdTech arbeitet amBrain an DSP-Entwicklung, Real-Time-Bidding-Plattformen und Ad-Exchange-Engineering.

amBrain arbeitet in drei Formaten: vollständige Umsetzung, ein dediziertes Team oder in Ihr Team eingebettete Entwickler. Der Kunde behält das volle Eigentum an Produkt und Code, ausgenommen die wiederverwendbaren Komponenten von amBrain.

amBrain entwickelt seit 2019 Software.

Dieser Artikel ist keine Case Study und beschreibt keine Arbeit für Kunden. Er nennt keinen Latenzwert für irgendein System, das amBrain gebaut hat, und weder Preise noch Zeitpläne.

Fragen Sie amBrain oder jede andere Firma auf Ihrer Liste, was sie an Ihrem System zuerst messen würde, und unterziehen Sie jede Firma denselben Prüfungen.

Häufige Fragen

  • Sollten wir stattdessen ein eigenes Team aufbauen? In der Studie von Acuiti aus dem Jahr 2023 unter 50 systematischen Hedgefonds entwickelten diejenigen, für die Latenz entscheidend ist, ihre Trading-Technologie eher im eigenen Haus. Messen Sie in jedem Fall zuerst, denn der Bericht sagt Ihnen, welche Art von Engineer Sie einstellen sollten oder womit Sie eine Firma beauftragen sollten
  • Kann eine Firma sowohl Trading als auch AdTech abdecken? Das kann sie, wenn sie in beiden Feldern Produktionssysteme in Ihrem Bereich hat. Verlangen Sie in jedem Feld ein laufendes System, und prüfen Sie seine Zahlen mit den Fragen oben

Liegt ein solcher Entwurf bei Ihnen auf dem Tisch?

Bringen Sie Ihre aktuelle Architektur und den Fehlerfall mit, der Sie beunruhigt - wir gehen ihn in einer halben Stunde gemeinsam durch.