
DFlash 2: ein 3.43×-Drafter, der unter Last auf 1.45× fällt
Inco AIs Block-Diffusion-Drafter erreicht 3.43× auf GSM8K bei einer Anfrage, aber nur 1.45× bei concurrency 32. Der Preis: Speicher und Varianz.
Alle bisher veröffentlichten Analysen, die neuesten zuerst.

Inco AIs Block-Diffusion-Drafter erreicht 3.43× auf GSM8K bei einer Anfrage, aber nur 1.45× bei concurrency 32. Der Preis: Speicher und Varianz.
browser-use/jev-ultrafast erledigt eine Google-Flights-Suche in 7,1 Sekunden, weil eine getypte Entscheidung pro Zyklus die Agentenschleife ersetzt. Hier der Haken.

mizorewww's Core-ML-Port führt eine getypte Laya-Entscheidung in 4.98 ms und 0.154 J auf einem M3 Max aus. Was die Paritäts-Fixtures beweisen – und was nicht.

Bespoke Labs feintunte Qwen3.5-9B mit 2,676 synthetischen Beispielen: 90.12% gegen Jevs 93.21%, doch die Auswertung deckt nur sechs von zehn trainierten Domänen ab.