Not logged inCSS-Forum
Forum CSS-Online Help Search Login
CSS-Shop Impressum Datenschutz
Up Topic Hauptforen / CSS-Forum / Was sind die sinnvollsten Testbedingungen für ein Engine-Ranking?
- - By Lothar Jung Date 2026-08-15 09:14
Kerne: 1 - 4 Kerne?
Rechnen auf Gegnerzeit on/off
Standard-Eröffnungsbuch oder mit Elo-Nachteil
Bedenkzeit 1 - 10 sec.
Bewertung nach NNUE oder Standard
Begrenzung der teilnehmenden Engines nach Spielstärke

Die modernen CPUs sind bei 1 Core erstaunlich schnell. Zwei Kerne sind deshalb nicht effektiv.
PB on wird weiter eingesetzt (CEGT)
Kurze Bedenkzeiten und weniger Engines ermöglichen schnellere Ergebnisse.
Parent - - By Frank Quisinsky Date 2026-08-15 11:08 Edited 2026-08-15 11:23
Hallo Lothar,

ich denke alles was aus menschlicher Sicht logisch ist, denn schließlich führt der Mensch auch aus.

Dazu gehört Ponder = on.
Wir schalten unser Gehirn ja nicht ab wenn der Gegner am Zug ist.
Einige Engines können das nicht, oder das Zeitmanagement ist dann weniger gut.
Auch wird mehr Hardwareleistung benötigt, weniger Partien können produziert werden.
Ich weiß das natürlich und handel dennoch unlogisch und verzichte auf Ponder = on.

Dazu gehört ein ausgeglichenes Buch.
Kein Mensch geht freiweillig in eine Partie mit Nachteil.
Wird der Nachteil z. B. von einer schwächeren Engines nicht zu einem Remis kompensiert entsteht
eine Punktausbeute von ca. 25% freiwillig weniger. Grob berechnet ... kommt auf die Engine-Spielstärke an.
Ein ausgeglichenes Buch führt heute auf höchsten Niveau zu vielen Remisen.
Wie das vermieden kann zeigt z. B. meine ETOC-G Idee auf.

1 Core für einen Vergleich reichte grundsätzlich immer schon aus.
Wenn ich den Faktor kenne (z. B. bei 2, 4, 8 Cores) macht es keinen Sinn tausende von Partien zu
produzieren. Den Faktor selbst kann ich für eine Engine anhand weniger Stellungen im Querschnitt
sehr schnell selbst ermitteln. Mit diesem Querschnitt kann ich dann alles siumlieren, dafür brauche
ich keine echten Partien, dass machte noch nie Sinn bzw. ist aus meiner Sicht komplett unnützer
Stromverbrauch ... wenn es sich um Engine Vergleiche handelt.

Wer will kann ja z. B. den Faktor bei 2 oder 4 Cores hinter einer Engine Elo in einer Liste niederschreiben.

Grundsätzlich ist eine ermittelte Elo niemals ultimativ.
Sie wird natürlich stimmen, passend zu den auserkorenen Bedinungen.

Es kommt z. B. immer auf die Gegner, Bedenkzeit, sonstiges wie Endspieldatenbank an.

Diesen grundsätzlichen Ausführungen könnte man entgegen halten:
Was für den Mensch logisch ist, sehen Engines mit einer Spielstärke weit weg von Gut und Böse, über 800 Elo
entfernt von max. menschlicher Spielstärke, völlig anders.

Daher können z. B. unlogische Einstellungen auch zu neuen Erkenntnissen oder gar Fortschritten
bei der Engine-Entwicklung führen.

Ein gutes Beispiel sind die UHU-Stellungen von Stefan Pohl.

Und genau das bereichert unseren Erkenntnisstand!
Was ist ohne Forschung schon großartig interessant?!

Völlig unterschiedliche Ideen, die z. B. auch mal länger durchgezogen werden, erzeugen neue Erkenntnisse.
Durch einseitige Test-Methoden werden wir nicht sonderlich schlauer. Wir können dann max. Vermutungen
anstellen. Dahingehend ist und war der Mensch immer schon absolute Spitzenklasse.

Gruß
Frank
Parent - - By Frank Quisinsky Date 2026-08-15 11:32 Edited 2026-08-15 11:42
Je krummer und verbogener ein Engine-Vergleich heute ist, desto interessanter könnte der bei dem heutigen Stand
der erreichten Spielstärke der Engines gar werden. Fantasie ist gefragt und vor allem "unlogisches Denken".

Dabei kommt meist mehr heraus als zu bekannten Wegen Bekanntes hinzuzufügen.

Ein gutes Beispiel:
Jemand war 4x verheiratet und kommt nun auf die glorreiche Idee tanzen zu gehen.
Im Tanzclub lachen Dich 5 Frauen an. Die 4 mit denen Du mal verheiratest war und eine völlig unbekannte sehr
hübsche Dame der Schöpfung. Der, der immer alles gleich machte im Leben landet immer im gleichen Tanzclub und
findet dort wahrscheinlich auch ...

Was machst Du?

Erst nachdenken ...

...

...

...

...

...

Richtig, Du sagst Dir ...
Lasst mich doch alle in Ruhe, ich gehe jetzt Currywurst essen und Morgen habe ich auch keine Zeit, da muss ich
zum Fussball bei der SG Wattenscheid 09.



Wobei ich nicht 4x verheiratet war.
Aber irgendwann reizt Dich selbst das Unbekannte nicht mehr und dann auf zur SG09.
Parent - By Frank Quisinsky Date 2026-08-15 12:08 Edited 2026-08-15 12:12
Halten wir fest ...
Die Currywurst ist wie Stockfish beim Computerschach.

Engine-Vergleiche sind fragwürdig, weil es ja Stockfish gibt.
Ich ziehe mir ja auch keine Roten Bete, besprenkelt mit Inhalten aus dem 16-Core-Nutella-Glas,
rein, wenn eine Currywurst daneben liegt.

Maximal kommt vielleicht die Pizza Reckless noch zum Einsatz.
Und wenn ich die Pizza Reckless nicht mehr mag dann ziehe ich mir Wreckless rein (den Clone)
in einer anderen Pizzeria.

Aber auch Spagehetti mit Bolognese aller PlentyChess ...

Früher zu Frank Elstner Zeiten hätten viele von uns bei Wetten-dass auftreten können.
Wir hätten die ganzen Schachcomputer Elos von Platz 1 bis 200 der SSDF runter beten können.
Vielleicht auch noch die "Meilers" BT-Ergebnisse für die Joker-Frage.

Die Zeiten sind lange vorbei?!
Parent - - By Lothar Jung Date 2026-08-15 13:33
Hallo Frank

„Wer will kann ja z. B. den Faktor bei 2 oder 4 Cores hinter einer Engine Elo in einer Liste niederschreiben.“

Der Faktor bei 4 müßte man für jede Engine ermitteln. 2 Cores machen keinen Sinn, da die CPUs unterschiedlich bei 1 Core optimiert sind.
Soll man einen Engine Benchmark nehmen?
Stockfish hat einen Benchmark eingebaut.

Lothar
Parent - - By Frank Quisinsky Date 2026-08-15 14:27 Edited 2026-08-15 14:45
Hi Lothar,

bei einer guten Optimierung sollte ca. Faktor 3,3 - 3,5 herauskommen.

Also, ich persönlich nehme dafür eine Stellungsdatenbank mit 4 Postionen aus späten Mittelspiel- / Übergang
Endspiel Stellungen (mind. 14 bis max. 20 Figuren auf dem Feld) und schalte, wenn vorhanden, syzygy
oder unter Umständen andere Endspieldatenbanken ab. Die Hash-Tabellen kannst Du bei einem Test
1-Core zu 4-Cores einfach vervierfachen.

Dann errechne ich den durchschnittlichen Faktor aus den Ergebnissen der 4 Positionen.

Möchtest Du 5 + 2 spielen lassen, machen z. B. 128 oder 256Mb für Hash-Tables Sinn.
Simulierst Du dann 4 Cores würden 512 oder 1Gb Sinn machen.

Gruß
Frank

PS:
Wenn Du wirklich krass-extrem-genau unterwegs sein möchtest ...
Dann besser bei einem Vergleich immer die syzygybases / Endspieldatenbanken abschalten.
Der Mensch rennt auch nicht für jeden Zug in die BiBi schauen, was sagen denn die Endspieldatenbanken
zu dieser Stellung. Das ist nichts selbst errechnetes.

Es kann immer nur das verglichen werden was vergleichbar ist, hat eine Engine keinen syzygy support
kann auch nichts verglichen werden. Na ja, ich war noch nie krass unterwegs. Doch, ich hatte in Urzeiten
auch mal eine Liste mit Ponder = on. Die machte auch mehr Spaß beim Zusehen aber hat Nerven
gekostet. Ich hatte irgendwann keine Lust mehr Programmierer auf die Fehler hinzuweisen. Wie gesagt,
ist schon lange her. Heute werden sicherlich mehr Engines mit Ponder = on eine vernünftige Zeiteinteilung
haben und auch fehlerfreier spielen.

Parent - By Frank Quisinsky Date 2026-08-15 14:51
Ich wollte das in der Tat auch mal machen.
Faktor ausrechnen, neben der Elo für einen Core schreiben und Ergebnis von 1 Core auf 64 Cores mittels Faktor siumulieren lassen.

Dann bist Du schnell fertig mit einer 64-Core Ratinglsite und sparst enorm viel Strom und Gelder für Hardware.

Weiß gar nicht wer damit angefangen hat.
Ich habe selbst nie auf 2 Cores getestet, never, never, never ... völliger Quatsch!
Parent - - By Frank Quisinsky Date 2026-08-15 15:43 Edited 2026-08-15 16:00
Noch ein paar Erläuterungen:

1. Immer ohne Aufgabefaktor.
Anhand vom Zügedurchschnitt lässt sich vieles ablesen.
Auch sind Stats zu Endspielen möglich, aber aufwendig zu erstellen.

2. Um die Remisquote bei einem ausgeglichenen Buch zu minimieren machte ich z. B. ETOC-G.
Es wird sehr schön aufgezeigt das dieses System perfekt funktioniert.

Hier ist es wichtig Engines zum Testen zu benutzen die auffällig unterschiedlich spielen.
Auch Engines zu benutzen die einen geringen Zügedurchschnitt haben, um nicht unnötig Test-Zeit zu verplempern.
Es macht Sinn Engines zu nutzen die sehr aggressiv sind, um schnell festzustellen wer dagegenhalten kann (aus
menschlicher Sicht gesehen, wir mögen fast alle schnelle Gewinnpartien).

3. Ponder = on, wäre besser als Ponder = off

4. Ohne Endspieldatenbanken = besser als mit.
Schont auch die Festplatte!

5. Fischer-Zeit Kontrolle nutzen
Das verringert die Bedenkzeit bei den vielen unnützen Endspielketten.
Besser als 40 Züge in x Minuten.

6. Bei den sogenannten "Standard Engines" darauf achten, dass diese nicht zu weit auseinander liegen.
Früher dachten wir Platz 1 und der letzte Platz sollten nicht mehr als 250-300 Elo auseinander liegen.
ETOC-G beweist das Gegenteil bei 800 Elo von Platz 1 zu Platz 26 der "Standard Engines". Die erzielten
Ergebnisse befinde ich für eindeutig zu gebrauchen, anfangs war ich nicht davon überzeugt. Ich zweifelte
immer schon an dieser These, jetzt nicht mehr. Ist auch realistischer, denn auch die Elo von einem GM
errechnet sich in den wenigsten Fällen gegen ca. gleich starke Gegner.

Dennoch reichen hier ca. 400-500 Elo aus.
Die Spanne die "Standard-Engines" auseinander liegen sollten.

Wenn Stockfish bei 3575 Elo, sollte dann die schlechteste" Standard-Engine" ca. bei 3125 Elo liegen.
Das mache ich gerade auf einem zweiten PC und habe dafür meine zweite private Ratingliste
abgebrochen. Ich will sehen wie hoch die Remisquoten sind. Die wären dann mit ca. 60% im
Rahmen wenn z. B. eine TOP-10 gegen 26 "Standard Engines" spielt die zwischen 3525 und 3125
liegen (in meinem Fall). Zusehen macht weiterhin Spaß bei einem ausgeglichenen Buch.

Bei der Elo orientiere ich mich immer nach der Aussage von GM Meyer in dem Interview was ich mit
GM Hickl machte. Bei mittleren Bedenkzeiten schätzte GM Meyer (er hatte damals ca. 2650 Elo)
Shredder 12 auf seinem 2-Core 2Ghz Notebook bei einem Core grob mit 2800 Elo ein.

Die Einschätzung von GM war nachvollziehbar, denn bis dahin eichte ich meine Listen bis auf 25
Elo Abweichung zu dieser Einschätzung über Jahre immer gleich.

7. Bei der Bedenkzeit:
Nutze eine Bedenkzeit bei dem Zusehen noch Spaß macht. Damit erhältst Du Dir die eigene
Motivation.

8. Eine besondere Komponente rein-bringen.
Am meisten erfolgreich bei den unzähligen Ratinglisten von mir war folgende Idee ...

Eine Gruppe von x-Engines spielt immer das gleiche Turnier nach Schweizer-System.
Die Ergebnisse wurden zu einer Ratingliste zusammengeführt.

Auch interessant waren die Turniere bei den Klaus Wlotzka per Excel Statistiken auswertete.
Ich hatte unzählige Downloads auf diese Daten.

Also, irgendetwas besonderes mit der eigenen Fantasie hinzusteuern.
Etwas, was bislang noch nicht gemacht wurde, schon allein um neue Erkenntnisse zu gewinnen.

Die Vorbereitungsphase bei ETOC-G inklusive der Testphase dauerte bei mir z. B. 9 Monate.
Ich überlegte genau, was kann ich noch feststellen was mir selbst noch wichtig ist und die
bislang gesammelten Erfahrungswerte vernünftig einbringen.

Bei Hau-Ruck-Verfahren wirst Du meist schnell eines Besseren belehrt.

7. Die Buchfrage ist wichtig:
Ich nutze die eigene FEOBOS Datenbank.
Es werden alle 500 ECO Codes, meist nach GM-Beliebtheit der Varianten zufällig gewählt und ausgespielt.
Mithin kann mit diesen produzierten Daten auch produktive Erkenntnisse aus den bisherigen ECO-Codes
generiert werden. Genau daran arbeiten 3 Personen die meine Daten für Verbesserungen bei wirklich
guten Eng-Eng Büchern nutzen.

8. Ich hatte mal sehr aufwendig festgestellt das eine Elo bei vielen Gegner schneller "ultimativ" wird
und dabei weniger Partien notwendig werden. Auch schon länger her, ich kam zu dem Ergebnis ... 26-Gegner.
Daher spielte ich ETOC mit 26 Standard-Engiens. Alles alte Erkenntnisse die sich so im Laufe der Zeit auch
bestätigten mit anderen Ratinglisten die ich machte.

Etc..

Alles muss gut überlegt sein und vor allem irgendetwas Besonderes sollte drin sein.
Heute zieht das Personen an, die immer auf der Suche nach neuen Erkenntnissen sind.

Grundsätzlich gilt auch:
Mit dem wenigsten Aufwand bestmögliche Erkenntnisse generieren.


Gruß
Frank

Und wem das alles zu kompliziert ist:
Auch schön zusammengestellte einfache Turniere, die gut kommentiert sind, sind nach wie vor
spannend. z. B. Turniere der besten HCE Engines lasse ich gerne auf meinem Ultra-Book spielen.
Parent - - By Frank Quisinsky Date 2026-08-15 16:48 Edited 2026-08-15 16:53
1. Immer ohne Aufgabefaktor.
Anhand vom Zügedurchschnitt lässt sich vieles ablesen.
Auch sind Stats zu Endspielen möglich, aber aufwendig zu erstellen.

Leider wird heute alles an Standard-Code offenbar meist wild in die Engines implementiert.
Die meisten Engines spielen nicht den direkten Weg zum Matt mit syzygy, sondern machen folgendes:

KRpp - K
Da wird der erste Bauer umgewandelt und die umgewandelte Figur geopfert dann die zweite Unterverwandlung großzügig geopfert.
Es verbleibt dann KR-K und dann wird matt gessetzt. Sind wir streng zu uns selbst, müssten wir dieses Vorgehen heute als Standard
ansehen, wenige versuchen dann mal solche Fehler zu beheben.

So viele andere Fehler bei syzygy, was leider den Zügedurchschnitt maßgeblich verschlechtert und mithin
ist streng genommen beim Eng-Eng Vergleich syzygy nicht gut.

Die guten alten Zeiten sind leider vorbei.
Ein Roland Pfister (Patzer Programmierer) der sich freute bei eigener Hirnanstrengung und ziemlich viel
Arbeit bei 2-Cores einen Faktor von 1,4 erreicht zu haben, Wenn Crafty bei 1,73 zu diesem Zeitpunkt lag.

Heute macht einer NN und nach kurzer Zeit gibt es hunderte NN Engines.
Das war ja noch nie anders. Auf einem Robolite Clone folgten unzählge andere, täglich neue Ivenhoes.

Im Computerschach wiederholt sich immer alles.

Jetzt kommt KI unterstützt.
Bald wird alles KI unterstützt sein, auch bei bestehende NN Engines überprüfen schon einige ob es Fehler
in der Engine mit KI Unterstützung gibt ... die vielleicht bislang nicht aufgefallen sind.

Ende vom Gelände:
Sind alle Programme unzählige Male durchupgedatet sammelt sich immer mehr um die derzeit
max. erreichte Spielstärke. Dann haben wir keine 40 Programme die ca. 100 Elo hinter Stockfish liegen,
sondern hunderte davon. Bis dahin gehen noch viele Updates ins Land ... Aufgaben die sich die Ratinglistenexperten,
warum auch immer widmen.
Parent - - By Lothar Jung Date 2026-08-15 18:08
Hallo Frank,

Ich habe mal ChatGPT rechnen lassen.
4 Threads sind Faktor 3,4 - 3,7.

Bei modernen Alpha-Beta-Engines wie Stockfish verläuft die Leistungskurve von 1 bis 8 Kernen anfangs steil, flacht dann aber zunehmend ab. Sie ist also keine Gerade.

Kerne/Threads  ungefähre Suchleistung  Ausnutzung der zusätzlichen Kerne  geschätzter Elo-Gewinn gegenüber 1 Kern
1  1,0×  100 %  0
2  1,8–1,9×  90–95 %  +55 bis +70
3  2,6–2,8×  87–93 %  +85 bis +105
4  3,4–3,7×  85–92 %  +110 bis +130
5  4,2–4,5×  84–90 %  +130 bis +145
6  4,9–5,3×  82–88 %  +145 bis +160
7  5,6–6,0×  80–86 %  +160 bis +175
8  6,3–6,7×  etwa 83 %  ungefähr +180

Stockfish selbst ermittelte bei längerer Bedenkzeit für 8 gegen 1 Thread etwa +179 Elo. Die Parallelisierung erreichte dabei rund 82–83 % Effizienz. Bei extrem kurzen Partien wurden sogar +327 Elo gemessen; diese Zahl lässt sich aber nicht auf normale Turnierpartien übertragen. Offizielle Stockfish-Daten⁠

Der Verlauf ist näherungsweise logarithmisch:

xychart-beta
    x-axis "Kerne" [1, 2, 3, 4, 5, 6, 7, 8]
    y-axis "relative Suchleistung" 0 --> 7
    line [1, 1.9, 2.7, 3.6, 4.4, 5.2, 5.9, 6.6]

Der größte Sprung liegt zwischen 1 und 4 Kernen. Von 4 auf 8 Kerne erhält man zwar fast die doppelte Rechenleistung, aber nur noch ungefähr 50–70 zusätzliche Elo. Für ein Turnier mit zwei gleichzeitig laufenden Engines ist 7 + 7 Kerne deshalb meist sinnvoller als 8 + 8, weil Betriebssystem und Turnieroberfläche noch zwei freie Kerne behalten.
Parent - - By Frank Quisinsky Date 2026-08-15 21:00 Edited 2026-08-15 21:14
Das liest sich gut und traf auch zu in Zeiten vor NN den Nagel auf dem Kopf.

Wobei +55 bei Faktor 1,8 eher in Zeiten der HCE Engines, vor dem NN-Zeitalter.
Vielleicht da dann auch um +15 zu hoch, eher so +40.

Im Laufe der ganzen Jahre ist eine Verdoppelung der Geschwindigkeit nicht immer gleich angestiegen.
So war das zu Zeiten der Schachcomputer noch rund 80-90 Elo.

Stockfish ermittelt viel wenn der Tag lang ist.
Im nackten Alltag bedeuten all diese ganzen Verbesserungen ...

Code:
   # Player                               :      Elo  Games  Score%   won  draw  lost  Points  Draw%  Error   OppAvg   OppE   OppD
   1 PlentyChess 8.0.0                    :  3570.83   1300    83.7   875   425     0  1087.5   32.7  16.96  3210.75   5.30   26.0
   2 Reckless 0.10.0 260501 dev           :  3569.14   1300    83.5   873   426     1  1086.0   32.8  17.28  3210.75   5.30   26.0
   3 Stockfish 260706 dev                 :  3567.45   1300    83.4   869   431     0  1084.5   33.2  17.83  3210.75   5.30   26.0
   4 Stockfish 18 JA                      :  3566.89   1300    83.4   870   428     2  1084.0   32.9  16.84  3210.75   5.30   26.0
   5 Stockfish 17.1 JA                    :  3563.55   1300    83.2   862   438     0  1081.0   33.7  17.02  3210.75   5.30   26.0
   6 Reckless 0.9.0                       :  3561.89   1300    83.0   859   441     0  1079.5   33.9  17.35  3210.75   5.30   26.0


Und je unterschiedlicher die Bedinungen einer Ratingliste sind, desto unterschiedlicher fallen die Ergebnisse aus.
Schaue Dir mal an wie weit Stockfish von Reckless in CEGT oder CCRL entfernt liegen.

Oder was die Stockfish Entwickler an Elo-Verbesserungen seit Stockfish 17 so alles ausgegeben haben.

Also, ChatCPT befrage ich eher selten, weil meist noch zu viel Murks ausgegeben wird.
Meist, aber immer öfters bin ich dann doch überrascht wie genau es werden kann.
Da gibt es noch sehr viel Verbesserungspotential.

Was aber ganz sicher richtig sein wird ist, dass die Kurve mit immer mehr Kernen abflacht.

---

Ein gutes Beispiel ist:
Früher behaupteten die vielen TOP-Programmierer beständig, dass eine gute NN Umsetzung 300 Elo ausmacht.
Ca. in der Zeit als immer mehr NN Engines verfügbar waren, also ca. Mitte bis Ende 2022.

Wie sehen die nackten Tatsachen aus:

Code:

   # Player                               :      Elo  Games  Score%   won  draw  lost  Points  Draw%  Error   OppAvg   OppE   OppD
   3 Stockfish 260706 dev                 :  3567.45   1300    83.4   869   431     0  1084.5   33.2  17.83  3210.75   5.30   26.0
   4 Stockfish 18 JA                      :  3566.89   1300    83.4   870   428     2  1084.0   32.9  16.84  3210.75   5.30   26.0
   5 Stockfish 17.1 JA                    :  3563.55   1300    83.2   862   438     0  1081.0   33.7  17.02  3210.75   5.30   26.0
  78 Stockfish 200731 HCE dev             :  3391.82  10550    63.4  4148  5090  1312  6693.0   48.2   4.98  3238.19  14.11  211.0


Wir sprechen von einer Verbesserung bei Stockfish vom 31.07.2020 bis 06.07.2026 von zusammengefasst 176 Elo im Spiel
mit einem ausgeglichenen Buch.

Nun gut, Stockfish war schon 2020 extrem gut optimiert, andere Engines nicht.
So gesehen kann das durchaus 300 Elo sein aber viele müssen wirklich lernen zu differenzieren und nicht jede Theorie
immer über einen Kamm zu ziehen.

Soweit zur Theorie und Praxis.

Im Computerschach sehen wir sehr oft die Pferde kotzen.

Mich überzeugen nur die knallharten Fakten!
Und immer in Anbetracht zu vergleichen was vergleichbar ist.

Gruß
Frank
Parent - - By Daniel Reist Date 2026-08-19 02:02 Edited 2026-08-19 02:14 Upvotes 1
Hallo Frank

Wenn du aber von Fakten sprichst.
Eine Engine hat 10000 Games gespielt und
die anderen 1300.
Da haben die Engines  also nicht die gleichen
Gegner gespielt und die Bedingungen sind
ja also auch nicht gleich.

Wenn du schon einen Knallharten Fakt ansprichst,
wäre es doch schön, wenn du das mit einem
Test von dieser Engine von 2000 gegen z.Bsp.
Stockfish 18 machen würdest und mit UHU
Eröffnungen den Test machst mit nur diesen zwei
Engines.
Dann sehen wir dann wieviel Prozent diese Engine
dann holt. Ich denke sie hat dann nicht mehr
63%.

Parent - - By Frank Quisinsky Date 2026-08-19 08:54 Edited 2026-08-19 09:07
Hallo Daniel,

zunächst mal:
Das gab es noch nie, dass bei einem Vergleich alle Engines immer die gleichen Gegner hatten.
Komplett neu!!

Es sei denn in Turniere, wie meine früheren Turniere bei 41 Engines und jeweils 50 Partien (2.000 Partien).
Klar bei Rundenturnieren ... aber mir ist keine Ratingliste bekannt wo das der Fall ist wenn so viele Engines eingepickt werden.

Bei ETOC-G spielt jede Engine immer gegen die gleichen 26 Gegner die 50 Partien = 1.300 Partien.
Auch die 26 untereinander haben gegeneinander gespielt.

Das heißt, bei den 26 Engines / Gegner, ich beschimpfe diese als "Standard-Engines" sammeln sich die Partien, die haben jetzt schon knapp 11.000 Partien gespielt.
11.000 : 50 = 220 Gegner, also 220 Engines sind getestet ...

Schöner Nebeneffekt von ETOC-G!
Eine so genaue Elo hat es noch nie gegeben und das gleichzeitig für die 26 Standard-Engines.
Weil, so viele Gegner hatte eine Engine bislang in keiner mir bekannten Ratingliste.

Aber auch nur für die 26 ... alle anderen Engines in der Liste haben immer 1.300 Partien gespielt.
Genau das läßt sich gar so gut vergleichen dass Elo gar nicht notwendig ist.

Du kannst ja mal ausrechnen wie lange es dauern wird wenn alle getesteten Engines bei ETOC-G immer gegen alle anderen gespielt hätten.
Ich vermute mal, dass würde so um die 20 Jahre dauern.

Von UHU halte ich für Vergleichszwecke nichts, ehrlich gesagt weniger als überhaupt nichts.
Also noch weniger als 0.



Wenn eine schwächere Engine mit einem Vorteil ins Spiel geht, erhöht sich die Remis Chance für diese Engine drastisch.

Beispiel:
Engine A (3000 Elo) - Engine B (2800 Elo) = 0,5 : 0,5 ... bei einer Vorgabe für schwarz die deutlichen Eröffnungsvorteil hat
Engine B (2800 Elo) - Engine A (3000 Elo) = 0:0 : 1.0

Normal würde das in der Regel 0:2 ausgehen (logisch für 3000 Elo), aber hier steigt die Chance auf ein 0,5 : 1,5 drastisch an!

Eine genaue Elo im Vergleich zu einer ausgeglichenen Eröffnungsvorgabe kann nicht erzielt werden.

UHU hat den Effekt das weniger Remisen aufs Brett kommen (warum ist klar).
Aber den Effekt hast Du bei einem ausgeglichenen Buch aus wenn schwächere Gegner für die TOP-Engines gewählt werden (ETOC-G).
Die größere Spannweite an ELO der eingesetzten Gegner verzerrt keine Elo, ganz im Gegenteil, die macht die Ausgabe in Elo gar noch genauer!!

Für den Zweck eines Vergleiches ist UHU nicht nutzbar.
Es kann nur das verglichen werden was gleich ist, Thema: Äpfel mit Birnen
Eine ungleiche Eröffnungsvorgabe ist logischer Weise nicht gleich.

Es kann natürlich alles mögliche miteinander verglichen werden.
Wenn beständig UHU benutzt wird, haben wir einen Vergleich innerhalb von UHU.
Du kannst auch ein paar Socken mit einem Stahlhelm vergleichen wenn Du Bock darauf hast.

Allerdings:
UHU hat einen anderen sehr schönen Effekt!
Stärkere Engines durch Optimierungen solcher Vorgaben, könnten im Spiel bei schlechter Eröffnungsvorgabe, besser werden.
Also ich bin mir sicher, dass wenn so optimiert wird es sich Verbesserungen einstellen.

Hat aber wenig mit Schach zu tun, wenn es um echte Vergleiche geht.
Für mich ist UHU eher eine Schachvariante.

Alles ist denkbar:
Eine Engine nutzt Ponder die andere nicht.
Eine Engine nutzt syzygy, die andere nicht.
Eine Engine nutzt ein Buch, die andere nicht.

Du hast Millionenfache Möglichkeiten irgend etwas zu mixen.

Gruß
Frank

Übrigens, ich hatte 2023 mal einen Vergleich unter Turnierbedingungen gestartet, gar 40 Züge in 150 Minuten.
Zwischen der letzten HCE Stockfish Version und Stockfish 16.
Da lagen die beiden Engines 165 Elo auseinander. Allerdings hatte ich nur 800 Partien pro Engine, zwar genug Gegner, aber nur 800 Partien.
Parent - - By Frank Quisinsky Date 2026-08-19 09:11
Code:
WELCOME to ETOC-G
Engine Test Operating Center-Gutweiler

Last update   : August 18th, 2026 (19:45)
Still running : Cinder 0.6.1

rankings
--------

Always based on 1.300 games played!
m-avg  = move-average
1/0<45 = 1:0 / 0:1 under 45 moves
rk     = ranks

                                          points   1:0 1/2   0:1     %   m-avg     1/0<45       rk
--------------------------------------------------------------------------------------------------  3-Stars Generals (08)
001. PlentyChess 8.0.0                   1.087,5   875 425     0   83,65   75   21/  0  + 21   03#
002. Reckless 0.10.0 260501 dev          1.086,0   873 426     1   83,54   86   26/  0  + 26   03#
003. Stockfish 260706 dev                1.084,5   869 431     0   83,42   80   19/  0  + 19   03#
---. Stockfish 18 JA                     1.084,0   870 428     2   83,38   81   19/  0  + 19   ---
---. Stockfish 17.1 JA                   1.081,0   862 438     0   83,15   78   21/  0  + 21   ---
---. Reckless 0.9.0                      1.079,5   859 441     0   83,04   75   34/  0  + 34   ---
004. Triumviratus 6.0 AI                 1.072,5   848 449     3   82,50   85   14/  0  + 14   03#
005. Berserk 250622 CE dev               1.070,0   842 456     2   82,31   86   18/  0  + 18   03#
006. Coda 0.9.3 AI                       1.068,0   838 461     1   82,19   82    5/  0  +  5   03#
---. PlentyChess 7.0.37 Pre              1.067,5   838 459     3   82,12   74   17/  0  + 17   ---
007. Viridithas 20.0.0                   1.067,5   838 459     3   82,12   81    8/  0  +  8   03#
008. Raphael 4.3.0 260705 Pre            1.067,5   837 461     2   82,12   80   33/  0  + 33   03#
--------------------------------------------------------------------------------------------------  2-Stars Generals (18)
009. Obsidian 16.15 CE dev               1.063,5   827 473     0   81,81   77   23/  0  + 23   04#
---. Berserk 14 JA                       1.063,0   830 466     4   81,77   85   14/  0  + 14   ---
010. Alexandria 9.0.0                    1.062,0   829 466     5   81,69   81   10/  0  + 10   04#
011. pawnocchio 3.0 260705 Pre           1.061,0   823 476     1   81,62   87   11/  0  + 11   04#
---. pawnocchio 2.0 260328 Pre           1.060,0   823 474     3   81,54   86    5/  0  +  5   ---
012. Hobbes 3.0                          1.058,5   821 475     4   81,42   78    9/  0  +  9   04#
013. Tarnished 6.0 (Eternal)             1.058,5   818 481     1   81,42   77    8/  0  +  8   04#
---. Reckless 0.9.0 260109 dev           1.057,0   814 486     0   81,31   73   24/  0  + 24   ---
014. Stormphrax 8.0.0 JA                 1.054,5   809 491     0   81,12   83   14/  0  + 14   04#
015. Halogen 15.4.0 Pre                  1.054,0   815 478     7   81,08   85   10/  0  + 10   04#
---. Halogen 15.7.2 Pre                  1.052,5   811 483     6   80,96   86   15/  0  + 15   ---
---. Stormphrax 7.0.17 JA dev            1.052,5   807 491     2   80,96   86   11/  0  + 11   ---
016. Astra 7.0                           1.051,5   809 485     6   80,88   83   14/  0  + 14   04#
017. Integral 250812 JA dev              1.050,5   801 499     0   80,81   76    9/  0  +  9   04#
018. Quanticade Phoenix 4.0 260617 dev   1.048,5   802 493     5   80,65   88   20/  0  + 20   04#
019. Dragon by Komodo 3.3                1.047,5   800 495     5   80,58   79   20/  1  + 19   04#
020. PZChessBot 7.1 JA                   1.047,0   795 504     1   80,54   79    9/  0  +  9   04#
021. Cinder 0.5.0                        1.046,0   795 502     3   80,46   79    6/  0  +  6   04#
022. Clover 9.1 JA                       1.045,5   792 507     1   80,42   87    6/  0  +  6   04#
---. Viridithas 19.0.1                   1.045,0   793 504     3   80,38   82    6/  0  +  6   ---
---. Raphael 4.1.1                       1.045,0   791 508     1   80,38   79   14/  0  + 14   ---
---. Tarnished 5.0 (Hero)                1.040,0   784 512     4   80,00   76    7/  0  +  7   ---
023. Caissa 1.25 JA                      1.039,5   783 513     4   79,96   81    7/  0  +  7   04#
---. Hobbes 2.1                          1.038,0   783 510     7   79,85   77   15/  0  + 15   ---
024. Horsie 1.1                          1.037,5   777 521     2   79,81   85    8/  0  +  8   04#
---. Quanticade Phoenix 4.0 260416 dev   1.027,5   765 525    10   79,04   90    5/  0  +  5   ---
025. Renegade 1.3.1                      1.027,0   764 526    10   79,00   87   11/  0  + 11   04#
026. Starzix 6.1 250524 JA               1.027,0   760 534     6   79,00   83    6/  0  +  6   04#
---. Lizard 11.2                         1.027,0   757 540     3   79,00   88    7/  0  +  7   ---
--------------------------------------------------------------------------------------------------  1-Star  Generals (10)
027. Fritz 21 260513 (Ginkgo)            1.024,5   756 537     7   78,81   79   23/  0  + 23   05#
028. RubiChess 250612 JA dev             1.024,5   752 545     3   78,81   80   10/  0  + 10   05#
---. PZChessBot 7.0 JA                   1.023,5   761 525    14   78,73   79   13/  0  + 13   ---
029. Motor 0.9.0 250603                  1.016,0   736 530     4   78,15   80   17/  0  + 17   05#
030. Tcheran 13.0                        1.010,5   735 551    14   77,73   77    9/  0  +  9   05#
---. Triumviratus 5.0 AI                 1.008,0   726 565     9   77,58   89    6/  1  +  5   ---
031. Uralochka 3.42a JA                  1.005,5   719 573*    8   77,35   82   15/  0  + 15   05#
---. Cinder 0.4.1                        1.002,5   720 565    15   77,12   81    5/  0  +  6   ---
---. Fritz 20 251024 (Ginkgo)            1.002,0   722 560    18   77,08   77   14/  0  + 14   ---
---. Dragon by Komodo 3.3 MCTS             992,0   701 582    17   76,31   85    8/  0  +  8   ---
032. Zangdar 7.0                           991,5   707 569    24   76,27   80    9/  0  +  9   05#
033. Heimdall 1.5.0                        991,0   698 586    16   76,23   80    4/  1  +  3   05#
034. Koivisto 9.2 JA dev                   989,5   710 559    31   76,12   94    5/  0  +  5   05#
035. Velvet 9.0.0 JA dev7                  989,0   695 588    17   76,08   83   16/  0  + 16   05#
036. Seer 250310 JA dev                    988,0   705 566    29   76,00   82    9/  2  +  7   05#
--------------------------------------------------------------------------------------------------  Generals, Honorary title (02)
087. Shredder 13 HCE                       502,0   245 514   541   38,62   83    0/ 12  - 12   00#
121. Crafty 25.3 HCE xb                    183,0    60 246   994   14,08   74    0/ 63  - 63   00#
---. Crafty 25.6 HCE JA xb                 178,0    63 230  1007   13,69   78    0/ 20  - 20   ---
---. Shredder 12 HCE                       176,0    53 246  1001   13,54   76    0/ 53  - 53   ---
--------------------------------------------------------------------------------------------------  Officers
037. Titan 1.1.0 250628 JA                 977,5   674 607    19   75,19   --    -/  -     -   06#  *2
---. Renegade 1.2.0 JA                     977,0   689 576    35   75,15   91    6/  0  +  6   ---
038. Booot 7.4                             975,5   677 597    26   75,04   80    6/  1  +  5   06#
039. Prune 4.0.1 JA                        975,0   681 588    31   75,00   84    7/  2  +  5   06#
040. Revenge 4.0                           975,0   671 608*   21   75,00   82   21/  0  + 21   06#
041. CSTal 2.07                            972,0   671 602    27   74,77   81    8/  0  +  8   06#
---. Tcheran 12.0                          971,5   669 605    26   74,73   77    7/  1  +  6   ---
042. Arasan 26.0 JA                        970,5   670 601    29   74,65   82   11/  1  + 10   06#
043. Clarity 8.0.0 JA                      968,0   681 574    45   74,46   81    3/  0  +  3   06#
---. Koivisto 9.0                          965,5   669 593    38   74,27   92    6/  0  +  6   ---
---. Arasan 25.4 JA                        964,5   659 611    30   74,19   81    7/  0  +  7   ---
---. CSTal 2.0                             961,0   649 624*   27   73,93   82    5/  0  +  5   ---
---. Velvet 8.1.1                          960,0   645 630*   25   73,85   78   17/  0  + 17   ---
---. Tcheran 11.0                          954,0   659 590    51   73,38   79    5/  0  +  5   ---
044. Igel 3.6.0 JA                         948,5   619 659*   22   72,97   79    6/  0  +  6   06#
---. Igel 3.6.3 JA dev                     948,0   633 630    37   72,92   77    8/  0  +  8   ---
045. Akimbo 1.1.0 JA dev                   947,0   640 614    46   72,85   83    7/  2  +  5   06#
046. rofChade 3.1                          945,0   638 614    48   72,69   87    5/  2  +  3   06#
047. Gaia 4.1.3                            937,5   619 637    44   72,12   97    8/  0  +  8   06#  *1
---. Zangdar 6.1.1                         925,0   618 614    68   71,15   83    6/  1  +  5   ---
048. Ruthorin 1.9.9                        925,0   598 654    48   71,15   88    5/  0  +  5   07#  *1
049. Fire 10 JA                            919,0   603 632    65   70,69   85    5/  2  +  3   07#
050. Minke 6.0.0                           907,0   591 632    77   69,77   87    5/  1  +  4   07#
---. Stockfish 200731 HCE dev              901,0   572 658*   70   69,31   84   22/  0  + 22   ---
051. Eleanor 4.1                           891,0   561 660    79   68,54   85   12/  2  + 10   07#
052. SlowChess Blitz 2.9                   878,0   532 692*   76   67,54   87    9/  0  +  9   08#
053. Texel 1.13 a6 dev                     876,5   542 669    89   67,42   83    7/  0  +  7   08#
---. Berserk 4.7.0 HCE                     864,5   571 587   142   66,50   89    3/  3     0   ---
---. Texel 1.12                            864,5   539 651*  110   66,50   83    7/  0  +  7   ---
054. Serendipity 1.0 JAVA                  864,0   532 664   104   66,46   84    1/  1     0   08#
055. Winter 5.0 JA                         856,0   523 666   111   65,85   81    8/  3  +  5   08#
056. Minic 3.46 JA                         855,0   520 670   110   65,77   88    9/  3  +  6   08#
---. Prune 3.2.1                           844,0   517 654   129   64,92   80    9/  2  +  7   ---
---. Monty 260208 MCTS dev                 842,0   537 610   153   64,77   92    7/ 15  -  8   ---
057. Willow 4.0.0.1                        840,0   533 614   153   64,62   90    1/  3  -  2   08#
058. Wasp 7.16 dev                         840,0   524 632   144   64,62   83    9/  1  +  8   08#
---. Wasp 7.15 dev                         835,5   519 633   148   64,27   81    9/  0  +  9   ---
---. Minic 3.41                            834,0   491 686   123   64,15   87    1/  5  -  4   ---
---. Monty 260512 MCTS dev                 831,0   508 646   146   63,92   94    2/ 10  -  8   ---
---. Wasp 7.14 dev                         825,5   529 593   178   63,50   81   17/  0  + 17   ---
---. Patricia 5 JA                         824,5   497 655*  148   63,43   77   22/  0  + 22   ---
---. Wasp 7.00                             815,0   500 630*  170   62,70   81   11/  0  + 11   ---
059. Tucano 12.17 JA dev                   808,0   480 656   164   62,15   83    1/  4  -  3   09#
---. Tucano 12.00 JA                       806,5   468 677*  155   62,04   83    1/  4  -  3   ---
060. Weiss 250206 HCE JA dev               803,5   494 619   187   61,81   86   12/  3  +  9   09#
061. Lambergar 1.5                         798,0   469 658   173   61,38   76   11/  0  + 11   09#
---. Calvin 6.1.1 JAVA                     790,5   327 927    46   60,81   81    7/  0  +  7   ---
062. Schönemann 0.5.0                      782,0   452 660   188   60,15   87    7/  3  +  4   09#
063. Bagatur 5.5c JAVA                     775,0   442 666   192   59,62   94    1/  8  -  7   10#  *1
---. Komodo 14.1 HCE                       761,0   433 656   211   58,54   83    7/  1  -  6   ---
064. Ethereal 14.31 HCE JA dev             754,0   452 604   244   58,00   92    5/  1  +  4   10#  *3
065. Leorik 3.2.1                          750,5   414 673   213   57,74   82    1/  3  -  2   10#
---. Patricia xtremeEAS                    746,5   463 567   270   57,42   78   23/  0  + 23   ---
066. Cwitch 6 260709                       745,0   433 624   243   57,31   84    4/  8  -  4   10#
067. Stash 37.10 HCE JA dev                743,5   439 609   252   57,19   87    3/ 11  -  8   10#
068. Arcanum 2.8                           737,5   421 633   246   56,73   82    1/ 11  - 10   10#
---. Bagatur 5.5 JAVA                      727,5   389 677   234   55,96   94    1/  3  -  2   ---  *1
069. Jackal 2.0.0 MCTS                     721,0   482 479   339   55,46  105    6/ 26  - 20   11#
---. Pedone 3.1                            719,5   409 621   270   55,35   82    5/  3  +  2   ---
---. CSTal 2.1 EAS                         713,5   416 595   289   54,88   85   24/  0  + 24   ---
070. Nemorino 6.11 JA                      711,0   392 638*  270   54,70   83    2/  9  -  7   11#
071. Cheng 4.48a                           708,0   391 634   275   54,46   86    3/  4  -  1   11#
072. Avalanche 3.0.0                       701,0   412 578   310   53,92   86    1/ 14  - 13   11#
073. Petrel 3.5 JA                         695,5   382 627   291   53,50   86   10/  3  +  7   11#
---. Tcheran 9.0                           683,0   359 648*  293   52,54   84    4/  0  +  4   ---
---. Leorik 3.1.3 JA                       681,0   360 642*  298   52,31   82    5/  3  +  2   ---
--------------------------------------------------------------------------------------------------  Soldiers
074. Lc0 0.32.1 791556 CPU                 673,0   334 678   288   51,77   81    4/ 18  - 14   12#
075. Vajolet2 3.2                          672,0   379 586   335   51,69   85    9/  4  +  5   12#
---. Komodo 14.1 HCE MCTS                  670,5   370 601   329   51,58   84    5/ 13  -  8   ---
076. Clockwork 260223 HCE dev              669,5   384 571   345   51,50   83    6/ 11  -  5   12#  *1
077. Grail 2.0.1                           656,0   275 792   263   50,46   93    3/  8  -  5   12#
---. Prune 3.1.0 JA                        618,5   327 583   390   47,58   83    5/ 20  - 15   ---
---. Petrel 3.3.1 JA                       609,5   323 573   404   46,88   88    7/  1  +  6   ---
078. Xiphos 0.6.1 HCE JA                   609,5   308 603*  389   46,88   85    6/  0  +  6   13#
---. Pedone 3.0                            608,5   311 595   394   46,81   86   13/  4  +  9   ---
---. Booot 6.5 HCE                         596,0   287 618*  395   45,85   82    4/  2  +  2   ---
079. Potential Unlocked HCE                585,0   304 562   434   45,00   80    3/ 15  - 12   14#
---. CSTal Extreme                         582,0   332 500   468   44,77   84   25/  0  + 25   ---
080. Zahak 10.0 JA                         577,0   293 568   439   44,38   83    1/ 39  - 38   14#
081. Hiarcs 16.4 HCE                       570,5   289 563   448   43,88   84    5/  4  +  1   14#
---. Cwtch 5                               570,0   282 576   442   43,85   83    3/ 20  - 17   ---
082. Laser 1.8 HCE JA dev                  562,0   282 560   458   43,23   85    1/  6  -  5   14#
083. EveAnn 5.1 NNCe                       558,5   274 569   457   42,96   82    1/ 10  -  9   15#
---. Booot 6.4 HCE                         555,0   265 580   455   42,69   82    6/  2  +  4   ---
084. Combusken 2.0.0 HCE JA                553,5   286 535   479   42,58   88    1/ 13  - 12   15#
---. EveAnn 5.0 NNCe                       553,5   284 539   477   42,58   85    0/ 12  - 12   ---
---. Sophix 1.0 HCE                        553,0   275 556   469   42,54   86    3/  2  +  1   ---
---. Laser 1.7 HCE                         531,0   255 552*  493   40,85   84    2/  2     0   ---
085. Schooner 2.2 HCE xb                   527,0   248 558   494   40,54   86    5/  1  +  4   15#
---. pawnocchio 1.9 HCE                    520,5   275 491   534   40,04   80    1/ 23  - 22   ---
086. Myrddin 0.96 NNCe xb                  515,0   237 556   507   39,62   82    3/ 16  - 13   16#  *1
087. Shredder 13 HCE                       502,0   245 514   541   38,62   83    0/ 12  - 12   00#
088. DanaSah 9.1 JA                        490,5   215 551*  534   37,73   83    4/ 11  -  7   16#
089. Fizbo 2.0                             473,5   210 527*  563   36,43   81    0/  4  -  4   17#
---. Vajolet2 3.0                          472,5   226 493   581   36,35   83    3/ 15  - 12   ---
090. Isa 4.5                               471,0   212 518   570   36,23   81    3/ 17  - 14   17#
---. Petrel 3.1 JA                         460,0   190 540*  570   35,39   88    3/  3     0   ---
091. Senpai 3.0.2 HCE                      453,0   210 486   604   34,85   89    4/ 10  -  6   17#
092. Simbelmyne 1.10.0 HCE                 444,5   215 459   626   34,19   86    0/ 45  - 45   17#
093. Andscacs 0.95123 HCE                  440,0   205 470   625   33,85   87    3/  5  -  2   18#
094. Chiron 5.01 HCE w32                   433,0   198 470   632   33,31   84    2/ 10  -  8   18#  *4
095. Seredina 1.2c                         432,0   183 498   619   33,23   77    1/ 48  - 47   18#
---. Wasp 4.50 HCE                         431,5   188 487   625   33,19   84    5/  5     0   ---
096. Scorpio 3.0.15.14 CPU JA              429,5   199 461   640   33,04   78    4/ 29  - 25   18#
---. Myrddin 0.95 NNCe xb                  427,5   191 473   636   32,88   77    5/ 21  - 16   ---
097. Aku 250709 JA                         401,0   140 522   638   30,85   79    3/ 41  - 38   19#
---. Myrddin 0.94 NNCe xb                  399,5   170 459   671   30,73   82    1/ 13  - 12   ---
098. Equinox 3.30 HCE                      391,0   158 466   676   30,08   83    2/ 22  - 20   19#
099. Orion 1.1                             387,5   154 467   679   29,81   82    1/ 17  - 16   19#
100. Anubis 3.06 xb                        383,0   168 430   702   29,46   79    2/ 10  -  8   19#
101. Critter 1.6a HCE                      377,5   155 445*  700   29,04   84    2/ 28  - 26   19#
---. Gilipol 1.00                          377,0   142 470   668   29,00   80    3/ 14  - 11   ---
102. ChessBrainVB 4.10 HCE                 371,0   157 428   715   28,54   86    1/ 12  - 11   19#
103. Fritz 16 180110 HCE (Rybka)           370,5   154 433   713   28,50   82    1/ 48  - 47   19#
---. Lozza 9 260213 JAVA                   370,0   150 440   710   28,46   80    2/ 29  - 27   ---
104. Demolito 251216 HCE                   369,0   150 438   712   28,38   86    1/ 26  - 25   19#
--------------------------------------------------------------------------------------------------
---. Vajolet2 2.8 HCE                      355,5   128 455*  717   27,35   84    3/ 15  - 12   ---
105. Invictus r391 HCE JA                  347,5   141 413   746   26,73   83    1/ 15  - 14   20#
106. Hannibal 181202 HCE JA dev            338,5   162 353   785   26,04   84    1/ 25  - 24   20#
107. Deep iCE 4.0.853 HCE JA               331,0   131 400*  769   25,47   80    0/ 18  - 18   20#
---. Rybka 4.1 HCE                         325,5   130 391   779   25,04   83    0/ 35  - 35   ---
108. chess22k 1.14 JAVA HCE                312,0   128 368   804   24,00   81    1/ 31  - 30   20#
---. Senpai 2.0 HCE                        312,0   119 386   795   24,00   83    1/ 39  - 38   ---
109. OliThink 5.11.9 NNCe JA v4            275,5    75 401   824   21,19   80    1/ 39  - 38   20#
---. Potential 3.0.0 HCE JA                271,5    95 353   852   20,88   77    0/104  -104   ---
---. Vault 0.4.1 JA                        269,5   128 283   889   20,73   82    1/ 69  - 68   ---
110. Amoeba 3.4 HCE                        260,5    87 347   866   20,04   78    1/108  -107   20#
111. SmarThink 1.98 HCE                    257,0    88 338*  874   19,77   78    0/ 41  - 41   20#  *4
---. Open Critter 1.037 HCE                255,0    98 314   888   19,62   81    0/ 36  - 36   ---
---. RuthIron 21.9.6.7                     254,5   108 293   899   19,58   79    3/  5  -  2   ---  *4
---. Polaris 1.8.1 HCE JA                  247,0    99 296   905   19,00   78    0/ 77  - 77   ---
112. Naum 4.6 HCE                          246,0    89 314   897   18,92   81    0/ 32  - 32   20#
113. Hakkapeliitta TCEC v2 HCE             245,0    81 328*  891   18,85   80    0/ 25  - 25   20#
114. Dirty Catpaw HCE xb                   242,0    93 298   909   18,62   81    1/  7  -  6   20#
115. pirarucu 3.3.5 JAVA HCE               241,5    90 303   907   18,58   77    0/ 75  - 75   20#
116. Vengeance 3.1.0 HCE JA                240,0    90 300   910   18,47   71    3/ 71  - 68   20#
---. PeSTO 2.210 HCE                       228,5    94 269   937   17,58   74    0/ 89  - 89   ---
117. tomitankChess 7.0 JAVA                225,5    54 337   909   17,12   81    0/ 17  - 17   20#
---. Senpai 1.0 HCE                        212,5    78 269   953   16,35   80    0/ 61  - 61   ---
---. tomitankChess 6.0 JAVA                195,5    52 287   961   15,04   80    0/ 18  - 18   ---
---. Rybka 2.32a HCE                       193,0    51 284   965   14,85   79    0/ 41  - 41   ---
118. Francesca 0.32 HCE xb                 192,5    67 251   982   14,81   74    0/ 78  - 78   20#
---. Prune 4.0.1 HCE                       191,5    78 227   995   14,73   76    0/ 72  - 72   ---
119. Junior 13.8.04 Yokohama HCE           187,5    60 255   985   14,42   77    0/ 26  - 26   20#  *1
120. Spike 1.4.1 HCE                       185,5    63 245   992   14,27   78    0/ 31  - 31   20#
---. CSTal 2.07 Absurd                     183,0    99 168  1033   14,08   71   12/ 50  - 38   ---
121. Crafty 25.3 HCE xb                    183,0    60 246   994   14,08   74    0/ 63  - 63   00#
---. Crafty 25.6 HCE JA xb                 178,0    63 230  1007   13,69   78    0/ 20  - 20   ---
122. Sjeng c't 2010 HCE w32                176,5    56 241  1003   13,58   76    0/ 51  - 51   20#
---. Shredder 12 HCE                       176,0    53 246  1001   13,54   76    0/ 53  - 53   ---
123. Cheese 3.3.2 HCE                      161,0    45 232  1029   12,38   76    1/ 38  - 37   20#
124. Spark 1.0 HCE                         159,0    32 254* 1014   12,23   79    3/ 17  - 14   20#
---. Junior 13.3.00 HCE                    158,0    45 226  1029   12,15   76    1/ 30  - 29   ---  *1
---. OliThink 5.11.9 HCE                   157,5    52 211  1037   12,12   76    0/ 65  - 65   ---
125. The Baron 3.451 HCE xb                153,5    29 249  1022   11,81   73    0/ 65  - 65   20#
126. EXchess 7.97b HCE xb                  147,5    38 219  1043   11,35   76    0/ 40  - 40   20#
127. KnightX 4.91 HCE                      147,0    47 200  1053   11,31   72    0/ 77  - 77   20#
---. KnightX 4.8 HCE                       144,0    40 208  1052   11,08   75    0/ 77  - 77   ---
128. Zurichess Nidwalden HCE dev           142,5    37 211  1052   10,96   77    1/ 53  - 52   20#
129. Zappa Mexico II HCE                   138,0    35 206  1059   10,62   78    0/ 17  - 17   20#
130. Quazar 0.4 HCE                        137,5    38 199  1063   10,58   81    0/ 59  - 59   20#
---. Leaf 5382 HCE JA dev xb               137,0    47 180  1073   10,54   77    0/ 37  - 37   ---
--------------------------------------------------------------------------------------------------
--------------------------------------------------------------------------------------------------
Rule 1: If the result is less than 10% (~2735 Elo), the error bar is too wide for
        my purposes! If these programs have been tested, they are not listed here
        and in my engine-overview!
Rule 2: If 10% or more of the games to be played (130) were lost in fewer than 45
        moves, engines not listed here and in my engine-overiew. These results are
        not good for various database statistics.
--------------------------------------------------------------------------------------------------

Hints:
------
*    = + 25.0 points (50 draws simulated) for "Standard-Engines"!
*1   = please have a look on buglist
*2   = please have a look on buglist
       Engines I've had repeated problems are running on Intel ® Core™ i9-10900K,
       with adjudication / resign = on
*3   = a commercial version with Neural-Network is available.
*4   = engine is currently unavailable!

- if the same number of points have been achieved, the higher quantity of won
  games) determines the higher ranking.
- if the same number of points and the same quantity of won games have been
  achieved, the number of quick wins under 45 moves less the quick losses under
  45 moves determines the higher ranking.
- if all is the same, my neighbor decides which engine he prefers to see ranked
  higher

20 ranks:
---------
01# General Field Marshal *****         1.300,0 (100,00%) - 1.144,0 ( 88,00%) ... represents a goal!
02# General of Engines ****             1.143,5 ( 87,96%) - 1.105,0 ( 85,00%) ... perhaps possible in 2026?
03# Lieutenant General ***              1.104,5 ( 84,96%) - 1.066,0 ( 82,00%)
04# Major General **                    1.065,5 ( 81,96%) - 1.027,0 ( 79,00%)
05# Brigadier General *                 1.026,5 ( 78,96%) -   988,0 ( 76,00%)
00# General (Ret.)                                                            ... Honorary title
---
06# Colonel                               987,5 ( 75,96%) -   936,0 ( 72,00%)
07# Lieutenant Colonel                    935,5 ( 71,96%) -   884,0 ( 68,00%)
08# Major                                 883,5 ( 67,96%) -   832,0 ( 64,00%)
09# Captain                               831,5 ( 63,96%) -   780,0 ( 60,00%)
10# First Lieutenant                      779,5 ( 59,96%) -   728,0 ( 56,00%)
11# Second Lieutenant                     727,5 ( 55,96%) -   676,0 ( 52,00%)
---
12# Sergeant Major                        675,5 ( 51,96%) -   637,0 ( 49,00%)
13# Master Sergeant                       636,5 ( 48,96%) -   598,0 ( 46,00%)
14# Sergeant First Class                  597,5 ( 45,96%) -   559,0 ( 43,00%)
15# Staff Sergeant                        558,5 ( 42,96%) -   520,0 ( 40,00%)
16# Sergeant                              519,5 ( 39,96%) -   481,0 ( 37,00%)
17# Corporal                              480,5 ( 36,96%) -   442,0 ( 34,00%)
18# Specialist                            441,5 ( 33,96%) -   403,0 ( 31,00%)
19# Private First Class                   402,5 ( 30,96%) -   364,0 ( 28,00%)
---
20# Private                               363,5 ( 27,96%) -     0,0 (  0,00%)

Note:
The order of the engines will vary depending on other game conditions, such as a
different time control and others. A list comparing game strengths is therefore
never “definitive,” but rather a guide. If a "Captain" is, under certain
circumstances, more like a "Major", then the staff leadership is to blame or,
rather, incompetent. Even so, I am the staff leadership ... not good for me!

Frank Quisinsky, Gutweiler (Germany)
Parent - - By Frank Quisinsky Date 2026-08-19 09:14 Edited 2026-08-19 09:35
Du siehst, alle haben 1300 Partien bei der Ausgabe der Plätze, auch die 26 Standard-Engines.

Eine genaue Liste ohne Elo wird möglich!
Weil, Elo ist im Grunde nutzlos.

Weil, für den Einen hat Engine X 2800 Elo, für den Anderen 3000 Elo und für einen Weiteren dann 3200 Elo.
Das hier ist knallhart nach Punkten sortiert im Spiel gegen immer die gleichen Gegner.

Und wer mag dichtet sich die gewünschte Elo einfach dazu!

Übrigens:
Zeigt den Stand der Engine Entwicklung sehr schön auf.
Je besser Remis gegen "Schwächer" verhindert wird, desto höher der Rang (bei den TOPs)

Und das Geheimnis ist:
Remis vermeiden, Zügedurchschnitt gering halten.

Derzeit läuft Cinder 0.6.1 bei mir.
Sortiere ich die bisherige Datenbank von Cinder nach Zuglänge wird schnell deutlich ...
Der Programmierer verhindert schnelle Remise aber auch lange Endspielketten ...
Traumhaft, perfekt wenn Du es magst zuzusehen und kaum Langeweile dabei aufkommt.

Cinder, ein wahrer und schlauer General in allen Belangen!
Engine kämpft derzeit um den 3-Stern ...
Parent - - By Frank Quisinsky Date 2026-08-19 10:43 Edited 2026-08-19 10:47
Hallo,

ich arbeite auch an einer Ratingliste, bei denen nur die besten Engines gegeneinander spielen.
Die ist zwar nicht so aussagekräfitig wie z. B. ETOC-G, weil die Remisquote zu hoch ist aber die Reihenfolge der Engines, stimmt meist.
Wie überhaupt auch in den vielen Ratinglisten die es gibt.

Die Frage die ich mir stelle ist eine ganz andere (bei der zweiten Liste von mir, veröffentliche ich nicht, gibt genug von dem Zeug):

Das Thema bei dieser Ratingliste (hier führt Stockfish for Reckless und PlentyChess, aber auch nur sehr knapp mit derzeit 7 Elo)
sind die Gewinnpartien bei einem ausgeglichenen Buch. Engine unabhänig kopiere ich hier nur die Gewinnpartien in eine Datenbank
und schaue mir im Detail an wann es zum Vorteil kommt.

Das vergleiche ich mit Stats zu Bauernstrukturen, die ich seit ein paar Jahren mache.
Versuche also herauszufinden, bei welchen Bauernstrukturen es oft zu Gewinnpartien kommt, weil zu 80% bilden sich die Gewinnpartien
in der Phase zum frühen Übergang ins Endspiel oder sehr späten Mittelspiel.

Es sind meist wirklich Nuancen aus menschlicher Sicht.
Wie soll ich sagen, Du denkst bei der Analyse dieser Partien meist, dass eine Engine einen oder zwei Tempo-Vorteile hat wenn es darum
geht wie genau die verbliebenen Bauernketten zusammenwirken.
Die Züge die dann zu solchen Vorteilen führen sind sau-schwer auszumachen ... übermenschlich.
Da kannst Du stundenlang drüber nachdenken und kommst meist zu dem Ergebnis: Das würde ein Mensch niemals spielen!

Und genau dieses Thema ist das Thema bei ca. 80% der Gewinnpartien der TOP-Engines untereinander.

pawnocchio hat hier sehr gute Stats, liegt taktisch allerdings ein bissel zurück, verliert hier Punkte.
Stockfish ist hier überlegen und es scheint so, dass Stockfish hier im iTüpfelchen optimiert ist.

Aber das alles sind Themen, die sind "übermenschlich".

Es macht also kaum Sinn, Engine Turniere zu organsieren bei denen die TOPs gegeneinander spielen.
Weil wir sehen Dinge, die wir sonst meist selbst nicht spielen würden und in 80% der Fälle kommt es einzig und allein nur zu dem Thema der Bauerstrukturen.
Ferner immer und immer wieder in einer Partiephase die für den Menschen weniger interessant ist, auch wenn bekannt ist das die superstarken Menschen hier
meist viele Fehler spielen.

Da lohnt der Strom nicht die TOPs aufeinander zu hetzen, es sei denn man möchte ... wie hier beschrieben ... etwas feststellen.

Statistiken zu schnellen Angriffen etc. sind einfacher!
Da ist derzeit auch sehr klar welche Engines die Angreifer sind.

Nur hier gibt es auch ein Problem:
Die bekannten Angreifer verzweifeln im Spiel gegen super stark.
Es kommt dort sehr selten zu schnellen Gewinnen ... die kannst Du suchen gehen, wie die Nadel im Heuhaufen.
Spielt also ein bekannter Angreifer gegen super stark.

Die Angreifer kommen mit Ihren Angriffen gegen spielschwächer durch.
Spielschwächer verteidigt sich also nicht korrekt.

Um mehr Möglichkeiten für Angriffe zu haben, müssen Angreifer offene Wege bei vielen Figuren auf dem Brett suchen.
Das schaut interessant für den Menschen aus (fast alle Schachspielen lieben das), wird von sehr starken Engines aber einfach locker wegverteidigt.

Nicht nur das, die sehr starken Engines nutzen dann wie oben beschrieben die Lücken, die sich bei den Bauernsturkturen
entstanden sind um mittels Nuancen dann gar die Partien gegen die besagten Angreifer zu gewinnen.

Meist sind es hier immer nicht zusammenhängende Bauerketten die zu diesen Verlusten der Angreifer führen.

So gesehen:
Zu öffnen, um aggressiver zu spielen, wird derzeit grundlegend wiederlegt.

Und daher ist es auch klar, dass z. B. sehr spielstarke Engines weniger schnelle Gewinne einfahren, weil die direkten Züge die öffnen meist
nur die zweitbesten Züge sind und langfristig zum Nachteil führen.

Egal, der Mensch sieht es trotzdem gerne und mag oftmals mehr die Angreifer unter den Engines!

Viele Grüße
Frank

So genug ...
Parent - - By Frank Quisinsky Date 2026-08-19 11:07 Edited 2026-08-19 11:34
Einer noch ...
Das heißeste Thema der Gewinnpartien der TOPs untereinander ist der Abtausch der Leichtfiguren.
Eindeutig gibt es durch Abtausch von Leichtfiguren sich bildende Vorteile und eindeutig weil das der häufigste Fall ist.

Stockfish erkennt sehr gut, ich gebe den Läufer für einen Springer aber durch den Abtausch gelingt mir vielleicht ein Vorteil bei den verbliebenen Bauernstrukturen.

Dann zieht Stockfish das durch und spielt das richtig gut.
Andere TOPs vermeiden dann den Abtausch, nach dem Motto ... der Läufer hat mehr Felder im Endspiel.

Menschliches Endspielwissen wird in Frage gestellt und daher denkst Du Dir ...
Das würde ein Mensch niemals spielen.

Es geht zu 80% immer nur um die Bauernstrukturen ...
Das ist ein hoch interessantes Thema aber sprengt gewaltig das eigene Wissen.

Wenn ich Zeit habe suche ich nach solchen Manövern, die Engines heute zeigen uns das viele Theorien im Schach zumindest "fraglich" sind.

Ansonsten ist die Ratingliste der TOPs untereinander unbrauchbar.
So rein, aus statistischen Gründen.

Brauchbarer sind Listen bei denen es zu Entscheidungen kommt.
Geringe Remisquote ...

Aus solchen Listen, wie ETOC-G, liest Du wie in einem Buch!

---

Derzeit habe ich einen Kontakt mit einem Großmeister der sich die ETOC-G Datenbank geladen hat.
Ein russischer GM.

Er hat nur ein einziges Thema:
Die Verlustpartien von Uralochka ...

Er erstellt Muster der Verluste ... es gibt fast 400 Verlustpartien der 12.000 gespielten Partien.

Welche Erkenntnisse kann ich mit diesen Verlusten ziehen, auch für das eigene Spiel.
Er unterstützt nicht den Programmierer von Uralochka, macht das als Trainingsaufgabe für sich selbst.

Wenn er mir dann schreibt, diskutiere ich die entstandenen offenen Stellungen die meist zu den Verlusten führen.
Uralochka öffnet was das Zeug hält. 1-Stern General mit ca. 3500 Elo. 700 Elo höher als das menschliche max. Level.

So arbeitet z. B. ein GM mit Computerschachdatenbanken!
In welchen Fällen niemals öffnen ist sein Thema!

Es ist wichtig dass immer alle ECO-Codes abgearbeitet werden, damit Daten brauchbar sind.
Eröffnungsvorgaben sind einfach Murks und haben zu viele Nachteile.
Parent - - By Frank Quisinsky Date 2026-08-19 14:19
weil Cinder 0.6.1 erwähnt.
Hat den dritten Stern knapp nicht geschafft, ist aber bester 2-Sterne General und bei mir auf Platz 9.
Immerhin stärker als Alexandria oder Obsidian, pawnocchio.

So schnell geht das derzeit an der Spitze.
Auch Tcheran und Zangdar stoßen bald in den Kreis der 2-Sterne oder 3-Sterne Generäle hinzu.
Ruck-Zuck geht das ...

Das ist wie bei Wattenscheid 09.
Tausende von Zuschauern ... Millionen ... etwas übertrieben!
Derzeit nur auf den letzten Platz nach Aufstieg in Liga 4, alles wird gut!

Gibt so viele Kandidaten die in naher Zukunft oben mitmischen können, man muss sagen ... werden!
z. B. Minke, Heimdahl, Prune, Eleanor ... viele!

Gespannt bin ich auf Igel, auch daran wird heftig entwickelt.
Parent - - By Thomas Zipproth Date 2026-08-19 20:47
Interessante Idee, die militärischen Ränge.
Ich konnte nicht anders, anbei ein Schnappschuss vom Spiel Fruit-Stockfish.
Just for Fun. 

Parent - By Frank Quisinsky Date 2026-08-20 07:57 Edited 2026-08-20 08:32
Hallo Thomas,

genau, so ist das!
Der arme Fruit ... das ergeht Spark bei mir täglich so.

Eine schöne Grafik.
Bei dem General ist gar kein Platz mehr auf der Brust, der sieht aus wie der Generalfeldmarschal, also 5 Sterne.
Den gibt es bei mir noch nicht. Stockfish hat 3-Sterne. Die Hintergründe auf dem Bild sind auch gelungen.
Wahrscheinlich KI erstellt.

Und der Soldat ist kein einfacher Soldat, der hat schon drei ... könnte ein Sergeant sein.

Zu sagen Meister, denke an die Urkunde vom Designer 2325 (Mach IV) 2325 Elo, bei einem Schachcomputer
halte ich für fragwürdig.

Die militärischen Ränge passen irgendwie besser zum Kampf- / Kriegsspiel Schach!
Für ETOC-G wollte ich eigentlich nur 20 Gruppen zur Einordnung der Spielstärke.

Vergleichbar zu der Arbeit von Günther Simon (chronology).
https://rwbc-chess.de/

Er sortiert auch übersichtlich in seiner "Excel chronology" nach Spielstärkegruppen.

So habe ich mir dieses System einfallen lassen.
Beruht also nicht ganz auf meinen Ideen, für mich logischer militärische Ränge zu vergeben.

Viele Grüße
Frank

Wie dem auch ist ...
Grundsätzlich eine nette Spielerei, mit der kleinen Pointe bei einem Update zu hoffen das es einen Rang höher geht.
Hätte Cinder 0.6.1 gestern nur einen Punkt mehr erreicht hätte ein Stern mehr gedroht. Nun, Grenzen müssen gezogen werden.
Zwei Programmierer fiebern dabei richtig mit und freuen sich enorm wenn es zu einer Beförderung kommt.
Nach dem Motto: Alles ist besser als Elo!!
Parent - - By Stefan Pohl Date 2026-08-23 06:49 Edited 2026-08-23 07:21
Pondern kann man nicht mehr nutzen. Viele, auch starke Engines, supporten es schlicht nicht mehr, da es in den wichtigen Turnieren (TCEC, chesscom) nicht genutzt wird. Und es ja auch eine Ressourcenverschwendung ist.

Gleiches gilt für MultiThreading. Auch das unterstützen nicht alle Engines, auch gute Engines teilweise, nicht. Aber hier kann man sagen, daß 1 Thread heutzutage auch genügend Rechenpower hat, damit man testen kann.

Bedenkzeit kann fast beliebig kurz sein, das spielt heutzutage qualitativ keine nenneswerte Rolle und je mehr Partien man pro Zeiteinheit generiert, desto besser (statistisch) die Ergebnisse. Ein Inkrement ist allerdings dringend empfohlen, da Enginepartien auch gerne mal 100-130 Züge dauern können. Ohne Inkrement kann es hier zu Zeitnotdramen kommen, die Ergebnisse unnötigerweise verzerren können.

Da man mit balancierten Eröffnungen nur noch bei Verwendung von extrem unterschiedlich starken Engines, übehaupt noch Ergebnisse bekommt, die nicht zu 90%+ aus Remisen bestehen, haben die anderen Ranglisten ja die Regel, daß es eben eigentlich nicht sinnvoll ist, Engines mit extremem Spielstärkeunterschieden gegeneinander zu testen, einfach über Bord geworfen. Nur, um sich nicht eingestehen zu müssen, daß ausbalancierte Eröffungen tot sind. Traurig aber wahr. Nichtsdestotrotz ist es natürlich viel besser, Engines mit vergleichbarer Spielstärke gegeneinander zu testen, was ja früher auch alle (ganz selbstverständlich) getan haben. Aber das geht heutzutage nur noch mit meinen UHO-Eröffnungen, die eben nicht ausbalanciert sind. Dazu kommt noch, daß alle Topengines heutzutage mithilfe von UHO-Eröffungen weiterentwickelt werden (es ginge ohne UHO schlicht schon seit Jahren nicht mehr weiter). Schon deshalb sollte eine seriöse Testmethode bzw. Rangliste natürlich auch denselben Eröffnungstyp nutzen, der eben sowohl bei der Entwicklung der Engines, als auch in den wichtigen Engineturnieren, zur Anwendung kommt. Alles andere wäre ja absurd, denn UHO ist heutzutage eben sowohl die Entwicklungsgrundlage im Engineschach, als auch das Format, das in den wichtigen Turnieren (TCEC, chesscom) genutzt wird. Wieso sollte man mit anderen Eröffnungstypen an dieser Lebenswirklichkeit des Engineschachs von heute "vorbei testen"? Eben. Wäre schlicht sinnfrei.

Genau deswegen sind meine Testbedingungen in meiner Rangliste so wie sie eben sind. Das hat schon triftige Gründe. Und deswegen heißt meine UHO-Top15 Rangliste bei den meisten TopEngine-Entwicklern mittlerweile schlicht "the Leaderboard". Weil die Top-Entwickler eben verstehen, welche Testbedingungen wirklich sinnvoll sind und welche eben nicht. Ich habe noch nie, wirklich noch nie, von irgendeinem Engine Entwickler eine Kritik oder einen Verbesserungsvorschlag zu meiner Ranglisten-Methodik gehört. Kritik gab es nur mal bei der Engine-Auswahl (AI unterstützte Engineentwicklung letztens z.B.).
Gäbe es ein besseres Testsetup für das Testen von Top-Engines, würde ich meines entsprechend ändern.

Zitate Andrew Grant (Torch, chessom): "I have repeatedly said, that your list is the best list out there at the moment", "I want to make it known, how important the (UHO) opening books, you have generated, are."
Zitate Vondele (Stockfish Projektleiter): "We have succesfully adapted UHO as the training book", "Several major tournaments have adopted UHO-style books as well"

Aus genannten Gründen ist für mich also alles Testen ohne UHO schlicht Quatsch, es sei denn, man bewegt sich in einem Celo-Bereich unter ca.3300. Nicht, weil UHO von mir stammt, sondern weil es ohne UHO einfach nicht mehr geht.

Von meiner Website:

Playing conditions:

The 15 strongest engines and the latest StockfishDev version are playing 1000 games vs. each opponent: 15000 games per engine are played. A RoundRobin Tournament with 120000 games overall !

Hardware: AMD Ryzen 9 7945HX 16-core (32 threads) notebook with 64GB RAM (since 2024/10/08), 2 identical machines. Windows 11 64bit
Speed: (singlethread, TurboBoost-mode switched off, chess starting position) Stockfish 17: 600 kn/s (when 26 games are running simultaneously)
Hash: 512MB per engine
GUI: Cutechess-cli (GUI ends game, when a 5-piece endgame is on the board, all other games are played until mate or draw by chess-rules (3fold, 50-moves, stalemate))
Tablebases: None for engines, 5 Syzygy for cutechess-cli
Openings: My UHO_2022_6mvs_+120_+129 openings are used (first 500 lines) (UHO 2022 openings are part of my Anti Draw Openings download-package).
Ponder, Large Memory Pages & learning: Off
Thinking time: 3min+1sec per game/engine. One testrun (15000 games) takes around 80-85 hours (=3.5 days)

Also kurz gefaßt: 15 strongest engines, singlethread, 3min+1sec, UHO_2022_6mvs_+120_+129 openings
Parent - - By Frank Quisinsky Date 2026-08-23 12:34 Edited 2026-08-23 12:59
Welche der stärkeren Engines nutzt am besten die Schwächen der spielschwächeren Engines und münzt diese idealerweise in Gewinnpartien um (bei einem normalen ausgeglichenen Buch).
Welche der stärkeren Engines kann ein Eröffnungsnachteil noch in ein Remis wenden, unter Umständen in einen Sieg?

Sind zwei verschiedene Wege!

Bei dem ersten beschriebenen Weg sind die Ergebnisse deckungsgleich zu bekannten Ratinglisten bei einer Remisquote von ca. 30% - 50%.
Bei dem zweiteren beschriebenen Weg sind die Ergebnisse in Elo nicht deckungsgleich zu bekannten Ratinglisten.

Tatsächlich führen viele Wege nach Rom!
z. B. die fast immer gleiche Reihenfolge der Engines in bekannten Listen, wenn diese nicht zu eng bei der Spielstärke auseinander liegen.

Ich halte zwar persönlich nichts von UHU aber um hohe Remisquoten beim Spiel der spielstärksten Engines untereinander zu vermeiden ist das ein Weg.
Das geht auch anders, mit ganz normalen Bedingungen wie Sie im Schach seit je her angewendet werden, davon halte ich mehr.

Erkenntnisse können nun dann gesammelt werden wenn experimentiert wird.

Neue Erkenntnisse für mich:

- es ist bei der Messung der Spielstärke eher richtig, dass genaue Ergebnisse auch bei einer großen Elo-Spannweite des Feldes der Teilnehmer ermittelt werden.
Die Annahme, dass ein Feld nicht weiter als x Elo (Zahlen waren einst im Raum von 250-350 Elo), früher diskutierten wir das oft in Schachforen, auseinerander liegen sollte ist nicht korrekt.

- wenn eine Elo geeicht wird auf eine Engine, muss diese Engine nicht in der Mitte des Feldes liegen. Auch diese frühere Annahme ist nicht korrekt.

Erkenntnisse die sich bestätigen:

- bei knappen 50 ECO Codes ist die Remiswahrscheinlichkeit der super starken Engines sehr sehr hoch. Das bedeutet, dass z. B. eine Elo im Spiel der super starken Engines gegeneinander kaum noch korrekt gemessen wird, wenn diese ca. 50 ECO codes immer wieder aufs Brett kommen. Auch der Mensch vermeidet Eröffnungssysteme, kann ein Computerprogramm logischer Weise auch. Ganz unabhänig von der Frage, das Entscheidungen, im Spiel der super starken Engines gegeneinander, meist bei den Bauernstrukturen in der Übegangsphase zum Endspiel bzw. im späten Mittelspiel zu suchen sind. Immer wieder genau das festzustellen macht keinen Sinn, weil das Level der heutigen TOP-Engines für den Menschen zu viele Dimensionen entfernt liegt. Aus dem was wir sehen ziehen wir insofern keine Erkenntnisse das wir daraus kaum etwas erlernen können. Wäre es anders würde der Mensch mit 3500 Elo spielen.

Vor dem NN-Zeitalter hatten wir Remisquoten von ca. 65% - 70% beim Spiel der spielstärksten Engines untereinander. Diese Remisquoten waren fast gleich ob nun 2800 oder 3100 Programme gegeneinander angetreten sind. Das sind heute rund 85%, eher so 87-88% bei ca. 3500 Elo aufwärts.
Die typischen Remisquoten von 65% - 70% werden z. B. bei einem Feld von 26 Gegner, bei einem Elo-Durchschnitt von ca. 3350 Elo des Feldes, erreicht (bei einem ausgeglichenen Buch). Wobei hier die schlechteste der 26 Engines ca. 400-450 entfernt liegen. Bei ETOC-G sind es über 700 Elo (Unterschied Platz 1 zu Platz 26 der Gegner). Spielt aber keine Rolle hinsichtlich der Ergebnisse in Elo. Die werden gleich sein. Da ich bei ETOC-G die TOP-250 ermitteln wollte brauchte ich ein breites Feld an unterschiedlichen Spielstärken. Das ich dadurch mehr herausgefunden habe als eigentlich geplant war ist reiner Zufall gewesen. Ich habe z. B. selbst nicht damit gerechnet, dass ETOC-G aufgrund der 700 Elo Spannweite der 26 Test-Genger so gestochen scharfe Ergebnisse ermittelt.

Es ist heute in jedem Fall etwas kniffelig gute Bedingungen für einen aussagekräftigen Engine Test zu finden.
Sprich, es ist anspruchsvoller und schwieriger als in Zeiten vor NN.

Spannend wird es wenn jemand etwas komplett neues versucht.
Anstatt Dinge macht die altbekannt sind.

---

Zum Thema "Pondern", "Multi-Threading" oder auch zu den "Bedenkzeiten" stimme ich Deinem Beitrag zu.

Jeder kann auf einem PC etwas herausfinden und Eng-Eng macht immer noch sehr viel Spaß.
Wirkliche Ratinglisten werden dafür eigentlich nicht mehr benötigt, weil durch schnelle Bedenkeiten auf einem PC schnell etwas zu ermitteln ist.
NN ist hier sehr hilfreich, weil schnellere Bedenkzeiten führen zu schnellen Ergebnissen.

Dennoch ...
Die Zeiten der Ratinglisten sind meines Erachtens vorbei!
Wie gesagt, sehr schnell kann jeder etwas auf einem PC herausfinden, dafür muss keine Ratingliste mehr studiert werden.

---

Testen mit UHU empfinde ich persönlich als Quatsch, es sei denn es wird glücklicher dargestellt, meines Erachtens als Schachvariante!
Mit Hinweisen darauf, dass viele ECO-Codes zu remislastig für TOP-Engines sind, wäre das meines Erachtens glaubwürdiger und auch folgerichtig,
Anstatt klassisches Schach absordum zu stellen, beim Einsatz von sehr starken Engines, durch solche Aussagen die Du hier anführst.
Die ECO-Codes gehören zum klassischen Schach und das wird sich durch konsturierte Stellungen mit "Nachteil" nicht ändern.

Wie Du etwas darstellst oder begründest musst Du natürlich selbst entscheiden!

Grundsätzlich verkehrt ist UHU nicht, auch wenn ich schreibe das ich niemals so testen würde weil mein Schachverständnis für das klassische Schach offenbar mit Deinem nicht vergleichbar ist.
Allerdings ist UHU ein Weg von vielen denkbaren (Millionen denkbare Dinge können bei Lust und Laune konsturiert werden) irgend etwas in Erfahrung zu bringen.

Genau das ist doch der Reiz!
Etwas in Erfahrung bringen um Wissen zu bündeln.
Parent - - By Frank Quisinsky Date 2026-08-23 13:16 Edited 2026-08-23 13:28
Die Frage die sich bei solchen Diskussionen immer wieder stellt ist eine ganz andere!

Was ist mit den 500 ECO-Codes?
Durch die super starken Engines von heute könnten die ECO-Codes komplett überarbeitet werden.
Es könnten gar detailierte Gewinnwahrscheinlichkeiten zu jeder Variante ausgegeben werden.

Viele Schachbücher werden dann Geschichte sein, überholt sein etc..
Wo etwas zu Ende geht, entsteht neues könnte argumentiert werden.
Neue Schachbücher zu den Eröffnungssystem werden den Markt erobern.

Meines Erachtens ist das bestehende ECO-System total out.
Die Klassifizierung ist mehr als überarbeitungsbedürtig, das schreibe ich ja schon mindestens 20 Jahre.

Das wäre ein sinnvoller Einsatz von Engines heute!
Ein sinnvoller Einsatz ist ja nicht dumme Ratinglisten zu erstellen.

Es sei denn wir wollten etwas in Erfahrung bringen und brauchen Partiematerial.

Die Frage wird aber sein:
Was macht der Mensch mit diesen vielen Erkenntnissen, wenn sich die menschliche Spielstärke dadurch nicht weiter verbessern wird?

Der wesentliche Punkt der dem entgegen steht!!

Selbst wenn der Mensch ein neues ECO-System zur Verfügung hätte, es ihm im Spiel gegen eine TOP-Engine als Datenbank zur Verfügung stehen würde,
ist im späten Mittelspiel wieder Schluss mit lustig. Der Mensch ist und bleibt gnadenlos dieser heutigen Spielstärke unterlegen. Das ist sehr gut vergleichbar
mit den Endspieldatenbanken, das perfekte Spiel wenn denn 7-Steiner auf dem Brett sind.

Insofern stellt sich die "Sinnhaftigkeit" von einem solchen Unterfangen.

Wir überwinden das Eröffnungsproblem, wir haben das Endpielproblem bei x Steinern auf dem Brett ja schon lange überwunden, aber es verbleibt
das Spiel nach der Eröffnung bis zum Endspiel und je mehr Fehler drin sind, desto niedriger die Elo. Das wird sich leider nicht ändern.
Parent - - By Frank Quisinsky Date 2026-08-23 13:51 Edited 2026-08-23 14:24
Ein aufgebohrtes ECO-System mit Unterteilungen zu:

1. Ausgeglichene Variante die nicht zwangsläuftig zum Remis führen muss.
2. Ausgeglichene Variante mit sehr hoher Remiswahrscheinlichkeit bei optimalen Spiel ... in über 50 ECO-Code gibt es die, in weiteren ca. 75 ECO-Codes teilweise enthalten, fragwürdig
3. Varianten die zum scharfen Spiel führen, mit höherer Gewinn-Wahrscheinlichkeiten für weiß
4. Varianten die zum scharfen Spiel führen, mit höherer Gewinn-Wahrscheinlichkeiten für schwarz
5. Varianten die mit hoher Wahrscheinlichkeit zum Verlust führen

Vieles ist denkbar um nun diese 5-Punkte ordentlich neu zu klassifizieren.

So könnte ein neues Klassifizierungssystem nur leicht oberflächlich verändert werden (ist der Einstieg einfacher):
Wir bleiben bei A00-E99.

z. B. wäre C38 zu finden unter Punkt 5:
Also, im neuen klassifizierten Bereich E, nehmen wir mal an E18

Ausgegeben werden könnte E18, ehemals C38

Zu jeder Variante könnten Gewinnwahrscheinlichkeiten ausgegeben werden.
Wir haben ja solche Stats bei Eröffnungsbüchern aber das geht viel detailreicher!

An einem solchen System arbeite ich z. B. seit vielen Jahren.
Dafür brauche ich Material zu den ausgeglichenen Varianten, erstelle ich mir durch Eng-Eng Partien aller 500 ECO-Codes!

Allerdings ist diese Arbeit so brutal aufwendig das ich mir immer sage, das wäre eine Lebensaufgabe für gleichzeitig 10 Leben.
Dann sage ich mir, jetzt erst Recht und mittlerweile bin ich fast 60 Jahre alt.

Es müssen mehrere Personen daran arbeiten, alleine kann das niemand bewerkstelligen.

Auch UHU könnte damit sehr einfach verbessert werden, wenn ausschließlich für den Engine-Test der Punkt 3 und 4 verwendet wird.
Dann wäre es eine Verbindung die Sinn macht, mit offiziellen Systemen in bekannten Varianten die zum klassischen Schach gehören!

...

Was ich noch vergessen habe ...

Je weniger Remise in Endergebnisse wandern, desto genauer offenbar die Ausgabe in Elo.
Ich komme zu diesen Erkenntnisse bei ETOC-G im Vergleich zu meinen anderen Ratinglisten bei einem ausgeglichenen Buch.

Und früher dachte ich ... je mehr Remis in der Mitte einer Ratingliste, desto genauer die Elo für alle und speziell für die Engines in der Mitte der Ratinglisten.
Auch das ist eine Erkenntnis, die zumindest bestehende Erkenntnisse "fragwürdig" erscheinen lassen.

Egal, das Thema neigt sich für mich dem Ende entgegen.
Werde bald andere spannende Tätigkeiten nachgehen.

Computerschach wird mit an Sicherheit grenzender Wahrscheinlichkeit noch sehr lange spannend bleiben!
Die Betätigungsfelder um neue Erkenntnisse zu sammeln sind enorm vielschichtig.
Parent - - By Kurt Utzinger Date 2026-08-23 18:44 Edited 2026-08-23 18:47
Frank Quisinsky schrieb:

Ein aufgebohrtes ECO-System mit Unterteilungen zu:

1. Ausgeglichene Variante die nicht zwangsläuftig zum Remis führen muss.
2. Ausgeglichene Variante mit sehr hoher Remiswahrscheinlichkeit bei optimalen Spiel ... in über 50 ECO-Code gibt es die, in weiteren ca. 75 ECO-Codes teilweise enthalten, fragwürdig
3. Varianten die zum scharfen Spiel führen, mit höherer Gewinn-Wahrscheinlichkeiten für weiß
4. Varianten die zum scharfen Spiel führen, mit höherer Gewinn-Wahrscheinlichkeiten für schwarz
5. Varianten die mit hoher Wahrscheinlichkeit zum Verlust führen

[...


Hallo Frank
Die Varianten 3. / 4. und 5. sind eigentlich nichts anderes als UHO im neuen Gewand.
Die Varianten 1. und 2 führen normalerweise stets zum Remis, sofern nicht z.B.
Stockfish 18 gegen Yace 0.99.56 antretetn muss. Um Stroh vom Weizen zu trennen,
eignen sich die diversen UHO-Eröffnung von Stefan Pohl am besten.
Gruss
Kurt

Parent - - By Frank Quisinsky Date 2026-08-23 19:56 Edited 2026-08-23 20:23
Kurt,

ich habe meine Standpunkte sehr ausführlich, wie immer, begründet und beschrieben.

Kein Mensch, geht in einer Schachpartie freiwillig mit Nachteil in ein Spiel.
UHU hat nichts, überhaupt nichts mit dem klassischen Schach zu tun.

Hast Du Dir die Stellungen mal im Detail angesehen.
Mal ermittelt, wie oft in der Theorie aufs Brett gekommen.

Eine zuverlässige Messung ist nicht möglich.

Du findest z. B. über 200 Test-Run Beispiele einer zuverlässigen Messung auf der ETOC-G Seite.
Vergleiche das mit Ratinglisten, die im Grunde gleich arbeiten, wie CEGT oder CCRL.

Die Remisquote liegt bei 30-50% bei mir.

Stockfish 18 - PlentyChess macht keinen Sinn.
Welcher Mensch profitiert aus dem mehr an Wissen über Bauernstrukturen in der sehr späten Mittelspielphase.
Ich schrieb das alles schon sehr detailreich.

Das heißt, die Entscheidungen solcher Partie von 3550 Elo Engines sind für Menschen kaum nachzuvollziehen.
Wäre das anders, hätten wir diese 3550 Elo auch.

Die geschilderte Variante 1 führt eben nicht immer zum Remis und ist und bleibt die spannende Frage für Schachspieler.
Die spannende Frage für Schachspieler ist nicht, in welcher Variante verliere ich am schnellsten, spannend hinsichtlich um diese
aus dem eigenen Repertoire auszugliedern. Es sei denn man spezialisiert sich darauf, um z. B. einen Gegner zu irritieren.

Wir Menschen sollten uns immer unserer eigenen Stärken bewusstwerden oder dahingehend versuchen
neues Wissen zu sammeln. Machen wir es nicht, z. B. jemand der sich seit ca. 20 Jahren nicht mehr mit Astronomie und Astrophysik
beschäftigt hat ist das Wissen veraltet, egal ob derjenige schon seine Theorien als Prof. oder Dr. unters Volk brachte. Das geht dort
so krass voran, was wir heute wissen, war uns meist vor 20 Jahren völlig unbekannt.

Im Schach passiert nichts anderes!

Dinge die vor der NN-Zeit aktuell waren, oder zu Zeiten der Schachcomputer, der danach aufkommenden PC-Ära sind heute
einfach veraltet. Dieses Wissen, was z. B. die super starken Engines vermitteln könnten, gerade zu der bestehenden Eröffnungstheorie,
könnte vieles verändern. Wie gesagt, ob der Mensch überhaupt fähig ist, neues Wissen aus Gewinnwahrscheinlichkeiten dann in der
Partiephase nach der Eröffnung auch korrekt anzuwenden bezweifle ich. Wir sind diesen super starken Engines um Dimensionen
unterlegen.

Wir könnten zwar die Eröffnungstheroie revolutionieren aber ob wir dann sonderlich spielstärker werden ...
Ich glaube nicht daran!

Es gab früher bei FEOBOS sehr viele Experimente.
Was bei FEOBOS von 10 Engines aussortiert wurde könnte ich auch UHU oder sonst wie beschimpfen.
Diese Daten lagen offen, lange bevor es UHU gab mit sämtlichen Analysen zu allen FEOBOS Positionen x10.
Das waren nur teils Stellungen aus der Theorie. FEOBOS beruhte maßgeblich auf der FCP-Ratingliste von mir,  bei dem die Engines
selbst immer Zug für Zug das Eröffnungsbuch ergänzt haben und unter Umständen dann auch wieder selbst korrigiert haben.
Das ist wie gesagt in FEOBOS eingeflossen. Viele dieser Stellungen tauchen nicht in der Theorie auf.

Wie gesagt, ich sehe auch Vorteile in UHU aber ich würde UHU als Beeinflussungsfaktor niemals für eine knallharte Messung
einsetzen um eine Remisquote mit Gewalt zu drücken durch Schach welches aus menschlicher Sicht unrealistisch wird.

Es ist natürlich Dein gutes Recht eine andere Meinung zu vertreten.

Was so in den Köpfen der Anderen vorgeht ist nicht uninteressant, wird aber uninteressant wenn es darum geht neue
Erkenntnisse zu erzeugen bzw. bestehendes in Frage zu stellen (nichts besonderes, ist immer das Gleiche).

Also, für mich immer maßgebend wenn ich z. B. Vergleiche starte, sonst brauche ich damit gar nicht anzufangen.
Versuche neue Komponenten die unklar sind zu beleuchten.

Gruß
Frank
Parent - - By Kurt Utzinger Date 2026-08-23 20:25
Hallo Frank

Da sind wir für einmal ganz unterschiedlicher Meinung. Die UHO-Eröffnungen stammen alle aus menschlichen Partien mit einer gewissen Bandbreite von Vorteilen für die eine Partei.

UHO_2024_+085_+094

UHO_2024_+090_+099

UHO_2024_+095_+104

UHO_2024_+100_+109

usw.

Und hier zeigt sich, welche Engine gegen seine Gegner bei welcher Bandbreite von Vor-/Nachteilen die Partie zum Sieg führen kann oder umgekehrt noch ausgleichen (oder gar noch gewinnen) kann. Eine einfachere und schnellere Methode, um die Stärke zwischen Engines zu vergleichen, gibt es meines Erachtens nicht. Dass es natürlich keinen Sinn macht, einen Crafty 23.05 gegen Stockfish 18 antreten zu lassen, ist dabei auch klar. Der letzte Satz trifft natürlich auch auf alle anderen Testbedingungen zu. Deshalb finde ich die Methode von Stefan Pohl einfach genial.

Beste Grüsse
Kurt
Parent - - By Frank Quisinsky Date 2026-08-23 21:43 Edited 2026-08-23 21:51
Kurt,

ob ich eine Engine mit Eröffnungsnachteil oder Vorteil in ein Match schicke oder mit einem ausgeglichenen Buch gegen eine schwächere Engine ins Rennen schicke
scheint augenscheinlich zunächst mal gleich zu sein aber ist es im Detail nicht.

Ungleiche Stellungen immer wieder anzuwenden hat nichts mit klassischen Schach zu tun.
So spielt kein Mensch auf Dauer ...

Und wie es Sinn macht Crafty - Stockfish spielen zu lassen.
Die stärksten Engines werden weniger Remis gegen Crafty spielen.
Je höher es bei der Spielstärke geht, desto niedriger die Remisquote gegen Crafty.

Diese Messung ist nachweislich (über 200 Beispiele liegen auf meiner Seite) vergleichbar zu der Variante die besten Engines gegeneinander antreten zu lassen.
Die erzeugen Elo Ausgaben sind ca. gleich.

Und es ist spannender beim Zusehen, also sich anzusehen wie bei Eröffnungnachteil starke Engines um das Remis kämpfen, in ellenlangen Partien.
Wir lernen daraus wie wir es nicht spielen sollten, wenn 2800 Elo gekillt wird, wie Crafty mit ca. 2800 Elo auseinander genommen wird.
2800 Elo, das ist fast das max. mögliche menschliche Level.

Wir lernen nichts daraus mit Vorgaben zu spielen, die aus menschlicher unrealistisch sind um etwas über Partiephasen zu lernen die um Dimensionen über unser Level hinaus gehen.

Klar, stammen die UHU Vorgaben aus menschlichen Partien (bei FEOBOS nicht unbedingt, schrieb ja gerade warum bzw. steht das auch in der 60 Seiten Doku).
Schaue in die Ausspielwahrscheinlichkeiten der UHU-Varianten.

Sicherlich hat Stefan nicht alle Eröffnungsstellungen die verwendet wurden selbst produziert.

Wie gesagt, halte Deine Meinung.
Es ist immer gut überhaupt eine eigene Meinung zu haben.

Für mich ist UHU noch nicht mal zu 1% realistisch ... erneut ... wenn es um knallharte Vergleiche geht.
Strom und Zeitverschwendung!

Gruß
Frank
Parent - By Olaf Jenkner Date 2026-08-24 00:59
Frank Quisinsky schrieb:
Es ist immer gut überhaupt eine eigene Meinung zu haben
Ich freue mich.
Parent - - By Andreas Matthies Date 2026-08-24 17:57
Frank Quisinsky schrieb:

Kein Mensch, geht in einer Schachpartie freiwillig mit Nachteil in ein Spiel.
UHU hat nichts, überhaupt nichts mit dem klassischen Schach zu tun.


Nur zwei Beispiele:
https://www.youtube.com/watch?v=V_u4_zHDyLY
https://www.youtube.com/watch?v=vlaar3KY6sU
Vermutlich sind diese Eröffnungen nicht in einem UHO Buch aber definitiv geht ein Mensch freiwillig mit Nachteil in ein Spiel.
Parent - By Kurt Utzinger Date 2026-08-24 21:05
Andreas Matthies schrieb:

Frank Quisinsky schrieb:

Kein Mensch, geht in einer Schachpartie freiwillig mit Nachteil in ein Spiel.
UHU hat nichts, überhaupt nichts mit dem klassischen Schach zu tun.


Nur zwei Beispiele:
<a class='ura' href='https://www.youtube.com/watch?v=V_u4_zHDyLY'>https://www.youtube.com/watch?v=V_u4_zHDyLY</a>
<a class='ura' href='https://www.youtube.com/watch?v=vlaar3KY6sU'>https://www.youtube.com/watch?v=vlaar3KY6sU</a>
Vermutlich sind diese Eröffnungen nicht in einem UHO Buch aber definitiv geht ein Mensch freiwillig mit Nachteil in ein Spiel.


Hallo Andreas
Solche Witz(Blitz)Partien schaue ich mir selten bis zum Ende an.
Gruss
Kurt
Parent - By Frank Quisinsky Date 2026-08-24 21:32 Edited 2026-08-24 21:39
Hallo Andreas,

jo, also ich will ja nicht sagen ich mache entgegengesetztes als ich schreibe aber oftmals ist das so.
Spiele ich gegen die älteren Schachcomputer, habe ich auch schon mit 1. h4 eröffnet.

Geil ist gegen die Dinger ...
1. e4 - e5
2. c4

oder ...
1. c4 und auf c5 oder e5 dann wieder
2. e4

Se2, Läufer fianchettieren auf g2 und dann geht die Luzie ab, zwischen durch mal etwas auf dem Damenflügel
absichern. So typische Killereröffnungen gegen die alten Comps. Die rennen fast alle in den Königsangriff.

1. h4, es ist immer wieder verblüffend was entstehen kann ...

Nakamura kommt sehr oft mit so Dingern um die Ecke.

Und das war früher eine Beleidigung.
Karpov - Miles (WDR3, Schach der Großmeister, glaube das war 1980, 1. ... a6).

Das haben die Russen als Beleidigung aufgefasst.

Nun ja, auf unseren Level geht vieles gut.
Aber Magnus zuzusehen war immer schon besonders!

Gruß
Frank

Magnus denkt sich ...
Warum soll ich h4 lange vorbereiten, ich spiele es einfach direkt und mein Gegner kann ja dann aufgeben!
Gut ist nur, dass er nicht auf die Idee kommt und mit 1. g4 eröffnet.
Parent - - By Thomas Plaschke Date 2026-08-25 12:21

> Kein Mensch, geht in einer Schachpartie freiwillig mit Nachteil in ein Spiel.


Diese Behauptung ist in ihrer Unumstößlichkeit schlicht falsch.

Es gibt schachlich viele Eröffnungen, die nach dieser Behautpung in ernsten Partien eigentlich nicht mehr gespielt werden dürften. Oder auf den Punkt gebracht es dürfte nur eine Eröffnung geben, die für Weiß den Eröffnungsverteil behält und für Schwarz eine Verteidigung, die dagegen am besten verteidigt.

1. d4 und alles andere als 1. e4 wäre demnach fragwürdig, weil die Spanische Partie die einzige Eröffnung ist, die den Anzugsvorteil am längsten behauptet.
Deswegen darf auf 1. e4 nicht mit 1. .. e5 geantwortet werden. Aber 1. .. Sf6 müsste man mit Deiner Apodiktik verwerfen und 1. .. e6 und 1. .. c5 gleich mit. Von 1. .. d5 oder 1. .. d6 und allem anderen wollen wir gar nicht erst reden.

Wenn mich meine etwas eingestaubten Eröffnungstheoriekenntnisse nicht täuschen, ist 1. .. c6 die stabilste Verteidigung gegen 1. e4. Aber wer will schon immer Caro-Kann spielen?
Es spielt im Übrigen auch gar keine Rolle, ob meine Charakterisierung der Eröffnungen richtig ist.
Ich behaupte, dass es (zum Glück) auch und vor allem andere Gründe für die Wahl einer Eröffnung oder eines Eröffnungssystem gibt als ausschließlich die Vermeidung eines Nachteils, wie ihn Schachprogramme in Bauerneinheiten oder Siegeswahrscheinlichtkeiten ausdrücken.

... und als mein ceterum censeo: Weiß kann sich dank des Anzugsvorteils eine Menge erlauben!
Orang Utan und Bird-Eröffnung und vor allem viele Gambits verdanken dem ihre Existenz: Königsgambit, Blackmar-Gambit, Nordisches Gambit, Göring-Gambit etc. Und gerade hier ist Dein Satz sogar absurd.

Viele Grüße
Th. Plaschke
Parent - By Frank Quisinsky Date 2026-08-25 12:47
Man kann sich jetzt natürlich etwas herausflücken.
Die Aussagen in meinen Postings sind eigentlich sehr klar wie ich befinde, was das eigentliche Thema war.

Deinen Aussagen stimme ich zu 100% zu!

Ich hätte besser geschrieben:
Kein Mensch geht erneut und erneut in eine Schachpartie freiwillig mit Nachteil.
Klar gibt es Spieler die sich speziealisieren und ihre Gegner überraschen mit seltenen Systemen.

Auch wenn Menschen wissen würden, welche Systeme, lt. unseren Engines, zum Nachteil führen würden, werden die trotzdem ausgespielt.
Ein Level von max. möglichen vielleicht 2900 Elo kann "fast" immer kompensieren. Ein sehr starker Vereinsspieler mit seinen 1800 Elo wird
seine Lieblingseröffnung, mit der er Erfolge hat, auch weiter spielen wenn Engines sagen: Nicht so dolle!
Parent - - By Lothar Jung Date 2026-08-24 09:00
Hallo Kurt,

in der ganzen Entwicklung der Eröffnungstheorie geht es darum, den bestmöglichen Zug für Weiß oder Schwarz zu begründen.
Nachteilige Voraussetzungen bzw. Handicaps sind dem Schach und anderen Sportarten fremd.
Es sei denn, die Nachteile sind gleich verteilt, z.B. Paralympics.

Gruß

Lothar
Parent - - By Kurt Utzinger Date 2026-08-24 21:25 Edited 2026-08-24 21:34
Lothar Jung schrieb:

Hallo Kurt,

in der ganzen Entwicklung der Eröffnungstheorie geht es darum, den bestmöglichen Zug für Weiß oder Schwarz zu begründen.
Nachteilige Voraussetzungen bzw. Handicaps sind dem Schach und anderen Sportarten fremd.

Es sei denn, die Nachteile sind gleich verteilt, z.B. Paralympics.

Gruß

Lothar


Hallo Lothar
Das stimmt so nicht. Gerade im heutigen, klassischen Spitzenschach bringen die top GM's
teilweise Varianten aufs Brett, die sie ausführlich analysiert haben und sind bereit, auch nachteilige
Stellungen in Kauf zu nehmen. Wenn die dann entstehenden komplizierten Stellungen durch
den Gegner am Brett nicht gelöst werden können, lässt sich auch auf diese Weise, wenn auch
nur ein einziges Mal, ein voller Punkt einfahren. BTW: Ich habe nichts gegen ausgeglichene
Stellungen. Und Frank hat mit dem Feobos-Projekt grossartige Leistungen erbracht. Mir geht
es aber darum, auch die beste der 5 - 10 top Engine herauszufinden. Mit ausgeglichenen
Eröffnungen ist das aber nicht mehr möglich. Und hier greifen eben die UHO-Eröffnungen als
m.E. einzige Methode, um noch Unterschiede festzustellen.
Beste Grüsse
Kurt

Parent - - By Frank Quisinsky Date 2026-08-24 22:27 Edited 2026-08-24 23:18
Hi Kurt,

das stimmt, das im Spiel der besten Engines untereinander die Remisquoten sehr hoch sind.
Das stelle ich auch nicht in Frage.

Es gibt viele Möglichkeiten was Du dagegen tun kannst.

Du lässt die TOPs mit 3500-3575 einfach gegen 20 Engines antreten, die 100-150 Elo darunter liegen und umgehst die hohen Remisquoten.
Oder z. B. was Stefan macht mit seinen UHU Stellungen.

Was ich mache ist krass bei ETOC-G ...
Die Spannbreite baue ich auf gar bis zu 750 Elo aus.

ETOC-G ist ein Experiment!
Ich wollte gar keine genaue Messung, ich wollte eine grobe Einschätzung (ohne mit Elo darzustellen) um Engines in 20 Spielstärkegruppen zu unterteilen.
Mehr steckte da gar nicht dahinter!

Ich musste das so machen, um für alle Engines, die in den TOP-250 sind, die gleichen Gegner zur Verfügung zu stellen.
Und die TOP-250 lagen nunmal 800 Elo weit auseinander, so war es Anfang 2026.

Das ich nun festgestellt habe, dass dieses System sehr gute Ergebnisse produziert war reiner Zufall.
Ich bin selbst davon ausgegangen, dass die Gegner in einem Test-Run niemals mehr als 400 Elo auseinander liegen sollten.

Oftmals wird rein zufällig etwas produziert was gut ist.

Was aber überhaupt keinen Sinn macht ist die TOPs gegeneinander antreten zu lassen.
Ob mit oder ohne UHU.

Bei UHU der Kampf um Ausgleich einer schwächeren Vorgabe. Dieser Kampf geht dann oft verloren und die Remisquote sinkt.
Und ferner überhaupt diese ellenlangen Partien.

Ich zweifle stark daran, dass ein Mensch großartige Erkenntnisse ziehen kann, weil sich bei den Entscheidungen dieser
Partien meist alles um Bauernkonstellationen im späten Mittelspiel dreht. Das ist nicht das Thema wo der Mensch seine Stärken hat.
Wäre es anders, hätten wir alle weit über 3000 Elo.

Sagst Du aber ...
Ich lasse z. B. Stockfish gegen 20 Engines antreten, die z. B. 150 Elo spielschwächer sind und nimmst dann für PlentyChess oder sonst was die gleiche
Gruppe an Gegnern macht das Zusehen deutlich mehr Spaß. Die Remisquote sinkt und alles in gut bekannten Systemen die den Menschen seit Jahrhunderten
begeistern.

Und alles mit ganz normalen Eröffnungen wie sie in der Turnierpraxis stark überwiegend aus den ECO-Codes eingesetzt werden.

UHU ist nicht uninteressant, aber ich betrachte das wie gesagt eher als eine Schachvariante.

Und eines sollte immer klar sein.
Wir haben 40 Engines die oben liegen und keine 100 Elo voneinander entfernt sind.
Die Remisquote steigte immer schon stark an wenn gleich starke Engines gegeneinander spielen.

Das war so bei 2400 Elo in Winboard Zeiten oder auch bei 3200-3300 Elo vor NN wenn gleich stark spielte.
Heute zugegeben noch krasser als es bislang war aber schaue doch mal in GM-Turniere von Großmeistern mit 2500-2600 Elo.
Wie wenige Partien da entschieden werden, da enden meist mehr als 75% der Partien mit Unentschieden.

Da steht ja auch nicht jemand von der Computer-Schach-Community daneben und ruft UHU, UHU und hat noch Fahnen und Plakate dabei ... beim GM-Turnier.
Die GMs würden sich denken, den müssen wir schnell wieder von der Zuschauertribüne nach draußen befördern.

Wir hatten das noch nie?!
40 Engines an der Spitze mit einem Abstand von 100 Elo.
Klar das die Remisquoten schon allein deswegen enorm ansteigen, wenn die denn gegeneinander antreten!

Kannst Du auch vergleichen mit:
Eine Wand aus Titan und eine Wand aus Stahl rennen aufeinander los.
Die Titan-Wand ist leichter, also schneller, hat den Anzugsvorteil.

Dann der Knall ...
Vergleichbar ... als wenn Du gegen die Wand flitzt.

Es hat weh getan und ein zweites Mal überlegst Du genauer.
Du kannst die Wand nicht einrennen, Stahl kann Titan und umgekehrt nicht zerstören bzw. es kommt unter Umständen darauf an.

Ich lasse auch super stark gegen super stark gegeneinander mit ausgeglichenen Buch spielen.
Um die Gewinnpartien zu sammeln und auszuwerten. Die Partien selbst tue ich mir nicht an, schaue da nicht zu.
Alles ellenlange Kröten, wie meine Beiträge.

Gruß
Frank
Parent - By Frank Quisinsky Date 2026-08-24 22:41 Edited 2026-08-24 22:48
Ich hatte im letzten Quartal 2025, bevor ich ETOC-G gestartet habe, schon mit dem System sehr ausgiebig experimentiert.

Stockfish gegen 20 Engines, ca. 100-150 Elo schwächer.
Stockfish gegen 20 Engiens, ca. 200-300 Elo schwächer.

etc..

Die Remisquote sinkt logischer Weise, je schwächer die Gegner bzw. die Gruppe der 20 Gegner werden.

Aber die Ausgabe in Elo war immer fast gleich.
Und zusehen macht enorm viel Spaß, Du fieberst automatsich mit der schwächeren Engine mit.

Deutlich geringerer Zügedurchschnitt, also weniger lange Endspielschleifen.
Und Du lernst beim Zusehen bzw. ist der Lernfaktor deutlich größer!
Auch bekommst Du mehr und mehr ein Gefühl für diese enorm hohen Elo-Zahlen die heute erzielt werden.
Parent - - By Olaf Jenkner Date 2026-08-24 00:47
Frank Quisinsky schrieb:
1. Ausgeglichene Variante die nicht zwangsläuftig zum Remis führen muss.
Wenn die Variante ausgeglichen ist, führt sie immer zum Remis.
Habe ich da was falsch verstanden?
Parent - - By Frank Quisinsky Date 2026-08-24 05:40 Edited 2026-08-24 05:45
Wäre es so, wären wir durch mit Schach.
Das Spiel beginnt doch erst.

Ich glaube es lassen sich viel zu viele Leute von oftmals gleich spielenden Engines und deren Remisquoten im Spiel gegeneinander beeindrucken.
Wenn vielleicht in 5-8 Jahren das maximale Level um weitere 150 Elo angestiegen ist, darfst Du dich gerne daraüber wundern was mit der heutigen Nummer 1 dann die
Engines dieser Zeit so treiben, bei einem stink-normalen ausgeglichenen Buch.

Es ist immer schön zu beobachten, das wenn bei einem Test-Run zwei Engines gegeneinander spielen die ca. das gleiche Level haben, dass plötzlich die Remisquote enorm hoch ist.
in diesen Matches steigt also die Remiswahrscheinlichkeit drastisch an. Es ist egal ob 2800, 2900, 3000, 3100 Elo. Das war schon bei Kasparow-Karpov so bei ca. 2800 Elo.

Es ist noch lange nicht so, dass eine Partie immer nach 8 Zügen Remis ist weil zu dem Zeitpunkt die Stellung ausgeglichen ist!

Also, ich habe schon viele komische Dinge in Schachforen gelesen, manchmal unglaublich was die Leute in den letzten 30 Jahren alles so vermutet haben.

Allerdings gibt es wie bereits beschrieben, viele Eröffnungen bei denen die Remiswahrscheinlichkeiten sehr sehr hoch sind.
Könnten wir die mit derzeitiger Engine Power ein wenig mehr eingrenzen bzw. Engines z. B. dafür sinnvoller einsetzen, wäre das doch eine echte Errungenschaft.
Parent - By Frank Quisinsky Date 2026-08-24 06:06 Edited 2026-08-24 06:10
Ich bin mir sehr sicher, dass anhand von den Remiswahrscheinlichkeiten der jeweiligen Spielstärkeklassen (aufgeteilt z. B. nach 2800, 2900, 3000, 3100, 3200 Elo etc.)
gar das maximal mögliche Level errechnet werden kann. Unter der Premisse, das ausgeglichene Eröffnungen in Berechnungen drin sind. Logisch, sonst sind derartige
Berechnungen nicht möglich.

Also, wenn 2800 Elo gegen 2800 Elo spielt und die Remisquote ca. bei 75% liegt.
Wenn 2900 Elo gegen 2900 Elo spielt, die Remisquote dann bei ca. 77% liegt.

Etc. kannst Du immer weiter spinnen.
Vorausgesetzt die Engines sind nicht komplett gleich!

Wir dachten immer zum entsprechenden Zeitpunkt ...
Die Nummer 1 ist ja fast unschlagbar, weil so weit über unser Level.

Das las ich hier schon vor 5, 10, 15 Jahren und wir werden jedesmal eines besseren belehrt.

Glaubst Du wirklich daran, dass Stockfish mit heute 3575 Elo gegen die Nummer 1 aus dem Jahr 2035 bei einem ausgeglichenen Buch immer nur Remis spielt.
Es wird dann eher noch deutlicher werden, welche der Eröffnungssysteme zwangsläufig und mit sehr hoher Wahrscheinlichkeit tatsächlich zum Remis führen.
Up Topic Hauptforen / CSS-Forum / Was sind die sinnvollsten Testbedingungen für ein Engine-Ranking?

Powered by mwForum 2.29.3 © 1999-2014 Markus Wichitill