Not logged inCSS-Forum
Forum CSS-Online Help Search Login
CSS-Shop Impressum Datenschutz
Up Topic Hauptforen / CSS-Forum / Wer noch Bock hat ... Coda 0.9.4 AI wird um Platz 1 kämpfen!
- - By Frank Quisinsky Date 2026-08-25 09:09 Edited 2026-08-25 09:14
Hallo zusammen,

ca. gegen 12:00 Uhr starte ich den Test-Run von Coda 0.9.4 AI.
Allerdings auf 8 Cores, zusammen mit einer anderen Engine auf 8 Cores.

Läuft also ca. 44 Stunden.

Bei mir hat PlentyChess als auch Reckless ... Stockfish überholt.
In diese Gruppe der Engines, die sich eng aneinander kuscheln, wird nun sicherlich auch Coda 0.9.4 AI aufsteigen.

Könnte man auch würfeln wer von denen auf Platz 1 ist, so eng sind die zusammen.

Den Test-Run Link setze ich dann in diesen Thread.

Gruß
Frank
Parent - - By Peter Martan Date 2026-08-25 09:13 Edited 2026-08-25 09:16
# Name                Points     %     Elo    +/-   W-L-D         1     2    
------------------------------------------------------------------------------
1 PlentyChess 8.0.0   273.5/500  54.7  +32.8  19.4  +125-78=297         54.7%
2 Coda 0.9.4          226.5/500  45.3     --    --  +78-125=297   45.3%      

500/500 total games, 59% draws, time control:180+1, book:UHO_2024_6mvs_+085_+094.pgn


# Name                Points     %     Elo    +/-   W-L-D         1     2    
------------------------------------------------------------------------------
1 PlentyChess 8.0.0   288.0/500  57.6  +53.2  18.6  +133-57=310         57.6%
2 Viridithas 20.0.0   212.0/500  42.4     --    --  +57-133=310   42.4%      

500/500 total games, 62% draws, time control:180+1, book:UHO_2024_6mvs_+085_+094.pgn


# Name                           Points     %     Elo    +/-   W-L-D        1     2    
----------------------------------------------------------------------------------------
1 Reckless 0.10.0-dev-7300f044   260.5/500  52.1  +14.6  18.1  +99-78=323         52.1%
2 PlentyChess 8.0.0              239.5/500  47.9     --    --  +78-99=323   47.9%      

500/500 total games, 65% draws, time control:180+1, book:UHO_2024_6mvs_+085_+094.pgn
Parent - - By Frank Quisinsky Date 2026-08-25 09:18 Edited 2026-08-25 10:00
Peter,

was willst Du eigentlich mit Einzelergebnisse erzählen?

Die Geschichten der Leute, die die vielen Ivanhoe Version mit Ihren 100-Test-Partien 1+1 abgetestet haben.
Das ist doch bestimmt auch schon 15 Jahre her.

Ah, da kommen ja noch welche ...
Davon brauchst Du eine ganze Armee ...

Du solltest 0,1 + 0,01 mit SUPER-HUHU testen ...
Damit ermittelst Du die Leistungsfähigkeit vom UCI-Protokoll in Verbindung mit einer GUI, dem kannst Du dann auch eine Elo geben, gar mit einer ErrorBar.
Auch die enorme Tiefe von HUHU beeindruckt.
Zwei Züge wären besser, damit die GMs auch neue Theorie-Varianten prüfen können.

Warum sind die eingentlich nicht in Computerschachforen aktiv, die GMs.
Die Frage stelle ich mir schon seit Jahren!

Stelle mir gerade GM Pfleger vor.
Als er den Modular, Exclusive und München beschrieb.
Hatte er nicht dabei gesagt, dass die Zukunft der Schachprogramme interessant ist?!
Wobei niemand wusste ob er das tatsächlich ernst meinte.
Nun, mit einer Zeitmaschine ab in diese Zeit und zu seinem Vortrag.
Dann tauchst Du auf und erklärst ihm UHU und verkaufst das als die Computerschachzukunft!
Was hätte GM Dr. Helmut Pfleger gemacht oder gedacht?

Der wäre wahrscheinlich so begeistert gewesen und hätte nichts eiligeres zu tun gehabt als schnell
noch zum Horten zu flitzen, um persönlich die Mephisto Werbeblätter unters Volk zu bringen bzw.
dort zu verteilen.

Er wäre dann restlos überzeugt von der Computerschachzukunft.

Gruß
Frank
Parent - - By Peter Martan Date 2026-08-25 09:32 Edited 2026-08-25 09:44
Naja, Frank, direkt gegeneinander kannst aber auch du immer nur 2 und 2 Engines spielen lassen, und weil du schriebst, man kann auch gleich würfeln, ja, das ist natürlich auch eine Methode, fürs Schach kannst du's ja noch mit ECO- Codes aufwerten, die du auf die Würfel malst.

Was die Hardware- TC angeht, ist 3'+1" single thread mit einem 4.3GHz Kern heutzutage ein durchaus moderater Kompromiss zwischen einerseits mit vertretbarem Hardware- Zeit- Aufwand halbwegs relevante Partiezahlen Zusammenbringen und andererseits die Performance- Vergleiche auf das Reduzieren, was einen (zum Unterschied von einem anderen) an der Spitze halt auch noch interessiert, LOS (in 2 der Matches, die ich oben zitiert habe, durchaus mehr oder weniger erreicht) und irgendeine Art von messbarem Unterschied, ob du den dann in Punkten, Prozenten, klingenden militärischen Rängen oder in Elo, Celo, oder Ranglistenplätzen einer bestimmten Listenlänge angibst, das ist schnurzpiep, aber wenn Elo heutzutage auch noch irgendeine Bedeutung im Computerschach haben dürfen, dann eben auch genau den: wie groß ist der Abstand zwischen 2 bestimmten Engines unter bestimmten Bedingungen (insbesonders Hardware- TC und Teststellungen, seien's auch solche aus eigens dafür editierten Büchern), wenn sie gegeneinander spielen, so what?
"Ideale" Testbedingungen gab's und gibt's (heutzutage weniger denn je) noch nie, ebenoswenig wie die gute alte Elosion der "overall playing strength".
Ceterum censeo...
Parent - - By Frank Quisinsky Date 2026-08-25 09:48 Edited 2026-08-25 09:56
Hi Peter,

also wenn mir jemand erzählt es gäbe keine vernünftigen Test-Bedingungen mehr zweifle ich an deren Fantasie.
Millionen von Test-Möglichkeiten sind denkbar.

z. B. Stockfish mit 1ms gegen den sagenumwobenen CXG Sphinx Enterprise Display vom Dänen Kaare Danielsen mit 2.400 Stunden pro Zug.
Drüber streiten müssten wir allerdings noch welchen Spielstil wir dem CXG mit auf dem Weg geben und vor allem müssen wir Stockfish eine
Hardware mit 128 Cores gönnen bzw. erst noch kaufen gehen ... 1ms muss hardwaretechnisch noch aufgewertet werden.
Tipps für solche Maschinen können uns die Fernschächler geben.

Auch kommt dann für den einen oder anderen Computerschächler wieder die UHU Frage ins Spiel.

Wir sollten die GMs ins Forum locken um solche Geschichten im Detail auszudiskutieren.
Die sind da ganz wild drauf.

Gruß
Frank
Parent - - By Tommy Tulpe Date 2026-08-25 10:04
"Die Fernschächler" schütteln bloß den Kopf - auch wenn es nicht ganz ernst gemeint war.
Parent - By Frank Quisinsky Date 2026-08-25 10:14
War nicht ernst gemeint!

Willst Du mich eigentlich verarschen?
Das war mein völliger Ernst!

Parent - - By Peter Martan Date 2026-08-25 11:32 Upvotes 1
Frank Quisinsky schrieb:

Millionen von Test-Möglichkeiten sind denkbar.

Sag' ich doch

Und schau, bei "meiner" hast du sogar schon nach 250 Partien ein statistisch belastbares Einzelergebnis zu der Frage, bei der du gemeint hattest, genau so gut würfeln zu können (wer die Nr. 1 ist):

# Name                     Points     %     Elo    +/-   W-L-D        1     2    
----------------------------------------------------------------------------------
1 Stockfish dev-20260819   159.0/251  63.3  +95.0  25.7  +81-14=156         63.3%
2 Reckless dev-20260804     92.0/251  36.7     --    --  +14-81=156   36.7%      

251/500 total games, 62% draws, time control:180+1, book:UHO_2024_6mvs_+085_+094.pgn
Parent - - By Frank Quisinsky Date 2026-08-25 12:52
Da hast Du natürlich Recht!
Es sind mehr als nur Millionen ...
Parent - - By Thomas Zipproth Date 2026-08-26 23:49 Upvotes 1
Und nicht zu vergessen, es gibt natürlich mehr als eine Million Meinungen dazu.
Meiner unerheblichen Meinung nach (ich bin kein Engine Tester) gibt es ungefähr eine Möglichkeit, mit leichten Variationen.

Aber ich habe mir die aktuelle Liste angeschaut:
https://www.amateurschach.de/fling/etoc-g_t238.html

Und da fiel mir eine neue Möglichkeit zur Ermittlung des Box Weltmeistes ein:
Jeder Kandidat muss gegen 10 Amateure kämpfen.
Es werden die Sekunden zusammengezählt, die es braucht, bis jeder Amateur KO geht.
Derjenige mit den wenigsten Sekunden ist der neue Boxweltmeister.
Parent - - By Frank Quisinsky Date 2026-08-27 02:11 Edited 2026-08-27 03:08
750 Elo ca. ist die Spannweite der 26 "Standard-Engines".

Betrachte das mal von den Schwächsten in der Liste?
Gegen was für Gigangten die spielen müssen!!

10% der Punkte = 2735 Elo = Super GM Level.
Das heißt, ich musste bei den TOP-250 (die lagen Anfang 2026 ca. 800 Elo auseinander) auch Standard-Engines so auswählen,
dass eine Engine mit ca. 2735 Elo überhaupt punkten konnte.

Ich habe das im Vorfeld mittels Excel simuliert, erst so ein wenig im Kopf ... dazu gibt es einen Thread in TalkChess Turnier-Rubrik.
Da fasste ich nur Gedanken dieser Analyze zusammen. z. B. wie muss die Aufteilung der Ergebnisse dann in militärische Ränge
aufgeteilt werden. ETOC-G hatte ich zwar länger geplant und viele Experimente liefen im Vorfeld, aber dann kamen neue Ideen
hinzu.

Die Gesamtpunktzahl die erzielt wird, ist dann gegen 3210 Elo (Elo Durchschnitt der 26 Standard-Engines).
https://www.amateurschach.de/main/checkfile.txt

Coda erreicht also 82,50% gegen 3210 Elo, also 82,50% gegen ca. 400 Elo "Stärker" als das max. menschliche Level.

Das meinte ich in einem Beitrag an Kurt mit ... Gefühl für Elo!
So gigantisch ... dieses erreichte "Level" im "Computerschach". So weit über unseren Horizont hinweg.

Und noch krasser ist ...
Vergleiche die Ausgaben in Elo mal mit CEGT ...

Anfangs dachte ich, nur die Ergebnisse um 3210 Elo können stimmen und war während der ersten 5 Monaten
der Laufzeit sehr kritisch. Es gab sehr viele Momente wo ich abbrechen wollte. Dann merkte ich durch
Überprüfungen einer parallel laufenden Liste ...

Mein Gott, das ist fast alles gleich hinsichtlich Elo und in der parallel laufenden Liste spielen nur die spielstärksten
Engines gegeneinander. Dann habe ich meine alten Ratinglisten betrachtet, wo seinerzeit z. B. Spark, Rybka etc.
gespielt haben. Und wieder die Überraschung, auch die Ausgaben in Elo für den unteren Teil stimmen bzw. liegt
im Rahmen der ErrorBar der Listen von früher.

Dieses Experiment ETOC-G ist aus unzähligen Gründen super interessant.
Teils wurde mein Wissen über sicher geglaubte Dinge völlig über Board geworfen.
Und so richtig glauben kann ich das bis jetzt nicht, ich schimpfe ETOC-G für mich immer "Zauberliste".
Also, meine kleine "Zauberliste".

Wäre ich bei solchen Experimenten nur früher schon mal so mutig gewesen.
Hätte ich in den all den Jahren vielleicht mehr feststellen können!!


ETOC-G ist gar die genaueste Ratingliste die ich je erstellt habe und zur Zeit denke ich, dass je geringer
die Remisquote ist, desto schneller und geanuer wird eine Ratingliste. Völlig entgegengesetzt von meinem
eigenen bisherigen Wissen. Über Ratinglisten wurde im CSS-Forum in früheren Zeiten unzählig oft diskutiert.
Viele können sich daran vielleicht noch erinnern!
Parent - By Frank Quisinsky Date 2026-08-27 02:55
Ich schrieb ja ...

Zwar gab es viele Experimente zu ETOC-G im Vorfeld aber tatsächlich ist das Entstandene
ein Zufallsprodukt. Das Ziel war eine einfache Aufteilung der TOP-250 in 20 Spielstärkegruppen
zwecks besserer Darstellung meiner Engine-Übersicht. Da boten sich die militärischen Ränge
ganz gut an.
Parent - - By Frank Quisinsky Date 2026-08-25 12:55 Edited 2026-08-25 13:04
Hier der Link zum Live Test-Run:
https://www.amateurschach.de/fling/etoc-g_t238.html

85% = 4-Sterne General ... wird nicht passieren!

Code:

                                         points   1:0 1/2   0:1     %   m-avg     1/0<45       rk
--------------------------------------------------------------------------------------------------  3-Stars Generals (08)
001. PlentyChess 8.0.0                   1.087,5   875 425     0   83,65   75   21/  0  + 21   03#
002. Reckless 0.10.0 260501 dev          1.086,0   873 426     1   83,54   86   26/  0  + 26   03#
003. Stockfish 260706 dev                1.084,5   869 431     0   83,42   80   19/  0  + 19   03#
---. Stockfish 18 JA                     1.084,0   870 428     2   83,38   81   19/  0  + 19   ---
---. Stockfish 17.1 JA                   1.081,0   862 438     0   83,15   78   21/  0  + 21   ---
---. Reckless 0.9.0                      1.079,5   859 441     0   83,04   75   34/  0  + 34   ---
004. Triumviratus 6.0 AI                 1.072,5   848 449     3   82,50   85   14/  0  + 14   03#
005. Berserk 250622 CE dev               1.070,0   842 456     2   82,31   86   18/  0  + 18   03#
006. Coda 0.9.3 AI                       1.068,0   838 461     1   82,19   82    5/  0  +  5   03#
---. PlentyChess 7.0.37 Pre              1.067,5   838 459     3   82,12   74   17/  0  + 17   ---
007. Viridithas 20.0.0                   1.067,5   838 459     3   82,12   81    8/  0  +  8   03#
008. Raphael 4.3.0 260705 Pre            1.067,5   837 461     2   82,12   80   33/  0  + 33   03#


Das ist der erlesene Club der 3-Sterne Generäle (82,00% - 84,99%)
Mehr als 83,65% und der Platz an der Sonne winkt, der dann aber sicherlich nur von kurzer Dauer ist.

Wir wollen hüpfen ... Erbsen zählen!
Mit dem Pusterohr schießen und auf Zufälle hoffen!
Parent - - By Frank Quisinsky Date 2026-08-26 06:27
Coda legt so langsam los ...
82,93 nach 574 Partien!
Parent - - By Frank Quisinsky Date 2026-08-27 05:50 Edited 2026-08-27 06:26
Hallo,

das wurde dann Platz 5.
Auffällig ist das im Vergleich Coda 0.9.4 AI zu Coda 0.9.3 AI jede Partie 9 Züge ohne Aufgabefaktor länger lief.
Auch die wenigen schnellen Gewinnpartien fallen ins Auge.

Das Ergebnis aus KI generiert.

Generell ist bekannt das neue Ideen mittels KI nicht wirklich generiert werden.
So mehr oder weniger, KI ist ein fantasieloses, eher ideenloses, Gebilde aus bekannten Daten.

Irgendwie bildet sich das aus diesen beiden Stats ab.
Sonst kann ich nicht viel zu Coda sagen, habe bei keiner Partie zugeschaut ... tue ich mir nicht an.
Keine Ahnung, bin auch kein KI Experte, will es auch nicht werden.

Wer will kann sich die Partien natürlich ansehen!

Die ganzen Daten liegen auf der ETOC-G Seite:
https://www.amateurschach.de/main/_etoc-g.htm

Es folgen nun eine Reihe von Engines die spielstark sind und wahrscheinlich in den TOP-100 liegen (bis auf wenige Ausnahmen).

Die letzte Engine, die ich mittels der ETOC-G Idee testen werde, wird die dann aktuelle Version von Stockfish sein.
ENDE von ETOC-G dann ca. um den 25.09., vielleicht ein paar Tage später, spätestens am 30.09.2026.


Also, Ursus (eine neue Engine) folgt.
Dann die Rodent IV, V, und Publius Versionen von Pawel und Mitwirkende.
Eine Engine aus Island (Seawall), die wahrscheinlich die 10% bei ETOC-G nur knacken könnte, durch den JA Booster.
Dat will ich sehen ...

Seawall muss dann zittern wenn es gegen Spark und Hakkapeliitta geht, also die beiden "Spielschwächeren" der 26-Standard-Engines.
Spark war mal auf Platz 8 und in seiner Zeit (um 2010) die aggressivste Engine!
Noch gar nicht so lange her als wir Spark von Allard Siemelink (Niederlande) gefeiert haben.

Hakkapeliitta hatte auch oft so komische Anwandlungen wie Spark, spielte sehr oft mega aggressiv.

Selbst Gaia 4.2.2 (stärkster Colonel) musste eine sehr schnelle Verlustpartie gegen Hakkapeliitta TCEC v2 hinnehmen (die liegen schlappe 586 Elo auseinander).

Die ETOC-G Datenbank enthält also richtig geile Daten!
Geiles Zeug ... viel Analysematerial, super schöne Mattkombinationen etc..
Brauchbares Zeug für Verbesserungen von meinem Eröffnungsbuch, wenn ich Bock darauf habe.

Gruß
Frank
Parent - - By Frank Quisinsky Date 2026-08-27 09:54 Edited 2026-08-27 10:29
Habe mir ein paar Stats von Coda 0.9.4 AI näher angesehen.

Eigentlich unglaublich was die Engine so treibt.

Keine Partien mit Remis unter 20 Zügen, sehr wenige kurze Remis-Partien darüber.
Kaum Partien über 200 Züge.

Alleine das ist sehr ungewöhnlich!
Dennoch ein sehr hoher Zügedurchschnitt mit über 90 Züge.

Wo kommt der her?
Sämtliche TOPs mal in eine Datenbank und dann wie früher ausgewertet nach Partiephase ...

Die Engine hat unglaubliche Werte in der dritten Partiephase (früher hatte ich in vier aufgeteilt).
Also, der Übergang zum Endspiel.

Nichts aber gar nichts wird Remis gegeben, es sei denn Bauernstruktren sehen nicht gut aus. Besonders die
verbundenen aber rückständigen Bauern. Sieht etwas tod Remis aus, wird ganz schnell abgewickelt. Aber ist da
nur der Hauch einer Chance wird kein Cent verschenkt.

Auch wann und wie Schwerfiguren, Leichtfiguren abgetauscht werden. Erst wird es vermieden und plötzlich steht
ein gegnerischer Bauer zu weit vorne, wird der Abtausch gesucht.

Wenn denn Bauernstrukturen im frühen Mittelspiel nicht gut aussehen, wird knallhart auf schnelles Remis gespielt.
Nach dem Motto, ich spare mir den Rest der Züge, blos keine Partie womöglich noch verlieren!

Also, wenn das die Zukunft ist?!
Da ist kaum was drin wo Zusehen richtig Spaß macht.
Ich verstehe diese Geschichten schachlich auch kaum, sehe nur anhand von Stats.

Offene Linien nach der Eröffnung:
Es wird eher so gespielt, dass Figuren auf bessere Felder gebracht werden, ohne irgend eine Linie freiwillig zu
öffnen. Das erklärt auch die wenigen schnellen Gewinne gegen deutlich schwächer.

Besonders interessant dabei die Partien gegen SmarThink.
SmarThink ist für seine Spielstärke ein Endspielkünstler und spielt die Partiephase recht gut. Taktisch ist
SmarThink sehr anfällig. Coda nutzt diese Schwäche gar nicht aus, tut sich oft schwer gegen SmarThink aber
überrechnet die russische Engine mit einfach aussehenden Züge, die nicht einfach zu finden sind. Die sehen
eher komisch aus.

Karpov würde mit Coda seine helle Freude haben.
Der hat auch so unglaubliche positionelle Manöver gespielt.

Mit dieser Spielweise hat Coda 0.9.4 AI keine einzige Partie von den 1.300 verloren.
Diese Engine stellt vieles Absdurdum und hat auch noch Erfolg damit.
Parent - By Frank Quisinsky Date 2026-08-27 10:13 Edited 2026-08-27 10:27
Wer den krassen Gegensatz sucht, sollte Coda 0.9.4 AI mal gegen Patricia 5 oder jetzt 5.1 ein 500 Partien Zweikampf spielen lassen.
Nimmt ein nomales ausgeglichenes Buch, sonst fallen diese Dinge nicht auf. Nach dem Motto ... was macht eine so krasse Engine
wie Coda mit bekannten Angreifern. Achtet auf die Bauerstrukturen von Coda, auf die Umgruppierungen von Leicht- und
Schwerfiguren, wann diese abgetausch werden oder wann der Abstausch vermieden wird. Krass ...

Also, das läuft hier gerade ...
Jetzt ist mein Interesse doch geweckt!!
Mal den Forscherdrang auf "on" setzen.
Up Topic Hauptforen / CSS-Forum / Wer noch Bock hat ... Coda 0.9.4 AI wird um Platz 1 kämpfen!

Powered by mwForum 2.29.3 © 1999-2014 Markus Wichitill