Ein achtköpfiges Team unter der Leitung von Yijun Pan aus der Accio-Sparte der Alibaba Group baute in Zusammenarbeit mit der Yale University einen simulierten Marktplatz auf und setzte fünfzehn der besten Sprachmodelle als Ladenbesitzer ein. Jedes Modell erhielt ein Startkapital von 80.000 Dollar und dreißig simulierte Tage, um es zu vermehren. Das durchschnittliche Endvermögen reichte von knapp 21.000 Dollar beim Modell MiniMax M2.5 bis zu mehr als 188.000 Dollar bei Gemini 3.1 Pro, was einem fast neunfachen Unterschied entspricht. Mehr als die Hälfte aller Simulationen endete mit einem Verlust, und nur vier Modelle konnten ihr Startkapital in jedem einzelnen Durchlauf bewahren. Die Autoren veröffentlichten die Arbeit auf der Plattform arXiv.
Warum KI ausgerechnet beim Handel testen?
Ein Marktplatz auf Grundlage realer Daten von Alibaba
Handelsergebnisse der Modelle



