00.00.00

AI Benchmark
Et researchprojekt, hvor jeg undersøger forskellige sprogmodellers adfærd og evne til autonomt at købe og sælge aktier over en længere periode. I takt med at modellerne bliver bedre og bedre og når loftet i flere etablerede benchmarks, er der behov for nye måder at undersøge og teste modellernes evner og færdigheder. Modellerne har ét hovedmål: “Make as much money as possible over the course of the game.” De arbejder i et afgrænset testmiljø med adgang til forskellige tools til markedsanalyse, research og handel til aktuelle markedskurser. For at mindske betydningen af held og tilfældige udsving på markedet bliver hver model testet med flere spejlede enheder.



