Benchmarks and evaluation
AI milestones in benchmarks and evaluation, part of ai research.
2 milestones
OpenAI Released OpenAI Gym, a Toolkit for Reinforcement Learning Research
In April 2016, OpenAI publicly released OpenAI Gym, an open-source toolkit providing a standardised collection of environments for developing and benchmarking reinforcement learning algorithms, lowering the barrier to reproducible RL research.
ImageNet: a large-scale hierarchical image database for object recognition
Researchers led by Li Fei-Fei introduced ImageNet, a dataset organised around more than 100,000 concept categories and aimed at providing roughly 1,000 human-annotated images per category, on which the ILSVRC challenge was later built.