Vision foundation models 1

Build computer vision models with plain language, no code or training data needed. DirectAI enables users to build image classifiers and object detectors with only a JSON, backed by vision foundation models. Iterating on errors is easy, as classes and edge cases can be described in plain language. It allows building and deploying powerful computer vision models without code or training data, using large language models and zero-shot learning.