Databricks je interno ocijenio učinkovitost kodnih agenata na stvarnim zadacima svojih inženjera na kodu veličine milijuna redaka. Istraživanje je pokazalo kako se modeli i alati grupiraju u tri razine sposobnosti, pri čemu skuplji modeli nisu uvijek nužni za svakodnevne zadatke.