O componente de banco de dados de vetores do BabyAGI armazena os registros e resultados de tarefas concluídas e funciona como a memória do agente. O BabyAGI pode usar os resultados da primeira tarefa para informar a segunda tarefa e itera esse processo à medida que avança na lista de tarefas.
Os bancos de dados de vetores armazenam dados como representações matemáticas chamadas embeddings. Pontos de dados que estão mais próximos uns dos outros no espaço vetorial de alta dimensão são considerados mais semanticamente semelhantes. O BabyAGI usa pesquisa semântica para encontrar informações relevantes no banco de dados.
A implementação canônica usa o Pinecone, mas armazenamentos de vetores alternativos, como o Facebook IA Similarity Search (FAISS) da Meta e o Chroma, às vezes, são usados em variantes ou forks. O FAISS e o Chroma são de código aberto, enquanto o Pinecone, como muitos produtos da OpenAI, não é.