Importante

Você está vendo a versão anterior da nova experiência da Alura que estamos preparando para você. Em breve, ela ganha uma identidade visual novinha totalmente pensada em potencializar seus estudos!

1
resposta

[Bug] A parte de cache emebeddings precisa de novo código no colab abaixo coloco o que funcionou pra mim

no item 2. Caching de Embeddings: Economia e Velocidade


# Instalação
!pip install -U langchain langchain-core langchain-classic langchain-google-genai

trocar os namespaces para langchain_classic

from langchain_classic.embeddings import CacheBackedEmbeddings
from langchain_classic.storage import LocalFileStore


# Diretório onde os embeddings serão armazenados
store = LocalFileStore("./cache/")


# Embedding principal
embedder_principal = GoogleGenerativeAIEmbeddings(
    model="gemini-embedding-001"
)


# Embedding com cache
cache_embeddings = CacheBackedEmbeddings.from_bytes_store(
    embedder_principal,
    store,
    namespace="gemini_cache"
)
# Configura o armazenamento local no disco do Colab
store = LocalFileStore("./cache/")

# Inicializa o modelo de embeddings do Gemini
embedder_principal = GoogleGenerativeAIEmbeddings(
    model="gemini-embedding-001"
)

# Cria o gerenciador de cache  aqui foi trocado também
cache_embeddings = CacheBackedEmbeddings.from_bytes_store(
    embedder_principal,
    store,
    namespace="gemini_cache"
)
textos_para_cache = ["Olá, mundo!", "Testando o cache de embeddings.", "Olá, mundo!"]

start_time = time.time()
embeddings_result_1 = cache_embeddings.embed_documents(textos_para_cache)
end_time = time.time()

print(f"  - Tempo de execução: {end_time - start_time:.4f} segundos.")
1 resposta

Oi, Marcelo.Tudo bem?

Compartilhar o seu código para otimizar o desempenho do cache em embeddings ajuda muito quem está passando por essa mesma situação nos estudos de tecnologia.

Ajustar os namespaces e atualizar as importações garante que o script funcione corretamente no ambiente de execução. Como dica, vale a pena verificar se o diretório local de armazenamento está sendo limpo periodicamente para evitar consumo excessivo de espaço durante projetos maiores.

Qual outra estratégia de otimização você costuma utilizar nos seus projetos com inteligência artificial?

Alura Conte com o apoio da comunidade Alura na sua jornada. Abraços e bons estudos!