diff --git a/.env.example b/.env.example index bebc74f..3f5dd83 100644 --- a/.env.example +++ b/.env.example @@ -99,6 +99,6 @@ VLM_FORCE_MOCK=false VLM_SNAPSHOT_ASSIST_ENABLED=true AI_SERVICE_TOKEN=change-me-same-as-strange-back # GEMINI_MODEL=gemini-2.5-flash -# GEMINI_EMBEDDING_MODEL=text-embedding-004 +# GEMINI_EMBEDDING_MODEL=gemini-embedding-001 # AI_INTERNAL_VLM_ENABLED=true # AI_INTERNAL_VLM_PORT=8091 diff --git a/ai/embedding_sdk.py b/ai/embedding_sdk.py index 1560301..dbb78e4 100644 --- a/ai/embedding_sdk.py +++ b/ai/embedding_sdk.py @@ -90,7 +90,7 @@ class GeminiEmbeddingProvider: def __init__( self, api_key: str, - model: str = "text-embedding-004", + model: str = "gemini-embedding-001", *, timeout_sec: float = 30.0, max_attempts: int = 3, @@ -200,7 +200,7 @@ def resolve_provider(provider_name: str | None = None, api_key: str | None = Non raise key = api_key if api_key is not None else os.getenv("GEMINI_API_KEY", "") if resolved == "gemini": - model = os.getenv("GEMINI_EMBEDDING_MODEL", os.getenv("VLM_QUERY_EMBEDDING_MODEL", "text-embedding-004")) + model = os.getenv("GEMINI_EMBEDDING_MODEL", os.getenv("VLM_QUERY_EMBEDDING_MODEL", "gemini-embedding-001")) timeout = _environment_float("EMBEDDING_TIMEOUT_SEC", 30.0) attempts = _environment_int("EMBEDDING_MAX_ATTEMPTS", 3) return GeminiEmbeddingProvider(api_key=key, model=model, timeout_sec=timeout, max_attempts=attempts)