test text-embedding-ada-002

This commit is contained in:
Ishaan Jaffer 2025-09-27 12:41:35 -07:00
parent c27beb74b9
commit 6aa35ec999
14 changed files with 30 additions and 31 deletions

View File

@ -1627,7 +1627,7 @@ def test_get_cache_key():
embedding_cache_key = cache_instance.get_cache_key(
**{
"model": "azure/azure-embedding-model",
"model": "azure/text-embedding-ada-002",
"api_base": "https://openai-gpt-4-test-v-1.openai.azure.com/",
"api_key": "",
"api_version": "2023-07-01-preview",
@ -1642,19 +1642,19 @@ def test_get_cache_key():
print(embedding_cache_key)
embedding_cache_key_str = (
"model: azure/azure-embedding-modelinput: ['hi who is ishaan']"
"model: azure/text-embedding-ada-002input: ['hi who is ishaan']"
)
hash_object = hashlib.sha256(embedding_cache_key_str.encode())
# Hexadecimal representation of the hash
hash_hex = hash_object.hexdigest()
assert (
embedding_cache_key == hash_hex
), f"{embedding_cache_key} != 'model: azure/azure-embedding-modelinput: ['hi who is ishaan']'. The same kwargs should have the same cache key across runs"
), f"{embedding_cache_key} != 'model: azure/text-embedding-ada-002input: ['hi who is ishaan']'. The same kwargs should have the same cache key across runs"
# Proxy - embedding cache, test if embedding key, gets model_group and not model
embedding_cache_key_2 = cache_instance.get_cache_key(
**{
"model": "azure/azure-embedding-model",
"model": "azure/text-embedding-ada-002",
"api_base": "https://openai-gpt-4-test-v-1.openai.azure.com/",
"api_key": "",
"api_version": "2023-07-01-preview",
@ -1689,7 +1689,7 @@ def test_get_cache_key():
"content-length": "80",
},
"model_group": "EMBEDDING_MODEL_GROUP",
"deployment": "azure/azure-embedding-model-ModelID-azure/azure-embedding-modelhttps://openai-gpt-4-test-v-1.openai.azure.com/2023-07-01-preview",
"deployment": "azure/text-embedding-ada-002-ModelID-azure/text-embedding-ada-002https://openai-gpt-4-test-v-1.openai.azure.com/2023-07-01-preview",
},
"model_info": {
"mode": "embedding",

View File

@ -283,7 +283,7 @@ def test_cost_azure_embedding():
async def _test():
response = await litellm.aembedding(
model="azure/azure-embedding-model",
model="azure/text-embedding-ada-002",
input=["good morning from litellm", "gm"],
)

View File

@ -15,7 +15,7 @@ model_list:
api_key: bad-key
- model_name: azure-embedding
litellm_params:
model: azure/azure-embedding-model
model: azure/text-embedding-ada-002
api_base: os.environ/AZURE_API_BASE
api_key: bad-key

View File

@ -52,7 +52,7 @@ model_list:
api_base: os.environ/AZURE_API_BASE
api_key: os.environ/AZURE_API_KEY
api_version: 2023-07-01-preview
model: azure/azure-embedding-model
model: azure/text-embedding-ada-002
model_info:
mode: embedding
model_name: azure-embedding-model
@ -105,7 +105,7 @@ model_list:
api_base: os.environ/AZURE_API_BASE
api_key: os.environ/AZURE_API_KEY
api_version: 2023-07-01-preview
model: azure/azure-embedding-model
model: azure/text-embedding-ada-002
model_info:
base_model: text-embedding-ada-002
mode: embedding

View File

@ -11,7 +11,7 @@ model_list:
id: gm
- model_name: azure-embedding-model
litellm_params:
model: azure/azure-embedding-model
model: azure/text-embedding-ada-002
api_base: os.environ/AZURE_API_BASE
api_key: os.environ/AZURE_API_KEY
api_version: "2023-07-01-preview"

View File

@ -774,8 +774,7 @@ async def test_async_embedding_openai():
customHandler_failure = CompletionCustomHandler()
litellm.callbacks = [customHandler_success]
response = await litellm.aembedding(
model="azure/azure-embedding-model", input=["good morning from litellm"]
)
model="azure/text-embedding-ada-002",
await asyncio.sleep(1)
print(f"customHandler_success.errors: {customHandler_success.errors}")
print(f"customHandler_success.states: {customHandler_success.states}")
@ -811,7 +810,7 @@ def test_amazing_sync_embedding():
customHandler_failure = CompletionCustomHandler()
litellm.callbacks = [customHandler_success]
response = litellm.embedding(
model="azure/azure-embedding-model", input=["good morning from litellm"]
model="azure/text-embedding-ada-002", input=["good morning from litellm"]
)
print(f"customHandler_success.errors: {customHandler_success.errors}")
print(f"customHandler_success.states: {customHandler_success.states}")
@ -823,7 +822,7 @@ def test_amazing_sync_embedding():
litellm.callbacks = [customHandler_failure]
try:
response = litellm.embedding(
model="azure/azure-embedding-model",
model="azure/text-embedding-ada-002",
input=["good morning from litellm"],
api_key="my-bad-key",
)
@ -846,7 +845,7 @@ async def test_async_embedding_azure():
customHandler_failure = CompletionCustomHandler()
litellm.callbacks = [customHandler_success]
response = await litellm.aembedding(
model="azure/azure-embedding-model", input=["good morning from litellm"]
model="azure/text-embedding-ada-002", input=["good morning from litellm"]
)
await asyncio.sleep(1)
print(f"customHandler_success.errors: {customHandler_success.errors}")
@ -858,7 +857,7 @@ async def test_async_embedding_azure():
litellm.callbacks = [customHandler_failure]
try:
response = await litellm.aembedding(
model="azure/azure-embedding-model",
model="azure/text-embedding-ada-002",
input=["good morning from litellm"],
api_key="my-bad-key",
)

View File

@ -107,7 +107,7 @@ def test_openai_embedding_3():
@pytest.mark.parametrize(
"model, api_base, api_key",
[
# ("azure/azure-embedding-model", None, None),
# ("azure/text-embedding-ada-002", None, None),
("together_ai/togethercomputer/m2-bert-80M-8k-retrieval", None, None),
],
)
@ -253,7 +253,7 @@ async def test_azure_ai_embedding_image(model, api_base, api_key, sync_mode):
def test_openai_azure_embedding_timeouts():
try:
response = embedding(
model="azure/azure-embedding-model",
model="azure/text-embedding-ada-002",
input=["good morning from litellm"],
timeout=0.00001,
)
@ -301,7 +301,7 @@ def test_openai_azure_embedding():
os.environ["AZURE_API_KEY"] = ""
response = embedding(
model="azure/azure-embedding-model",
model="azure/text-embedding-ada-002",
input=["good morning from litellm", "this is another item"],
api_key=api_key,
api_base=api_base,
@ -726,7 +726,7 @@ def test_aembedding_azure():
async def embedding_call():
try:
response = await litellm.aembedding(
model="azure/azure-embedding-model",
model="azure/text-embedding-ada-002",
input=["good morning from litellm", "this is another item"],
)
print(response)
@ -1099,7 +1099,7 @@ async def test_lm_studio_embedding(monkeypatch, sync_mode):
"model",
[
"text-embedding-ada-002",
"azure/azure-embedding-model",
"azure/text-embedding-ada-002",
],
)
def test_embedding_response_ratelimit_headers(model):

View File

@ -282,7 +282,7 @@ def test_azure_embedding_exceptions():
try:
response = litellm.embedding(
model="azure/azure-embedding-model",
model="azure/text-embedding-ada-002",
input="hello",
mock_response="error",
)

View File

@ -51,7 +51,7 @@
# {
# "model_name": "text-embedding-ada-002",
# "litellm_params": {
# "model": "azure/azure-embedding-model",
# "model": "azure/text-embedding-ada-002",
# "api_key": os.environ["AZURE_API_KEY"],
# "api_base": os.environ["AZURE_API_BASE"],
# },

View File

@ -239,7 +239,7 @@ def test_sync_fallbacks_embeddings():
{ # list of model deployments
"model_name": "bad-azure-embedding-model", # openai model name
"litellm_params": { # params for litellm completion/embedding call
"model": "azure/azure-embedding-model",
"model": "azure/text-embedding-ada-002",
"api_key": "bad-key",
"api_version": os.getenv("AZURE_API_VERSION"),
"api_base": os.getenv("AZURE_API_BASE"),
@ -289,7 +289,7 @@ async def test_async_fallbacks_embeddings():
{ # list of model deployments
"model_name": "bad-azure-embedding-model", # openai model name
"litellm_params": { # params for litellm completion/embedding call
"model": "azure/azure-embedding-model",
"model": "azure/text-embedding-ada-002",
"api_key": "bad-key",
"api_version": os.getenv("AZURE_API_VERSION"),
"api_base": os.getenv("AZURE_API_BASE"),

View File

@ -503,7 +503,7 @@ async def test_async_embedding_azure():
{
"model_name": "azure-embedding-model", # openai model name
"litellm_params": { # params for litellm completion/embedding call
"model": "azure/azure-embedding-model",
"model": "azure/text-embedding-ada-002",
"api_key": "my-bad-key",
"api_version": os.getenv("AZURE_API_VERSION"),
"api_base": os.getenv("AZURE_API_BASE"),

View File

@ -15,7 +15,7 @@ model_list:
api_key: bad-key
- model_name: azure-embedding
litellm_params:
model: azure/azure-embedding-model
model: azure/text-embedding-ada-002
api_base: os.environ/AZURE_API_BASE
api_key: bad-key

View File

@ -52,7 +52,7 @@ model_list:
api_base: os.environ/AZURE_API_BASE
api_key: os.environ/AZURE_API_KEY
api_version: 2023-07-01-preview
model: azure/azure-embedding-model
model: azure/text-embedding-ada-002
model_info:
mode: embedding
model_name: azure-embedding-model
@ -105,7 +105,7 @@ model_list:
api_base: os.environ/AZURE_API_BASE
api_key: os.environ/AZURE_API_KEY
api_version: 2023-07-01-preview
model: azure/azure-embedding-model
model: azure/text-embedding-ada-002
model_info:
base_model: text-embedding-ada-002
mode: embedding

View File

@ -541,14 +541,14 @@ def test_embedding(mock_aembedding, client_no_auth):
try:
test_data = {
"model": "azure/azure-embedding-model",
"model": "azure/text-embedding-ada-002",
"input": ["good morning from litellm"],
}
response = client_no_auth.post("/v1/embeddings", json=test_data)
mock_aembedding.assert_called_once_with(
model="azure/azure-embedding-model",
model="azure/text-embedding-ada-002",
input=["good morning from litellm"],
specific_deployment=True,
metadata=mock.ANY,