llama-stack

forked from phoenix-oss/llama-stack-mirror

History

Ashwin Bharambe 81ce39a607 feat(api): Add options for supporting various embedding models (#1192 ) We need to support: - asymmetric embedding models (#934) - truncation policies (#933) - varying dimensional output (#932) ## Test Plan ```bash $ cd llama_stack/providers/tests/inference $ pytest -s -v -k fireworks test_embeddings.py \ --inference-model nomic-ai/nomic-embed-text-v1.5 --env EMBEDDING_DIMENSION=784 $ pytest -s -v -k together test_embeddings.py \ --inference-model togethercomputer/m2-bert-80M-8k-retrieval --env EMBEDDING_DIMENSION=784 $ pytest -s -v -k ollama test_embeddings.py \ --inference-model all-minilm:latest --env EMBEDDING_DIMENSION=784 ```		2025-02-20 22:27:12 -08:00
..
bedrock	feat(api): Add options for supporting various embedding models (#1192 )	2025-02-20 22:27:12 -08:00
cerebras	feat(api): Add options for supporting various embedding models (#1192 )	2025-02-20 22:27:12 -08:00
databricks	feat(api): Add options for supporting various embedding models (#1192 )	2025-02-20 22:27:12 -08:00
fireworks	feat(api): Add options for supporting various embedding models (#1192 )	2025-02-20 22:27:12 -08:00
groq	feat(api): Add options for supporting various embedding models (#1192 )	2025-02-20 22:27:12 -08:00
nvidia	feat(api): Add options for supporting various embedding models (#1192 )	2025-02-20 22:27:12 -08:00
ollama	feat(api): Add options for supporting various embedding models (#1192 )	2025-02-20 22:27:12 -08:00
passthrough	feat(api): Add options for supporting various embedding models (#1192 )	2025-02-20 22:27:12 -08:00
runpod	feat(api): Add options for supporting various embedding models (#1192 )	2025-02-20 22:27:12 -08:00
sambanova	feat(api): Add options for supporting various embedding models (#1192 )	2025-02-20 22:27:12 -08:00
sample	build: format codebase imports using ruff linter (#1028 )	2025-02-13 10:06:21 -08:00
tgi	feat(api): Add options for supporting various embedding models (#1192 )	2025-02-20 22:27:12 -08:00
together	feat(api): Add options for supporting various embedding models (#1192 )	2025-02-20 22:27:12 -08:00
vllm	feat(api): Add options for supporting various embedding models (#1192 )	2025-02-20 22:27:12 -08:00
__init__.py	`impls` -> `inline`, `adapters` -> `remote` (#381 )	2024-11-06 14:54:05 -08:00