Docs for meta-reference-gpu

2025-12-18 19:09:47 +00:00 · 2024-11-18 13:58:12 -08:00 · 2024-11-18 13:58:12 -08:00 · dd732f037f
commit dd732f037f
parent 38563d7c00
9 changed files with 374 additions and 101 deletions
--- a/llama_stack/providers/inline/inference/meta_reference/config.py
+++ b/llama_stack/providers/inline/inference/meta_reference/config.py
@ -49,6 +49,18 @@ class MetaReferenceInferenceConfig(BaseModel):
        resolved = resolve_model(self.model)
        return resolved.pth_file_count

+    @classmethod
+    def sample_run_config(
+        cls,
+        model: str = "Llama3.2-3B-Instruct",
+        checkpoint_dir: str = "${env.CHECKPOINT_DIR:null}",
+    ) -> Dict[str, Any]:
+        return {
+            "model": model,
+            "max_seq_len": 4096,
+            "checkpoint_dir": checkpoint_dir,
+        }
+

 class MetaReferenceQuantizedInferenceConfig(MetaReferenceInferenceConfig):
    quantization: QuantizationConfig