Overview
产品概述
Capabilities
核心能力
本地模型推理
仓库提供最小示例,可在 PyTorch/CUDA 环境中通过 torchrun 运行对话补全等推理脚本,并支持调整 max_seq_len、max_batch_size 等参数。
模型权重与起始代码
发布内容包含 7B 到 70B 参数的预训练和微调 Llama 语言模型权重及起始代码。
多途径模型下载
可通过 Meta 网站接受许可后下载权重和 tokenizer,也可在 Hugging Face 上申请访问相应模型。
Use Cases
适用场景
-
01
快速开始本地推理
用户按照 Quick Start 步骤下载模型后,可在本地运行 Llama 2 模型推理,适合快速体验。
-
02
面向研究者与企业的实验创新
Llama 2 向个人、创作者、研究人员和各类规模企业开放,以支持实验、创新和负责任的规模扩展。
Integrations
集成能力
Hugging Face
可通过 Hugging Face 模型卡填写许可声明并申请访问 Llama 模型下载。