Llama 3.1 发布:405B、70B、8B 三个尺寸,主打多语言和长上下文
Meta 在 Hugging Face 上放出了 Llama 3.1,一共三个尺寸:8B、70B 和 405B。8B 适合在消费级显卡上跑,70B 给大规模 AI 应用,405B 主要用来做合成数据、让模型当裁判或者蒸馏小模型。每个尺寸都有基础版和指令微调版。这次还多了两个安全模型:Prompt Guard 是个小分类器,用来检测提示注入和越狱攻击。
推荐理由:Meta 在 Hugging Face 放出 Llama 3.1 的 8B、70B、405B 三个尺寸,405B 的用途是合成数据、模型裁判和蒸馏小模型,为关注开源模型分工的人提供一份具体参照。