> 数据图表如何才能3.4、Meta:Llama3.3提升后训练实现低成本高性能、智能体生态加速构建2025-4-13.4、Meta:Llama3.3提升后训练实现低成本高性能、智能体生态加速构建Llama3.1:2024年7月24日,Llama推出Llama3.1 405B,同时发布了全新升级的Llama 3.1 70B和8B模型。Llama 3.1 405B支持上下文长度为128K Tokens,在基于15万亿个Tokens、超1.6万个H100 GPU上进行训练;同时Llama 3.1 将模型从BF16量化为FP8。Llama3.2:2024年9月26日,Llama3.2发布,包括110亿和900亿参数的多模态版本10亿参数和30亿参数的轻量级纯文本模型;而专为端侧打造的3B版本,在性能测试中表现也优于谷歌的Gemma 2 2B和微软的Phi 3.5-mini。Llama3.3:2024年12月,Llama3.3发布,70B版本就能实现Llama3.1 405B的性能。同时Llama3.3推理部署成本出现大幅下降,输入成本降低了 10 倍,输出成本降低了近 5 倍。Llama 3.3 采用优化的 transformer 架构,融合了SFT和RLHF等技术,支持 128K tokens的上下文长度。在多个行业基准测试中,Llama-3.3-70B 的表现超过了谷歌的 Gemini 1.5 Pro、OpenAI 的 GPT-4o 和亚马逊的 Nova Pro。智能体生态构建:基于 Llama 的智能体项目(如 Meta Live)已实现实时语音交互、跨设备协作(如雷朋眼镜集成),定位为 “个人数码助手”。未来计划通过多模态输入(摄像头、传感器)和端云协同,构建具备规划、记忆和环境交互能力的通用智能体。图:Llama3.1测评图:Llama3.3测评资料来源:智东西公众号、量子位公众号请务必阅读报告附注中的风险提示和免责声明 42国海证券综合其他