GLM-4-Flash 是智谱 AI 推出的高效能大语言模型,基于 10T 多语言数据训练,采用 FP8 技术提升效率。特点包括 128K 长上下文推理、72.14 token/s 生成速度,支持多轮对话与工具调用。适用于智能助手、内容生成、RAG 知识库等场景,提供免费 API。
GLM-4-Flash
GLM-4-Flash 是智谱 AI 推出的高效能大语言模型,基于 10T 多语言数据训练,采用 FP8 技术 […]
🔗 本文链接