文本生成/大模型 (14 个模型)
GPT-4.1 Mini
GPT-4.1 mini 是 OpenAI 推出的中小型多模态模型,支持百万 token 上下文,可处理文本、图像及视频。性能媲美 GPT-4o,MMMU 测试得分 73% 超前代,延迟降半、成本减 83%。
Gemini 2.0 Flash Lite
Gemini 2.0 Flash Lite 是 Gemini 2.0 系列中速度最快的模型,主打成本效益与低延迟,支持多模态输入(图片、文档、音频)。
Grok 4 Fast
Grok 4 Fast 是 xAI 于 2025 年推出的轻量版本,主打高速推理与成本优化,75 token/s 生成速度,200 万 token 超长上下文。
o3-mini
OpenAI o3-mini 是 2025 年 1 月推出的小型推理模型,定位 STEM 领域专业方案,支持函数调用、结构化输出,提供低/中/高推理级别以平衡精度与效率。
Claude 3 Opus
Claude 3 Opus 是 Anthropic 顶级大模型,具备多模态能力,支持 20 万 Token 上下文窗口,MMLU、GPQA 等基准测试表现领先。
Gemini 2.0 Flash
Gemini 2.0 Flash 是谷歌多模态 AI 模型,具备文本理解、图像生成与编辑能力,支持 100 万 token 上下文,响应速度比 1.5 Pro 快两倍。
Claude Haiku 4.5
Claude Haiku 4.5 是 Anthropic 小型混合推理模型,性能接近 Sonnet 4,成本仅 1/3,推理速度提升超两倍,支持 20 万 token 上下文。
Gemini 2.5 Flash
Gemini 2.5 Flash 是谷歌多模态轻量级模型,支持文本、图像、音频、视频输入,具备自适应推理能力,token 使用效率提升 20-30%。
Claude Sonnet 4.5
Claude Sonnet 4.5 是 Anthropic 中端平衡型模型,编程能力突出,SWE-bench Verified 得分 77.2%,支持连续编程超 30 小时。
Claude 3 Sonnet
Claude 3 Sonnet 是 Anthropic 推出的大语言模型,属 Claude 3 系列中端型号,平衡能力与速度,适用企业级应用。2 倍速于前代,高可控性,支持内容生成、分类、数据提取、知识检索等,已在 API 及 Amazon Bedrock 上线。
Gemini 2.5 Flash Lite
Gemini 2.5 Flash-Lite 是谷歌推出的轻量级 AI 推理模型(预览版),主打极速响应与成本优化,为当前速度最快的 Gemini 模型。支持多模态输入、100 万 token 上下文及谷歌原生工具,适用于高吞吐量、低延迟场景。
Qwen3 Max
Qwen3-Max 是阿里 Qwen3 系列最高阶大模型,万亿参数,预训练 36T tokens,支持 26 万+ tokens 上下文,多语言覆盖,显式推理模式。
千帆 Lightning
千帆 Lightning 是百度智能云千帆大模型平台推出的高性能、超低延迟模型系列,主打高性价比。
Doubao Seed Translation
Doubao-Seed-Translation 是字节跳动火山引擎推出的多语言翻译大模型,支持 28 种语言互译,BLEU 评分 42.5。