Doubao-1.5-vision-pro-32k 是字节跳动推出的多模态大模型,支持文本、图像输入与输出,具备任意分辨率及极端长宽比图像识别能力,增强视觉推理、文档识别、细节理解和指令遵循能力,最大思维链内容长度 32k,适用于复杂视觉任务与长文本交互场景。
Doubao-1.5-vision-pro-32k
Doubao-1.5-vision-pro-32k 是字节跳动推出的多模态大模型,支持文本、图像输入与输出,具 […]
🔗 本文链接