# Ling-3.0-flash-VL：给文本模型加上眼睛，还能当视觉Agent用

> 原标题：Ling-3.0-flash-VL, built on Ling-3.0-flash with visual understanding and visual agent capabilities

- 来源：r/LocalLLaMA
- 发布时间：2026-09-04T18:14:34.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/54820
- 原文：https://www.reddit.com/r/LocalLLaMA/comments/1w7c6u4/ling30flashvl_built_on_ling30flash_with_visual/

## 摘要

AntLingAGI 在 Ling-3.0-flash 基础上加了视觉理解和视觉 Agent 能力，新模型叫 Ling-3.0-flash-VL。官方说它在视觉感知、STEM 推理、文档理解、多模态 Agent 任务、前端代码生成和医疗报告解读上都表现不错。但权重还没放出来，评论区在问 HuggingFace 链接和参数量，帖子都没提。如果你打算跑本地...
