4.2 添加附件
本节目标
学会把图片喂给 agent,让它"看到"你的设计稿、截图或流程图,照着干活。
为什么要喂图片
对话只靠文字,很多场景说不清楚:
- 你想让它照着设计稿做页面,光描述颜色、间距太费劲,把图发过去它直接看
- 你截图了一个报错弹窗,直接发图,它读图就知道问题在哪
- 你想让它按流程图改逻辑,把图拖进去,它照着改
这就是附件的作用:让 agent 直接"看到"你的图,而不是靠转述。
怎么添加图片
添加方式很直接,和聊天软件发图一样:
- 整页拖拽:把图片文件直接拖进主界面任意位置,松开即添加
- 粘贴:复制一张图片(比如截图后 Ctrl+C),在输入框里按 Ctrl+V 粘贴
添加成功后,输入框上方会出现图片的缩略图,确认无误后正常发送即可。

发送后,图片会作为消息的一部分出现在对话流里,agent 会先"看图"再回答你。
支持哪些图片
目前支持常见的栅格图片格式:
| 格式 | 用途 |
|---|---|
| PNG | 截图、设计稿 |
| JPEG / JPG | 照片、效果图 |
| WebP | 网页素材 |
| GIF | 动图、演示 |
暂时只有图片
dsh 的附件目前只支持图片。想传代码、文档、数据文件?更推荐把它们放进工作区(Part 2),让 agent 直接读文件,而不是上传。
图片进了上下文,就占 token
每张图片都会被模型"看"一遍,占用上下文的 token。图片越多越大,对话开销越高。用完的图片可以从消息里删掉,控制上下文在合理范围。
常见问题
问:拖图片没反应?
确认拖的是图片文件(PNG/JPG/WebP/GIF),并且拖进了主界面区域而不是系统任务栏。如果拖拽不行,改用截图后直接粘贴。
问:agent 说看不懂图?
图太糊、文字太小的图识别效果差。截图时放大关键区域,或者用文字补充说明重点。
小结
- 拖拽或粘贴图片到界面,agent 会先"看图"再答
- 目前支持 PNG、JPEG、WebP、GIF 等图片格式
- 图片占 token,能用工作区读的文件就不必传
图片喂好了,下一节解锁输入框的隐藏效率:斜杠命令和引用。