工具与能力
给纯文本编码智能体装上眼睛:多图理解、长截图 OCR、前端 UI 还原与 GUI 自动化,以视觉工具箱+技能形式提供,可无缝接入 Codex、Claude Code 等主流智能体。
图片与文件直达纯文本模型:PDF/Office/压缩包/视频显示为附件块,发送时自动转为工作区路径。
底层是宿主的图片准入预检(attachment-error): 配合 dsh-vision-toolkit 可以解决"看图"的问题——但它的工具只认 工作区文件路径 ,图片必须以路径形式进入消息。于是每次看图都要:截图 → 存到工作区 → 手动把地址写进消息。非常笨重。而除了图片之外,DSH 根本不允许把 PDF、Office 文档、视频等任何非图片文件作为附件发送。
dsh-drop-to-path 是 DeepSeek Harness 生态中的资源,由 loudMore 维护。图片与文件直达纯文本模型:PDF/Office/压缩包/视频显示为附件块,发送时自动转为工作区路径。
项目源码与使用说明位于 GitHub 仓库 https://github.com/loudMore/dsh-drop-to-path。请以仓库 README 中的安装或使用步骤为准。
dsh-drop-to-path 是社区开源项目,采用 MIT 许可证。使用前请查看仓库中的许可证和项目说明。
工具与能力
给纯文本编码智能体装上眼睛:多图理解、长截图 OCR、前端 UI 还原与 GUI 自动化,以视觉工具箱+技能形式提供,可无缝接入 Codex、Claude Code 等主流智能体。
工具与能力
开源版锤子便签:复刻锤科美学,一键 Docker 私有化部署,支持 skill 调用与 dsh 插件,还能一键生成公众号格式。
工具与能力
在 DeepSeek Harness 里检测并下载网页中的视频和音频。