文件处理
Wesclaw 支持在对话中上传和处理各种类型的文件。AI 助手可以阅读文档、分析图片、理解代码,帮助你高效处理文件相关的工作。
功能概述
文件处理能力涵盖:
- 文档阅读:读取 PDF、Word、TXT、Markdown 等文档
- 图片分析:理解图片内容、提取文字(OCR)
- 代码理解:阅读和分析代码文件
- 数据处理:处理 CSV、JSON、Excel 等数据文件
- 批量操作:同时处理多个文件
文件上传
上传方式
方式一:拖拽上传
直接将文件从文件管理器拖拽到 Wesclaw 的对话窗口。
方式二:点击上传
- 点击输入框左侧的 📎 附件按钮
- 在文件选择器中选择文件
- 文件会以附件形式显示在输入框上方
方式三:粘贴上传
- 截图后直接
Ctrl + V(macOS:⌘ + V)粘贴 - 从文件管理器复制文件后粘贴
支持的文件类型
| 类别 | 文件格式 | 说明 |
|---|---|---|
| 文档 | PDF, DOCX, TXT, MD, RTF | 文本提取和理解 |
| 图片 | JPG, PNG, GIF, WebP | 视觉理解和 OCR |
| 代码 | 所有编程语言源码 | 代码分析和理解 |
| 数据 | CSV, JSON, XLSX | 数据分析和处理 |
| 表格 | Excel, Google Sheets 导出 | 表格理解和分析 |
文件大小限制
| 文件类型 | 大小限制 | 说明 |
|---|---|---|
| 图片 | 最大 20MB | 超大图片会自动压缩 |
| 文档 | 最大 50MB | 建议控制在 10MB 以内 |
| 其他文件 | 最大 50MB | 视模型上下文窗口限制 |
图片分析
图片理解
上传图片后,AI 可以:
- 描述内容:"这张图片里有什么?"
- 提取文字:"帮我识别图片中的文字"
- 分析图表:"解读这个柱状图的数据"
- 识别物体:"这是什么品种的植物?"
- 比较图片:同时上传多张图片进行比较
使用示例
场景:识别名片信息
- 拍照或截图名片
- 上传到对话
- 输入"提取名片上的联系信息"
- AI 返回结构化的联系方式
场景:分析数据图表
- 截图数据图表
- 上传到对话
- 输入"分析这个图表的趋势和关键数据点"
- AI 返回数据分析和洞察
Vision 模型要求
图片分析需要使用支持 Vision 的模型:
| 模型 | 图片支持 |
|---|---|
| GPT-4o | ✅ 完整支持 |
| Claude Sonnet/Opus | ✅ 完整支持 |
| Gemini 2.5 Pro | ✅ 完整支持 |
| DeepSeek V4 | ⚠️ 有限支持 |
注意:如果当前模型不支持 Vision,上传图片时会收到提示。
文档摘要
快速摘要
上传文档后,直接要求 AI 生成摘要:
"帮我总结一下这个文档的核心内容"
AI 会阅读文档并生成结构化摘要,通常包括:
- 文档主题
- 核心观点
- 关键数据
- 结论和建议
深度分析
"分析这份报告中的数据趋势,找出潜在的风险点"
多文档对比
同时上传多个文档进行对比:
"比较这两份合同的主要差异"
文档问答
上传文档后,可以针对文档内容提问:
"根据这份规范文档,API 的认证方式是什么?"
AI 会基于文档内容回答,而非使用训练数据。
代码文件
代码阅读
上传代码文件,AI 可以帮你:
- 理解代码逻辑:"解释这段代码的功能"
- 找出问题:"这段代码有什么 bug?"
- 优化建议:"如何改进这段代码的性能?"
- 生成文档:"为这段代码生成注释文档"
代码审查
上传:pull_request.diff
提问:审查这个 PR 的代码变更,关注安全性和性能
AI 会对代码进行审查并给出建议:
- 潜在的安全风险
- 性能优化建议
- 代码风格改进
- 逻辑错误提示
代码转换
"把这个 Python 脚本转换成 Go 语言"
批量处理
多文件上传
你可以一次上传多个文件:
- 在文件选择器中选择多个文件(Ctrl/⌘ + 点击)
- 或者批量拖拽文件到对话窗口
- 所有文件显示在输入框上方
批量处理示例
场景一:批量翻译
上传 5 个英文文档 "请将这 5 个文档都翻译成中文,保持原有格式"
场景二:批量摘要
上传 10 份会议纪要 "分别总结每份会议纪要的关键决策和待办事项"
场景三:数据合并
上传 3 个 CSV 文件 "合并这三个数据文件,按日期排序,去除重复行"
文件处理技巧
提高处理效果
- 明确指令:告诉 AI 你想要什么格式的输出
- 分步处理:复杂文件建议分段处理
- 提供上下文:说明文件的背景信息有助于更好的理解
- 指定重点:告诉 AI 关注文件的哪些部分
处理长文档
对于超长文档(超过模型上下文窗口):
- AI 会自动截取关键部分
- 你可以指定关注的页码或章节
- 也可以先要求 AI 生成目录大纲,再针对性地深入
保护敏感信息
处理包含敏感信息的文件时:
- 桌面版文件处理在本地进行,不会上传到服务器
- 但文件内容会发送给 LLM 模型进行理解
- 如需保密,建议使用本地部署的模型
- 处理完成后,临时文件会自动清理
注意事项
文件格式兼容性
- PDF:支持文字型 PDF,扫描件需要 OCR 能力
- Word:支持 .docx 格式,旧版 .doc 可能部分兼容
- Excel:支持基本的数据读取,复杂公式和宏不支持
- 图片:支持常见格式,RAW 格式需先转换
处理限制
- 加密或受密码保护的文件需要先解密
- 极大文件可能需要较长处理时间
- 某些特殊格式可能无法完整解析
- 复杂排版的 PDF 可能丢失格式信息
Token 消耗
- 文件内容会被转换为文本并消耗 Token
- 大文件意味着更多的 Token 消耗
- 图片分析的 Token 消耗通常大于同等内容的文本
- 建议只上传必要的文件内容
常见问题
Q: 上传的文件会被保存吗?
A: 桌面版中,文件内容在处理后存储在本地的会话数据库中。你可以通过删除对话来清除这些数据。
Q: 能处理扫描版 PDF 吗?
A: 对于扫描版 PDF,AI 会尝试使用 OCR 提取文字。识别效果取决于扫描质量。建议使用清晰的扫描件。
Q: 文件处理失败怎么办?
A: 尝试以下方法:
- 检查文件是否损坏
- 确认文件格式是否受支持
- 尝试转换为更通用的格式(如 PDF 转 TXT)
- 如果文件过大,尝试分拆上传
Q: 可以让 AI 修改我的文件吗?
A: AI 可以根据你的要求生成修改后的内容,但不会直接修改你的原始文件。你需要手动将 AI 的输出保存为新文件。