文件处理

Wesclaw 支持在对话中上传和处理各种类型的文件。AI 助手可以阅读文档、分析图片、理解代码,帮助你高效处理文件相关的工作。


功能概述

文件处理能力涵盖:


文件上传

上传方式

方式一:拖拽上传

直接将文件从文件管理器拖拽到 Wesclaw 的对话窗口。

方式二:点击上传

  1. 点击输入框左侧的 📎 附件按钮
  2. 在文件选择器中选择文件
  3. 文件会以附件形式显示在输入框上方

方式三:粘贴上传

支持的文件类型

类别文件格式说明
文档PDF, DOCX, TXT, MD, RTF文本提取和理解
图片JPG, PNG, GIF, WebP视觉理解和 OCR
代码所有编程语言源码代码分析和理解
数据CSV, JSON, XLSX数据分析和处理
表格Excel, Google Sheets 导出表格理解和分析

文件大小限制

文件类型大小限制说明
图片最大 20MB超大图片会自动压缩
文档最大 50MB建议控制在 10MB 以内
其他文件最大 50MB视模型上下文窗口限制

图片分析

图片理解

上传图片后,AI 可以:

使用示例

场景:识别名片信息

  1. 拍照或截图名片
  2. 上传到对话
  3. 输入"提取名片上的联系信息"
  4. AI 返回结构化的联系方式

场景:分析数据图表

  1. 截图数据图表
  2. 上传到对话
  3. 输入"分析这个图表的趋势和关键数据点"
  4. AI 返回数据分析和洞察

Vision 模型要求

图片分析需要使用支持 Vision 的模型:

模型图片支持
GPT-4o✅ 完整支持
Claude Sonnet/Opus✅ 完整支持
Gemini 2.5 Pro✅ 完整支持
DeepSeek V4⚠️ 有限支持

注意:如果当前模型不支持 Vision,上传图片时会收到提示。


文档摘要

快速摘要

上传文档后,直接要求 AI 生成摘要:

"帮我总结一下这个文档的核心内容"

AI 会阅读文档并生成结构化摘要,通常包括:

深度分析

"分析这份报告中的数据趋势,找出潜在的风险点"

多文档对比

同时上传多个文档进行对比:

"比较这两份合同的主要差异"

文档问答

上传文档后,可以针对文档内容提问:

"根据这份规范文档,API 的认证方式是什么?"

AI 会基于文档内容回答,而非使用训练数据。


代码文件

代码阅读

上传代码文件,AI 可以帮你:

代码审查

上传:pull_request.diff
提问:审查这个 PR 的代码变更,关注安全性和性能

AI 会对代码进行审查并给出建议:

代码转换

"把这个 Python 脚本转换成 Go 语言"


批量处理

多文件上传

你可以一次上传多个文件:

  1. 在文件选择器中选择多个文件(Ctrl/⌘ + 点击)
  2. 或者批量拖拽文件到对话窗口
  3. 所有文件显示在输入框上方

批量处理示例

场景一:批量翻译

上传 5 个英文文档 "请将这 5 个文档都翻译成中文,保持原有格式"

场景二:批量摘要

上传 10 份会议纪要 "分别总结每份会议纪要的关键决策和待办事项"

场景三:数据合并

上传 3 个 CSV 文件 "合并这三个数据文件,按日期排序,去除重复行"


文件处理技巧

提高处理效果

  1. 明确指令:告诉 AI 你想要什么格式的输出
  2. 分步处理:复杂文件建议分段处理
  3. 提供上下文:说明文件的背景信息有助于更好的理解
  4. 指定重点:告诉 AI 关注文件的哪些部分

处理长文档

对于超长文档(超过模型上下文窗口):

  1. AI 会自动截取关键部分
  2. 你可以指定关注的页码或章节
  3. 也可以先要求 AI 生成目录大纲,再针对性地深入

保护敏感信息

处理包含敏感信息的文件时:


注意事项

文件格式兼容性

处理限制

Token 消耗


常见问题

Q: 上传的文件会被保存吗?

A: 桌面版中,文件内容在处理后存储在本地的会话数据库中。你可以通过删除对话来清除这些数据。

Q: 能处理扫描版 PDF 吗?

A: 对于扫描版 PDF,AI 会尝试使用 OCR 提取文字。识别效果取决于扫描质量。建议使用清晰的扫描件。

Q: 文件处理失败怎么办?

A: 尝试以下方法:

Q: 可以让 AI 修改我的文件吗?

A: AI 可以根据你的要求生成修改后的内容,但不会直接修改你的原始文件。你需要手动将 AI 的输出保存为新文件。