与文档聊天
信息处理的下一步
与其依赖公开数据集和一般知识,“与文档聊天”基于你信任的内部资源,提供情境特定的回答和分析。上传你的文档,并将它们用作回答聊天中问题的基础!
解决数据限制
如果你向语言模型提问,你将依赖模型所训练的数据集。通常这类信息来自网络公开信息。非公开来源可能不在该数据集中。将你的文档作为聊天来源,可以确保模型具备回答你问题所需的信息。
使用你文档的可能性
你可以就你的文档提问,例如列出文档的要点或对文档进行摘要。也可以让语言模型基于你自己的数据集执行特定分析。
基于文档的聊天的缺点
上传和处理文档是额外步骤,如果不需要特定信息的上下文也能给出满意答案,则无需此过程。生成答案也会更慢,因为需要先从文档中提取必要信息再向语言模型发送请求。
与文档聊天的幕后
你上传的文档中的文本会被提取并分成片段。每个片段具有固定字符数(1024 字符),并设有重叠(128 字符)。每段文本都以向量的形式存储在向量数据库中。每次提问时,将基于与问题的相似性从这些数据中进行选择。
文档片段选择过程
文本片段已被转换为向量。向量有多维,表示文本与其他文本的相似程度。向量数据库使我们能够按问题对文本片段进行排序和过滤。我们最多从中选择 100 段长度为 1024 字符的文本,随问题一起发送。
适用于基于文档的聊天的模型
我们选择了具有较大上下文窗口的模型,以便实现文档聊天。我们希望最多能发送 100 段长度为 1024 字符的文本,总共超过 100,000 字符。请优先从中央模型目录中选用高质量的语言模型。
适合的模型具有足够的上下文空间和良好的文档分析能力,例如 OpenAI、Claude、Google 的高质量模型,以及欧洲 AI 的模型。
选择一个或多个文档
你可以通过在问题栏右侧点击回形针图标来开启文件模式。最多可以选择 10 个文件进行聊天。
你上传的文件会先被处理。一旦处理完成,AI-School 可以在聊天、助手和工作流中使用其内容。如果处理失败,文件将显示错误状态,你需要重新上传或重新处理。
在你开始与文档聊天时,我们会检查语言模型是否适合文档聊天。如果不合适,系统会自动从当前目录中选择一个合适的模型。

在启用文件模式时,你可以继续与你的这些文档聊天。
管理与重新处理文件
在 文件管理 中,你可以看到你上传的文件或 AI-School 自动创建的文件。对于 PDF 文件,你可以通过操作菜单重新处理该文件。这将用新的处理替代现有的文本提取。
对于 PDF,AI-School 可以使用普通文本层,并在需要时进行更全面的 PDF 分析。这在以下情况特别有用:
- 扫描的 PDF
- 填写的表格
- 手写的回答
- 圈出或下划线的选项
- 表格、图形及其他可视信息
处理较大的 PDF 可能需要更长时间。AI-School 会在需要时将大型文档拆分为较小的部分,以便也能处理更长的 PDF。
选择现有文件
当表单或工作流需要一个文件时,你不仅可以上传新文件,还可以通过媒体管理器选择现有文件。这样就不必每次都重新上传试题、评阅模板或其他源文档。
通过此类表单添加的文件会出现在对话的助手文件中。除非你自己在普通聊天中启用它们,否则它们不会自动被选中用于常规聊天问题。
每个文件的处理
除了基于文档的聊天,AI-School 还提供对每个文档单独应用提示并获取单独回答的功能。此功能称为 按文件处理。

此功能可与“与文件聊天”结合使用。
可能的场景
使用“按文件处理”的实际示例:
- 你上传考题和答案模型并在“与文件聊天”中启用
- 你上传多份已提交的考题并在“按文件处理”中启用
- 你提出一个提示,逐个应用于所有文件
通过这种方式,你可以让所有提交的考题基于答案模型自动评分。
“按文件处理”功能有最大 30 个文件的限制。
支持的文件类型
AI-School 支持多种用于与文档聊天的文件类型:
- .pdf 的 PDF 文件
- .docx 的 Word 文件
- .csv 的 CSV 文件
- .json 的 JSON 文件
- .txt 的文本文件
- .md 的 Markdown 文件
- 拓展名为 'mp3', 'mp4', 'mpeg', 'mpga', 'm4a', 'wav' 或 'webm' 的音频和视频文件
与音频或视频文件聊天
AI-School 会先用设置好的转录提供商把音频和视频文件转为文本。对于对话,结果可能包含时间块和说话人标签。之后可以用合适的文本模型修正标点、拼写、说话人标签和专业术语。由于提供商和模型限制,长文件的处理方式可能不同于短文件。