WARNING
本页面由 Gemini 机器翻译。
各步骤详细操作指南
步骤 1:数据提取(提取页面)
从待处理文件中提取双语对照句段数据。

- 从菜单中选择“提取”。
- 将文件拖拽至上传区域,或点击选择本地文件。
- 点击 “执行解析” 按钮。
TIP
若 Excel 或 XLIFF 中含有换行符,默认会按换行符拆分句段。若需保留单元格内换行,请取消勾选“按换行符拆分解析”。
支持的文件格式
- XLIFF 系列:
.xliff,.xlf,.sdlxliff,.mxliff,.mqxliff等 - 记忆库/术语库:
.tmx,.tbx - Excel/CSV:
.xlsx(A列原文,B列译文,C列起为备注信息),.csv,.tsv - 其他:Word 双语对照表、JSON / JSONL 格式文件
字数与词数统计
表格上方实时显示预估字数(Chara)与词数(Word),点击可切换统计维度。
数据导出下载
点击右上角的 CSV 或 JSON 按钮可随时下载已提取的数据。
步骤 2:数据排除与过滤(过滤与抽样)
过滤器
剔除无效行以缩减体积并节省 AI Token:
- 删除重复行:自动去除完全一致的重复句段(保留首条)。
- 删除锁定(LOCKED)行:剔除已标记为锁定的句段(支持 mxliff/mqxliff)。
- 无需翻译(DNT)过滤:自动识别并排除代码、纯数字等无需翻译的内容。
抽样评估
从海量数据中随机抽取指定容量样本用于质检评测:
- 设定 目标提取字数 与 随机种子值(Seed),点击 “执行抽样” 即可导出测试样本。
步骤 3:整合与结构化(结构化页面)
将提取并清洗后的数据转换为统一的“项目数据”(ShWvData),该格式可直接用于 SheepWeave。
- 选择“结构化”菜单。
- 如需追加双语文件可继续拖入上传区。
- 输入项目名称、源语言(Source)与目标语言(Target)。
- 点击 “执行结构化”。
步骤 4:记忆库与术语库匹配(分析页面)
将结构化数据与历史记忆库(.tmx, .csv)和术语库(.tbx, .csv)进行比对分析。 计算加权字数(WWC)并锁定匹配术语,为 AI 提供精准的上下文参考。
步骤 5:数据分块与管理(管理页面)
为 AI 批量处理进行前置准备:
- 保存与恢复项目:一键导出完整
.json或.csv项目工程。 - AI 智能分块(Chunking):按文件或按指定字数(如每块 5000 字)自动等长切分。
- JSONL 导出与导入:导出标准
.jsonl供 AI 管道使用,或回填处理完成的 JSONL 数据。
步骤 6:AI 批量调用(API 页面)
联动桌面客户端(SheepBobbin)批量发起翻译或质检请求。
- 进入“API”页面并输入 连接密码 建立连接。
- 点击 “生成分块”。
- 配置处理类型(翻译、校验,或选择 CUSTOM 自定义包含
src、tgt、history、terms字段以节省 Token 消耗)。 - 配置或上传提示词(Prompt)模板。
- 点击 “处理所有分块”,系统将自动顺序向 AI 发送请求。
- 完成后点击 “导出 CSV” 下载审校或翻译结果。