Skip to content

WARNING

本页面由 Gemini 机器翻译。

各步骤详细操作指南

步骤 1:数据提取(提取页面)

从待处理文件中提取双语对照句段数据。

SheepComb Web 提取

  1. 从菜单中选择“提取”。
  2. 将文件拖拽至上传区域,或点击选择本地文件。
  3. 点击 “执行解析” 按钮。

TIP

若 Excel 或 XLIFF 中含有换行符,默认会按换行符拆分句段。若需保留单元格内换行,请取消勾选“按换行符拆分解析”。

支持的文件格式

  • XLIFF 系列.xliff, .xlf, .sdlxliff, .mxliff, .mqxliff
  • 记忆库/术语库.tmx, .tbx
  • Excel/CSV.xlsx(A列原文,B列译文,C列起为备注信息), .csv, .tsv
  • 其他:Word 双语对照表、JSON / JSONL 格式文件

字数与词数统计

表格上方实时显示预估字数(Chara)与词数(Word),点击可切换统计维度。

数据导出下载

点击右上角的 CSV 或 JSON 按钮可随时下载已提取的数据。


步骤 2:数据排除与过滤(过滤与抽样)

过滤器

剔除无效行以缩减体积并节省 AI Token:

  • 删除重复行:自动去除完全一致的重复句段(保留首条)。
  • 删除锁定(LOCKED)行:剔除已标记为锁定的句段(支持 mxliff/mqxliff)。
  • 无需翻译(DNT)过滤:自动识别并排除代码、纯数字等无需翻译的内容。

抽样评估

从海量数据中随机抽取指定容量样本用于质检评测:

  • 设定 目标提取字数随机种子值(Seed),点击 “执行抽样” 即可导出测试样本。

步骤 3:整合与结构化(结构化页面)

将提取并清洗后的数据转换为统一的“项目数据”(ShWvData),该格式可直接用于 SheepWeave

  1. 选择“结构化”菜单。
  2. 如需追加双语文件可继续拖入上传区。
  3. 输入项目名称、源语言(Source)与目标语言(Target)。
  4. 点击 “执行结构化”

步骤 4:记忆库与术语库匹配(分析页面)

将结构化数据与历史记忆库(.tmx, .csv)和术语库(.tbx, .csv)进行比对分析。 计算加权字数(WWC)并锁定匹配术语,为 AI 提供精准的上下文参考。


步骤 5:数据分块与管理(管理页面)

为 AI 批量处理进行前置准备:

  • 保存与恢复项目:一键导出完整 .json.csv 项目工程。
  • AI 智能分块(Chunking):按文件或按指定字数(如每块 5000 字)自动等长切分。
  • JSONL 导出与导入:导出标准 .jsonl 供 AI 管道使用,或回填处理完成的 JSONL 数据。

步骤 6:AI 批量调用(API 页面)

联动桌面客户端(SheepBobbin)批量发起翻译或质检请求。

  1. 进入“API”页面并输入 连接密码 建立连接。
  2. 点击 “生成分块”
  3. 配置处理类型(翻译、校验,或选择 CUSTOM 自定义包含 srctgthistoryterms 字段以节省 Token 消耗)。
  4. 配置或上传提示词(Prompt)模板。
  5. 点击 “处理所有分块”,系统将自动顺序向 AI 发送请求。
  6. 完成后点击 “导出 CSV” 下载审校或翻译结果。