AI 与数据集术语表
本术语表解释 FishFarmHub 站内数据集使用的 AI 与数据概念。每个条目同时说明通用含义以及该术语在当前数据目录中的具体用法。
核心 AI 与数据概念
人工智能(Artificial Intelligence,AI)
人工智能(AI)是构建计算机系统以执行语言理解、推理、分类和生成等任务的技术领域。
FishFarmHub 使用 AI 作为面向语言模型训练或评测的数据集总称。
相关字段或数据集: 相关商品:石斑鱼养殖 AI 训练数据包。
大语言模型(Large Language Model,LLM)
大语言模型(LLM)是通过文本集合训练、用于处理和生成语言的机器学习模型。
FishFarmHub 数据集为石斑鱼养殖场景中的语言模型训练或行为评测提供结构化样本。
相关字段或数据集: 相关数据类型:QA、CoT、SFT、RAG 和 DPO。
问答对(Question-Answer,QA)
问答对(QA)是一条把问题与对应答案关联起来的数据记录。
FishFarmHub 问答数据集将问题和答案存储为独立 CSV 字段,部分数据集还包含推理或上下文。
相关字段或数据集: 相关字段:question、answer。
逗号分隔值(Comma-Separated Values,CSV)
逗号分隔值(CSV)是一种纯文本表格文件,每一行表示一条记录,每一列表示一个命名字段。
FishFarmHub 当前站内数据集以 CSV 文件或包含 CSV 文件的 ZIP 压缩包交付。
相关字段或数据集: 相关概念:行、列、记录、字段。
思维链推理(Chain-of-Thought,CoT)
思维链推理(CoT)是连接问题与答案的书面中间推理过程。
FishFarmHub CoT 数据集将 question、reasoning 和 answer 分别存储为独立字段。
相关字段或数据集: 相关字段:question、reasoning、answer。
监督微调(Supervised Fine-Tuning,SFT)
监督微调(SFT)是一种使用已标注输入和目标输出样本训练模型的方法。
FishFarmHub SFT 数据集将每条 instruction 与 response 和 evidence 文本配对。
相关字段或数据集: 相关字段:instruction、response、evidence、type、difficulty、quality_score。
检索增强生成(Retrieval-Augmented Generation,RAG)
检索增强生成(RAG)是在模型生成答案前先检索相关上下文的工作流程。
FishFarmHub 的 RAG 商品是包含问题、答案、正例上下文和困难负例上下文的评测数据,并不是在线托管的 RAG 系统。
相关字段或数据集: 相关字段:question、answer、positive_context、hard_negative_context。
直接偏好优化(Direct Preference Optimization,DPO)
直接偏好优化(DPO)是一种使用同一提示下的优选回答和拒绝回答进行偏好训练的方法。
FishFarmHub DPO 数据集包含 prompt、chosen、rejected、critique 和 quality_score 字段。
相关字段或数据集: 相关字段:prompt、chosen、rejected、critique、quality_score。
数据字段与评测概念
指令(Instruction)
指令是监督微调记录中提供给模型的任务或问题。
FishFarmHub 在每条 SFT 样本的 instruction 字段中存储用户请求。
相关字段或数据集: 相关数据类型:SFT。
回复(Response)
回复是监督微调记录中与指令配对的目标答案。
FishFarmHub 在每条 SFT 样本的 response 字段中存储目标助手答案。
相关字段或数据集: 相关字段:instruction、evidence。
依据(Evidence)
依据是与数据记录一同保存、用于支撑回复的来源文本。
FishFarmHub SFT 记录使用 evidence 字段保留与目标回复相关的文本依据。
相关字段或数据集: 相关字段:instruction、response。
正例上下文(Positive Context)
正例上下文是能够直接支撑 RAG 问题正确答案的检索文本。
FishFarmHub RAG 评测记录在 positive_context 字段中保存支撑答案的文本。
相关字段或数据集: 相关字段:question、answer、hard_negative_context。
困难负例上下文(Hard-Negative Context)
困难负例上下文是主题相近但不应支撑正确答案的文本。
FishFarmHub RAG 评测记录使用困难负例上下文,测试检索或回答过程能否区分相关依据与看似合理的干扰文本。
相关字段或数据集: 相关字段:question、answer、positive_context。
提示(Prompt)
提示是 DPO 偏好对共同使用的输入问题或指令。
FishFarmHub DPO 记录针对同一 prompt 比较 chosen 和 rejected 两个回复。
相关字段或数据集: 相关字段:chosen、rejected、critique。
优选回复(Chosen Response)
优选回复是 DPO 记录中被标记为更符合偏好的回复。
FishFarmHub 将优选答案存储在 chosen 字段中。
相关字段或数据集: 相关字段:prompt、rejected、critique。
拒绝回复(Rejected Response)
拒绝回复是 DPO 记录中与优选回复配对的较弱回复。
FishFarmHub 将非优选答案存储在 rejected 字段中。
相关字段或数据集: 相关字段:prompt、chosen、critique。
评析(Critique)
评析是说明 rejected 回复为什么弱于 chosen 回复的简短文字。
FishFarmHub DPO 记录将这段说明存储在 critique 字段中。
相关字段或数据集: 相关字段:chosen、rejected。
质量评分(Quality Score)
质量评分是与样本一同存储、用于表示其记录质量等级的数值。
FishFarmHub 当前 SFT、RAG 和 DPO 记录使用 1 到 5 的 quality_score 数值;该字段不代表未公开的外部评测标准。
相关字段或数据集: 相关字段:quality_score。