图像分类器
X-AnyLabeling 的图像分类器是独立的图像分类标注窗口,支持多类分类(单标签)和多标签分类。用户可以管理标签、对单张或多张图像进行 AI 辅助分类、查看数据集统计信息,并将已分类图像按类别导出到对应目录。
PaddleOCR
PaddleOCR 是百度飞桨生态中的 OCR 与文档智能工具,覆盖通用文字识别、文档版面分析、表格解析、公式识别等能力,适用于扫描件、拍照文档、多页 PDF、技术文档等常见资料处理场景。
视频分类器
X-AnyLabeling 的视频分类器是面向动作识别和视频片段分类数据集的独立标注窗口。它支持加载视频、维护类别标签、在时间轴上创建片段、为每个片段分配类别、预览帧,并可导出按类别整理的视频片段或抽帧数据。
视觉问答
X-AnyLabeling 的视觉问答工具用于标注多模态图像问答数据集。它支持创建图像对应的问题与答案,提供多种可配置的输入组件,并集成 AI 辅助功能,可为监督微调、强化学习后训练等任务准备结构化数据。
聊天机器人
X-AnyLabeling 的聊天机器人是集成在标注流程中的 AI 助手,可与大语言模型(LLM)进行自然语言交互、批量处理图文问答数据,并导入或导出单轮及多轮对话数据。导出的多模态数据采用 ShareGPT 格式,可用于 LLaMA-Factory 等大模型微调框架。