描述
筛选器是一个多模态数据实验室,提供经过精心策划的视频、音频、图像和交互数据,以训练前沿的人工智能模型。它在真实、数字和模拟环境中捕获和聚合数据,然后根据语义、权利、工件和任务质量对其进行评分,最后进行打包以供交付。
该平台使用专门构建的检测器和嵌入索引数十亿个视频、图像、音频片段和交互痕迹,并添加密集的注释,如字幕、转录、对象标签、动作元数据、相机信号和大规模的人类质量保证。团队可以浏览现成的数据集或请求针对特定模型能力的定制收集。
筛选器直接与研究团队合作,确定数据量、分布、元数据、许可、质量保证和交付格式,并支持合规要求,包括过滤、同意和保留。数据集和评估集通过端到端加密和SOC 2 Type 2控制安全交付。
筛选器的核心功能
经过策划的多模态视频、音频、图像和交互数据集
在真实、数字和模拟环境中获取数据
针对语义、权利、工件和任务质量的质量过滤
使用专门构建的检测器和嵌入进行索引
密集注释:字幕、转录、标签和动作元数据
针对特定模型能力的定制数据收集
合规优先的过滤、许可、同意和保留支持
通过加密和SOC 2 Type 2控制进行安全交付
如何使用 筛选器?
探索能力:浏览现成的数据集或描述您的研究团队所需的内容。
接收样本:请求视频、音频、图像、计算机使用或交互环境的样本。
确定数据集范围:与筛选器团队合作定义数据量、分布、元数据、许可、质量保证和交付格式。
购买访问权限:根据数据量、任务复杂性和注释签署购买协议。
接收交付:在几天内获取预包装的数据集或根据服务水平协议获取定制数据和环境。
筛选器的使用案例
- 模型训练数据集
- 评估集
- 视频编辑和生成数据
- 交互和计算机使用环境







