大数据集按间隔抽取,做成小数据集

import os
import shutil


def extract_subset(img_dir, labels_dir, output_dir, interval=15, image_ext='.jpg', label_ext='.txt'):
    # Create output directories if they don't exist
    output_img_dir = os.path.join(output_dir, 'img')
    output_labels_dir = os.path.join(output_dir, 'labels')
    os.makedirs(output_img_dir, exist_ok=True)
    os.makedirs(output_labels_dir, exist_ok=True)

    # List all images assuming they end with the specified image extension
    images = [f for f in os.listdir(img_dir) if f.endswith(image_ext)]

    # Sort images to maintain a consistent order
    images.sort()

    # Filter images to pick every 15th image
    selected_images = images[::interval]

    # Copy selected images and their corresponding YOLO label files
    for img in selected_images:
        # Construct the full path for image and label
        img_path = os.path.join(img_dir, img)
        label_path = os.path.join(labels_dir, os.path.splitext(img)[
            0] + label_ext)  # Assumes label has same base name with .txt extension

        # Check if corresponding label file exists
        if os.path.exists(label_path):
            # Copy image
            shutil.copy(img_path, output_img_dir)
            # Copy label
            shutil.copy(label_path, output_labels_dir)
        else:
            print(f"Label file for {img} not found. Skipping this file.")

    print(f"Extracted {len(selected_images)} images and their labels to {output_dir}")


# Example usage
if __name__ == "__main__":
    img_dir = "D:\Myself文档\Dataset\官方Dataset\spain\original\original\imgs"
    labels_dir = "D:\Myself文档\Dataset\官方Dataset\spain\original\original\yolo_labels"
    new_dataset_dir = "D:\Myself文档\Dataset\官方Dataset\spain\original\original_select_15"
    extract_subset(img_dir, labels_dir, new_dataset_dir)
img_dir,原数据集img目录地址
labels_dir,原数据集labels目录地址(YOLO格式)
new_dataset_dir,形成新数据集的目录地址,脚本会自动生产两个子目录img/labels  注意yolo数据集命名必须为images/labels。所以这里最终生成文件名称img的需要改一下
interval=15,控制提取间隔

  • 1
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 打赏
    打赏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

似苦又甜

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值