Python 按比例获取样本数据或执行任务的实现代码

作者:授客 时间:2023-01-10 09:48:16 

按比例获取样本数据或执行任务

By:授客 QQ:1033553122

开发环境

win 10

python 3.6.5

需求

已知每种分类的样本占比数,及样本总数,需要按比例获取这些分类的样本。比如,我有4种任务要执行,分别为任务A,任务B,任务C,任务D, 要求执行的总任务次数为100000,且不同分类任务执行次数占比为 A:B:C:D = 3:5:7:9,且在宏观上这些任务同时进行

代码实现


#!/usr/bin/env python
# -*- coding:utf-8 -*-

__author__ = 'shouke'

import time
from copy import deepcopy

def main():

class_propotion_map = {'A':3, 'B':5, 'C':7, 'D':7} # 分类及样本数比例映射
 class_list = [] # 分类
 class_proption_list = [] # 存放分类样本数比例

for class_type, propotion in class_propotion_map.items(): # 同一个循环,可以保证比例索引和对应分类索引一一对应
   class_list.append(class_type)
   class_proption_list.append(propotion)

temp_class_propotion_list = deepcopy(class_proption_list)
 result = []

t1 = time.time()
 total_sample_num = 100000 #任务执行次数
 for i in range(1, total_sample_num+1):
   max_propotion = max(temp_class_propotion_list)
   if max_propotion > 0:
     index = temp_class_propotion_list.index(max_propotion)
     result.append(class_list[index])
     temp_class_propotion_list[index] -= 1
   elif max_propotion == 0 and min(temp_class_propotion_list) == 0:
     temp_class_propotion_list = deepcopy(class_proption_list)
     index = temp_class_propotion_list.index(max(temp_class_propotion_list))
     result.append(class_list[index])
     temp_class_propotion_list[index] -= 1

t2 = time.time()
 from collections import Counter
 c = Counter(result)
 for item in c.items():
   print(item[0], item[1]/total_sample_num)
 print('耗时:%s'%(t2-t1))

main()

运行结果

Python 按比例获取样本数据或执行任务的实现代码

说明

以上方式大致实现思路就是,获取每种分类样本数所占比例副本数据列表,然后每次从中获取最大比例值,并查找该比例值对应的分类(获取分类后就可以根据需要构造、获取分类样本数据),找到目标分类后,把比例数据副本中该比例值减1,直到最大比例和最小比例都等于0,接着重置比例副本数据为样本数比例值,重复前面的过程,直到样本数达到目标样本总数,这种方式实现的前提是得提前知道样本总数及不同分类样本数所占比例,且比例值为整数

来源:https://www.cnblogs.com/shouke/archive/2020/12/02/14077282.html

标签:Python,样本数据,执行任务
0
投稿

猜你喜欢

  • python对文档中元素删除,替换操作

    2023-08-30 11:28:20
  • Python正则表达式介绍

    2023-05-29 01:32:58
  • 一文教你如何快速学会Go的struct数据类型

    2024-02-14 22:58:44
  • Can''t connect to MySQL server on localhost (10061)解决方法

    2024-01-22 00:25:02
  • Sqlserver 2005附加数据库时出错提示操作系统错误5(拒绝访问)错误5120的解决办法

    2024-01-27 10:14:51
  • sqlserver数据库导入方法的详细图文教程

    2024-01-15 16:52:24
  • 基python实现多线程网页爬虫

    2023-10-30 00:58:48
  • Python根据欧拉角求旋转矩阵的实例

    2022-09-03 15:11:00
  • 用JAVASCRIPT格式化数字成货币(逗号隔开)

    2008-01-30 12:34:00
  • 教你快速上手Selenium爬虫,万物皆可爬

    2022-01-02 18:44:31
  • python+selenium开发环境搭建图文教程

    2022-10-17 13:04:05
  • python实现傅里叶级数展开的实现

    2022-06-14 14:35:17
  • 详解python中xlrd包的安装与处理Excel表格

    2021-10-23 06:06:59
  • Python写安全小工具之TCP全连接端口扫描器

    2023-12-30 13:34:52
  • Bootstrap Paginator分页插件使用方法详解

    2023-09-05 23:08:42
  • windows下python 3.6.4安装配置图文教程

    2023-08-10 02:57:37
  • python中return不返回值的问题解析

    2021-04-26 20:36:07
  • jupyter notebook 恢复误删单元格或者历史代码的实现

    2022-03-03 16:13:45
  • ASP中的301跳转和302跳转

    2008-08-06 18:40:00
  • 基于Python socket的端口扫描程序实例代码

    2021-02-24 03:05:09
  • asp之家 网络编程 m.aspxhome.com