python计算Content-MD5并获取文件的Content-MD5值方式

作者:茕夜 时间:2022-09-27 00:53:29 

1、首先计算MD5加密的二进制数组(128位),然后再对这个二进制数组进行base64编码(而不是对32位字符串编码)。

例如,用Python计算0123456789的Content-MD5,主要代码如下:


import base64, hashlib
hash = hashlib.md5()
hash.update("0123456789")
base64.b64encode(hash.digest())

这样就生成了 'eB5eJF1ptWaXm4bijSPyxw==' 的Content-MD5值

2、接着,实际上如何获取文件的Content-MD5值呢,下面有两种不同的写法,建议用第一种,不知道为啥实际调试的时候,用第一种可以的时候,用第二种不可以,因为是不同人写的代码,估计调用的时候方式不一样:

(1)、第一种写法


import hashlib, base64

def content_encoding(path: str):
 """
 文件转 bytes 加密并使用 base64 编码
 :param path: 文件路径
 :return: 返回加密编码后的字符串
 """
 with open(path, 'rb') as f:
   content = f.read()
 content_md5 = hashlib.md5()
 content_md5.update(content)
 content_base64 = base64.b64encode(content_md5.digest())
 return content_base64.decode("utf-8")

(2)、第二种写法:


import hashlib, base64

def match(file_path, Bytes=1024):
 """
 先计算文件md5值,在对该md5值进行base64编码
 :param file_path: 文件路径
 :param Bytes: 字节大小
 :return:
 """
 try:
   md5_1 = hashlib.md5() # 创建一个md5算法对象
   with open(file_path, 'rb') as f: # 打开一个文件,必须是'rb'模式打开
     while 1:
       data = f.read(Bytes) # 由于是一个文件,每次只读取固定字节
       if data: # 当读取内容不为空时对读取内容进行update
         md5_1.update(data)
       else: # 当整个文件读完之后停止update
         break
   f.close()
   ret = base64.b64encode(bytes(md5_1.digest())) # 获取这个文件的MD5值
   ret = ret.decode('ascii') # 去掉前面的b'
   return ret
 except Exception as e:
   print(e)
   return ''

补充知识:Python之文件处理-批量修改md文档内容


#!/usr/bin/env python
# -*- coding:utf-8 -*-
import os
import re
import time

def modify_md_content(top):
 for root, dirs, files in os.walk(top, topdown=False):
   # 循环文件
   for file_name in files:
     file_name_split = file_name.split('.')

try:
       if file_name_split[-1] == 'md':
         # 找到md文件并且复制一份md文件路径
         md_file_path = os.path.join(root, '.'.join(file_name_split))
         copy_md_file_path = os.path.join(root, '.'.join([f'{file_name_split[0]}_copy', file_name_split[1]]))

# 打开md文件然后进行替换
         with open(md_file_path, 'r', encoding='utf8') as fr, \
             open(copy_md_file_path, 'w', encoding='utf8') as fw:
           data = fr.read()
           # data = re.sub('\(/配图/', '(配图/', data)
           # data = re.sub('<br>', '<br>\n', data)
           # data = re.sub('<br>', '', data)
           data = re.sub('^ #.*? ', '', data)

fw.write(data) # 新文件一次性写入原文件内容
           # fw.flush()

# 删除原文件
         os.remove(md_file_path)
         # 重命名新文件名为原文件名
         os.rename(copy_md_file_path, md_file_path)
         print(f'{md_file_path} done...')
         time.sleep(0.5)
     except FileNotFoundError as e:
       print(e)
   time.sleep(0.5)

if __name__ == '__main__':
 top = r'/Users/mac/Desktop/'
 modify_md_content(top)

来源:https://blog.csdn.net/u012561176/article/details/104021413

标签:python,Content,MD5
0
投稿

猜你喜欢

  • Iinternet Explorer浏览器简介(IE)

    2009-02-05 20:59:00
  • Orcas中C#语言的新特性:自动属性,对象初始化器,和集合初始化器

    2007-09-23 12:43:00
  • pycharm快捷键汇总

    2022-12-30 22:43:40
  • ASP网站数据采集经验谈

    2008-03-09 15:30:00
  • PHP 实现一种多文件上传的方法

    2024-05-03 15:07:11
  • PyTorch两种安装方法

    2022-04-16 04:11:50
  • Tensorflow 合并通道及加载子模型的方法

    2023-08-10 05:36:54
  • 使用pytorch进行张量计算、自动求导和神经网络构建功能

    2022-08-18 11:50:48
  • YUI学习笔记(1)

    2009-01-12 18:06:00
  • 最新idea2021最新激活超详细教程

    2023-08-08 01:50:17
  • python多进程控制学习小结

    2021-08-31 00:48:57
  • python爬虫之百度API调用方法

    2021-11-18 17:17:13
  • MySQL下使用Inplace和Online方式创建索引的教程

    2024-01-18 11:28:18
  • 如何利用Fiddler模拟恶劣网络环境

    2022-04-12 02:22:51
  • 利用Python+eval函数构建数学表达式计算器

    2021-01-28 14:38:44
  • 禁止使用 Firebug

    2009-05-20 12:04:00
  • 如何保持Oracle数据库的优良性能

    2024-01-14 18:05:32
  • 仿天涯底部固定漂浮导航,无JS纯CSS定义

    2009-07-06 12:44:00
  • golang进程内存控制避免docker内oom

    2024-05-09 09:47:11
  • pandas如何解决excel科学计数法问题

    2023-12-20 05:06:20
  • asp之家 网络编程 m.aspxhome.com