0% encontró este documento útil (0 votos)
3 vistas2 páginas

Comparador de MD5 y rutas duplicadas

Este script de Python compara dos listados de MD5 para identificar coincidencias y genera un archivo con las rutas de los archivos duplicados. Los archivos de entrada deben ser renombrados manualmente por el usuario y el resultado se almacena en 'TotalRepetidos.txt'. El script también incluye comandos para limpiar y procesar los datos en la terminal.

Cargado por

Deric Chan
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como TXT, PDF, TXT o lee en línea desde Scribd
0% encontró este documento útil (0 votos)
3 vistas2 páginas

Comparador de MD5 y rutas duplicadas

Este script de Python compara dos listados de MD5 para identificar coincidencias y genera un archivo con las rutas de los archivos duplicados. Los archivos de entrada deben ser renombrados manualmente por el usuario y el resultado se almacena en 'TotalRepetidos.txt'. El script también incluye comandos para limpiar y procesar los datos en la terminal.

Cargado por

Deric Chan
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como TXT, PDF, TXT o lee en línea desde Scribd

#!

/usr/bin/env python
# -*- coding: utf-8 -*-
#Deric 13/08/2019
import os
#[Link]("clear")

#[Link]
#este fichero python compara un listado de MD5 contra un listado de MD5 que se
encuentran repetidos, y por cada coincidencia verdadera concatena el path de ese
MD5.
#luego que genera un listado "[Link]" que es donde se compara las
/rutas/fichero, las lineas que se conserven en el fichero es para su eliminacion
apoyandose con el comando rm -R

# se debe renombrar manualmente, el usuario debe definirlo


#[Link] ---> contiene el listado de MD5 de los ficheros de la carpeta origen
#[Link] ---> contiene el listado de MD5 de los ficheros de la carpeta destino

# se debe renombrar manualmente, el usuario debe definirlo


#PathRepetidosA ---> contiene el listado de PATH de los ficheros de la carpeta
origen
#PathRepetidosB ---> contiene el listado de PATH de los ficheros de la carpeta
destino

# el fichero [Link] es la suma de "[Link]" de la carpeta de


origen y el "[Link]" de la carpeta destino

# coloca el contenido de un archivo , linea por linea en cada elemento de array

pfile1=open("/tmp/temporal/[Link]","r")
pfile2=open("/tmp/temporal/[Link]","r")
pfile3=open("/tmp/temporal/listMD5Tamañ[Link]","r")
ResultadoTemporal=open("/tmp/temporal/[Link]","w")

listMD5Duplicados=[Link]()
listMD5=[Link]()
listMD5TamañoPath=[Link]()
#listRep=[Link]()

#listIndice=[Link]()
count=0
listIndice=[]
print "\ncomparando\n"
for j in listMD5Duplicados:
for i in listMD5:
if (i == j ):
print "i es: "+i
print "j es: "+j
# metodo index para obtener la posicion de un elemento q exista
en un array
indice=[Link](i)
# alimenta a un array de tamaño indefinido y conservando lo que
contiene, partiendo de otro array ya existente y accediendo a algun indice
especifico
[Link](listPath[indice])
# almacena lo que contiene un array en proceso de llenado a un
fichero .txt
[Link](listMD5[indice])

[Link]()
[Link]()
[Link]()
[Link]()
#print listIndice

#print data3

(awk '{print $0}' /tmp/temporal/[Link] | sort | uniq -c | awk


'{$1=""; print $0}' | sort -k2 -r -h) > /tmp/temporal/[Link]
echo
echo "el resultado se almaceno en: /tmp/temporal/[Link]"
echo
cat /tmp/temporal/[Link]

print ""
print ""
# cuanta las veces que esta la palabra mandarina en el arreglo frutas
#>>> [Link]('mandarina')
# devuelve la posicion donde se encuentra la palabra mandarina en el arreglo frutas
#>>> [Link]('banana')
#ejemplo:
#indice=[Link]("PATH DE UN FOX")

[Link]("echo 'saliendo de python'")

También podría gustarte