Hashing er en proces, der bruger en algoritme (f.eks. MD5, SHA-1 eller SHA-2) til at skabe en unik identifikator – et "hashing" – for en fil på grundlag af dens data. To identiske filer vil altid have samme hashing. På samme måde vil to forskellige filer altid have forskellige hash'er, selv om forskellen mellem de to filer er minimal. Hashing af filer, der krænker ophavsretligt beskyttet materiale, kan føjes til "sorte lister", som kan bruges af cloud storage-tjenester til at opdage, blokere og fjerne uautoriserede filer.
Formålet med hashing er at identificere forskellige kopier af den samme digitale fil. Først bruges en algoritme til at tildele den digitale fil en unik tegnstreng, kaldet en "hash", og denne hash gemmes i en hash-database. En anden digital fil gennemgår derefter den samme hashing-proces, og den resulterende hash sammenlignes med den, der allerede er gemt i hash-databasen, for at afgøre, om filerne matcher nøjagtigt.
Hashing bruges primært til at indeksere indhold, sikre adgangskoder, opdage ondsindede filer som f.eks. virus eller blokere ulovligt indhold som f.eks. fremme af terrorhandlinger eller udnyttelse af mindreårige. Med hensyn til ophavsretligt beskyttet materiale tjener hashing til at identificere, sammenligne og forhindre upload af digitalt indhold, der allerede er taget ned på grund af krænkelse af ophavsretten.
Det er svært at angive specifikke implementeringskrav til hashing, da der er flere forskellige hashing-teknikker og -algoritmer, der kan bruges, og som alle kræver forskellige mængder regnekraft. De fleste hashing-metoder er kryptografiske (hvor to forskellige filer, selvom de er meget ens, vil have helt forskellige hashes), men der findes også perceptuelle hashing-metoder (hvor to næsten identiske filer, f.eks. lignende billeder, vil have lignende hashes). Når det er sagt, er fordelen ved hashing, at det kan anvendes på allerede eksisterende indhold. Hashes kan deles og bruges af alle de forskellige parter, der bruger den samme hashing-proces og den samme hash-database. Ulempen er dog, at hashing kun genkender den samme identiske fil, ikke dens indhold.
Hashing kræver begrænsede investeringer, da der findes open source-løsninger. Da hashing-databaser kun gemmer en streng af tegn i stedet for hele filen, kræver de desuden færre beregnings- og hukommelsesressourcer.