Hyppää sisältöön
    • FI
    • ENG
  • FI
  • /
  • EN
OuluREPO – Oulun yliopiston julkaisuarkisto / University of Oulu repository
Näytä viite 
  •   OuluREPO etusivu
  • Oulun yliopisto
  • Avoin saatavuus
  • Näytä viite
  •   OuluREPO etusivu
  • Oulun yliopisto
  • Avoin saatavuus
  • Näytä viite
JavaScript is disabled for your browser. Some features of this site may not work without it.

Catchem : a browser plugin for the Panama papers using approximate string matching

Kostakos, Panos; Moilanen, Miika; Niemelä, Arttu; Oussalah, Mourad (2017-12-28)

 
Avaa tiedosto
nbnfi-fe201901222693.pdf (449.3Kt)
nbnfi-fe201901222693_meta.xml (32.81Kt)
nbnfi-fe201901222693_solr.xml (27.13Kt)
Lataukset: 

URL:
https://doi.org/10.1109/EISIC.2017.28

Kostakos, Panos
Moilanen, Miika
Niemelä, Arttu
Oussalah, Mourad
Institute of Electrical and Electronics Engineers
28.12.2017

P. Kostakos, M. Moilanen, A. Niemelä and M. Oussalah, "Catchem: A Browser Plugin for the Panama Papers Using Approximate String Matching," 2017 European Intelligence and Security Informatics Conference (EISIC), Athens, 2017, pp. 139-142. doi: 10.1109/EISIC.2017.28

https://rightsstatements.org/vocab/InC/1.0/
© 2017 IEEE. Personal use of this material is permitted. Permission from IEEE must be obtained for all other uses, in any current or future media, including reprinting/republishing this material for advertising or promotional purposes, creating new collective works, for resale or redistribution to servers or lists, or reuse of any copyrighted component of this work in other works.
https://rightsstatements.org/vocab/InC/1.0/
doi:https://doi.org/10.1109/EISIC.2017.28
Näytä kaikki kuvailutiedot
Julkaisun pysyvä osoite on
https://urn.fi/URN:NBN:fi-fe201901222693
Tiivistelmä

Abstract

The Panama Papers is a collection of 11.5 million leaked records that contain information for more than 214,488 offshore entities. This collection is growing rapidly as more leaked records become available online. In this paper, we present a work in progress on a web browser plugin that detects company names from the Panama Papers and alerts the user by means of unobtrusive visual cues. We matched a random sample of company names from the Public Works and Government Services Canada registry against the Panama Papers using three different string matching techniques. Monge-Elkan is found to provide the best matching results but at increased computational cost. Levenshtein-based approach is found to provide the best tradeoff between matching and computational cost, while Jacquard index like approach is found to be less sensitive to slight textual change.

Kokoelmat
  • Avoin saatavuus [38358]
oulurepo@oulu.fiOulun yliopiston kirjastoOuluCRISLaturiMuuntaja
SaavutettavuusselosteTietosuojailmoitusYlläpidon kirjautuminen
 

Selaa kokoelmaa

NimekkeetTekijätJulkaisuajatAsiasanatUusimmatSivukartta

Omat tiedot

Kirjaudu sisäänRekisteröidy
oulurepo@oulu.fiOulun yliopiston kirjastoOuluCRISLaturiMuuntaja
SaavutettavuusselosteTietosuojailmoitusYlläpidon kirjautuminen