--- dao/DaoAdresseService/src/main/java/dk/daoas/daoadresseservice/AddressSearch.java 2015/12/01 11:08:56 2788 +++ dao/DaoAdresseService/src/main/java/dk/daoas/daoadresseservice/AddressSearch.java 2016/01/19 10:02:51 2821 @@ -6,7 +6,6 @@ import java.util.Collections; import java.util.Date; import java.util.HashMap; -import java.util.HashSet; import java.util.List; import java.util.Map; import java.util.Map.Entry; @@ -216,7 +215,7 @@ Address addr = litraList.get( result.splitResult.litra ); if (addr == null) { //litra ikke fundet - if (config.nearestLitra == true) { + if (config.nearestLitra == true || naermesteHusnr == true) { result.nearestLitra = true; addr = litraList.values().iterator().next(); } else { @@ -311,19 +310,25 @@ searchGadeidentAdresser = new HashMap>>(); helperCache = new ConcurrentHashMap(); + // ////////////////////// + // Start stage1 + long start1 = System.currentTimeMillis(); System.out.println("Build -- stage 1"); alleAdresser = db.getAllAdresses(); - /* Mapper mellem db Row ID og adresse noden */ + /* Mapper mellem db Row ID og adresse noden - skal bruges i stage3*/ Map idAddressMap = new HashMap( alleAdresser.size() ); - DeduplicateHelper aliasHelper = new DeduplicateHelper(); + DeduplicateHelper shortHelper = new DeduplicateHelper(); DeduplicateHelper intHelper = new DeduplicateHelper(); + AliasGenerator aliasGenerator = new AliasGenerator(); + + for (Address a : alleAdresser) { idAddressMap.put(a.id, a); @@ -332,7 +337,7 @@ Map postnrVeje = searchPostnrVejnavnGadeid.get(postnr); if (postnrVeje == null) { - postnrVeje = new ConcurrentHashMap(); + postnrVeje = new HashMap(10240); //lige nu indeholder den største 9500 entries searchPostnrVejnavnGadeid.put(postnr, postnrVeje); } @@ -344,15 +349,14 @@ gadeident = intHelper.getInstance( a.gadeid ); - Set aliaser = findVejAliaser(a.vejnavn); - for(String alias : aliaser) { - String vasketAlias = AddressUtils.vaskVejnavn(alias); - vasketAlias = aliasHelper.getInstance(vasketAlias); - - postnrVeje.put(vasketAlias, gadeident); - } + Set aliaser = aliasGenerator.findVejAliaser(a.vejnavn); + for(String alias : aliaser) { + postnrVeje.put(alias, gadeident); + } + } + Map> gade = searchGadeidentAdresser.get(gadeident); if (gade == null) { gade = new TreeMap>(); @@ -368,6 +372,15 @@ litraList.put(a.husnrbogstav, a); } + + aliasGenerator.clear(); //frigiv hukommelse inden stage2 + aliasGenerator = null; + shortHelper.clear(); + shortHelper = null; + intHelper.clear(); + intHelper = null; + + //////////////////////////////////////////////////////////////////////////////////////// long start2 = System.currentTimeMillis(); System.out.println("Build, stage1 elapsed: " + (start2-start1) ); @@ -402,6 +415,8 @@ } System.out.println("Anvendte " + vaskCount + " aliaser fra databasen"); + aliasList.clear();//cleanup inden stage3 + //////////////////////////////////////////////////////////////////////////////////////// long start3 = System.currentTimeMillis(); @@ -444,21 +459,21 @@ boolean covered = false; if (targetAddress.distributor.equals("DAO")) { - orgAddress.rute = calculateExtendedDaoRoute(eb,orgAddress,targetAddress); - orgAddress.rute = ruteHelper.getInstance(orgAddress.rute); + orgAddress.ruteMandag = calculateExtendedDaoRoute(eb,orgAddress,targetAddress); + orgAddress.ruteMandag = ruteHelper.getInstance(orgAddress.ruteMandag); - if (orgAddress.rute != null) { - orgAddress.koreliste = targetAddress.koreliste; + if (orgAddress.ruteMandag != null) { + orgAddress.korelisteMandag = targetAddress.korelisteMandag; covered = true; } } if (targetAddress.distributor.equals("BK")) { - orgAddress.koreliste = calculateExtendedBkKoreliste(eb,orgAddress,targetAddress); - orgAddress.koreliste = korelisteHelper.getInstance(orgAddress.koreliste); + orgAddress.korelisteMandag = calculateExtendedBkKoreliste(eb,orgAddress,targetAddress); + orgAddress.korelisteMandag = korelisteHelper.getInstance(orgAddress.korelisteMandag); - if (orgAddress.koreliste != null) { - orgAddress.rute = targetAddress.rute; + if (orgAddress.korelisteMandag != null) { + orgAddress.ruteMandag = targetAddress.ruteMandag; covered = true; } } @@ -477,8 +492,10 @@ } } - // nu skal vi ikke bruge idAddressMap længere + // cleanup inden stage 4 idAddressMap = null; + ruteHelper = null; + korelisteHelper = null; ////////////////////////////////////////////////////////////////////////////////////// long start4 = System.currentTimeMillis(); @@ -502,8 +519,8 @@ } addr.daekningsType = DaekningsType.DAEKNING_100PCT; - addr.rute = bean.rute; - addr.koreliste = bean.koreliste; + addr.ruteMandag = bean.rute; + addr.korelisteMandag = bean.koreliste; addr.dbkBane = bean.dbkBane; addr.distributor = bean.distributor; } @@ -562,7 +579,7 @@ private String calculateExtendedDaoRoute(ExtendedBean eb, Address orgAddress, Address targetAddress) { - if (targetAddress.rute == null) { //hvis targetAdress.rute er null så er adressen ikke dækket alligevel + if (targetAddress.ruteMandag == null) { //hvis targetAdress.rute er null så er adressen ikke dækket alligevel return null; } @@ -570,35 +587,35 @@ switch( eb.transport) { case "cykel": if (eb.afstand < 0.151) { - return "." + targetAddress.rute; + return "." + targetAddress.ruteMandag; } else if (eb.afstand < 0.501) { - return ".." + targetAddress.rute; + return ".." + targetAddress.ruteMandag; } else if (eb.afstand < 0.701) { - return "..." + targetAddress.rute; + return "..." + targetAddress.ruteMandag; } else if (eb.afstand < 1.001) { - return "...." + targetAddress.rute; + return "...." + targetAddress.ruteMandag; } break; case "scooter": if (eb.afstand < 0.151) { - return "." + targetAddress.rute; + return "." + targetAddress.ruteMandag; } else if (eb.afstand < 0.801) { - return ".." + targetAddress.rute; + return ".." + targetAddress.ruteMandag; } else if (eb.afstand < 1.201) { - return "..." + targetAddress.rute; + return "..." + targetAddress.ruteMandag; } else if (eb.afstand < 2.101) { - return "...." + targetAddress.rute; + return "...." + targetAddress.ruteMandag; } break; case "bil": if (eb.afstand < 0.151) { - return "." + targetAddress.rute; + return "." + targetAddress.ruteMandag; } else if (eb.afstand < 1.001) { - return ".." + targetAddress.rute; + return ".." + targetAddress.ruteMandag; } else if (eb.afstand < 1.601) { - return "..." + targetAddress.rute; + return "..." + targetAddress.ruteMandag; } else if (eb.afstand < 2.601) { - return "...." + targetAddress.rute; + return "...." + targetAddress.ruteMandag; } break; default: @@ -637,209 +654,9 @@ } else { inject = ".."; } - return AddressUtils.injectIntoBk(targetAddress.koreliste, inject); + return AddressUtils.injectIntoBk(targetAddress.korelisteMandag, inject); } - private Set findVejAliaser(String vejnavn) { - vejnavn = vejnavn.toLowerCase(); - HashSet aliasSet = new HashSet(); - aliasSet.add(vejnavn); - - aliasSet.add(vejnavn.replace("alle", "allé") ); - aliasSet.add(vejnavn.replace("allé", "alle") ); - - - // forkortelser - aliasSet.add(vejnavn.replace("dronningens", "dr") ); - aliasSet.add(vejnavn.replace("dr.", "dronningens") ); - aliasSet.add(vejnavn.replace("dr ", "dronningens") ); - - aliasSet.add(vejnavn.replace("dronning", "dr") ); - aliasSet.add(vejnavn.replace("dr.", "dronning") ); - aliasSet.add(vejnavn.replace("dr ", "dronning") ); - - aliasSet.add(vejnavn.replace("kng", "kongen") ); - aliasSet.add(vejnavn.replace("kongen", "kng") ); - - aliasSet.add(vejnavn.replace("kvt", "kvarter") ); - aliasSet.add(vejnavn.replace("kvarter", "kvt") ); - - aliasSet.add(vejnavn.replace("gl", "gammel") ); - aliasSet.add(vejnavn.replace("gammel", "gl") ); - - aliasSet.add(vejnavn.replace("gl", "gamle") ); - aliasSet.add(vejnavn.replace("gamle", "gl") ); - - aliasSet.add(vejnavn.replace("lille", "ll") ); - aliasSet.add(vejnavn.replace("ll ", "lille") ); - aliasSet.add(vejnavn.replace("ll.", "lille") ); - - aliasSet.add(vejnavn.replace("store", "st") ); - aliasSet.add(vejnavn.replace("st ", "store") ); - aliasSet.add(vejnavn.replace("st.", "store") ); - - aliasSet.add(vejnavn.replace("søndre", "sdr") ); - aliasSet.add(vejnavn.replace("sdr", "søndre") ); - aliasSet.add(vejnavn.replace("sønder", "sdr") ); - aliasSet.add(vejnavn.replace("sdr", "sønder") ); - - - aliasSet.add(vejnavn.replace("nørre", "nr") ); - aliasSet.add(vejnavn.replace("nr", "nørre") ); - - aliasSet.add(vejnavn.replace("nordre", "ndr") ); - aliasSet.add(vejnavn.replace("ndr", "nordre") ); - - - aliasSet.add(vejnavn.replace("vestre", "vester") ); - aliasSet.add(vejnavn.replace("vester", "vestre") ); - - aliasSet.add(vejnavn.replace("søndre", "sønder") ); - aliasSet.add(vejnavn.replace("sønder", "søndre") ); - - aliasSet.add(vejnavn.replace("østre", "øster") ); - aliasSet.add(vejnavn.replace("øster", "østre") ); - - aliasSet.add(vejnavn.replace("borgmester", "borgm") ); - aliasSet.add(vejnavn.replace("borgm", "borgmester") ); - - - aliasSet.add(vejnavn.replace("sankt", "skt") ); - aliasSet.add(vejnavn.replace("sankt", "sct") ); - aliasSet.add(vejnavn.replace("skt", "sankt") ); - - aliasSet.add(vejnavn.replace("skt", "sct") ); - aliasSet.add(vejnavn.replace("sct", "skt") ); - - - - // fornavn forkortelser - aliasSet.add(vejnavn.replace("john", "j") ); - aliasSet.add(vejnavn.replace("thomas", "th") ); - aliasSet.add(vejnavn.replace("thorvald", "th") ); - aliasSet.add(vejnavn.replace("frederik", "fr") ); - aliasSet.add(vejnavn.replace("frederiks", "fr") ); - - - aliasSet.add(vejnavn.replace("christian", "chr") ); - aliasSet.add(vejnavn.replace("christians", "chr") ); - aliasSet.add(vejnavn.replace("kristian", "kr") ); - aliasSet.add(vejnavn.replace("kristians", "kr") ); - - aliasSet.add(vejnavn.replace("mylius", "myl") ); - aliasSet.add(vejnavn.replace("myl", "mylius") ); - - aliasSet.add(vejnavn.replace("ludvig", "ludv") ); - aliasSet.add(vejnavn.replace("ludv", "ludvig") ); - - - // alternative stavninger - aliasSet.add(vejnavn.replace("peder", "peter") ); - aliasSet.add(vejnavn.replace("peter", "peder") ); - - - - // Romertal - aliasSet.add(vejnavn.replace("1", "i") ); - aliasSet.add(vejnavn.replace("i", "1") ); - - aliasSet.add(vejnavn.replace("2", "ii") ); - aliasSet.add(vejnavn.replace("ii", "2") ); - - aliasSet.add(vejnavn.replace("3", "iii") ); - aliasSet.add(vejnavn.replace("iii", "3") ); - - aliasSet.add(vejnavn.replace("4", "iv") ); - aliasSet.add(vejnavn.replace("iv", "4") ); - - aliasSet.add(vejnavn.replace("5", "v") ); - aliasSet.add(vejnavn.replace("v", "5") ); - - aliasSet.add(vejnavn.replace("6", "vi") ); - aliasSet.add(vejnavn.replace("vi", "6") ); - - aliasSet.add(vejnavn.replace("7", "vii") ); - aliasSet.add(vejnavn.replace("vii", "7") ); - - aliasSet.add(vejnavn.replace("8", "viii") ); - aliasSet.add(vejnavn.replace("viii", "8") ); - - aliasSet.add(vejnavn.replace("9", "ix") ); - aliasSet.add(vejnavn.replace("ix", "9") ); - - aliasSet.add(vejnavn.replace("10", "x") ); - aliasSet.add(vejnavn.replace("x", "10") ); - - - //alternative måder at stave vej/gade/alle - aliasSet.add(vejnavn.replace("vej", "ve") ); - aliasSet.add(vejnavn.replace("vej", "vj") ); - aliasSet.add(vejnavn.replace("vej", "v") ); - aliasSet.add(vejnavn.replace("vej", "vejen") ); - aliasSet.add(vejnavn.replace("vejen", "vej") ); - - aliasSet.add(vejnavn.replace("v", "vej") );//Vi kan have vejnavne i DB der bare slutter på v istedet for vej - - aliasSet.add(vejnavn.replace("alle", "all") ); - aliasSet.add(vejnavn.replace("allé", "all") ); - aliasSet.add(vejnavn.replace("alle", "allú") ); //Fundet i logs.hentruteinfo - aliasSet.add(vejnavn.replace("allé", "allú") ); - - aliasSet.add(vejnavn.replace("gade", "gaed") ); //Fundet i logs.hentruteinfo - aliasSet.add(vejnavn.replace("gade", "gde") ); - - aliasSet.add(vejnavn.replace("plads", "pl") ); - aliasSet.add(vejnavn.replace("vænget", "vænge") ); - - aliasSet.add(vejnavn.replace("boulevard", "blvd") ); - aliasSet.add(vejnavn.replace("blvd", "boulevard") ); - - aliasSet.add(vejnavn.replace("boulevard", "boule") ); - aliasSet.add(vejnavn.replace("boule", "boulevard") ); - - aliasSet.add(vejnavn.replace("kronborg", "krbg") ); //Krbg ladegårdsvej, 3000 - aliasSet.add(vejnavn.replace("krbg", "kronborg") ); - - // Opbyg æøå varianter over alle fundne aliaser - - @SuppressWarnings("unchecked") - HashSet variants = (HashSet) aliasSet.clone(); - - for (String vVejnavn : variants) { - // danske tegn 1 - aliasSet.add( vVejnavn.replace("æ", "ae") ); - aliasSet.add( vVejnavn.replace("ø", "oe") ); - aliasSet.add( vVejnavn.replace("å", "aa") ); - aliasSet.add( vVejnavn.replace("ae", "æ") ); - aliasSet.add( vVejnavn.replace("oe", "ø") ); - aliasSet.add( vVejnavn.replace("aa", "å") ); - - //danske tegn 2 - aliasSet.add( vVejnavn.replace("æ", "ae").replace("ø", "oe") ); - aliasSet.add( vVejnavn.replace("æ", "ae").replace("å", "aa") ); - aliasSet.add( vVejnavn.replace("ø", "oe").replace("å", "aa") ); - aliasSet.add( vVejnavn.replace("ae", "æ").replace("oe","ø") ); - aliasSet.add( vVejnavn.replace("ae", "æ").replace("aa","å") ); - aliasSet.add( vVejnavn.replace("oe", "ø").replace("aa", "å") ); - - //danske tegn 3 - aliasSet.add( vejnavn.replace("æ", "ae").replace("ø", "oe").replace("å", "aa") ); - aliasSet.add( vejnavn.replace("ae", "æ").replace("oe", "ø").replace("aa", "å") ); - - - //udenlandsketegn - aliasSet.add(vejnavn.replace("u", "ü") ); - aliasSet.add(vejnavn.replace("ü", "u") ); - - aliasSet.add(vejnavn.replace("ä", "æ") ); - aliasSet.add(vejnavn.replace("æ", "ä") ); - - aliasSet.add(vejnavn.replace("ö", "ø") ); - aliasSet.add(vejnavn.replace("ø", "ö") ); - } - - return aliasSet; - } public Set getPostnumre() { return new TreeSet( searchPostnrVejnavnGadeid.keySet() );