Changeset When Comment
79465752

Angående vindskyddens bilder i beskrivningar. Jag har nyligen försökt extrahera dem av de jättelånga länkarna som jag fått av Google-tjänster. Sedan ville jag ladda bilderna upp till Commons-tjänsten du tidigare länkat.
Men det visade sig att kräva Google-kontos auktorisation, annars ger det 403 Forbidden som svaret. Detta försvårar automatisk extrahering. Jag är säkert att det fortfarande är möjligt att genomföra efter lite sysslor med kakor osv. Men för tillfället har jag andra spännande kartrelaterade saker att göra.

79465600

Att deskriptionerna blir kapade är förväntat. Mina skript var inte särskilt smarta för att spara hela beskrivningar om de var längre än 255 tecken. Och jag tror inte att OSM:s taggar var tänkta som förvaringsplats för överdrivet långa texter. Jag förväntar mig inte att någon skulle leta efter till exempel fullständiga vägbeskrivningar till en stuga i dess OSM-beskriviningsetikett.

Jo, ja kunde ha gjort det bättre och ha ett skript som avslutar textrader vid punkttecken, så att de inte ser så fullt ut, men skillnaden vore riktigt liten.

79465752

>det måste ha tagit en stund om du gjode det manuellt.
Oj nej, då använde jag reguljära uttrycks kraft. Kodavsnittet nedan gör jobbet:

def sanitize_nodes(new_list):
# The tag "note=*" in import data is often bad, attempt to clean it up
for nd in new_list:
tag = get_item_with_k(nd.xmlitem, "note")
if tag is None:
return
note = tag.attrib['v']
# remove img tags as extremely long and impossible to keep
while True:
m = re.search(r"(.*)<img[^>]+>(.*)", note)
if m:
note = m.group(1) + m.group(2)
else:
break
note = note.replace("<br>", " ")
note = note.replace(" ", " ")
note = note[:255].strip()
# Mangle the existing tag
tag.attrib['k'] = "comment"
tag.attrib['v'] = note

79465752

> Många av dem som var i vatten var det vattnet som inte låg riktigt rätt.
Sant. Jag har nyss fixat ett par sjöar med dåliga konturnlinjer.

> Bilder läggs bäst upp på commons.wikimedia.org med lämplig licens.

Nä, det var redan ganska jobbigt att rensa nodbeskrivningarna från bild-URL:er som var lös- eller friformaterade. Jag gjorde mitt bästa för att extrahera åtminstone en smula nyttig textinformation av de ursprungliga beskrivningarna. Det vore för mycket att fråga från mig att flytta samtliga bilder till en annan hosting.

79470921

Tack!

79465752

Hej! Tack för meddelandet. Angående dina anmärkningar:
1) Tråkigt att positionsfel var såpass dåligt för dem som hamnade i vattnet. Jag kan kolla genom dem en gång till och redigera bort de drunknade.
2) Håller med, kan redigera "comment" till "description".
3) Jag försökte överföra så mycket data (dvs enstaka vindskydds särdrag) som möjligt, tror inte att jag kan lägga något mer. T ex URL till bilder kunde jag inte lägga till, för de alltid var längre än 255 tecken och inte kunde rymmas i OSM-etiketter.
4) Jag redigerade de flesta dubbletter bort innan uppladdningen (nya noder som var närmare till ett befintligt vindskydd än tröskelvärdet ansågs som dubbletter). Men några få punkter kunde ändå ha tränga sig in (som det alltid händer). Visst kommer jag radera de uppenbara dubbletter, men du och andra är visst välkomna att göra det också.