https://github.com/jagedn/versosalpaso.madrid.es.csv
CSV con los versos de las aceras de Madrid , extraidos de la web extinta https://versosalpaso.madrid.es/
https://github.com/jagedn/versosalpaso.madrid.es.csv
Last synced: 5 months ago
JSON representation
CSV con los versos de las aceras de Madrid , extraidos de la web extinta https://versosalpaso.madrid.es/
- Host: GitHub
- URL: https://github.com/jagedn/versosalpaso.madrid.es.csv
- Owner: jagedn
- Created: 2019-10-01T07:22:20.000Z (almost 7 years ago)
- Default Branch: master
- Last Pushed: 2023-12-19T11:18:34.000Z (over 2 years ago)
- Last Synced: 2025-10-10T17:44:10.526Z (10 months ago)
- Language: HTML
- Homepage: https://jagedn.github.io/versosalpaso.madrid.es.csv/
- Size: 112 KB
- Stars: 0
- Watchers: 1
- Forks: 0
- Open Issues: 0
-
Metadata Files:
- Readme: README.md
Awesome Lists containing this project
README
# versosalpaso.madrid.es.csv
CSV con los versos de las aceras de Madrid , extraidos de la web https://versosalpaso.madrid.es/
Como no he encontrado un dataset con los versos en formato "amigable" he scrappeado la web con este groovy
```
String html = "https://versosalpaso.madrid.es/".toURL().text
def m = html =~ /var marker_([0-9]+) = L.marker\(\[([0-9\,\.-]+)\].+?nombre:"(.+?)".+?barrio:"(.+?)".+?direccion:"(.+?)".+?verso:"(.+?)"/
println "id|latitud|longitud|autor|barrio|verso|direccion"
def lines = m.collect{ token ->
String line = [
token[1],
token[2].split(',')[0],token[2].split(',')[1],
token[3],
token[4],
token[6],
token[5]
].join('|')
line
}
lines.sort().each{
println it
}
```
y subido el resultado al repositorio