Il dataset delle razze
Tutto ciò che il sito valuta, in un unico file. BreedQuest conserva circa 5.400 valori assegnati su 458 razze di cani e gatti — carattere, impegno di cura, energia, salute — e finora esistevano solo sparsi su 458 pagine diverse. La tabella qui sotto sono gli stessi dati, in piano, generati a ogni build perché non possano discostarsi da ciò che dicono le pagine.
Cosa contiene
Una riga per razza, 36 colonne. Le colonne d'identità sono slug, nome, specie e gruppo, più numero e gruppo FCI dove la razza è registrata FCI e se l'AKC la riconosce. Poi quattro dati descrittivi — taglia, peso, aspettativa di vita e mantello — così come compaiono sulla pagina della razza.
Il punto sono i punteggi. Undici colonne portano le valutazioni da 1 a 5 che mostrano le pagine, altre sei quelle da 1 a 10 che usa l'app. Misurano cose diverse su scale diverse e non vengono unite di proposito.
Il tratto distintivo, e perché ce ne sono due
Ogni razza porta esattamente dodici tratti valutati, ma nei cani solo undici sono fissi. Il dodicesimo si sceglie razza per razza fra 48 possibilità — istinto da pastore, russare, illusione da cane da grembo, istinto di salvataggio in acqua, arte della fuga — ed è spesso il numero più interessante della pagina. I gatti hanno i loro dodici fissi e condividono solo otto etichette con i cani.
Invece di appiattirlo per rendere rettangolare la griglia, l'esportazione gli dà due colonne sue: signature_trait e signature_score. Due razze hanno bisogno di una seconda coppia, e infatti c'è: il Corgi Gallese Pembroke porta abbaio/allerta più istinto da pastore, e il Siberian Husky ululato più arte della fuga. Una griglia rettangolare da dodici colonne avrebbe scartato in silenzio 364 punteggi specifici di razza.
Da dove vengono i numeri
I dati descrittivi — taglia, peso, longevità, mantello, gruppo — si leggono dagli standard di razza, con FCI e AKC come riferimenti principali e il club nazionale dove la razza è sua. È verificabile, e la pagina della razza cita le sue fonti.
I punteggi dei tratti sono valutazioni editoriali, non misurazioni. Sono la nostra lettura dello standard e della letteratura di lavoro, applicata in modo coerente su tutta la libreria perché il confronto fra razze significhi qualcosa, e sono riviste, non generate. Prendile per quello che sono: un'opinione ben fondata su una scala coerente, e non dati da indagine. Dove un valore è derivato e non ricavato da una fonte, il metodo è documentato: il punteggio di giocosità, per esempio, è una formula pubblicata su tratti che la razza già possiede, con correzioni editoriali che citano ciascuna uno standard.
Come usarlo
I due file sono normali download HTTP, senza chiave e senza limiti di richieste. Il CSV è UTF-8 con riga di intestazione. Il JSON è il registro che legge il sito stesso.
Non abbiamo messo una licenza di riuso su questi dati, quindi non si concedono diritti oltre alla lettura e alla citazione. Se vuoi costruirci sopra qualcosa, è una conversazione che facciamo volentieri: scrivi a [email protected] e raccontaci cosa hai in mente. Citarli non richiede permesso: BreedQuest, dataset delle razze, con la data in cui l'hai scaricato.
Le colonne
slug, name, species | the breed's identity and whether it is a dog or a cat |
group | our group key — hound, terrier, shorthair… |
fci_number, fci_group | FCI nomenclature, blank for cats and for unregistered breeds |
akc | yes / no |
size, weight, life_expectancy, coat | the descriptive facts, as printed on the breed page |
web_* | eleven trait scores, 1–5, the ones the breed pages display |
signature_trait, signature_score | the breed-specific twelfth trait, and its score |
signature_trait_2, signature_score_2 | a second one, for the two breeds that carry two |
app_* | six trait scores, 1–10, the scale the app uses |
Cita così: BreedQuest. Dataset delle razze. breedquest.com/data/