Views
No views yet
text_embeddings.json), seguido de softmax. No se entrena con fotos de arañas: se midió que
entrenar con fotos chilenas de iNaturalist mejora en iNaturalist y empeora en otra fuente
(ROC 0.79 vs 0.93 sobre ejemplares de museo).| Archivo | Qué es |
|---|---|
image_encoder.onnx | Torre visual de BioCLIP-2, int8. Entrada pixel_values [N,3,224,224], salida image_embedding [N,768] (ya normalizada). |
text_embeddings.json | 26×768 vectores de texto de las clases + logit_scale. |
labels.json | Nombres científicos/comunes, target_index y umbrales calibrados (🔴 0.9012 / 🟡 0.0458). |
[0.4815, 0.4578, 0.4082], std [0.2686, 0.2613, 0.2758]).