Acceso a los datos de OBIS

Cómo encontrar y acceder a los datos de OBIS

Elizabeth Lawrence

2026-07-24

Cómo obtener datos de OBIS

Existen varias formas de acceder, según lo que necesites:

  • obis.org — explorar, buscar y citar conjuntos de datos
  • OBIS Mapper — exploración visual y descargas rápidas
  • robis — acceso programático desde R
  • Parquet + robisdb (nuevo) — acceso rápido y local al conjunto de datos completo

El portal de OBIS — obis.org

Tu punto de partida para encontrar y entender los datos:

  • Buscar y explorar por taxón, región o conjunto de datos
  • Ver el resumen del conjunto de datos y la información de citación
  • Encontrar los datos de contacto del proveedor de los datos

OBIS Mapper — mapper.obis.org

Exploración visual de los datos de OBIS, basada en filtros:

  • Filtrar por taxón, geografía, tiempo y extensiones
  • Combinar varias capas en una sola vista
  • Descargar capas individuales como CSV
    • Mejor para conjuntos de datos más pequeños (<20,000,000 registros)
  • Incluir las extensiones eMoF y/o de datos derivados de ADN
    • (marca la casilla — no está activada por defecto)

robis — acceso programático desde R

install.packages("robis")
library(robis)

records <- occurrence(scientificname = "Megaptera novaeangliae", fields="associatedSequences")
dna <- dataset(scientificname = "Megaptera novaeangliae", fields="associatedSequences")
  • Consultar por especie, grupo taxonómico, geometría (WKT), profundidad, tiempo, indicadores de calidad…
  • Función incorporada checklist() para listas de taxones en un área
  • dataset() — consulta de conjuntos de datos en lugar de registros biológicos

github.com/iobis/robis

Nuevo: acceso rápido mediante Parquet

  • OBIS publica el conjunto de datos global completo en formato Parquet
  • Paquete de R recién lanzado, robisdb
    • (publicado este mes — en desarrollo activo)
pak::pak("iobis/robisdb")
library(robisdb)

con <- connect_opendata_local("~/data/obis-open-data")
occ <- con |> occurrence_db(scientificname = "Minuca rapax")
  • Refleja las funciones de robis en la medida de lo posible (occurrence_db(), checklist_db()…)
  • Funciona sobre DuckDB — consultas rápidas y locales sin cargar todo en memoria
  • Diseñado para escalar: análisis del conjunto de datos completo o repetidos que serían lentos vía la API