110 datasets found

Organizations: DemIA Marketplace

Filter Results
  • hugging face speech recognition starter

    Esta plantilla es un proyecto de partida para reconocimiento automático del habla con transformers, con el preprocesado de audio (remuestreo a 16 kHz mono) y la transcripción a...
  • hugging face image captioning starter

    Esta plantilla es un proyecto de partida para generar descripciones de imágenes con transformers, combinando un modelo de visión-lenguaje y la generación de texto. Útil, por...
  • hugging face object detection starter

    Esta plantilla es un proyecto de partida para detección de objetos con transformers, con el procesado de la imagen, la inferencia y el post-procesado con umbral de confianza...
  • sentence transformers search starter

    Esta plantilla es un proyecto de partida de búsqueda semántica con sentence-transformers: codifica un corpus en vectores, los indexa y recupera por similitud del coseno frente a...
  • hugging face zero shot classification starter

    Esta plantilla es un proyecto de partida para clasificación zero-shot con transformers, que asigna etiquetas arbitrarias a un texto mediante inferencia de lenguaje natural, sin...
  • Hugging face text generation starter

    Esta plantilla es un proyecto de partida para generación de texto con transformers, con la configuración de los parámetros de muestreo (temperatura, top-k/top-p) y la generación...
  • Hugging face translation starter

    Esta plantilla es un proyecto de partida para traducción automática con transformers, con la carga de un modelo de traducción y el flujo de inferencia entre pares de idiomas. En...
  • Hugging face summarisation starter

    Esta plantilla es un proyecto de partida para resumen automático (abstractive summarisation) con transformers, con el troceado de textos largos y la generación del resumen. En...
  • Hugging face question answering starter

    Esta plantilla es un proyecto de partida para pregunta-respuesta extractiva con transformers, que localiza la respuesta dentro de un contexto dado a partir de una pregunta. En...
  • Hugging face token classification starter

    Esta plantilla es un proyecto de partida para clasificación de tokens con transformers, típicamente reconocimiento de entidades nombradas (NER), con la agrupación de subtokens...
  • Hugging face text classification starter

    Esta plantilla es un proyecto de partida para clasificación de texto con transformers, con la carga del modelo y el tokenizador, la inferencia y el paso a etiquetas, aplicable a...
  • Hugging face pipeline starter

    Esta plantilla muestra cómo usar la API pipeline() de Hugging Face para ejecutar inferencia con modelos preentrenados en pocas líneas, sin necesidad de gestionar el tokenizador...
  • hugging face image classification starter

    Esta plantilla es un proyecto de partida para clasificación de imágenes con transformers, usando el image processor del modelo y la inferencia a etiquetas. En el contexto de la...
  • hugging face embeddings starter

    Esta plantilla muestra cómo obtener representaciones vectoriales (embeddings) de texto con modelos de transformers, como base para búsqueda semántica, agrupamiento o...
  • facebook/mms-tts-spa

    El modelo MMS-TTS-spa es un modelo de síntesis de voz (text-to-speech) basado en arquitectura VITS, que genera voz en español de extremo a extremo. Ha sido desarrollado en el...
  • facebook/mms-tts-ara

    El modelo MMS-TTS-ara es un modelo de síntesis de voz (text-to-speech) basado en arquitectura VITS, que genera voz en árabe de extremo a extremo. Ha sido desarrollado en el...
  • facebook/mms-tts-eng

    El modelo MMS-TTS-eng es un modelo de síntesis de voz (text-to-speech) basado en arquitectura VITS, que genera voz en inglés de extremo a extremo con un único modelo. Ha sido...
  • microsoft/speecht5_tts

    El modelo SpeechT5-TTS es un modelo de síntesis de voz (text-to-speech) basado en arquitectura encoder-decoder unificada de voz y texto (SpeechT5), que genera voz en inglés a...
  • superb/wav2vec2-base-superb-ks

    El modelo Wav2Vec2-base-superb-ks es un modelo de clasificación de audio basado en arquitectura Wav2Vec2, ajustado para la detección de palabras clave (keyword spotting). Ha...
  • facebook/mms-lid-256

    El modelo MMS-LID-256 es un modelo de clasificación de audio basado en arquitectura Wav2Vec2 (familia MMS), especializado en la identificación del idioma hablado entre 256...
You can also access this registry using the API (see API Docs).