110 datasets found

Filter Results
  • hugging face speech recognition starter

    Esta plantilla es un proyecto de partida para reconocimiento automático del habla con transformers, con el preprocesado de audio (remuestreo a 16 kHz mono) y la transcripción a...
  • hugging face image captioning starter

    Esta plantilla es un proyecto de partida para generar descripciones de imágenes con transformers, combinando un modelo de visión-lenguaje y la generación de texto. Útil, por...
  • hugging face object detection starter

    Esta plantilla es un proyecto de partida para detección de objetos con transformers, con el procesado de la imagen, la inferencia y el post-procesado con umbral de confianza...
  • sentence transformers search starter

    Esta plantilla es un proyecto de partida de búsqueda semántica con sentence-transformers: codifica un corpus en vectores, los indexa y recupera por similitud del coseno frente a...
  • hugging face zero shot classification starter

    Esta plantilla es un proyecto de partida para clasificación zero-shot con transformers, que asigna etiquetas arbitrarias a un texto mediante inferencia de lenguaje natural, sin...
  • Hugging face text generation starter

    Esta plantilla es un proyecto de partida para generación de texto con transformers, con la configuración de los parámetros de muestreo (temperatura, top-k/top-p) y la generación...
  • Hugging face translation starter

    Esta plantilla es un proyecto de partida para traducción automática con transformers, con la carga de un modelo de traducción y el flujo de inferencia entre pares de idiomas. En...
  • Hugging face summarisation starter

    Esta plantilla es un proyecto de partida para resumen automático (abstractive summarisation) con transformers, con el troceado de textos largos y la generación del resumen. En...
  • Hugging face question answering starter

    Esta plantilla es un proyecto de partida para pregunta-respuesta extractiva con transformers, que localiza la respuesta dentro de un contexto dado a partir de una pregunta. En...
  • Hugging face token classification starter

    Esta plantilla es un proyecto de partida para clasificación de tokens con transformers, típicamente reconocimiento de entidades nombradas (NER), con la agrupación de subtokens...
  • Hugging face text classification starter

    Esta plantilla es un proyecto de partida para clasificación de texto con transformers, con la carga del modelo y el tokenizador, la inferencia y el paso a etiquetas, aplicable a...
  • Hugging face pipeline starter

    Esta plantilla muestra cómo usar la API pipeline() de Hugging Face para ejecutar inferencia con modelos preentrenados en pocas líneas, sin necesidad de gestionar el tokenizador...
  • hugging face image classification starter

    Esta plantilla es un proyecto de partida para clasificación de imágenes con transformers, usando el image processor del modelo y la inferencia a etiquetas. En el contexto de la...
  • hugging face embeddings starter

    Esta plantilla muestra cómo obtener representaciones vectoriales (embeddings) de texto con modelos de transformers, como base para búsqueda semántica, agrupamiento o...
  • facebook/mms-tts-spa

    El modelo MMS-TTS-spa es un modelo de síntesis de voz (text-to-speech) basado en arquitectura VITS, que genera voz en español de extremo a extremo. Ha sido desarrollado en el...
  • facebook/mms-tts-ara

    El modelo MMS-TTS-ara es un modelo de síntesis de voz (text-to-speech) basado en arquitectura VITS, que genera voz en árabe de extremo a extremo. Ha sido desarrollado en el...
  • facebook/mms-tts-eng

    El modelo MMS-TTS-eng es un modelo de síntesis de voz (text-to-speech) basado en arquitectura VITS, que genera voz en inglés de extremo a extremo con un único modelo. Ha sido...
  • microsoft/speecht5_tts

    El modelo SpeechT5-TTS es un modelo de síntesis de voz (text-to-speech) basado en arquitectura encoder-decoder unificada de voz y texto (SpeechT5), que genera voz en inglés a...
  • superb/wav2vec2-base-superb-ks

    El modelo Wav2Vec2-base-superb-ks es un modelo de clasificación de audio basado en arquitectura Wav2Vec2, ajustado para la detección de palabras clave (keyword spotting). Ha...
  • facebook/mms-lid-256

    El modelo MMS-LID-256 es un modelo de clasificación de audio basado en arquitectura Wav2Vec2 (familia MMS), especializado en la identificación del idioma hablado entre 256...