-
hugging face speech recognition starter
Esta plantilla es un proyecto de partida para reconocimiento automático del habla con transformers, con el preprocesado de audio (remuestreo a 16 kHz mono) y la transcripción a... -
hugging face image captioning starter
Esta plantilla es un proyecto de partida para generar descripciones de imágenes con transformers, combinando un modelo de visión-lenguaje y la generación de texto. Útil, por... -
hugging face object detection starter
Esta plantilla es un proyecto de partida para detección de objetos con transformers, con el procesado de la imagen, la inferencia y el post-procesado con umbral de confianza... -
sentence transformers search starter
Esta plantilla es un proyecto de partida de búsqueda semántica con sentence-transformers: codifica un corpus en vectores, los indexa y recupera por similitud del coseno frente a... -
hugging face zero shot classification starter
Esta plantilla es un proyecto de partida para clasificación zero-shot con transformers, que asigna etiquetas arbitrarias a un texto mediante inferencia de lenguaje natural, sin... -
Hugging face text generation starter
Esta plantilla es un proyecto de partida para generación de texto con transformers, con la configuración de los parámetros de muestreo (temperatura, top-k/top-p) y la generación... -
Hugging face translation starter
Esta plantilla es un proyecto de partida para traducción automática con transformers, con la carga de un modelo de traducción y el flujo de inferencia entre pares de idiomas. En... -
Hugging face summarisation starter
Esta plantilla es un proyecto de partida para resumen automático (abstractive summarisation) con transformers, con el troceado de textos largos y la generación del resumen. En... -
Hugging face question answering starter
Esta plantilla es un proyecto de partida para pregunta-respuesta extractiva con transformers, que localiza la respuesta dentro de un contexto dado a partir de una pregunta. En... -
Hugging face token classification starter
Esta plantilla es un proyecto de partida para clasificación de tokens con transformers, típicamente reconocimiento de entidades nombradas (NER), con la agrupación de subtokens... -
Hugging face text classification starter
Esta plantilla es un proyecto de partida para clasificación de texto con transformers, con la carga del modelo y el tokenizador, la inferencia y el paso a etiquetas, aplicable a... -
Hugging face pipeline starter
Esta plantilla muestra cómo usar la API pipeline() de Hugging Face para ejecutar inferencia con modelos preentrenados en pocas líneas, sin necesidad de gestionar el tokenizador... -
hugging face image classification starter
Esta plantilla es un proyecto de partida para clasificación de imágenes con transformers, usando el image processor del modelo y la inferencia a etiquetas. En el contexto de la... -
hugging face embeddings starter
Esta plantilla muestra cómo obtener representaciones vectoriales (embeddings) de texto con modelos de transformers, como base para búsqueda semántica, agrupamiento o... -
facebook/mms-tts-spa
El modelo MMS-TTS-spa es un modelo de síntesis de voz (text-to-speech) basado en arquitectura VITS, que genera voz en español de extremo a extremo. Ha sido desarrollado en el... -
facebook/mms-tts-ara
El modelo MMS-TTS-ara es un modelo de síntesis de voz (text-to-speech) basado en arquitectura VITS, que genera voz en árabe de extremo a extremo. Ha sido desarrollado en el... -
facebook/mms-tts-eng
El modelo MMS-TTS-eng es un modelo de síntesis de voz (text-to-speech) basado en arquitectura VITS, que genera voz en inglés de extremo a extremo con un único modelo. Ha sido... -
microsoft/speecht5_tts
El modelo SpeechT5-TTS es un modelo de síntesis de voz (text-to-speech) basado en arquitectura encoder-decoder unificada de voz y texto (SpeechT5), que genera voz en inglés a... -
superb/wav2vec2-base-superb-ks
El modelo Wav2Vec2-base-superb-ks es un modelo de clasificación de audio basado en arquitectura Wav2Vec2, ajustado para la detección de palabras clave (keyword spotting). Ha... -
facebook/mms-lid-256
El modelo MMS-LID-256 es un modelo de clasificación de audio basado en arquitectura Wav2Vec2 (familia MMS), especializado en la identificación del idioma hablado entre 256...