# F5 Tts

> Usa al hacer TTS clonado con F5-TTS (src layout).

- Skill: `ntizar/f5-tts` (Agent Skill)
- Install (CLI): `npx skillmds@latest add ntizar/f5-tts`
- Raw SKILL.md: https://api.skillmd.com/api/skills/ntizar/f5-tts/raw
- Safety review: pending
- Works with: Claude Code, Claude.ai, OpenAI Codex
- Category: AI & ML
- Author: ntizar (https://skillmd.com/u/ntizar)
- Updated: 2026-09-17
- Page: https://skillmd.com/skills/ntizar/f5-tts

---


# F5-TTS — texto-a-voz con clonado (zero-shot)

> ⚠️ Corrección 2026-09-05 (auditoría stars-explorer): la v1 usaba `from f5_tts.infer.api import synthesize` — **inexistente**. El paquete vive en `src/`; la API real es la clase `F5TTS.infer(...)` (o el CLI).

**Repo:** `https://github.com/SWivid/F5-TTS` (MIT, Python, ~15K⭐). Modelo en HF: `SWivid/F5-TTS`.

## When to Use

- Cuando pidas **clonar una voz** con un TTS open-source de alta calidad y velocidad (zero-shot, con una sola referencia de audio).
- Como alternativa ligera y rápida en la cadena de voces de David.

## Uso

El repo usa **layout `src/`** (`src/f5_tts/`). Instalación válida: `pip install -e .` (pyproject.toml en raíz).

API Python:

```python
from f5_tts.api import F5TTS        # clase, no función de módulo
tts = F5TTS()
tts.infer(...)                       # parámetros por el README real
```

CLI:

```bash
python -m f5_tts.infer.infer_cli     # o el binario f5-tts-infer tras instalar -e .
```

*(No existe `f5_tts/infer/api.py` — `f5_tts/infer/` contiene `infer_cli.py`, `infer_gradio.py`, `utils_infer.py`, `speech_edit.py`.)*

## Pitfalls

- Import correcto: `from f5_tts.api import F5TTS`; **no** `from f5_tts.infer.api import synthesize`.
- El paquete no está en la raíz: está en `src/f5_tts/`.
- Parámetros de `F5TTS.infer(...)`: ver el README — no coinciden con `ref_audio/ref_text` de la v1.

## Verificación

- Instalar con `pip install -e .`, llamar `F5TTS().infer(...)` con una referencia de audio y comprobar el clon.

