Launcher updates

More
PierrunoYT/SmolLM3-3B-Pinokio-Gradiov5.0updated 2d ago
A local AI chatbot powered by SmolLM3-3B with a Gradio web interface.
@pierrunoyt0 check-insNVIDIAAMDApple
PierrunoYT/MossTTS-Pinokiov5.0updated 2d ago
All-in-one Gradio UI for the MOSS-TTS Family: voice cloning, dialogue generation, voice design from text, and sound effects.
@pierrunoyt4 check-insNVIDIAAMDApple
PierrunoYT/HiggsAudioV3-Pinokiov7.0updated 2d ago
Pinokio launcher for Higgs Audio v3 TTS with Gradio UI, SGLang-Omni backend, and automatic model download.
@pierrunoyt2 check-insNVIDIAAMDApple
PierrunoYT/Transcribr-Pinokiov5.0updated 2d ago
Bulk transcribe many YouTube videos, whole playlists, or your own uploaded audio/video files at once with faster-whisper. Outputs txt, srt, vtt, or json.
@pierrunoyt0 check-insNVIDIAAMDApple
PierrunoYT/OmniVoice-Pinokiov5.0updated 2d ago
Zero-shot multilingual TTS (600+ languages) with voice cloning and voice design — Gradio UI (app/app.py)
@pierrunoyt8 check-insNVIDIAAMDApple
PierrunoYT/PRX-Pixel-Pinokiov5.0updated 2d ago
Pixel-space PRX text-to-image pipeline (~7B params, Qwen3-VL text encoder, no VAE)
@pierrunoyt1 check-inNVIDIAAMDApple
PierrunoYT/Audio-Flamingo-3-Pinokiov7.0updated 2d ago
NVIDIA's Audio Flamingo 3 - Large Audio-Language Model for speech, sound, and music understanding with Gradio web interface
@pierrunoyt0 check-insNVIDIAAMDApple
PierrunoYT/dots.tts-Pinokiov5.0updated 2d ago
2B-parameter fully continuous, end-to-end autoregressive text-to-speech with zero-shot voice cloning. https://huggingface.co/rednote-hilab/dots.tts-base
@pierrunoyt1 check-inNVIDIAAMDApple
PierrunoYT/OmniVoice-Studio-Pinokiov7.0updated 2d ago
The open-source ElevenLabs alternative. Local voice cloning, video dubbing, and real-time dictation — 646 languages, no API keys.
@pierrunoyt2 check-insNVIDIAAMDApple
PierrunoYT/SmolLM3-3B-Pinokiov5.0updated 2d ago
Advanced 3B parameter language model with Gradio web interface, GPU acceleration, and complete privacy
@pierrunoyt2 check-insNVIDIAAMDApple
PierrunoYT/TranslateGemma-Pinokiov5.0updated 2d ago
🌍 TranslateGemma - Google's open-source multilingual translation AI. Translate text across 55+ languages and extract/translate text from images. Powered by Gemma 3 architecture.
@pierrunoyt2 check-insNVIDIAAMDApple
PierrunoYT/Youtube2MP3-Pinokiov5.0updated 2d ago
🎵 YouTube to MP3 downloader with a simple Gradio UI and bundled FFmpeg. Paste a YouTube link to download MP3.
@pierrunoyt0 check-insNVIDIAAMDApple
PierrunoYT/Photoroom-PRX-Pinokiov5.0updated 2d ago
Gradio web interface for Photoroom's PRX-1024-t2i-beta text-to-image model
@pierrunoyt2 check-insNVIDIAAMDApple
PierrunoYT/VyvoTTS-LFM2-Pinokiov5.0updated 2d ago
High-quality Text-to-Speech powered by VyvoTTS LFM2 model with easy-to-use web interface
@pierrunoyt0 check-insNVIDIAAMDApple
PierrunoYT/moondream-3-pinokiov5.0updated 2d ago
A web interface for the Moondream3 vision-language model featuring image captioning, visual question answering, object detection, and object pointing.
@pierrunoyt0 check-insNVIDIAAMDApple
PierrunoYT/soprano-tts-pinokiov5.0updated 2d ago
Instant, Ultra-Realistic Text-to-Speech
@pierrunoyt1 check-inNVIDIAAMDApple
PierrunoYT/KittenTTS-Pinokiov7.0updated 2d ago
Ultra-lightweight text-to-speech (15M-80M params) — CPU optimized, 8 voices, ONNX-powered
@pierrunoyt2 check-insNVIDIAAMDApple
PierrunoYT/liquid-audio-pinokiov7.0updated 2d ago
Liquid Audio - LFM2.5-Audio-1.5B: speech-to-speech, ASR, and TTS powered by Liquid AI.
@pierrunoyt0 check-insNVIDIAAMDApple
PierrunoYT/VoxCPM-2-Pinokiov5.0updated 2d ago
Tokenizer-free TTS for context-aware speech, voice cloning, and voice design. 2B params, 48kHz, 30 languages (Gradio UI).
@pierrunoyt3 check-insNVIDIAAMDApple