Voice Clone Studio vereint alle wichtigen Stimmodelle in einem Fenster
Voice Clone Studio vereint Qwen3-TTS, VibeVoice, Fish Speech und weitere Stimmnetze in einer Oberfläche mit Klonen, Dialogen und Modelltraining.
Sprache
StartSprachen
Bereiche
Voice Clone Studio vereint Qwen3-TTS, VibeVoice, Fish Speech und weitere Stimmnetze in einer Oberfläche mit Klonen, Dialogen und Modelltraining.
Wie Memora Claude-Code-Assistenten über MCP Langzeitgedächtnis und einen Wissensgraphen verleiht und verstreute Notizen in eine strukturierte Wissensdatenbank umwandelt.
Ein Blick auf fast-plate-ocr, eine leichtgewichtige Bibliothek zur Kennzeichenerkennung, die bis zu 14.000 Kennzeichen pro Sekunde mit kompakten CCT-Modellen und ONNX Runtime erreicht.
GigaAM ist eine Open-Source-Akustikmodellfamilie von SberDevices, die bei der russischen Spracherkennung besser abschneidet als Whisper. Was sie kann und wie man sie nutzt.
Verwandeln Sie ein altes Android-Smartphone mit Sentinel in ein intelligentes KI-Überwachungssystem. Erfasst Video über LAN, zeichnet auf dem PC auf und nutzt multimodale neuronale Netze für die Echtzeit-Ereigniserkennung.
Guide to integrating Tesla vehicles with Home Assistant using the community-built alandtse/tesla component, covering setup, vampire drain concerns, and Fleet API configuration.
httptap zerlegt HTTP-Anfragen in Phasen und zeigt sie als Wasserfalldiagramm im Terminal. Unterstützt SLO-Prüfungen und JSON-Export.
Open-Source-Tool, das Nachrichtenereignisse auf Candlestick-Charts legt und LLM + ML verwendet, um Marktbewegungen zu erklären und Preisbewegungen vorherzusagen.
Tired of juggling scattered training scripts for multimodal models? lmms-engine is a modular engine that handles distributed training, sequence packing, and GPU optimizations so you can focus on config and data.
TetherIA's Aero Hand Open is a five-fingered tendon-driven robotic hand you can 3D print and assemble for about $314. Here's what's inside.
Researchers from TUM and Huawei released GenRecon, which combines generative 3D models with scene reconstruction to produce clean interior meshes from photos.
Turn any website into a ready-made API client without manually parsing DevTools. The reverse-api-engineer project automates the entire chain.
arXiv-Papers mit einem Befehl in Folien und Diagramme umwandeln. paper-craft-skills erstellt akademische Diagramme, PPTX-Präsentationen und detaillierte HTML-Aufschlüsselungen.
Der Open-Source-mcp-scanner prüft MCP-Server auf versteckte Bedrohungen mit YARA, LLM-as-a-Judge und Docker-Sandboxing.
WifiForge lets you practice Wi-Fi hacking in a virtual environment—no Alfa adapters or physical routers needed. Built on Mininet-WiFi with full Kali Linux tool support.
OpenOPC von HKU-Forschern stellt Multi-Agenten-Systeme als echtes Unternehmen mit Organisationsstruktur, Kanban-Boards und rollenbasierter Speicherung neu vor – keine endlosen Schleifen höflicher Entschuldigungen mehr.
UniFace konsolidiert Gesichtserkennung, Ausrichtung, Embedding, Segmentierung, Kopfpose, Blickverfolgung und mehr unter einer einzigen ONNX-gestützten Python-Schnittstelle.
MiroShark bietet swarm-basierte Agenten-Simulationen für unter einem Dollar. So funktioniert es und wo es in Ihren Werkzeugkasten passt.
Erfahren Sie, wie Sie den physischen Standort eines Routers anhand seiner BSSID mit geowifi finden – ein Tool, das mehrere WLAN-Standortdatenbanken gleichzeitig abfragt.
Ein Open-Source-Humanoider für 5.000 Dollar, gebaut mit 3D-Druck und Python. Enthält CAD-Dateien, RL-Trainings-Pipeline und Sim-to-Real-Transfer.
Jeder, der KI-Agenten in der Produktion entwickelt, kennt den Schmerz, fünf verschiedene Tools zusammenzuflicken. Future AGI möchte dies mit einer Open-Source-Plattform lösen.
Open-Source-Alternative zu OpenAI Deep Research, die lokal mit Docker läuft, eigene LLM-Anbieter unterstützt und nur die API-Nutzung kostet.
Ein Blick auf das neka-nat/freecad-mcp-Projekt, das FreeCAD mit Claude Desktop via MCP verbindet. Erstellen Sie 3D-Modelle aus Text oder Zeichnungen.
PdfDing ist ein leichtgewichtiger, selbst gehosteter PDF-Reader und Katalog mit Synchronisierung, Anmerkungen, Signaturen und Docker-Deployment.