📢
gitzw.com上线了,功能陆续更新中,如有问题或反馈请在下方反馈/建议中给我们留言。
✕
读懂开源,从这里开始
首页
排行榜
教程中心
知识库
资讯
分类
专题合集
🌙
简
▾
简体
繁體
English
登录
用户中心
▾
👤 用户中心
📬 我的订阅
✉️ 我的邮箱
🔑 修改密码
⭐ 我的收藏
💬 我的反馈记录
↩ 退出
订阅
☰
首页
排行榜
教程中心
知识库
资讯
分类
专题合集
搜索
订阅
RSS
简体
繁體
English
🔍
搜索
📡
RSS
🔥 热门搜索
llm
vuejs
pytorch
langchain
sql
graphql
peg
leetcode
tokio
redis
unity
php8
"语音活动检测"
KoljaB
/
RealtimeSTT
RealtimeSTT:实时语音转文本库 — RealtimeSTT是一个基于Python的库,能够实现实时语音转文本,具有高效、低延迟和准确的特点。它可以应用于各种语音交互场景,例如虚拟助手、语音识别等。RealtimeSTT的先进功能使其成为语音技术领域的一种重要工具。
Python
★ 10k
⑂ 850
other
☆
snakers4
/
silero-vad
silero-vad:企业级语音活动检测器 — Silero VAD 是一个预训练的企业级语音活动检测器,适用于语音识别和语音命令等场景。它基于 ONNX 和 PyTorch 构建,能够高效准确地检测语音活动。
Python
★ 9.6k
⑂ 804
ai-ml
☆
android
/
uamp
uamp:Android 音频示例应用 — uamp 是一个 Android 平台上的音频应用示例,使用 Kotlin 编写。它为开发者提供了一个参考示例,展示了如何使用 Android 的音频 API。通过 uamp,开发者可以学习如何创建自己的音频应用
Kotlin
★ 13.2k
⑂ 3.8k
mobile
☆
coqui-ai
/
TTS
TTS:深度学习文本转语音工具包 — TTS是一个基于深度学习的文本转语音工具包,支持多种语音合成模型和声码器,包括Glow-TTS、HiFiGAN和MelGAN等。它已在研究和生产环境中得到广泛应用,能够生成高质量的语音。TTS的主要特点包括支持多说话人语音合成、声码器和语音合成模型的选择等
Python
★ 45.8k
⑂ 6.2k
ai-ml
☆
Zackriya-Solutions
/
meetily
meetily:开源AI会议助手 — meetily是一个自托管、开源的AI会议记录工具,支持macOS和Windows系统,采用Rust编程语言,实现了快速的Parakeet/Whisper实时转录和Ollama总结。meetily注重隐私保护,所有处理都在本地进行,无需云服务。meetily的出现为用户提供了一个安全、快速的会议记录解决方案
Rust
★ 25.6k
⑂ 2.6k
ai-ml
☆
actions
/
checkout
checkout:代码库检出操作 — checkout是一个GitHub Actions的操作,用于检出代码库,以便在工作流程中执行后续的操作。它支持多种版本控制系统,包括Git。使用checkout,可以轻松地在工作流程中获取代码库的最新版本,并执行自动化的测试、构建和部署等操作。
TypeScript
★ 8.5k
⑂ 2.7k
web
+8 ★
☆
espnet
/
espnet
espnet:端到端语音处理工具包 — espnet是一个基于Python的工具包,提供了从语音识别到语音合成等一系列的语音处理功能。它支持多种深度学习框架,包括chainer和pytorch。通过使用espnet,可以快速开发和部署语音处理应用,提高语音识别和合成的准确性和效率。
Python
★ 9.9k
⑂ 2.4k
ai-ml
☆
open-mmlab
/
Amphion
Amphion:音频、音乐和语音生成工具包 — Amphion提供了一系列的音频、音乐和语音生成工具和库,包括audio-generation、speech-synthesis和music-generation等。它支持Python语言,帮助研究人员和工程师快速开发和测试音频、音乐和语音生成模型。同时,Amphion也提供了许多预训练模型和示例代码,方便用户快速上手。
Python
★ 10k
⑂ 829
other
☆
aristocratos
/
btop
btop:系统资源监控工具 — btop 是一个使用 C++ 编写的系统资源监控工具,用于显示系统的 CPU、内存、磁盘和网络资源使用情况。它可以帮助用户实时监控系统资源,快速发现和解决系统瓶颈。通过使用 btop,用户可以优化系统性能和资源利用率。
C++
★ 33.6k
⑂ 1.1k
other
☆
karpathy
/
autoresearch
autoresearch:自动研究项目 — autoresearch项目使用AI代理自动进行研究,重点关注单GPU上的nanochat训练,能够自动完成训练过程。该项目利用Python语言开发,能够高效地进行研究工作。autoresearch项目的目标是实现自动化研究,减少人工干预,提高研究效率
Python
★ 91.6k
⑂ 13.1k
ai-ml
☆
2noise
/
ChatTTS
ChatTTS:日常对话生成语音模型 — ChatTTS是一个基于Python的生成式语音模型,利用自然语言处理和机器学习算法,实现日常对话的语音生成。它支持多种语言,包括英语和中文,能够很好地模拟人类对话。ChatTTS的出现使得语音交互变得更加自然和人性化.
Python
★ 39.7k
⑂ 4.2k
ai-ml
☆
moonshine-ai
/
moonshine
moonshine:低延迟语音处理工具 — moonshine 是一个专注于极低延迟语音处理的工具,支持语音转文本、意图识别和文本转语音,特别适合用于开发语音助手和用户界面。
C++
★ 10.1k
⑂ 526
ai-ml
+282 ★
☆
jiaaro
/
pydub
pydub:音频操作库 — pydub 提供了一个简单易用的接口来操作音频,允许用户以高级方式处理音频数据。它支持多种音频格式,包括 WAV、MP3 和 FLAC。通过使用 pydub,开发者可以轻松地创建、编辑和操作音频文件
Python
★ 9.8k
⑂ 1.1k
other
☆
osquery
/
osquery
osquery:操作系统监控和分析 — osquery是一个开源的操作系统监控和分析工具,使用SQL来查询和分析操作系统的数据。它能够提供实时的操作系统信息,帮助用户监控和分析系统的安全性和性能。通过使用osquery,用户可以更好地了解和管理自己的系统
C++
★ 23.4k
⑂ 2.6k
devops
☆
babysor
/
MockingBird
MockingBird:实时语音克隆与生成 — MockingBird利用Python和PyTorch实现了快速的语音克隆和实时语音生成,能够广泛应用于语音合成、语音助手等领域。它的出现标志着语音技术的重大进步,能够为人们带来更加自然和便捷的语音交互体验。同时,MockingBird也为AI和深度学习的研究提供了新的可能性
Python
★ 36.9k
⑂ 5.2k
ai-ml
☆
RVC-Project
/
Retrieval-based-Voice-Conversion-WebUI
Retrieval-based-Voice-Conversion-WebUI:基于检索的语音转换Web界面 — Retrieval-based-Voice-Conversion-WebUI是一个开源项目,利用检索模型实现语音转换。它可以帮助用户轻松训练一个好的语音转换模型,仅需10分钟的语音数据。该项目使用Python语言开发,集成了多种技术,如so-vits-svc和vits,能够实现高质量的语音转换。
Python
★ 36.5k
⑂ 5.1k
data
☆
handy-computer
/
transcribe.cpp
transcribe.cpp:语音转文字工具 — transcribe.cpp是一个基于ggml库的语音转文字工具,支持超过16种不同的模型家族。它能够高效地将语音转换为文本,适用于多种应用场景。
C++
★ 1.4k
⑂ 35
other
+395 ★
☆
xcanwin
/
KeepChatGPT
KeepChatGPT:提高ChatGPT数据安全和效率的插件 — KeepChatGPT通过提供自动刷新、保持活跃、数据安全等功能,提高了ChatGPT的数据安全能力和效率。同时,它还提供了诸如克隆对话、言无不尽和净化页面等创新功能,提升了用户的AI体验。通过使用KeepChatGPT,用户可以享受更加安全、顺畅和高效的AI互动。
JavaScript
★ 14.9k
⑂ 738
ai-ml
☆
MiniMax-AI
/
skills
skills:人工智能技能开发库 — skills是一个开源的C#库,用于开发和集成人工智能技能。它提供了一种简单的方式来创建和管理AI能力,使得开发者可以更加容易地将AI集成到自己的应用程序中。通过使用skills,开发者可以快速构建智能应用,提高用户体验
C#
★ 13.1k
⑂ 1.1k
other
☆
Unclecheng-li
/
VulnClaw
VulnClaw:基于AI的漏洞发现和利用工具 — VulnClaw利用大语言模型和自然语言输入,能够自动完成漏洞发现和利用的全流程。该工具结合了AI技术和渗透测试技能,能够提高漏洞发现和利用的效率和准确性。同时,VulnClaw也能够生成报告,方便用户查看和分析漏洞信息。
Python
★ 1.7k
⑂ 227
ai-ml
+132 ★
☆
AudioKit
/
AudioKit
AudioKit:音频合成与分析平台 — AudioKit是一个强大的音频合成、处理和分析平台,支持iOS、macOS和tvOS。它提供了丰富的音频功能,包括MIDI支持,能够帮助开发者创建出色的音频应用。AudioKit使用Swift语言开发,易于集成和使用
Swift
★ 11.4k
⑂ 1.6k
mobile
☆
rcourtman
/
Pulse
Pulse:实时监控和AI洞察 — Pulse提供了实时监控和AI驱动的洞察,帮助用户快速发现和解决问题。它支持多种平台,包括Proxmox、Docker和Kubernetes,提供智能告警和统一的仪表盘。通过使用Pulse,用户可以提高系统的可靠性和性能
Go
★ 6k
⑂ 241
devops
☆
interviewstreet
/
hiring-agent
hiring-agent:人工智能招聘评估工具 — hiring-agent是一个使用Python编写的AI代理,用于评估和评分简历。它可以帮助招聘人员快速筛选出合适的候选人,提高招聘效率。hiring-agent的出现标志着招聘行业向智能化转型的重要一步
Python
★ 2.5k
⑂ 623
ai-ml
+203 ★
☆
mozilla
/
DeepSpeech
DeepSpeech:开源嵌入式语音识别引擎 — DeepSpeech是一个开源的语音识别引擎,可以在设备上离线运行,使用C++编写,利用深度学习和神经网络技术来实现高准确率的语音识别。它支持多种设备,并且可以实时运行,具有广泛的应用前景。DeepSpeech的开源性使其受到广泛关注和贡献。
C++
★ 26.8k
⑂ 4.1k
ai-ml
☆
apache
/
hertzbeat
hertzbeat:下一代开源实时可观测性系统 — hertzbeat是一个基于Java的开源系统,提供实时监控和分析功能,支持多种数据源,如Prometheus、Grafana和Zabbix,能够帮助用户快速发现和解决系统问题。hertzbeat的AI能力可以自动化监控和告警,提高系统的可靠性和稳定性。同时,hertzbeat也支持自托管和多种通知方式,满足不同用户的需求。
Java
★ 7.3k
⑂ 1.3k
ai-ml
☆
hiyouga
/
LlamaFactory
LlamaFactory:统一高效微调 — LlamaFactory实现了对100多个LLMs和VLMs的统一高效微调,支持多种微调方法,包括fine-tuning、instruction-tuning和Lora等。该项目使用Python语言开发,基于Transformers库,能够高效地微调大语言模型。LlamaFactory的出现对于自然语言处理(NLP)领域具有重要意义,能够帮助研究人员和开发人员更好地利用大语言模型
Python
★ 73.4k
⑂ 9k
ai-ml
☆