📢
gitzw.com上线了,功能陆续更新中,如有问题或反馈请在下方反馈/建议中给我们留言。
✕
讀懂開源,從這裡開始
首頁
排行榜
教程中心
知識庫
資訊
分類
專題合集
🌙
繁
▾
简体
繁體
English
登入
使用者中心
▾
👤 使用者中心
📬 我的訂閱
✉️ 我的郵箱
🔑 修改密碼
⭐ 我的收藏
💬 我的回饋記錄
↩ 登出
訂閱
☰
首頁
排行榜
教程中心
知識庫
資訊
分類
專題合集
搜尋
訂閱
RSS
简体
繁體
English
🔍
搜尋
📡
RSS
🔥 熱門搜尋
llm
vuejs
pytorch
langchain
sql
graphql
peg
leetcode
tokio
redis
unity
php8
"語音辨識"
espnet
/
espnet
espnet:端到端语音处理工具包 — espnet是一个端到端的语音处理工具包,使用Python语言开发,支持多种深度学习框架,如chainer和pytorch。它提供了多种语音处理功能,包括语音识别、语音合成、语音增强等。espnet的主要目标是提供一个高效、灵活的语音处理平台,用于研究和开发各种语音处理应用
Python
★ 9.9k
⑂ 2.4k
ai-ml
☆
moonshine-ai
/
moonshine
moonshine:低延遲語音處理 — moonshine 提供低延遲的語音轉文字、意圖識別和文字轉語音功能,特别適合用於開發語音代理和用戶界面,提升用戶體驗。
C++
★ 10.1k
⑂ 526
ai-ml
+282 ★
☆
RVC-Project
/
Retrieval-based-Voice-Conversion-WebUI
Retrieval-based-Voice-Conversion-WebUI:語音轉換網頁界面 — Retrieval-based-Voice-Conversion-WebUI 提供了一個簡單的網頁界面,讓用戶可以輕鬆地訓練語音轉換模型,無需大量的語音數據。這個工具利用了 Retrieval 模型和 VITS 等技術,實現了高質量的語音轉換。通過這個工具,用戶可以快速地建立自己的語音轉換模型,適用於各種語音應用
Python
★ 36.5k
⑂ 5.1k
data
☆
coqui-ai
/
TTS
TTS:文字轉語音工具包 — TTS 是一個基於 Python 的深度學習工具包,提供了多種文字轉語音的模型和技術,包括 Glow-TTS、HiFiGAN 和 MelGAN 等,能夠用於研究和生產環境。TTS 的優點在於其高質量的語音合成和靈活的配置選項。TTS 的應用包括語音合成、語音轉換和語音克隆等領域
Python
★ 45.8k
⑂ 6.2k
ai-ml
☆
CorentinJ
/
Real-Time-Voice-Cloning
Real-Time-Voice-Cloning:即時語音克隆技術 — Real-Time-Voice-Cloning 是一個基於 Python 的開源項目,利用 deep-learning 和 TTS 技術實現即時語音克隆。這個項目可以快速生成任意語音內容,對語音合成和語音識別領域具有重要意義。它支持多種框架,包括 PyTorch 和 TensorFlow
Python
★ 60k
⑂ 9.4k
ai-ml
☆
snakers4
/
silero-vad
silero-vad:企業級語音活動檢測器 — silero-vad 是一個預訓練的企業級語音活動檢測器,基於 PyTorch 和 ONNX 技術。它能夠精確地識別語音活動,適用於語音命令、語音控制等場景。
Python
★ 9.6k
⑂ 804
ai-ml
☆
m87-labs
/
moondream
moondream:微型視覺語言模型 — moondream 是一個基於 Python 的微型視覺語言模型,利用深度學習技術實現視覺和語言之間的交互。這個模型可以用於各種應用,例如圖像描述、視覺問答等。moondream 的開發對於推動人工智慧和機器學習的發展具有重要意義
Python
★ 9.9k
⑂ 789
other
☆
togatoga
/
karukan
karukan:Linux、macOS 的日語輸入法系統 — karukan 是一個開源的日語輸入法系統,適用於 Linux 和 macOS 平台。它使用神經網路技術實現假名漢字轉換,提供高效和準確的輸入體驗。karukan 的開發使用 Rust 語言,保證了系統的穩定性和安全性
Rust
★ 623
⑂ 38
ai-ml
+42 ★
☆
FunAudioLLM
/
CosyVoice
CosyVoice:多語音頻生成模型 — CosyVoice是一個基於Python的多語音頻生成模型,能夠提供多種語言的音頻生成,包括英文、中文、日文和韓文等。它提供了推理、訓練和部署的全棧能力,讓用戶可以輕鬆地使用和擴展模型。CosyVoice的出現對於自然語言生成和文本轉語音等領域具有重要意義
Python
★ 22.1k
⑂ 2.6k
ai-ml
☆
KoljaB
/
RealtimeSTT
RealtimeSTT:即時語音轉文字庫 — RealtimeSTT是一個基於Python的語音轉文字庫,提供即時的語音轉文字功能,具有低延遲和高準確度。它的先進語音活動檢測和喚醒詞激活功能,使其成為一個強大且實用的工具。RealtimeSTT的應用包括語音助手、語音控制和語音轉文字等領域
Python
★ 10k
⑂ 850
other
☆
babysor
/
MockingBird
MockingBird:實時語音合成 — MockingBird 利用 PyTorch 和深度學習技術,實現了快速和高質量的語音合成。這個工具可以用於各種應用,例如語音助手、播音等。它的出色性能和易用性使其成為語音合成領域的一個重要突破
Python
★ 36.9k
⑂ 5.2k
ai-ml
☆
langchain-ai
/
open_deep_research
open_deep_research:開源深度研究平台 — open_deep_research 提供了一個強大的開源框架,支持各種深度學習模型的開發和研究。它對於希望在深度學習領域進行創新研究的開發者來說極為重要。
Python
★ 12.2k
⑂ 1.7k
other
+14 ★
☆
myshell-ai
/
OpenVoice
OpenVoice:即時語音複製技術 — OpenVoice 是一個利用 Python 開發的音頻基礎模型,能夠實現即時語音複製,為 text-to-speech 和 voice-clone 領域提供了新的解決方案。這個技術的出現對於語音合成和語音識別領域具有重要意義。OpenVoice 的 zero-shot-tts 能力使其在業界具有競爭力
Python
★ 37k
⑂ 4.1k
other
☆
handy-computer
/
transcribe.cpp
transcribe.cpp:語音轉文字工具 — transcribe.cpp 是一個基於 ggml 庫的語音轉文字工具,支援超過 16 種不同的模型家族。它能夠高效地將語音轉換為文字,適用於各種需要自動轉錄語音的場景。
C++
★ 1.4k
⑂ 35
other
+395 ★
☆
ageitgey
/
face_recognition
face_recognition:人臉識別API — face_recognition是一個開源的Python庫,提供了簡單的人臉識別功能,能夠輕鬆地將其集成到各種應用程序中。它使用機器學習技術來識別人臉,並提供了命令列界面和Python API。它的簡單性和易用性使其成為開發人員的熱門選擇
Python
★ 56.6k
⑂ 13.7k
ai-ml
☆
pjreddie
/
darknet
darknet:神經網路框架 — darknet 提供了一個簡單且高效的方式來實現 CNN 模型,支援多種神經網路架構和訓練算法。這個框架廣泛應用於圖像識別、物體偵測等領域。darknet 的優點在於其高性能和低資源占用,使其成為嵌入式系統和移動設備的理想選擇。
C
★ 26.5k
⑂ 21k
ai-ml
☆
explosion
/
spaCy
spaCy:工業級自然語言處理 — spaCy 提供高效的自然語言處理功能,包括實體辨識、文本分類和標記化等,能夠有效地處理大量文本數據。它的優點在於高效、可擴展和易於使用,廣泛應用於各個領域的文本分析任務。因此,spaCy 成為了 Python 中最受歡迎的 NLP 庫之一
Python
★ 33.8k
⑂ 4.7k
ai-ml
☆
mozilla
/
DeepSpeech
DeepSpeech:開源語音識別引擎 — DeepSpeech是一個開源的嵌入式語音識別引擎,利用Deep Learning和TensorFlow等技術,能夠在各種設備上實時運行,提供高準確度的語音識別功能。這個項目對於各種語音應用有重要意義,包括語音助手、語音控制等。DeepSpeech的開源性質也使得其能夠被廣泛使用和修改。
C++
★ 26.8k
⑂ 4.1k
ai-ml
☆
huggingface
/
transformers
transformers:機器學習模型框架 — transformers 提供了一個統一的框架,讓開發者可以輕鬆地使用和訓練各種機器學習模型,包括自然語言處理、語音識別和視覺模型等。這個框架支持 PyTorch 和其他深度學習庫,讓開發者可以快速地部署和集成模型。同時,transformers 還提供了大量的預訓練模型,讓開發者可以快速地開始自己的項目。
Python
★ 162.7k
⑂ 33.9k
ai-ml
☆
BVLC
/
caffe
caffe:深度學習快速開放框架 — caffe是一個開源的深度學習框架,旨在提供快速和高效的神經網絡計算功能。它支持多種程式語言,包括C++、Python和MATLAB,同時也提供了豐富的API和工具,讓開發者可以輕鬆地使用和擴展。caffe的優勢在於其高性能和高擴展性,使其成為深度學習領域的一個重要工具
C++
★ 34.6k
⑂ 18.5k
ai-ml
☆
microsoft
/
VibeVoice
VibeVoice:開源前沿語音AI — VibeVoice是一個開源的語音AI項目,使用Python語言開發,提供了一種新的語音交互方式。它利用AI技術來實現語音識別、語音合成等功能,為用戶提供更好的語音體驗。VibeVoice的開源性使得開發者可以自由地擴展和修改它
Python
★ 50k
⑂ 5.6k
ai-ml
☆
JaidedAI
/
EasyOCR
EasyOCR:支援80多種語言的OCR解決方案 — EasyOCR是一個基於Python的OCR解決方案,利用深度學習技術來識別圖像中的文字,支援多種語言和書寫系統。它可以應用於多種領域,如數據挖掘、圖像處理和信息檢索。EasyOCR的出色性能和易用性使其成為開發人員的首選
Python
★ 29.8k
⑂ 3.6k
ai-ml
☆
harvard-edge
/
cs249r_book
cs249r_book:機器學習系統 — cs249r_book 是一個關於機器學習系統的項目,使用 Python 進行開發。它提供了機器學習系統的相關知識和實踐指南。該項目對於機器學習系統的開發和應用具有重要意義
Python
★ 27k
⑂ 3.2k
other
+329 ★
☆
supertone-inc
/
supertonic
supertonic:輕量級、多語言、在設備上的文字轉語音系統 — supertonic 是一個基於 ONNX 的文字轉語音系統,能夠快速地在各種設備上運行,支持多種語言和平臺,包括 iOS、Android、Web 等。它使用 Swift 語言開發,能夠實現輕量級和高效的文字轉語音功能。supertonic 的出現對於語音合成和語音助手等領域具有重要意義
Swift
★ 13.4k
⑂ 1.4k
mobile
☆
jiaaro
/
pydub
pydub:音頻編輯庫 — pydub 能夠讓開發者輕鬆地操控音頻,包括剪輯、合併和修改音頻等。這個庫的高級介面使得音頻編輯變得非常簡單,讓開發者可以專注於其他工作。pydub 的優點在於其簡單易用,讓開發者可以快速地完成音頻編輯任務
Python
★ 9.8k
⑂ 1.1k
other
☆
MiniMax-AI
/
skills
skills:人工智慧技能開發 — skills是一個開源項目,提供了一個基於C#的技能開發框架,讓開發者可以輕鬆地創建和集成人工智慧技能。這個項目的目的是提供一個簡單和靈活的方式來開發和應用人工智慧技能。同時,skills也提供了一個強大的API,讓開發者可以輕鬆地擴展和自定義技能
C#
★ 13.1k
⑂ 1.1k
other
☆
hankcs
/
HanLP
HanLP:下一代自然語言處理 — HanLP是一個強大的自然語言處理工具包,提供了分詞、詞性標注、命名實體識別、句法與語義依存分析、文檔分類等功能。它的目的是為了簡化自然語言處理任務,讓開發者能夠更容易地構建自己的NLP應用。HanLP的出現對於NLP領域的發展具有重要意義
Python
★ 36.5k
⑂ 10.9k
ai-ml
☆
2noise
/
ChatTTS
ChatTTS:每日對話的生成語音模型 — ChatTTS是一個開源項目,使用Python和Torch等庫來實現生成語音模型。它可以用於每日對話的語音合成,提供自然和流暢的語音體驗。這個項目對於語音助手、聊天機器人等領域具有重要意義
Python
★ 39.7k
⑂ 4.2k
ai-ml
☆
huggingface
/
text-embeddings-inference
text-embeddings-inference:文本嵌入式模型推理解决方案 — text-embeddings-inference 提供了一种快速高效的方式来进行文本嵌入式模型的推理。它利用 Rust 语言的性能优势,能够快速处理大量的文本数据。该解决方案对于需要快速处理文本数据的应用来说非常重要,例如自然语言处理和机器学习等领域
Rust
★ 4.9k
⑂ 415
ai-ml
☆
keras-team
/
keras
keras:人性化的深度學習框架 — keras 是一個高層神經網絡 API,能夠在 TensorFlow、PyTorch 和 JAX 等多個後端上運行。它提供了簡單易用的 API,讓用戶可以快速地構建和訓練神經網絡模型。keras 的出現使得深度學習技術更加民主化和易於使用
Python
★ 64.2k
⑂ 19.7k
ai-ml
☆
openai
/
CLIP
CLIP:對比語言圖像預訓練 — CLIP是一種通過對比語言圖像預訓練的模型,能夠學習圖像和文字之間的關聯,從而實現圖像文字匹配等功能。這種模型對於多模態任務有重要意義,能夠廣泛應用於圖像識別、文字生成等領域。CLIP的出現標誌著人工智慧領域的一大突破
Jupyter Notebook
★ 34k
⑂ 4k
ai-ml
☆
linyqh
/
NarratoAI
NarratoAI:AI視頻剪輯與解說 — NarratoAI是一個基於Python的開源項目,利用AI模型來實現一鍵式影片解說和剪輯。這個項目使用了moviepy和Gemini API等庫來處理影片,能夠大大簡化影片製作的過程。NarratoAI的出現對於需要快速製作影片的用戶來說具有重要意義
Python
★ 10k
⑂ 1.4k
ai-ml
☆
HKUDS
/
LightRAG
LightRAG:簡單快速的檢索增強生成 — LightRAG是一個簡單快速的檢索增強生成框架,基於Python實現,能夠有效地整合知識圖譜和大型語言模型,從而提高生成文本的質量和相關性。它的出現為自然語言生成領域帶來了新的可能性。LightRAG的優勢在於其簡潔的設計和快速的運行速度,使其成為了一個非常有前途的研究方向
Python
★ 37.8k
⑂ 5.3k
ai-ml
☆
JuliaLang
/
julia
julia:程式設計語言 — julia是一種新的程式設計語言,旨在提供高效能的計算能力和簡單的語法,適用於科學計算、數值分析和機器學習等領域。julia的設計目標是提供比現有語言更快、更簡單、更靈活的計算能力。因此,julia對於科學家、工程師和數據分析師等具有重要意義
Julia
★ 48.9k
⑂ 5.9k
ai-ml
☆
interviewstreet
/
hiring-agent
hiring-agent:人工智慧招聘評估代理 — hiring-agent 是一個人工智慧代理,利用 AI 技術評估和評分簡歷,以幫助企業快速找到合適的候選人。這個代理可以自動化招聘流程,節省時間和成本。同時,hiring-agent 也可以提供更客觀和公平的評估結果
Python
★ 2.5k
⑂ 623
ai-ml
+203 ★
☆
karpathy
/
char-rnn
char-rnn:字符級語言模型 — char-rnn 提供了一種基於字符的語言模型實現,利用 Lua 和 Torch 框架,能夠有效地處理和生成文本數據。這個庫通過多層遞歸神經網路的設計,實現了對字符級語言模型的支持,從而可以用於文本生成、語言翻譯等任務。同時,char-rnn 的實現也展示了 Torch 框架在深度學習任務中的強大能力
Lua
★ 12.1k
⑂ 2.6k
ai-ml
☆
kaldi-asr
/
kaldi
kaldi:語音識別開源專案 — kaldi 是一個開源的語音識別軟體工具包,提供了一系列的語音處理和識別功能,包括語音轉文字、語音辨識和聲音驗證等。它使用 C++ 和 CUDA 等技術實現,廣泛應用於語音助手、語音搜索和語音控制等領域。kaldi 的開源性使得開發者可以自由修改和擴展其功能
Shell
★ 15.4k
⑂ 5.4k
other
☆