Building Better Speech Data for Indic Languages
Our Indic Speech release, featuring 3,845+ hours of transcribed Hindi, Telugu, Tamil, and Bengali speech data for ASR training, evaluation, and error analysis.
ResearchYash VyasKrishna Rupaakula
More from the Poseidon team
10
ProductOpen-Sourcing SONAR: Poseidon's Multilingual ASR Evaluation Toolkit
Rashmi Nagpal
ResearchSONAR: Evaluating Voice AI Beyond English
Rashmi NagpalSarick ShahLJW
ResearchThe Complexity of Multi-Speaker Audio Evaluation
Krishna RupaakulaSebastian LiuLJW
ResearchWe Tested 3 Frontier Models on Bengali Linguistics: They Rarely Agreed
Sebastian LiuKrishna RupaakulaLJW
CompanySovereign AI Needs Verifiable Trust
Poseidon
ProductIntroducing the Poseidon Voice AI Dataset
Poseidon
CompanyIntroducing Poseidon Litepaper
Poseidon
ProductLive Now: Poseidon App V1
Poseidon
ResearchWhy Distributed Systems Matter for AI’s Data Bottleneck
Poseidon
CompanyPoseidon Raises $15M Seed Round to Accelerate Physical AI
Poseidon
