O rodzinie
Moshi to rodzina modeli głosowej AI czasu rzeczywistego opracowana przez Kyutai (paryskie laboratorium AI). Obejmuje pełnodupleksowy model mowa-w-mowę Moshi oraz jego warianty dostrojone na danych syntetycznych: Moshiko (głos męski) i Moshika (głos żeński). Modele łączą backbone językowy Helium (7B) z neuronowym kodekiem audio Mimi i metodą „Inner Monologue”.

