A few examples:
- openwhispr.com
- huggingface.co/OpenMOSS-Tea...
- huggingface.co/convaiinnova...
A few examples:
- openwhispr.com
- huggingface.co/OpenMOSS-Tea...
- huggingface.co/convaiinnova...
https://www.phoronix.com/news/Lemonade-2026.40-RC
https://www.phoronix.com/news/Lemonade-2026.40-RC
#Linux
#Linux
#Linux #OpenSource
#Linux #OpenSource
"OpenMOSS Releases MOSS-Audio: An Open-Source Foundation Model for Speech, Sound, Music, and Time-Aware Audio Reasoning"...
www.marktechpost.com/2026/04/27/o...
==========================
#librecanada #linux #opensource
"OpenMOSS Releases MOSS-Audio: An Open-Source Foundation Model for Speech, Sound, Music, and Time-Aware Audio Reasoning"...
www.marktechpost.com/2026/04/27/o...
==========================
#librecanada #linux #opensource
À lire sur GinjFo 👇
https://www.ginjfo.com/actualites/logiciels/amd-vulkan-est-jusqua-44-fois-plus-rapide-que-rocm-20260924
À lire sur GinjFo 👇
https://www.ginjfo.com/actualites/logiciels/amd-vulkan-est-jusqua-44-fois-plus-rapide-que-rocm-20260924
Model: huggingface.co/collections/...
Demo: huggingface.co/spaces/OpenM...
✨ 11B - Apache 2.0
✨ Cross-attention + XRoPE (3D: time, height, width)
✨ Beats Qwen3-VL-8B by 8.3 pts on VSI-bench
Model: huggingface.co/collections/...
Demo: huggingface.co/spaces/OpenM...
✨ 11B - Apache 2.0
✨ Cross-attention + XRoPE (3D: time, height, width)
✨ Beats Qwen3-VL-8B by 8.3 pts on VSI-bench
🔗 aidailypost.com/news/openmos...
🔗 aidailypost.com/news/openmos...
OpenMOSS-Team/MOSS-Transcribe-Diarize
MOSS-Transcribe-Diarize 0.9Bは、長尺の多人数音声から文字起こし、話者分離、タイムスタンプ付与、音響イベント検知を一度に行うエンドツーエンドの音声理解モデルです。
50以上の言語に対応し、会議やインタビューなどの音声・動画ファイルから、誰がいつ何を話したかをまとめた構造化された書き起こしを生成することを目的としています。
OpenMOSS-Team/MOSS-Transcribe-Diarize
MOSS-Transcribe-Diarize 0.9Bは、長尺の多人数音声から文字起こし、話者分離、タイムスタンプ付与、音響イベント検知を一度に行うエンドツーエンドの音声理解モデルです。
50以上の言語に対応し、会議やインタビューなどの音声・動画ファイルから、誰がいつ何を話したかをまとめた構造化された書き起こしを生成することを目的としています。
它能中英双语合成,零样本克隆音色,长语音生成超稳定。核心的XY - Tokenizer可高效压缩音频,支持960秒音频生成。现已全面开源,商业应用更便利,感兴趣的伙伴可以看一下 github.com/OpenMOSS/MOSS-…
它能中英双语合成,零样本克隆音色,长语音生成超稳定。核心的XY - Tokenizer可高效压缩音频,支持960秒音频生成。现已全面开源,商业应用更便利,感兴趣的伙伴可以看一下 github.com/OpenMOSS/MOSS-…
支持960秒超长语音,还有零样本音色克隆等强大功能。而且开源免费优势大,潜力无限。目前模型相关已全面开源,快来体验,https://github.com/OpenMOSS/MOSS-TTSD
支持960秒超长语音,还有零样本音色克隆等强大功能。而且开源免费优势大,潜力无限。目前模型相关已全面开源,快来体验,https://github.com/OpenMOSS/MOSS-TTSD
создаёт аудио до 30 секунд по текстовому описанию. Работает быстро и не требует мощного железа. Что можно сделать: звуки природы, эффекты для игр и видео, фоновые...
https://huggingface.co/OpenMOSS-Team/MOSS-SoundEffect-v2.0
создаёт аудио до 30 секунд по текстовому описанию. Работает быстро и не требует мощного железа. Что можно сделать: звуки природы, эффекты для игр и видео, фоновые...
https://huggingface.co/OpenMOSS-Team/MOSS-SoundEffect-v2.0
Licence and Ascend-native are the right shape for an embodied-AI baseline. The model card is a ghost though: no param count, no base, no evals. Until someone reproduces a...
Licence and Ascend-native are the right shape for an embodied-AI baseline. The model card is a ghost though: no param count, no base, no evals. Until someone reproduces a...
But the card ships no param count, no benchmarks, no eval, and timestamps set to June 2026.
Hard to take "any-to-any" seriously until OpenMOSS...
But the card ships no param count, no benchmarks, no eval, and timestamps set to June 2026.
Hard to take "any-to-any" seriously until OpenMOSS...