在花
返回时间线
· 13:02 · 已编辑 · 15 条回复 ·

Grok下一个版本将支持原生视频和语音输入

马斯克宣布Grok V7基础模型已于上周完成预训练,具备原生多模态能力。该版本能直接处理视频/音频比特流,无需转换即可理解内容。例如,能够精准捕捉语音中的细微变化,准确辨识表达的情绪与语调重点。

X

🍀频道 🍵茶馆 📮投稿

Telegram 评论区

15 条回复,可以前往 Telegram 继续讨论。

去评论区