1. 马斯克SpaceX电话会透露AI模型进展
◦ Grok 4.6将于下周推出,随后几周内发布Grok 4.7。
◦ SpaceX全部历史数据将被用于模型训练,新模型会依赖SpaceX的私有数据,而非仅依靠公开语料。
2. 开源视频实时编辑模型JOYAI发布
◦ 该模型支持30帧/秒级推理,实现“边看边改”的实时视频创作体验。
◦ 还能为机器人训练数据的合成提供新的技术路径。
3. 阿里千问图像生成模型Qwen-Image-3.0上线
◦ 正式在千问AI平台开放使用,产品涵盖产品摄影、人像写真、手绘插画、室内设计等场景。
◦ 在国际评测平台Arena的文生图榜单中位列全球第5、国内第1。
4. 腾讯混元发布HY-ASR3.0语音识别模型
◦ 突破传统语音识别“逐字硬转”的模式,能够理解语音的语境,提升识别的准确性和自然度。
5. 字节跳动SEED推出SEEDREAL音视频全双工大模型
◦ 该模型已在豆包APP上线,支持边看、边听、边说的实时交互,解决了此前音视频交互卡顿的问题。
6. MISTRAL推出SHIELDSTRAL多模态审核模型
◦ 3B参数的小模型可在单张16GB显存的设备上运行,实现多模态内容审核,号称拿下开源领域的SOTA(最优)水平。
相关文章
订阅评论
登录
请登录后发表评论
0 评论