1. 视频生成模型WAN 3.0开启公测
该模型在生成时长、参考与真实感等维度全面升级,单次可生成30秒视频,能完整表达创作意图;在文本、图片、音频、视频四种基础模态之外,首次支持DOC、XLS、PPT、PDF、MD等文档格式输入,目标是实现“万物皆可生视频”,同时力求准确还原真实世界,做到人物千人千面、细节经得起审视,每帧画面真实可信。
2. OpenAI相关动态
• GPT-5.6对全球十亿人开放免费使用,LUNA的文本对话不再限量;
• SOL迎来全新升级,ChatGPT界面新增滑块,统一了INSTANT和THINKING两大模式,可让SOL自主决定每个问题的思考时长;
• 首款AI硬件“OpenAI Companion Concept Device”曝光,为甜甜圈造型、冰球大小,配备可移动部件和多种传感器,强调自然语音交互体验。
3. 谷歌推出离线翻译设备GEMMA-4E2B
该设备基于谷歌自家的GEMMA模型,拥有51亿总参数和23亿激活参数。
4. SUNO的版权相关动作
宣布为AI歌曲添加水印,同时签署了版权检测协议。
相关文章
订阅评论
登录
请登录后发表评论
0 评论