OpenAI的图像模型更新属常规迭代,实测显示其在中文等多语言场景仍有明显短板。小米新模型技术细节的公布,展现了其在高效架构上的务实探索。Orange AI的语音克隆功能创新了交互方式,试图解决情感自然度问题。社区层面,实用的视频创作提示词模板涌现,降低了特定风格内容的生产门槛。

模型动态

OpenAI发布图像模型Image 1.5

事件:OpenAI发布了新升级的Image 1.5图像模型。 实测:修复了此前泛黄问题,但饱和度偏灰;在中文生成、复杂推理、世界知识及图标还原上表现不佳。[1][2][3]

小米发布MiMo-V2-Flash模型技术细节

事件:小米发布了MiMo-V2-Flash模型,由前DeepSeek成员罗福莉主导。 技术:采用Hybrid SWA注意力、多token预测(MTP)及MOPD后训练技术,旨在提升长上下文推理效率与训练收益。

技巧教程

歸藏分享Medeo的“哈基米”风格视频创作提示词

事件:分享了一套用于AI视频创作工具Medeo的详细提示词模板。 用途:可将经典小说/影视剧内容,用特定萌宠形象(如耄耋、奶龙)进行“哈基米”Meme风格解构与视频生成。

行业资讯

Orange AI上线“对话式语音克隆系统”

事件:Orange AI宣布上线全球首个“对话式语音克隆系统”。 特点:通过自然对话而非朗读文本来克隆更真实、带情感的声音,并提供无限次免费体验。[4][5][6]