本期重点关注【硬件动态】与模型安全研究,剑桥大学发布362Gbps超高速LiFi芯片,同时社区深入探讨MoE模型安全拒绝机制。

模型动态

研究揭示MoE模型安全拒绝机制

社区研究发现,在Qwen3.5-397B等MoE模型中,安全拒绝行为是通过【专家选择】机制编码的,并且这种拒绝能力在权重烘焙后依然能够保留。[2]

产品工具

基于GLM 5.1的AI口语教练SpeakFlow发布

新产品SpeakFlow发布,它是一款AI对话练习教练,使用GLM 5.1模型,支持11种语言的实时口语评估和演示模式。项目地址:https://www.reddit.com/r/MachineLearning/comments/1sdjzoh/p_speakflow_ai_dialogue_practice_coach_with_glm_51/[3]

技巧教程

用户分享让Agent成为产品营销者的提示词技巧

开发者分享了一个实用技巧:在构建AI应用时,通过在AGENTS.md文件中加入特定提示词,可以让用户的Agent自动成为产品的【营销者】。[4]

社区讨论测试本地LLM质量的实用提示词

Reddit社区用户分享了用于测试和【挑战】本地LLM的提示词,例如针对Apple A6芯片等特定知识领域,这是评估模型质量的实用方法。[6]

硬件动态

剑桥大学发布超高速微型LiFi芯片

剑桥大学团队发表论文,展示了一款面积小于1mm²的LiFi芯片,实现了高达362Gbps的数据传输速率。这项突破可能对未来AI数据传输产生重要影响。[1]

RTX 5090上Gemma4-26B性能基准测试报告

社区发布了在RTX 5090显卡上运行Gemma4-26B模型的性能报告,使用了支持NVFP4的修改版vLLM,权重约15.76GiB。[5]

行业资讯

用户质疑Qwen模型在OpenRouter的免费策略与限流

用户对OpenRouter平台开始限流表示不满,并质疑Qwen模型在阿里云收费却在OpenRouter免费的策略,认为这影响了用户体验。[7]