PrismML将27B模型压缩至手机运行,性能保留95% PrismML基于Qwen3.6-27B,通过量化将模型从54GB压至3.9-5.9GB,在手机端保留原版90-95%性能,RTX 5090达163字/秒。来源:@小互 [2]
腾讯发布Hy-Embodied-RxBrain-1.0多模态基础模型 腾讯发布多模态基础模型,结合【语言推理】与视觉想象,实现具身认知三大能力。项目地址:https://huggingface.co/tencent/Hy-Embodied-RxBrain-1.0[5]
Apple智能大模型获手机端侧AI服务备案,国行Siri将至 网信办公告「Apple智能」等7款大模型完成端侧备案,包括华为小艺、vivo蓝心等。国行iPhone将正式上线端侧AI功能。来源:@小互 [1]
Gemma Google在Pixel 10上跑Gemma 4,端侧断网可用 Google在Pixel 10中通过TPU运行Gemma 4轻量版,支持断网聊天、看图、控制手机,演示旅行规划等场景。来源:@小互 [3]
OpenAI / Claude / xAI Codex与Grok Build用量重置,Claude未跟进引讨论 社区发现Codex和Grok的Build用量已重置,但Claude未同步,用户猜测是竞争策略。来源:@小互 [8]
OpenAI 开发者分享GPT-5.6三子模型(Sol/Luna/Terra)组合使用心得 用户实测Sol Medium适合开发创意,Ultra配合Subagent处理复杂任务,Luna xhigh用于日常对话但需清晰指令。来源:@向阳乔木 [4]