本期速报聚焦两大热点:GPT-5.3 Instant全面推送,带来更准确、更自然的回答;同时,Qwen3.5小模型生态持续扩张,量化权重发布并登陆多个平台。

模型动态

GPT-5.3 Instant 全面推送,大幅减少“尴尬”回答

OpenAI宣布GPT-5.3 Instant已向所有用户推送。新版本更准确、减少了不必要的拒绝和说教式免责声明,并优化了联网搜索时的上下文理解和回答一致性。[1][2][3][4]

Qwen3.5系列发布GPTQ-Int4量化权重,降低部署门槛

Qwen团队发布了Qwen 3.5 SeriesGPTQ-Int4量化权重,支持vLLM和SGLang。此举旨在减少显存占用、加速推理,让用户能在有限GPU资源上运行强大模型。模型地址:https://t.co/3MSb7miq68[5]

产品工具

Qwen3.5小模型登陆LM Studio、Ollama和MLX平台

Qwen3.5-9B等小模型已登陆LM StudioOllamaMLX平台,支持本地运行。其中9B模型仅需约7GB显存,具备多模态输入、工具调用和长上下文能力。[6][7][8][9]

LM Studio获苹果M5发布会提及

本地大模型运行工具LM Studio在苹果M5芯片的发布会上被提及,显示了其在本地AI生态中的影响力。[12]

技巧教程

开发者分享利用Obsidian CLI创建读书笔记Skill

开发者分享了一个实用教程:利用Obsidian CLI为Claude Code创建一个读书笔记Skill。AI可以自动询问书名、创建笔记并点评,实现“有人陪读”的体验。[13]

用户分享自研Skill效果优于市面方案,并给出安装方法

开发者【@向阳乔木 】分享称,其自研的前端设计Skill效果优于尝试过的许多市面方案。安装方法简单,只需在Claude Code中输入指令即可。Skill地址:https://t.co/1vH7WJZ5pw[14]

行业资讯

Qwen核心成员Junyang Lin宣布离职

Qwen团队成员Junyang Lin宣布离职,引发社区关注。MiniMax官方对其为开源社区的贡献表示感谢。[10][11]