本周AI速递:社区热推Claude不讨好Prompt引发开发者共鸣,Obsidian作者称Markdown赢得AI时代文本格式战争Multi-LoRA推理服务上线预览。

模型动态

Cerebras推理服务上线Multi-LoRA功能,单端点托管多任务模型

Cerebras Inference推出Multi-LoRA私有预览,允许单个模型通过LoRA承担多种专项能力,在一个端点后服务全部任务,并可根据请求动态切换,以【Cerebras速度】运行。[3]

用户实测Qwen3.6-27B启用MTP后的性能表现,超长上下文降速明显

用户使用llama.cpp MTP功能运行Qwen3.6-27B,发现生成速度在超过85K上下文后急剧下降30%-35%,但KV缓存槽保存功能有效提升了命中率,预热加载较慢。[8]

产品工具

开源项目让20款大模型竞相开发相同UI组件,直观对比效果差异

一个有趣项目让包括GPT-5.5Opus 4.7在内的20个不同大模型开发相同UI组件,直观展示各自设计风格与文案差异,为开发者选型提供参考。网址链接见评论。[4]

Codex官方客户端获推荐,对不习惯Terminal的用户更友好

用户推荐Codex官方客户端作为命令行替代方案,支持可视化界面第三方API中转站,降低了使用门槛,对多数用户更加友好。[5]

AI视频系列“Phineas 2 Trappy”在TikTok和IG爆火

一部名为Phineas 2 Trappy的AI短剧在TikTok和IG上病毒式传播,该剧用Kling将《飞哥与小佛》重新构想为【暗黑写实风格】,创作者每周更新数集。[7]

技巧教程

社区热推“不让Claude和GPT讨好你”的系统提示词

社区分享了一段用于Claude.mdAgents.md的系统提示,要求AI以世界级专家标准提供精准、强硬且具【争辩性】的回答,拒绝讨好和政治正确,并强调严格核实事实、绝不幻觉。[1]

开发者让三个AI Agent同时运行在同一微信号上,解决连接冲突

开发者让HermesOpenClawOpenCode三个Agent跑在同一微信账号,通过约500行Python代码的轻量代理HermesClaw独占iLink连接,解决了403冲突问题。[6]

行业资讯

Obsidian作者:Markdown赢得AI时代文本格式战争,应跳出编辑器思维

Obsidian作者指出Markdown已成为AI文件交互的事实标准,并形成谢林点。下一步不应只做编辑器,而应将Markdown作为数据使用,构建更跳脱常规的人机交互体验。[2]