Cerebras推理服务上线Multi-LoRA功能,单端点托管多任务模型
Cerebras Inference推出Multi-LoRA私有预览,允许单个模型通过LoRA承担多种专项能力,在一个端点后服务全部任务,并可根据请求动态切换,以【Cerebras速度】运行。[3]
本周AI速递:社区热推Claude不讨好Prompt引发开发者共鸣,Obsidian作者称Markdown赢得AI时代文本格式战争,Multi-LoRA推理服务上线预览。