【Cerebras云收入高速增长】并扩充600MW算力合作,Nemotron 3.5 Lightning迎来密集领域定制与部署。Arena AutoEval则将人类偏好评估压缩至小时级。

模型动态

DeepSeek V4 Pro长程Agent编码测试出现早停

50轮测试中,reasoning_effort=max三次有两次在42至43轮早停。单一案例未胜GLM-5.1,原因仍待确认。[2]

Nemotron 3.5 Lightning多项领域后训练结果出炉

该模型领域定制见效。法律任务0%升至8.3%,30B证明模型胜约大50倍模型;代码路由微调不足100美元[3][4][5]

产品工具

Nemotron 3.5 Lightning密集上线多家推理平台

模型已上线【Fireworks、Together、Tinker】等平台。Baseten称【吞吐4倍、成本低50%】,Uniphore测得约5倍吞吐。[6][7][8][9][10][11]

Runway上线Grok Imagine Image 2.0

Grok Imagine Image 2.0已在Runway上线。用户可直接试用,进一步扩充平台的生成式视觉模型组合。[16]

Vercel AI Gateway接入Seedance 2.5

Vercel AI Gateway接入Seedance 2.5。开发者可通过统一网关调用,价格与技术指标暂未披露。[17]

技巧教程

Nemotron 3.5 Lightning可在22GB显存运行本地Agent

Unsloth展示2-bit量化版本,可在约22GB显存持续搜索、运行代码和调用工具。适合低成本本地Agent部署。[12][13]

行业资讯

Cerebras云业务收入近四倍增长并扩充算力产能

Cerebras二季度GAAP云收入同比增281%,核心云收入增287%。已签约600MW容量,并与OpenAI、AMD合作。[1]

Arena AutoEval将人类偏好评估缩短至数小时

Arena AutoEval用数千万场真人对战训练奖励模型。新模型评估可由【数周压缩至数小时】,减少对LLM裁判的依赖。[14][15]