0
280B参数、每次只激活16B:MoE如何改写本地大模型的成本公式
MoE把模型容量与单Token计算量拆开,也把显存、KV Cache、路由通信和设备利用率带入成本核算。本文结合dots3-note与Qwen3.8-27B分析本地部署的完整账单。
MoE把模型容量与单Token计算量拆开,也把显存、KV Cache、路由通信和设备利用率带入成本核算。本文结合dots3-note与Qwen3.8-27B分析本地部署的完整账单。
AI Forensics 调查发现,Hugging Face 部分热门图像编辑 Spaces 可以在缺少有效安全措施的情况下生成非自愿私密图像。研究团队监测到的请求中,73% 带有性化意图。
路透社报道称,中国商务部正与国内主要科技企业讨论,研究是否限制海外访问中国最先进的 AI 模型。这一信号说明,AI 出口管制正在从芯片、设备和算力,进一步走向模型能力本身。
TripoAI 和 VAST AI Research 开源了 TripoSplat:从单张 2D 图片直接生成可变数量的 3D Gaussians。它真正重要的地方,不只是“图生 3D”,而是把质量、渲染成本和创作工作流的控制权交回给开发者。
Cohere 在 5 月 20 日发布 Command A+,真正值得关注的地方,不是它又把某个榜单分数往上推了一截,而是它把一个更现实的问题摆到了台面上:企业到底需要什么样的 AI?