深度专题 FEATURES — 1
Mercury 2.5:推理不再逐字生成
Mercury 2.5并行生成、反复修正文句,速度很亮眼,但“最快”仍缺独立验证。
速览 BRIEFS — 9
NEWS
ExLlamaV3补上CPU卸载与自校准量化
ExLlamaV3新增MoE专家CPU卸载与自校准量化,显存有限也能尝试更大模型。
REPO
NVIDIA给Agent Skill上安检机
安装 Agent Skill 前先过安检,查提示注入、外泄与供应链风险
REPO
OpenShell为自治Agent提供私密沙箱
NVIDIA 为自治 AI Agent 加上一层可细调权限的私密沙箱
NEWS
104GB模型挤进48GB Mac
slotstream 从 SSD 按需读取权重,让 104GB 模型在 48GB Mac 上以约 12 tok/s 运行。
NEWS
老款Radeon跑长上下文又快一步
专为 Radeon VII、MI50/60 优化的 llama.cpp 分支,长上下文预填充最高快约14%。
REPO
代码仓库RAG开始画知识图谱
它把散落在多文件、多语言仓库里的代码关系,画成可查询、可编辑的知识图谱。
REPO
PageIndex押注无向量文档RAG
PageIndex用目录树和模型推理替代切块与向量搜索,瞄准复杂长文档检索。
REPO
机器人训练栈换上MuJoCo-Warp
mjlab 把 Isaac Lab 式任务编排接上 MuJoCo GPU 后端,提供更轻量、开放的机器人训练底座。
REPO
workmux把并行开发塞进终端
把 Git worktree 和 tmux 绑在一起,让多个编码 Agent 各忙各的,切换任务只需切窗口。