深度专题 FEATURES — 2
Flyweight:显存装不下,内存来接力
Flyweight 让单张消费级显卡借系统内存运行超显存 MoE,还能直接接入常见聊天与 Agent 工具。
Inco Splash让Mac推理再快一档
为苹果芯片定制的本地推理引擎,亮点不只快,更在多 Agent 并发。
速览 BRIEFS — 9
REPO
代码库一键变成Agent知识图谱
把整座代码库画成关系地图,让编码 Agent 更快看懂项目脉络。
NEWS
Claude Code开始读取AGENTS.md
Claude Code 2.1.277开始兼容AGENTS.md,团队可少维护一份重复的项目说明。
REPO
OpenSpec连续升温
OpenSpec连续两日上榜,用可持续修订的规格给AI编码助手划清任务边界。
REPO
Xing4.0冲进模型榜第六
29B总参数、每次仅激活4B,Xing4.0下载量增长137%,升至HF趋势榜第六。
NEWS
实时全模态模型来到9B档
Realtime-Venus把持续看听、择机回应和语音生成装进9B模型,为本地实时全模态应用提供新选择。
NEWS
Token级操控LLM有了交互工具
把模型逐字生成的选择摊开来看,还能随时改道,方便调试输出与 Agent 行为。
NEWS
ZCode被质疑静默上传工作区
个人逆向分析称,ZCode会在后台上传含.git历史的工作区快照,数据边界值得警惕。
REPO
GLM-5.3推出200 token/s版本
GLM-5.3-FlashX标称最高200 token/s,为实时Agent和高并发任务提供新选项。
NEWS
768GB显存的低成本拼装实验
用12张退役计算卡拼出768GB显存,以速度和复杂度换取大模型本地运行空间。