深度专题 FEATURES — 2
Mica:4B模型不写字,只做决定
Mica 不负责写答案,只负责选动作:一个 4B 开放模型,把 Minecraft 与俄罗斯方块变成了 Agent 决策实验。
老V100也能追上现代推理
1Cat-vLLM为退役V100补回现代推理路径,但“追上新硬件”仍缺同条件验证。
速览 BRIEFS — 9
NEWS
Jev Router动态选择模型与推理强度
Jev让一个轻量决策模型按请求挑选模型与推理强度,还把选择概率摆到台前。
REPO
OpenCode连续两天冲上趋势榜
OpenCode连续两天登上趋势榜,单日再增193星,开源终端开发工作流持续升温。
REPO
OpenRig让Claude Code与Codex协作
OpenRig把Claude Code与Codex编成一支分工协作、持续运行的代码团队。
REPO
LangExtract给LLM抽取结果补上出处
让大模型抽取的每个字段都能跳回原文核验,还能生成交互式审阅页面。
REPO
NobodyWho瞄准全设备本地推理
Rust 推理引擎 NobodyWho 试图用一套核心覆盖桌面与移动设备,但“任意设备”仍有兼容边界。
NEWS
M5 Ultra预填充参数藏着性能开关
M5 Ultra实测:把预填充分块调到8192,读提示和生成都可能提速
NEWS
四卡与八卡3060未必线性提速
八张 RTX 3060 能装下更大模型,但跨卡通信可能吃掉加卡带来的速度收益。
NEWS
临床说话人分离迎来同场实测
四类说话人分离模型同测医患对话,Nemotron 3在准确率与速度间表现突出。
REPO
LiteParse用Rust重做文档解析
LiteParse以Rust为核心,在本地快速提取PDF文字与位置,为RAG预处理提供轻量选择。