深度专题 FEATURES — 1
177B模型借SSD挤进16GB显卡
119GiB的177B MoE不必全塞进显存:借高速SSD分层读取,16GB显卡自报跑到9—10 tok/s。
速览 BRIEFS — 9
NEWS
五块退役矿卡跑出40 tok/s
五块退役矿卡拼出约71GB显存,不到800美元跑起编程模型,代价是高功耗与慢互联。
NEWS
30B工具模型被蒸馏到一半宽度
社区把30B工具模型按宽度缩成14.44B,蒸馏后仍完成57项闭环任务
NEWS
TinyAIArena让Agent现场对战
四个 AI Agent 在网格中生存对战,用回放直观看见策略与失误。
REPO
TeleOCR冲入模型趋势榜前十
TeleOCR升至模型趋势榜第九,但性能证据与模型来历仍待补全。
NEWS
Naive N0.5 Flash押注百万上下文
309B MoE模型用稀疏注意力挑战百万上下文,面向编码与AI研发。
REPO
Data Formulator把AI接进数据探索
微软用自然语言、AI Agent 和图表,把反复追问数据变成一条可回溯的探索路径。
NEWS
Julia 1用144M参数只做判断
Julia 1把分类、排序和路由压进144M参数,普通CPU也能运行。
REPO
Qwen图像加速版下载量升至17万
Viggle Turbo 下载量突破17万,以轻量适配把 Qwen-Image 2.1 出图提速约5倍。
REPO
跨平台SSH客户端补上加密同步
把终端、传文件和隧道管理收进一个窗口,连接配置还能加密同步到 Android。