深度专题 FEATURES — 3
PhysBrain:物理模型闭环了
PhysBrain把看懂环境、生成动作和预测后果放进同一模型,但“闭环”目前主要成立在训练框架里。
Dream-RSI:在进化世界里自我进化
Dream-RSI把探索历史变成低成本“梦境”,让Agent先复盘搜索策略,再回到真实任务继续发现。
机器人模型也要做推理服务
Robion把机器人的“看懂”和“行动”错峰并行,让多台机器人共享GPU也尽量按时交卷。
速览 BRIEFS — 8
PAPER
GPU利用率可能一直在骗你
GPU显示“很忙”,不等于真在干活;LLM性能诊断需要拆开看。
PAPER
字节模型蒸馏撞上Token天花板
字节级学生起步慢,却随算力增长越跑越快,可能突破Token模型的平台期。
PAPER
量化MoE开始按请求选实例
同一模型备好多种位宽副本,再按请求对量化损伤的敏感度动态分流。
PAPER
固定缓存能让扩散语言模型跑多远
固定大小缓存让块扩散生成长文本时,显存不再随上下文一起膨胀。
PAPER
世界模型换环境,只调低秩参数
CLAW 用少量现场交互生成低秩补丁,让世界模型换环境后快速校准。
PAPER
视频Token开始显式理解4D
VideoTok4D把场景结构与运动分开压缩,让视频Token开始描述随时间变化的三维世界。
PAPER
MoE卸载开始预判专家到达
SeqMoE预判专家调用并提前搬权重,减少低显存推理中的GPU空等。
PAPER
编码Agent的能力,多少来自脚手架
固定同一模型只换脚手架,私有测试显示榜单成绩并非只由模型决定。