AGENTQ: A Checkpoint Can Pass Every Audit and Misbehave Once Quantized
AGENTQ:一个检查点可以通过所有审计,却在量化后行为不端
AGENTQ:一个检查点可以通过所有审计,却在量化后行为不端
度量前沿大模型在自动化科研中的「创造力」
以「近乎最少的部署次数」达到表演性稳定
TF-IDF 与 BM25 都是精确的 KL 散度
VeriDx:一个正确的诊断,可能是靠错误的理由得出的
一种用「排序」来度量校准的方法
「良性损失地形」与「最坏情形困难性」可以共存
Embodied-BenchForge:逐个产物做验证,否则缺陷会一路传播
SAS:别再蒸馏注意力分布,去优化「上下文排序」
「类型多样性」解释了「结构泛化为何看起来更难」
人工本我:当「驱动力」仅从「持续性」中涌现
MoE 对「重复数据」过拟合更严重,而驱动力是「稀疏度」
诺贝尔经济学奖(1969–2025)
57 postsOdoo 14开发者指南(Cookbook)第四版
24 postsOdoo 12开发者指南(Cookbook)第三版
24 postsTouchDesigner教程
20 postsPython脚本实战
18 postsOdoo 12开发手册
14 posts李宏毅机器学习2025
13 postsDwarkesh播客笔记
4 postsAndrej Karpathy LLM笔记
2 postsfreeCodeCamp
1 posts