2026.08.17 · 周一研究论文
←返回首页话题 · Topic
#可解释性
共 19 条相关资讯
2026.08.16 · 周日研究论文
Qwen3.6 与 3.8 跨版本 Jacobian Lens 迁移实验
2026.08.15 · 周六研究论文
至知研究院拆权重做可解释性:数据成本不到传统路线 1%
2026.08.15 · 周六研究论文
立场论文呼吁:AI 对齐方法应镜像人类推理
2026.08.14 · 周五研究论文
Fireworks AI 用 Anthropic J-Lens 探针检测开源模型内部表征
2026.08.12 · 周三工具
HyperSAE:基于双曲几何的 LLM 可解释性引擎开源
2026.08.10 · 周一研究论文
CoCo:面向 MoE 奖励模型的响应级可解释性新方法
2026.08.10 · 周一研究论文
六款前沿大模型在引导压力下呈现分化行为
2026.07.30 · 周四研究论文
TraceCoder:让 LLM 代码生成可解释可审计
2026.07.30 · 周四研究论文
RL vs SFT 微调:研究揭示推理模型内部表征差异
2026.07.29 · 周三研究论文
ISNAD:把千年传述链核验方法引入多智能体 AI 信任层
2026.07.28 · 周二行业动态
别再让大模型给自己打置信度分数:为何这条「心理安慰」链路行不通
2026.07.24 · 周五研究论文
DecodeShare:发现 LLM 解码阶段的跨任务共享子空间
2026.07.23 · 周四行业动态
AI 是终极的『泄漏抽象』:当大模型的推理变得不可下钻
2026.07.22 · 周三工具
开源工具 Subtext:实时可视化语言模型的内部思考
2026.07.20 · 周一研究论文
Causal-Audit:面向大模型的显式可审计因果推理框架
2026.07.11 · 周六研究论文
DeepMind 播客聚焦大模型可解释性:思维链如何成为推理「便签」
2026.07.07 · 周二工具
Jacobian Lens 幻觉路由开源模型实测
2026.07.04 · 周六行业动态
