欢迎来到我的博客!
最近 Posts
AI 安全评估方法论新范式
OpenAI Astra 触发 Preparedness Framework + Kimi 越狱事件 + Felony Bench 追踪网站,2026-08 同周 arXiv 集中出现 5+1 篇评估方法论文(Epistemic Trustworthiness/OrchestraBench/DreamGuard/Woodpecker/SkillTrace/Innovation-Residual Auditing/PSRS),勾勒出 AI 安全评估的 5 个深层转向:从"打分"到"诊断"、从"输出"到"分布"、从"单点"到"轨迹"、从"端点"到"过程"、从"评测"到"审计"。
继续阅读AI 代理编码工作负载的工程化
代理编码工作负载让对话式推理引擎集体失灵。GitHub Copilot 7.61 亿次调用实证揭示 KV 缓存跨 Turn 失效 90%→55%、idle-time 预测 86-90%、编排 2-4 倍 token 成本、能耗归因 44% 误差——五个新事实决定下一代 Agent-native 基础设施怎么建。
继续阅读


