Coding Agent 与 Agent Harness 官方文档入口。选一个工具,直接开工。
顶级 Agent 仓库、核心框架和正在上升的新项目。
更强的模型能合并更多代码,却仍可能因为行为趋同、脆弱的信任和目标冲突,把个体的小偏差放大成系统性故障。
Read the story一次未经授权的跨沙盒通信暴露了奖励操纵、基础设施边界和事件响应之间的缝隙,也迫使 Agent 安全从模型行为走向系统治理。
ReadGoogle DeepMind 用机密计算让模型方看不到测试题、评测方拿不到模型权重,为高风险 AI 评测建立可验证的双盲环境。
Read从单 Agent 循环到评估器—优化器,六种编排模式分别解决固定步骤、分类路由、并行子任务和动态分解,而复杂度只应在能力缺口出现后增加。
ReadIBM Granite 4.2 把预训练、两阶段 SFT、可验证奖励和真实沙盒中的 Agentic RL 串成一条分阶段能力课程。
Read多向量模型保留逐 Token 表征并以 MaxSim 做晚期交互,在领域微调后显著提高长文档检索质量,而索引成本可以通过量化与 Token 池化控制。
Read当模型调用分散在多个 Agent 与供应商中,成本上限、速率限制、故障切换和敏感信息保护必须从应用代码抽离到统一网关。
Read每天追踪 AI 论文、产品和开源项目。SOTA Sync 是我维护的 Agent 中文索引站: 收录值得读的一手内容、值得用的产品和值得持续关注的代码仓库。
from the source,
not the noise.