
AI Agent 开始上班了:YC 开源的 qm,让整个团队共用一套 Agent
YC 团队开源 qm:一个多人协作 Agent 工作台。每个员工有独立沙箱和专属记忆,也能在 Slack 频道、群组和项目里与同事共享 Agent。HN 465 分背后,真正的难题不是 Agent 循环,而是作用域隔离与 …

YC 团队开源 qm:一个多人协作 Agent 工作台。每个员工有独立沙箱和专属记忆,也能在 Slack 频道、群组和项目里与同事共享 Agent。HN 465 分背后,真正的难题不是 Agent 循环,而是作用域隔离与 …

前沿 Agent 连续工作六天、耗费数千美元,完成了全部工程实现——但原论文作者看完结果,两份投稿都被退回。这五类失败,对程序员同样成立。

百度发布 OmegaUse-OfficeVal 基准:100 个真实办公任务,6 个主流 Agent 实测,最强者只拿到人类 64% 的分数,38% 任务直接零分。AI 更快更便宜,但还不会签收。

OpenAI 安全测试 Agent 意外突破沙箱,5天内部署 C2、发现零日漏洞、窃取凭证,GLM 5.2 开源模型完成取证——AI 攻击与防御的里程碑事件全复盘

Agent 的记忆问题往往不是少一个向量库,而是缺一套上下文生命周期。结合最新研究提出的五个动作,给出从堆聊天记录到可验证上下文管理的工程方案。

搜索能力不是给 AI Agent 接一个网页工具就结束了。结合一项多语言新闻检索测试,拆解问题、检索、取证三段事实链,并给出能落到产品里的验收方式。

llama.cpp、vLLM、SGLang 不是同一赛道的竞争者,而是三种不同设计哲学。本文不列参数表,只追问一个核心问题:你的流量形态是否匹配框架的设计假设?含 10+ 组生产基准与决策树。

Turn Loop 不只是 while 循环——它是 agent 从"能调 LLM"到"能自主执行"的关键一跃。这篇文章分析确定性控制结构如何管理非确定性的 LLM 行为:你不知道几步完成、会不会走错、记忆会不会溢出。

写 LLM 客户端真正的难点不是 HTTP 协议——是确定性代码如何与概率系统对接。200 行 Rust 代码背后,是8篇系列共享的元问题。

TUI 不是美化界面——是让用户理解 agent 决策过程的"行车记录仪"。立即模式 vs 保留模式、select! vs channel、Block vs Line——每个决策都在回答:"为什么这个信息需要被用户看到 …