Skip to main content

Latest posts

我为什么要给自己建一套「个人上下文资产」

我为什么要给自己建一套「个人上下文资产」

每次切换 AI 模型,你要花多少时间重新让模型认识你?

【翻译自用】如何运营一个 AI 原生工程团队

【翻译自用】如何运营一个 AI 原生工程团队

https://claude.com/blog/running-an-ai-native-engineering-org

当你开始讨厌和人说话

当你开始讨厌和人说话

上周四晚上十一点,我躺在床上刷手机。

你的 AI Agent 昨晚做了什么,你知道吗?

你的 AI Agent 昨晚做了什么,你知道吗?

如果答案是“不知道”,那这篇论文你得看看了。

Code as Agent Harness:迈向可执行、可验证、有状态的智能体系统(完整翻译)

Code as Agent Harness:迈向可执行、可验证、有状态的智能体系统(完整翻译)

Xuying Ning¹†, Katherine Tieu¹†, Dongqi Fu²†, Tianxin Wei¹†, Zihao Li¹†, Yuanchen Bei¹†, Jiaru Zou³, Mengting Ai¹, Zhining Liu¹, Ting-Wei Li¹, Lingjie Chen¹, Yanjun Zhao¹, Ke Yang¹, Bingxuan Li¹, Cheng Qian¹, Gaotang Li¹, Xiao Lin¹,

提示词实战手册自用版本

提示词实战手册自用版本

核心理念:少理论,多模板,学完直接复制粘贴\ 最后更新:2025年5月

科技周报 Weekly Tech Digest (2026-04-26)

科技周报 Weekly Tech Digest (2026-04-26)

2026-04-20 2026-04-26 | Top 20 picks curated by AI

LLM 项目级代码审计能力现状评估

LLM 项目级代码审计能力现状评估

目的:澄清 2026 年 4 月 LLM + AI 编码工具在项目级代码(50 万行 / 中度游戏规模)审计场景下的真实能力边界,为团队技术决策提供依据。核心结论:LLM 在局部辅助开发上已经非常好用,但在全局代码审计上目前没有成熟方案。两者是本质不同的任务,不应混淆。

科技周报 Weekly Tech Digest (2026-04-19)

科技周报 Weekly Tech Digest (2026-04-19)

2026-04-12 2026-04-18 | Top 20 picks curated by AI

译文:从意图到发现:设计 AI 时代的用户体验

译文:从意图到发现:设计 AI 时代的用户体验

本文译自 UX 领域先驱 Jakob Nielsen 发表于其 Substack 的文章《Intent by Discovery: Designing the AI User Experience》(2026 年 3 月 26 日)。Nielsen 是可用性工程的奠基人,提出了著名的“十大可用性启发式原则”和“雅各布定律”,从业逾 43 年。本译文力求信达雅,供中文读者参考。

The "Virtual Company" Illusion: Why Role-Based Multi-Agent Architecture Fails in Practice

The "Virtual Company" Illusion: Why Role-Based Multi-Agent Architecture Fails in Practice

A widely circulated architectural approach in the AI community is leading countless teams astray.

共同进步:对《三省六部幻觉》的回应与修正

共同进步:对《三省六部幻觉》的回应与修正

发出去以后收到了110条评论,345K的阅读量超出预期。认真读完之后,有几条评论让我重新审视了文章里表述不够准确的地方,也有几条把论点说得比我更清楚。这篇文章是对这些评论的正面回应——承认哪里说得不够好,坚守哪里不动摇,以及讨论延伸出来的新问题。