Dives

深度

围绕产品、技术与真实项目的深度剖析;从学术前沿到工程决策,从产品解析到团队复盘,探寻变革背后真正的长期主义逻辑。

72

22580:从 GPT-2 到 Kimi K3,全解析

七年放大 22580 倍,架构到底变了多少?这篇工程师 worklog 从 GPT-2 的 decoder-only 出发,逐步推导线性注意力、DeltaNet、门控 DeltaNet、KDA 与 AttnRes,答案远不只是「放大」。

7月28日 2026年

Kimi K3 技术博客:开放的前沿智能

月之暗面发布 2.8 万亿参数的 Kimi K3——全球首个开源 3T 级模型,性能逼近 Claude Fable 5 和 GPT 5.6 Sol,API 价格仅为顶级闭源模型的 1/3 到 1/5。本文逐段拆解官方发布稿,还原技术设计取舍,并标出跑分话术里该打折扣的地方。

7月25日 2026年

Claude 5 模型的上下文工程新规则

Anthropic 官方复盘:删掉 Claude Code 系统提示词 80% 后评测无损——Claude 5 世代模型的上下文工程,从立规矩转向信任判断力。

7月24日 2026年

别再写 Prompt,开始 Loop:Boris Cherny 方法论

Claude Code 负责人 Boris Cherny 彻底抛弃了人工撰写 Prompt 的传统模式,转而构建自动化 Loop。本文详细拆解他如何通过 5 个终端窗口、多网页 Session、团队共享 CLAUDE.md、Plan 模式以及端到端验证构建高并发 AI 工程体系。

7月21日 2026年

利用 Harness 工程实现自我提升 (Lilian Weng)

本文译自 Lilian Weng 的个人学术博客。文章深入探讨了如何通过围绕基座模型的外挂控制系统(Harness)设计,推动大语言模型的递归自我提升(RSI),并解析了工作流自动化、持久化状态管理等关键模式及前沿优化算法。

7月4日 2026年

ClickUp:用数千个AI智能体替代了数百名员工

一家成立九年的项目管理 SaaS 公司 ClickUp 用数千个 AI 智能体替代了数百名员工。同一周,Uber 公开质疑 AI 投入产出、加州签署 AI 失业行政令。这是 2026 年 AI 与就业最真实的剖面。

5月26日 2026年

db9.ai: Postgres for Agents

黄东旭(PingCAP CTO)的最新作品 db9.ai 上了 HN 首页。这是一个给 AI Agent 用的 serverless PostgreSQL 数据库,基于 TiKV,内置向量搜索、文件系统 fs9、cron、HTTP 调用。

5月15日 2026年

UI 曾是软件最大的护城河,但 Agent 来了

a16z 合伙人 Seema Amble 深度分析:当 AI Agent 不再需要浏览器,SaaS 的护城河在哪里?三条路径、五个新维度,和一个正在被重写的行业规则。

5月14日 2026年

Anthropic 一周三连发:当 AI 公司开始住在你的软件里

Anthropic 一周内连推 Small Business、Financial Services、Legal 三款行业产品,直接将 Claude 嵌入 QuickBooks、DocuSign、M365 等现有 SaaS。300 亿美元 ARR 的背后,是从模型 API 到应用内 AI 平台的战略转身。

5月14日 2026年

TARS:字节跳动在赌一个怎样的桌面 Agent 未来?

字节跳动的 TARS(原 UI-TARS-desktop)不是另一个 Claude Computer Use 克隆。33K stars、四层架构、多模型支持、完全开源——它在桌面 Agent 赛道上选了一条跟 Anthropic 完全不同的路。

5月12日 2026年

antirez 的选择:当推理引擎只为一个模型而生

Redis 创始人 antirez 用纯 C 为 DeepSeek V4 Flash 写了一个专用推理引擎 DS4,抛弃了 llama.cpp 的通用抽象层。这个项目引出一个值得认真想清楚的问题:通用推理框架的代价,究竟是多少?

5月12日 2026年

200ms 节拍:拆解 Thinking Machines「交互模型」的架构假设

前 OpenAI CTO Mira Murati 创立的 Thinking Machines Lab 发布了一种全新的「交互模型」架构——原生多模态、全双工、200ms 节拍维持在场感。这不是又一个 Agent 框架,而是对「人机该怎样协作」这件事的根本性重写。

5月12日 2026年

Agent Memory Engineering

Agent 到底是怎么"记住"我和我的指令的?为什么把一个 agent 的记忆迁移到另一个 agent 比单纯复制文件要难得多? 我经常同时使用 Claude Code 和 Codex。工作中,我用 GitHub Copilot CLI 在 Anthropic 和 OpenAI 模型之间根据任务切…

5月6日 2026年

Cursor: 持续优化我们的 Agent Harness

Cursor 如何像打磨软件产品一样打磨 Agent Harness——从上下文窗口管理、A/B 实验、工具可靠性,到模型定制与多智能体未来。

5月6日 2026年

Flue:当 Astro 团队决定做 Agent 框架

Astro 团队做了一个 agent 框架,叫 Flue。它不是 AI SDK,不是 LangChain 的竞品,而是一个 headless Claude Code——纯 TypeScript,不需要人坐在终端前面敲键盘。我翻了完整源码,写写实际看到的。

5月4日 2026年

AI早知道周刊 · 20260427-0503

DeepSeek V4 价格冲击、IBM Granite 4.1 小模型反超大 MoE、Agent 框架全面爆发——本周 AI 圈围绕「模型经济学」与「Agent 基础设施」两条主线激烈交锋。

5月3日 2026年

Langfuse 项目深度分析报告

Langfuse 是开源 LLM 工程平台,提供可观测性、指标分析、自动化评估、Prompt 管理等核心功能。本文深度分析其技术架构、商业模式、竞争格局及投资建议。

4月30日 2026年

AI早知道周刊 · 20260420-0426

上一自然周 HN Top 10:模型发布、硬件可维修、供应链安全与平台权力竞争同时升温。

4月26日 2026年

AI早知道周刊 · 20260413-0419

Anthropic、OpenAI、Qwen 继续占据 HN 话语中心,但这一周更值得注意的是,模型发布如何迅速外溢到开发者工作流、数据边界、供应链安全与平台治理。

4月19日 2026年

AI早知道周刊 · 20260406-0412

上一自然周 Hacker News Top 10 中文周刊,聚焦 AI 工程化、开源安全、平台依赖与终端个性化。

4月12日 2026年

Mem0:AI应用的自适应记忆层

Mem0提供分层记忆架构,支持会话/会话/用户/组织四级记忆,结合向量检索与图存储,为AI代理实现长期上下文保持。

4月9日 2026年

AI早知道周刊 · 20260330-0405

上一自然周 HN 的核心叙事并不是单点爆款,而是 AI 工具链安全、供应链攻击、平台边界和开源模型竞争同时升温。

4月5日 2026年

AI早知道周刊 · 20260323-0329

NVIDIA 在 GTC 上发布 NemoClaw,为 OpenClaw 进入企业市场打开大门;Superpowers 三个月获 9.2 万 star 打破 Linux 纪录;Claude Cowork Dispatch 成为 Anthropic 史上最大发布。Agent 生态本周加速。

3月29日 2026年

我受够了 Claude Code 的黑箱,所以自己造了一个

Mario Zechner 受够了 Claude Code 的黑箱,自己造了一个只有 4 个工具、900 token 的极简 agent。核心主张:你以为你在做 context engineering,但你连 context 里有什么都不知道。

3月23日 2026年

五个月,零行人工代码,一百万行 AI 代码

OpenAI 工程团队五个月写了百万行 AI 代码,却发现代码库有传染性——坏模式被 AI 无限复制。他们的解法:用 GC Agent 清 agent 的垃圾,用知识即代码阻止问题蔓延。

3月22日 2026年

AI早知道周刊 · 20260316-0322

本周主旋律是买买买:OpenAI 收购 Astral,Anthropic 收购 Bun,大厂从卷模型转向卷开发者工具链。同期:Cursor Composer 2 发布,Claude Cowork 亮相,Codex 周活突破 200 万。

3月22日 2026年

AI 写代码的时候,谁在当质检员?

AI 评估自己的工作,几乎永远给出好评。Anthropic 工程师 Prithvi 从 GAN 偷来一个想法:用独立的 Evaluator agent 充当刻薄的质检员,让输出质量在多轮迭代中持续提升。

3月21日 2026年

什么是 Harness?给 AI 工程师的第一份完整定义

模型够好,工具够多,但结果还是不稳定——问题往往不在模型,而在 Harness。这篇文章给出 Harness 的完整定义:围绕 AI 模型构建的运行环境总和,以及理解它的五个核心维度。

3月20日 2026年

情境感知:前言 (Introduction)

《情境感知》系列前言:AGI 军备竞赛已经打响,万亿美元工业总动员拉开序幕,『国家计划』即将启动——拥有情境感知的人,已在旧金山窥见终局。

6月4日 2024年