我构建 AI-native 应用,要求它们可测试、可观测、有证据支撑——是能在失败里活下来的工作流,而不是只在 demo 里好看的东西。
我不手写代码——这里的每一行代码都由 AI(Claude Code 和 Codex)编写。 架构设计、技术决策和验收测试由我负责。Vibe coding,按工程标准交付。
- 🔭 正在做 — AI/Agent Tech Radar:混合检索(E5 + BM25 + RRF + cross-encoder)、有界 tool-calling ReAct agent、确定性引用校验、只读 MCP server
- 🧪 在探索 — 会话上下文压缩、agent 评测套件、claim-level groundedness
- 🌏 工作语言 — 中文 & English · UTC+8
- 📫 联系我 — juzidekuwei@outlook.com
这里的每一行代码都由 AI 编写——与 Claude Code、Codex 和 Cursor 一起 vibe coding。分工如下:
| Mine | AI's |
|---|---|
| 架构、范围与 spec | 实现——全部代码 |
| 代码审查与设计质询 | 重构与样板代码 |
| 验收:测试、评测套件、Trace | 测试脚手架 |
| 决策记录与权衡取舍(ADR) | 文档草稿,由我编辑定稿 |
|
Vibe-coded with Claude Code & Codex — human-owned architecture and acceptance. |
Vibe-coded with Claude Code & Codex — human-owned architecture and acceptance. |
scope before framework
evidence before confidence
failure paths are product behavior
small experiments before large abstractions
ai writes, i verify
我边做边分享真实过程:架构决策、别扭的边界情况、评测里的缺口,以及每一个让 AI 工作流更可信的小改进。
公开地构建——一次一个可度量的工作流。