个人架构能力,落到代码上就是清晰的任务边界
一个程序、模块或实验脚本只负责一件明确的事。
有固定命令、函数入口、参数说明和最小运行样例。
输入格式、输出结果、错误状态和边界条件都能被机器读取。
每个单元都能离开完整系统运行自己的测试或仿真检查。
外部设备、数据库、网络和模型依赖可以替换成 mock 或样例数据。
缓存、配置、临时文件和实验结果不要隐式污染其他流程。
过去很多工具、软件界面、文档、日志和调试方式默认是给人看的。AI 进入研发以后,这些东西还要能被 AI 读取、定位、调用、验证和复盘。第一个变化不是“多一个聊天框”,而是研发资产的使用对象变了。
不是所有旧资产都要保留,也不是所有东西都要写成文档。关键是判断:这个环节以后是给人判断、给 AI 执行,还是给双方共同复核。
很多 AI Agent 会直接读目录、改文件、跑命令。项目入口、构建脚本和目录说明要比按钮位置更重要。
有些 PRD 不必保留原样,有些约束必须结构化沉淀。问题不是写不写文档,而是谁要使用它。
日志不只是给人扫一眼,要包含时间、设备、版本、上下文、错误码和可过滤字段。
AI 需要明确命令、输入、期望输出和失败证据。临场经验要变成可以重复执行的检查步骤。
业务目标、用户体验、风险判断、架构取舍、专业结论和最终审批。
AGENTS.md、目录说明、接口定义、脚本、测试入口、机器可读日志和实验配置。
代码差异、测试报告、调试记录、实验结果、版本记录、问题清单和阶段摘要。
过去很多架构判断主要由研发总监、架构师或核心负责人承担。AI 进入研发以后,每个人在给 AI 分配任务时,都要能判断功能怎么拆、边界在哪里、依赖能否隔离、测试能否单独运行。否则 AI 会把模糊边界变成更快的错误扩散。
一个程序、模块或实验脚本只负责一件明确的事。
有固定命令、函数入口、参数说明和最小运行样例。
输入格式、输出结果、错误状态和边界条件都能被机器读取。
每个单元都能离开完整系统运行自己的测试或仿真检查。
外部设备、数据库、网络和模型依赖可以替换成 mock 或样例数据。
缓存、配置、临时文件和实验结果不要隐式污染其他流程。
一个大程序同时处理连接、协议、状态同步、日志、界面和异常恢复。AI 很难判断改动边界,测试也只能依赖完整系统联调。
连接管理、协议解析、状态同步、日志分析和异常恢复各自有入口和测试。AI 可以只改一个单元、跑对应测试,再由工程师决定是否进入集成验证。
Token 优化不是少打几个字,而是让 AI 不必反复寻找入口、读取无关材料、猜测环境和重新推理确定性步骤。
无关文件、完整日志和重复历史都会直接增加用量。
错误方向、重复命令和无效重试会拉长交付时间。
上下文越杂,关键约束越容易被不相关内容淹没。
没有文档、脚本和固定环境时,AI 每次都要重新认识项目。
用术语索引、CDB、`rg`、LSP 或 AST 找到相关项目、符号和文档。
用 `jq`、`jc` 和 SQL 保留时间段、字段、错误和聚合结果。
构建、测试、采集、实验和比较使用固定入口,失败时返回非零状态。
记录已确认事实、已排除假设、当前决定、未解决项和下一步。
模型升级很快。企业应该比较具体产品在具体环境中完成具体任务的结果,而不是制作一张永不过期的排行榜。
理解、推理、生成、多模态、速度和成本。
能否读项目、改文件、运行命令和验证结果。
模型实际可以使用的数据、工具、设备和权限。
培训里不做永久排行榜,而是给研发团队一个当前可用的经验判断:前台 UI、算法理解和图形相关任务,Claude 系列通常更顺手;后台逻辑、工程执行和实际落地干活,GPT 系列通常更稳;xAI 可以作为搜索、补充思路和交叉验证的备选。
| 模型方向 | 更适合的研发任务 | 使用方式 | 必须保留的验证 |
|---|---|---|---|
| Claude 系列 | 前台 UI、交互体验、算法解释、图形和多模态相关分析 | 用于理解复杂材料、整理界面/图形问题、比较算法思路和生成可讨论方案 | 必须看真实页面、图形结果、实验复现和人工专业判断 |
| GPT 系列 | 后台逻辑、接口、数据库、工程 Agent、小步修改和工具执行 | 用于拆任务、改代码、跑命令、修测试、查日志和推动实际工程闭环 | 必须跑单元/集成测试,检查 diff、日志、权限和回退路径 |
| xAI / Grok | 补充搜索、外部信息、不同思路和交叉验证 | 作为第二意见,不作为唯一执行者;适合补充资料和发现遗漏角度 | 必须回到代码、数据、测试和官方资料验证,不直接采信结论 |
| 任务方向 | 优先尝试 | 适合让 AI 参与 | 必须保留的验证 |
|---|---|---|---|
| 后台逻辑 | GPT | 接口、数据库、事务、并发、权限、异常路径和测试修复 | 单元/集成测试、权限测试、日志和回退 |
| 前台 UI | Claude | 页面、组件、交互、状态、真实数据连接和视觉问题分析 | 真实页面、交互路径、移动端和接口数据 |
| 算法研发 | Claude | 公式解释、论文/方案理解、实验脚本、基线复现和误差切片 | 固定数据、随机种子、基线和结果复现 |
| 图形/可视化 | Claude | 图表、图像、界面截图、曲线异常和可视化表达 | 真实截图、像素/数据核对、人工视觉确认和复现脚本 |
| 建模工作 | Claude + GPT | 数据划分、特征、训练、评估和结果分析;GPT 负责脚本化执行和修测试 | 数据版本、配置、切分规则和独立评估 |
| 硬件/固件 | GPT + 人工确认 | 规格整理、接口、日志、状态机和测试矩阵 | 仪器、真实设备、模拟器和硬件工程师确认 |
工具不是命令清单。每组工具都必须回答四件事:解决什么问题、AI 怎样调用、输出怎样压缩、结果怎样判断可信。
项目大、术语多、旧名称多,AI 容易找错仓库或模块。
先查术语索引,再用 `rg` 限定目录搜索代码、配置和文档。
只返回文件路径、行号和少量上下文,不粘贴整个文件。
回到真实定义和项目文档,不用搜索片段代替上下文。
日志、接口和系统命令输出很多,无关内容消耗 Token。
`jq` 过滤 JSON;`jc` 把进程、磁盘和网络文本转成 JSON。
按时间、事件、错误码和字段筛选,必要时先聚合计数。
保留过滤表达式和原始来源,抽样核对没有漏掉关键事件。
业务记录、实验结果和指标量大,直接读取整库风险高。
提供表结构和只读要求,先查小时间段、小行数和聚合结果。
只保留相关列、行数、统计摘要和异常样本。
保存 SQL、结果行数和查询环境,确认没有写入生产数据。
全文搜索无法可靠区分定义、引用、类型和同名文本。
LSP 查定义和引用;AST 工具按语法结构搜索与转换。
只返回目标符号、调用者、实现者和相关诊断。
检查引用、类型诊断、编译结果和受影响测试。
构建、测试、采集和实验步骤脆弱,人工重复容易漏步骤。
优先使用已有脚本或 Make 目标;耗时任务进入 `nq` 队列。
终端只保留步骤、结果和日志路径,详细输出写入日志。
必需步骤失败时返回非零状态,重复执行得到一致结果。
接口、端口、Socket 和环境差异经常被误判成代码问题。
`curl` 查接口,`socat` 临时桥接,`envdir` 分离每个变量。
只保留状态码、关键响应头、目标地址和必要错误。
监听默认限制本机,密钥不打印,临时桥接使用后关闭。
AI 修改越快,越需要知道改了什么、为什么改、怎样比较、如何回退。没有基线,就没有可信的 AI 修改。
文件本身进入专门存储;Git 保存清单、哈希、版本和来源。不要把大型二进制文件、数据副本或密钥直接提交到普通仓库。
“能不能发给 AI”不能靠个人感觉。先按公司规则给数据分级,再决定使用哪个账号、什么环境、多少数据和什么权限。
| 数据等级 | 典型内容 | AI 使用规则 |
|---|---|---|
| 公开 | 公开文档、公开代码、公开论文 | 可以使用,仍要检查来源、许可证和准确性。 |
| 内部 | 普通内部流程、非敏感项目说明 | 只进入企业批准的账号、模型和工具。 |
| 机密 | 源码、原理图、核心算法、客户资料 | 最小裁剪、脱敏或在受控环境中处理。 |
| 禁止上传 | 密钥、密码、可识别用户信息、敏感听力数据、完整客户资料 | 不进入外部 AI;按公司专门流程处理。 |
限制目录、日志时间段、字段和样本,删除人员、客户和设备标识。
写入、联网、外发、删除和生产修改不是同一个权限。
删除、发送、发布、支付、生产变更和真实设备关键操作不能自动放行。
安装前检查来源、权限、数据去向、写入能力和升级方式。
使用企业批准的密钥存储或独立环境配置,避免被输出和提交。
检查依赖、许可证、异常处理、权限和未经验证的技术结论。
AI 不能替代医疗、验配、硬件安全、算法有效性、产品合规和最终发布判断。它可以整理证据,但最终结论必须由有责任和资质的人确认。
本节案例、代码和展示方式由讲师现场安排。本页不提供 Demo、运行脚本或指定技术栈。你需要观察的不是 AI 输出了多少代码,而是整个过程是否可控、可复核、可回退。
目标、事实、输入、范围、禁区、验收和未知项有没有被明确。
是否先定位和过滤最小上下文,确定性工作有没有交给脚本或工具。
是否建立 Git 基线、检查 diff、运行测试并留下未解决风险。
补齐任务契约、边界和验收标准,先让问题可检查。
增加 AGENTS.md、运行脚本、测试入口、术语索引和日志过滤工具。
固定任务、输入、权限和验收,比较总成本和人工介入点。
明确数据分级、本地 Git、工具安装、关键动作和输出复核要求。