愚蠢的 AI
关于使用 AI 进行编程的过程中遇到的一些趣事,目前我仍无法完全信任 AI
基于 OmniGibson 的仿真器
Time: 2026.09 - now
Model
- GPT: 重构一些小代码用 5.6 luna / 5.6 terra / 6 luna,重构后修复使用 5.6 sol / 6 sol
Insight
- 指令遵循不错,但问题就是太过于听话,有时为了修复一个表象,写入了离谱的逻辑,AI 的产出仍然需要人来进行检查
- 架构上的问题老生常谈,AI 仍无法设计优秀的架构,毕竟网上代码很多,但是高质量的又有多少?
Result
- 为了修复渲染图像曝光不足的问题,没有从 api 角度切入,而是对生成的图片使用 LUT 提高曝光
- 为了创建可以作为动态物体的 mug,居然不使用 og 提供的碰撞体生成方法,而是用一个圆柱体代替它
- 由于给定要抓取的 mug(非绝对尺度)宽度大于机械臂夹爪宽度,居然放弃了夹取,而是让机械臂接触 mug 并“粘住”
- 计算一个场景可用于任务的工作空间时,本应该是设计为按需采样的生成器,但却设计成穷举所有结果的函数,导致效率极其低下
个人网站
Time: 2026.03 - 2026.06
Model
- 阿里云、火山、百度的 Coding Plan:可以明显地感觉到模型是降智过的 (上下文过长时会无限“口吃”)
- OpenCode Go:主要使用了 Kimi 和 GLM,体验比前者好很多
Insight
- AI 不具备自主发现问题的能力,都需要靠我提出问题才能修复
- AI 的上下文有限,在从零开始一个项目时,缺乏对项目细节的打磨
- 尽管项目成型很快,但差劲的架构导致后续进行了非常多次重构
Result
- 一次性加载所有图像,导致用户最先看到的图片加载缓慢
- 硬编码了很多内容(资源路径,页面名称),而不是从配置文件中读取
- 出现了很多不必要的断言(我假设配置文件是符合标准的),导致代码中存在大量“废话”
- markdown 在客户端编译而不是在本地先编译成 html,导致用户需要等待很长时间才能看到内容