愚蠢的 AI

关于使用 AI 进行编程的过程中遇到的一些趣事,目前我仍无法完全信任 AI

基于 OmniGibson 的仿真器

Time: 2026.09 - now

Model

  • GPT: 重构一些小代码用 5.6 luna / 5.6 terra / 6 luna,重构后修复使用 5.6 sol / 6 sol

Insight

  • 指令遵循不错,但问题就是太过于听话,有时为了修复一个表象,写入了离谱的逻辑,AI 的产出仍然需要人来进行检查
  • 架构上的问题老生常谈,AI 仍无法设计优秀的架构,毕竟网上代码很多,但是高质量的又有多少?

Result

  • 为了修复渲染图像曝光不足的问题,没有从 api 角度切入,而是对生成的图片使用 LUT 提高曝光
  • 为了创建可以作为动态物体的 mug,居然不使用 og 提供的碰撞体生成方法,而是用一个圆柱体代替它
  • 由于给定要抓取的 mug(非绝对尺度)宽度大于机械臂夹爪宽度,居然放弃了夹取,而是让机械臂接触 mug 并“粘住”
  • 计算一个场景可用于任务的工作空间时,本应该是设计为按需采样的生成器,但却设计成穷举所有结果的函数,导致效率极其低下

个人网站

Time: 2026.03 - 2026.06

Model

  • 阿里云、火山、百度的 Coding Plan:可以明显地感觉到模型是降智过的 (上下文过长时会无限“口吃”)
  • OpenCode Go:主要使用了 Kimi 和 GLM,体验比前者好很多

Insight

  • AI 不具备自主发现问题的能力,都需要靠我提出问题才能修复
  • AI 的上下文有限,在从零开始一个项目时,缺乏对项目细节的打磨
  • 尽管项目成型很快,但差劲的架构导致后续进行了非常多次重构

Result

  • 一次性加载所有图像,导致用户最先看到的图片加载缓慢
  • 硬编码了很多内容(资源路径,页面名称),而不是从配置文件中读取
  • 出现了很多不必要的断言(我假设配置文件是符合标准的),导致代码中存在大量“废话”
  • markdown 在客户端编译而不是在本地先编译成 html,导致用户需要等待很长时间才能看到内容