20 hours ago
- AI代理不能真正编程;它们是统计模型,会产生越来越难以检测的有缺陷代码。
- 作者使用代理进行了6个月的实验,但发现手动工作更高效;代理能提前推进进度,但在完善方面失败。
- AI对原型设计有用,在搜索方面比谷歌更好,但不能替代软件工程师。
- 高绩效个人使用代理能很好地纠错,但大型组织中低绩效的人在没有自我检查的情况下会产生更多的'垃圾'。
- 假设AI生成的工件是由类似人类的过程创建的,会导致脆弱、不可构建的代码。
- 作者认同LeCun/Marcus的观点,即真正的编程代理需要世界模型,而不是当前的RLVR方法。
- 在软件中采用AI的主要风险是大型组织在'AI精神病'中伤害自己。