科研没有单元测试,AI 也替代不了研究员
AI Coding 在工程任务中已经非常成熟,但科研没有明确的预期输出,也缺少可以直接验收结果的单元测试。AI 可以辅助实验,研究员仍然必须对代码、结果和结论负责。
工作、研究与生活中,值得继续想下去的事。
AI Coding 在工程任务中已经非常成熟,但科研没有明确的预期输出,也缺少可以直接验收结果的单元测试。AI 可以辅助实验,研究员仍然必须对代码、结果和结论负责。
最近因为 GPT-5.5 太牛了,我开始翻了一些 LLM 和 VLM 相关的论文。与此同时,我又分别和不同朋友聊到了同一个问题,结果得到了两个截然相反的结论。这让我非常好奇,也产生了一些新的思考。 先叠个甲。 我本人没有训练过 LLM 和 VLM,对这个方向的认知基本…
最近 AutoResearch 的风很大。 大到什么程度呢。 打开知乎,全网都在吹。 从 Karpathy 的 AutoResearch ,到清华的 AutoSOTA,再到各种二创解读,整体画风基本就是一句话,AI 负责科研,你负责睡觉。 我第一次看到这个说法的时候,说实话,心里是有点慌的。…
这两天不知道为什么,天天能刷到opecnclaw,然而因为工作比较忙,懒得配置环境,所以看见kimi出了claw,免配环境,就花了199订阅了一个月试了一下。说实话很肉疼,我的gpt plus才160块,国产ai都已经贵的这么离谱了么。 配置:配置起来,确实非常方便,冲完…
大家好久不见!评论区有不少朋友催更,希望能更新一些模型轻量化,low level方面的内容。但是最近投稿屡投不中,刚刚NIPS正分被拒,AAAI被一轮因为奇葩理由拒稿,眼看就要全聚德,搞得我有点无心算法。所以这次不聊技术,单纯唠唠嗑,分享一下自己最近对AI…