Jev ニュース

Jev 与无法解释的失败的常态化

Hacker News 热门(buzzing.cc 中文翻译)AIHOT スコア 54/100

要約

作者评论 TypeSafe AI 推出的 AI 模型 Jev,认为其用户不做 evals、把置信度分数当形式或甩锅理由,丢弃了对失败原因的追查。他担忧 LLM 驱动的开发会让"有时就是烂"成为排查的可接受终点,而本可用几条提示词搭建的 eval 反而能解决部分问题。

元の記事の見出し

无法解释的失败的常态化