LLM 能建議 Metamorphic Relations,但它保證不了正確性
大型語言模型是發掘 test oracles 時還算稱職的腦力激盪夥伴,但它會幻覺化性質、遺漏領域限制。以下是如何安全使用它們,而不會上線錯誤的測試。
你需要測試一個無法事先知道正確輸出的函式。一個路徑最佳化器。一個情緒分類器。一個物理模擬。你讀過 metamorphic testing:找出輸入與輸出之間必須成立的關係,然後測試這些關係,而不是精確值。 問題在於想出這些關係。你盯著你的函式簽章,腦袋一片空白。 於是你去問 LLM。它在幾秒內丟回十個…