# 微软开源新工具，用文字描述就能给 AI 模型出考卷

> 原标题：New Microsoft tool lets devs spin up AI behavior tests using text descriptions

- 来源：TechCrunch · AI
- 发布时间：2026-06-02T19:02:21.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/32990
- 原文：https://techcrunch.com/2026/06/02/new-microsoft-tool-lets-devs-spin-up-ai-behavior-tests-using-text-descriptions/

## 摘要

微软发布了一个叫 ASSERT 的开源框架，让开发者直接用自然语言写测试要求，就能自动生成一套评估 AI 行为的考题和回归测试。正文没披露它具体支持哪些模型、打分指标怎么算，也没提使用限制。

## 推荐理由

我会先打个折：正文没披露这个框架支持哪些模型、具体用什么指标、以及跑起来的硬件或环境要求，所以实际能省多少事还不好说。但方向本身挺对——让开发者用自然语言写测试意图，而不是手搓脚本，确实能降低回归测试的门槛。微软把它开源出来，至少说明不是内部玩具。这点先别太激动，等看到跑分和兼容性再判断值不值得集成。

## 锐评

微软把 ASSERT 开源了，这个框架让开发者用自然语言描述“我要测什么”，它就能自动生成一套评估 AI 行为的考题和回归测试。对天天手写测试用例的工程师来说，这能省不少事。

但正文信息缺口很大：没披露支持哪些模型，也没说打分指标具体怎么算。如果只支持自家模型，或者指标定义很模糊，那实用性就要打折扣。另外也没提使用限制，比如测试生成有没有数量上限、对中文场景支持如何。

我会先打个折。想法不错，但得等看到实际支持的模型列表和指标定义，才能判断它是不是真能替代手写测试。
