略读 预计 1 分钟
My personal AI benchmark: “Generate an SVG of a frog with a Habsburg jaw”
摘要
作者用 “生成一只哈布斯堡下巴的青蛙 SVG” 作为个人 AI 基准,对 google/gemini-3.6-flash 模型进行了三次运行测试。三次结果都显示模型在简单提示之外添加了大量编辑性内容:虚构皇家身份与服饰(皇冠、金羊毛勋章、披风)、情绪标签(忧郁、高傲、困倦)以及解剖学/临床评论(将下巴描述为 “凸颌” 病理特征)。作者记录了每次运行的耗时、输出大小和具体添加的文本片段,并指出这些内容超出了字面描绘。
荐读理由
这个测试揭示了当前模型在生成SVG时倾向于添加超出提示的叙事性、拟人化和临床化标签,对构建精确提示词有实际警示作用。你可以据此在生成代码或图形时明确限制模型不要添加额外注释,或检查输出中是否混入无关的编辑性内容。
这条对你有帮助吗?