AI 博客

标签: structured-outputs

← 返回 AI 博客

15 分钟读完

Ollama、LM Studio、llama.cpp 与 MLX:差别全在那一次工具调用上

四个本地运行时、同一份权重,进去的是四份不同的提示词,出来的是「工具调用到底解析没解析出来」的四种答案。这些都与吞吐无关,而吞吐是唯一被拿来比较的那根轴。

10 分钟读完

Outlines、XGrammar、llguidance 与 Instructor:合法 JSON 从来不是难的那一部分

这四者中有三个约束采样器,让非法输出根本产生不出来,而它们之间的选择坍缩成一个问题:你的 schema 会重复吗?第四个做的是另一类事,也是唯一能强制那些真正搞垮智能体的规则的——因为语法只保证枚举值是五个当中的一个,却对"是哪一个"只字不提。