llm 0.32rc2 更新默认模型并支持端点
Simon Willison··作者 Simon Willison
关键信息
GPT-5.6 Luna 的价格高于 GPT-4o mini,输入/输出 token 分别是每百万 $0.20/$1.20,而后者是 $0.15/$0.60;同时还可以把默认模型切换为更便宜的 GPT-5 nano,价格为 $0.05/$0.40。新的 `llm openai endpoint` 调用不会被记录,Simon Willison 还演示了可通过 `uvx` 直接对接 LM Studio 的本地服务,甚至无需先安装 llm。
资讯摘要
Simon Willison 在 RC1 之后不久发布了 llm 0.32rc2,并把它描述为一个小而实用的更新。这个版本修复了一个依赖问题,同时新增了两个值得注意的功能。第一,对于没有显式设置默认模型的用户,llm 现在默认使用 GPT-5.6 Luna,而不再是 GPT-4o mini。Willison 指出,Luna 更强也更新,但运行成本也略高。文中给出的价格是:Luna 的输入 token 每百万 $0.20、输出 token 每百万 $1.20,而 GPT-4o mini 分别是 $0.15 和 $0.60。
若用户想降低成本,可以用 `llm models default gpt-4o-mini` 切回 GPT-4o mini,或者用 `llm models default gpt-5-nano` 把默认模型改成更便宜的 GPT-5 nano。第二,版本新增了 `llm openai endpoint` 命令,可在不先配置模型的情况下,针对任意兼容 OpenAI 的端点发送提示、聊天请求和模型列表请求。作者特别说明,这些调用不会被记录。Willison 表示,他加入这个功能是因为自己需要一个简单的命令行工具,来测试各种 OpenAI Chat Completions 风格的仿真端点。他还给出了一个使用 `uvx` 直接连接 LM Studio 本地服务的示例,而且可以连同工具一起运行,无需先安装 llm。
来源与参考
收录于 2026-08-01