llm 0.32rc2
llm 0.32rc2
llm 0.32rc2 发布,修复依赖问题并新增两个功能。默认模型从 GPT-4o mini 改为 GPT-5.6 Luna($0.20/$1.20 每百万 token),用户可通过命令切换回 4o mini 或更便宜的 GPT-5 nano($0.05/$0.40)。新增 `llm openai endpoint` 命令(#1576),支持针对任意 OpenAI 兼容 endpoint 运行 prompt、聊天和模型列表查询,调用不记录。该功能提供 uvx 单行命令示例,用于 LM Studio 本地模型测试。
发布:llm 0.32rc2 紧随 RC1 之后,此版本修复了一个依赖问题,并新增了两个简洁功能:对于未设置默认模型的用户,默认模型现已改为 GPT-5.6 Luna。此前默认模型为 GPT-4o mini。Luna 是性能更优且更新的模型,尽管价格略高——每百万输入 token 收费 $0.20,每百万输出 token 收费 $1.20,而 4o mini 分别为 $0.15/$0.60。你可以通过 llm models default gpt-4o-mini 切换回 4o mini,或使用 llm models default gpt-5-nano 切换到更便宜的默认模型 GPT-5 nano($0.05/$0.40)。#1576 新增 llm openai endpoint 命令,用于在未预先配置模型的情况下,针对任意兼容 OpenAI 的 endpoint 运行 prompt、聊天和模型列表查询。这些调用不会被记录。#1565 llm openai endpoint 命令非常实用。由于缺乏一个直观的 CLI 工具来针对任意 OpenAI Chat Completions 模仿 endpoint 测试 prompt,我感到不便,因此决定将此功能直接集成到 LLM 中。你甚至无需安装 LLM 即可使用。以下是一个使用 uvx 的单行命令,用于针对 LM Studio 本地模型运行带工具的 prompt:uvx --pre llm openai endpoint http://127.0.0.1:1234/v1 \ T llm_version -T llm_time --td \ -m google/gemma-4-31b 'what is the current LLM version? And the time?' 输出见此处。标签:llm、uv、lm-studio