llm 0.33: шаблоны наслаиваются, embed получил --key

В llm 0.33 флаг -t можно склеивать по очереди: конфиг модели — в одном шаблоне, текст промпта — в другом, запуск собирает оба слоя без копипаста. Заодно CLI переехал на OpenAI Python 3.x и httpx2 вместо httpx — полноценный фикс после вчерашней 0.32.1 (#1608, #1631).
Как раскладывать шаблоны
Willison показал рабочий паттерн для терминала. Сначала сохраняешь модель с опциями:
llm -m gpt-5.6-luna -o reasoning_effort high --save lhigh
Потом — сам промпт:
llm "Generate an SVG of a pelican riding a bicycle" --save pelican
Один вызов склеивает шаблоны в порядке аргументов:
llm -t lhigh -t pelican
Модель и опции из первого файла подхватываются вторым — один конфиг, много разных промптов.
Ключи для embed и reasoning
llm embedиllm embed-multiпринимают--key; в Python то же черезkey=вEmbeddingModel.embed(),embed_multi()и методах Collection — ключ на вызов, без смены общего состояния модели (#757, #1620).- Старые плагины с
self.keyпродолжают работать через fallback совместимости. - У embedding-моделей ключи устроены так же, как у обычных LLM.
- Модели Responses API с reasoning получили опцию
reasoning_summaryсо значениями auto, concise и detailed — черезllm openai endpoint --responses(#1600).
Источник: llm 0.33.