Один и тот же промпт можно отправить в модель четырьмя способами: набрать в веб-чате, отдать консольному агенту, вызвать из кода через SDK или собрать HTTP-запрос руками. Ответ вернётся похожий. А вот система вокруг него получится разной по задержке, стоимости, предсказуемости и безопасности — и разница эта возникает не в модели, а в слое, через который вы к ней обращаетесь.
Continue reading “Чат, CLI, SDK или голый HTTP: какой слой доступа к LLM выбрать под задачу”