Heroku LLM 托管推理
llama-index-llms-heroku 软件包包含用于在 Heroku 托管推理平台上构建应用程序模型的 LlamaIndex 集成。该集成使您能够轻松连接并使用部署在 Heroku 基础设施上的 AI 模型。
%pip install llama-index-llms-heroku1. 创建一个 Heroku 应用
Section titled “1. Create a Heroku App”首先,在 Heroku 中创建一个应用:
heroku create $APP_NAME2. 创建并附加AI模型
Section titled “2. Create and Attach AI Models”创建并附加一个聊天模型到您的应用:
heroku ai:models:create -a $APP_NAME claude-3-5-haiku导出所需的配置变量:
export INFERENCE_KEY=$(heroku config:get INFERENCE_KEY -a $APP_NAME)export INFERENCE_MODEL_ID=$(heroku config:get INFERENCE_MODEL_ID -a $APP_NAME)export INFERENCE_URL=$(heroku config:get INFERENCE_URL -a $APP_NAME)from llama_index.llms.heroku import Herokufrom llama_index.core.llms import ChatMessage, MessageRole
# Initialize the Heroku LLMllm = Heroku()
# Create chat messagesmessages = [ ChatMessage( role=MessageRole.SYSTEM, content="You are a helpful assistant." ), ChatMessage( role=MessageRole.USER, content="What are the most popular house pets in North America?", ),]
# Get responseresponse = llm.chat(messages)print(response)该集成自动从环境变量中读取:
import os
# Set environment variablesos.environ["INFERENCE_KEY"] = "your-inference-key"os.environ["INFERENCE_URL"] = "https://us.inference.heroku.com"os.environ["INFERENCE_MODEL_ID"] = "claude-3-5-haiku"
# Initialize without parametersllm = Heroku()您也可以直接传递参数:
import os
llm = Heroku( model=os.getenv("INFERENCE_MODEL_ID", "claude-3-5-haiku"), api_key=os.getenv("INFERENCE_KEY", "your-inference-key"), inference_url=os.getenv( "INFERENCE_URL", "https://us.inference.heroku.com" ), max_tokens=1024,)有关可用模型的完整列表,请参阅Heroku托管推理文档。
该集成包含针对常见问题的适当错误处理:
- 缺少API密钥
- 无效的推理URL
- 缺少模型配置
有关 Heroku 托管推理的更多信息,请访问官方文档。