跳转至

Groq Prompt Driver 极速推理提示驱动与 LPU 模型连接节点

Groq Prompt Driver 驱动节点专用于在 Griptape Nodes 框架中配置并驱动 Groq 专有 LPU(Language Processing Unit)芯片架构上的各种开源大语言模型,为工作流提供亚秒级响应、超高 Token/s 吞吐的极速推理能力。

驱动环境配置 (Configuration)

API 凭证管理 (API Key)

使用 Groq 提示驱动需要有效的 Groq API 密钥。您可以前往 Groq 控制台 (Groq Console) 免费创建和获取专属 API Key。

支持的模型清单 (Available Models)

Groq 提示驱动全面适配并支持以下主流模型矩阵:

正式生产模型 (Production Models)

实验预览模型 (Preview Models)

配置参数规范 (Parameters)

参数名称 (Parameter) 数据类型 (Type) 默认值 (Default) 语义说明 (Description)
model string gemma2-9b-it 用于文本生成与推理的目标 Groq 模型标识符。
temperature float 0.7 控制生成的发散度与随机性(0.0 至 1.0)。
top_p float 0.9 核采样阈值,调控候选词词汇多样性(0.0 至 1.0)。
max_tokens integer 2048 单次生成允许的最大 Token 数量上限。
stream boolean false 是否开启实时流式生成(Token-by-Token 吐出)。
max_attempts integer 3 请求异常或触发限流时的最大自动重试次数。

使用步骤指南 (Usage)

  1. 在工作流画布中添加 Groq Prompt Driver 节点。
  2. 确保在 Groq 密钥管理中心 获取了有效的 API Key。
  3. 在 Griptape 统一环境配置或全局偏好设置中挂载 GROQ_API_KEY。
  4. 从下拉列表中选择所需的生产级或预览版模型。
  5. 根据任务属性按需调整温度与最大 Token 数量。
  6. 将其输出引脚连入 Agent 或后续的处理算子中。

关键技术特性与说明 (Notes)

  • OpenAI 兼容协议:Groq 驱动基于兼容 OpenAI 的标准 REST 端点 https://api.groq.com/openai/v1 进行安全通信。
  • 预览模型生命周期提醒:Preview 系列模型专供技术评估测试,官方可能随时下线轮换;在核心生产管线中强烈建议选用 Production Models。
  • 执行前状态自检:在工作流每次触发执行前,该节点均会自动在后台对 API Key 的合法性进行快速探测与连通性验证。