通过 Groq 的 LPU 推理引擎实现毫秒级 LLM 响应。支持 Llama、Mixtral 等模型,适用于实时对话、代码补全等低延迟场景。
通过 Groq 的 LPU 推理引擎实现毫秒级 LLM 响应。支持 Llama、Mixtral 等模型,适用于实时对话、代码补全等低延迟场景。 安装:npx skills add groq# 安装到当前项目
npx skills add groq
# 全局安装
npx skills add groq -g
Sanity.io <hello@sanity.io>groq
评论区
该文章暂未开放评论功能。