Generative AI Vision

备注

image_3rd_party "Generative AI Vision" 由 RTKSG SD3 与 ChungYi Fu(高雄,台湾) 联合开发

image_ameba_iot 特别感谢所有开发者的努力与贡献。

材料

范例

在本范例中,我们将使用开发板拍摄图像并将其发送到各种 LLM 服务器进行视觉分析。

File -> Examples -> AmebaNN -> MultimediaAI -> GenAIVision 中打开 Generative AI Vision 范例。

../../_images/image018.png

在突出显示的代码片段中,将 "wifi_ssid" 填入您的 WiFi 网络 SSID,并将 "wifi_pass" 填入网络密码。

../../_images/image028.png

在本文档中,我们将使用 Gemini API 进行演示。

Google AI Studio 中创建您自己的 Gemini API 密钥。

复制您的 API 密钥并粘贴到 Gemini_key 部分。

../../_images/image037.png

取消注释 gemini vision 提示函数以执行。

../../_images/image046.png

编译并上传固件。打开串口监视器查看响应。

您也可以修改 prompt_msg 以满足您的应用需求。

Online LLM Models

SDK 中集成的各种在线服务器和 LLM 模型:

服务器

模型

速率限制

定价

openAI platform

gpt-4o-mini

500 RPM

付费(Tier 1)

Google AI Studio

gemini-2.5-flash

15 RPM

免费

GroqCloud

meta-llama/llama-4-scout-17b-16e-instruct

15 RPM

免费

速率限制参考

openAI: https://platform.openai.com/docs/guides/rate-limits?context=tier-one#usage-tiers

Google AI Studio: https://ai.google.dev/gemini-api/docs/rate-limits

GroqCloud: https://console.groq.com/settings/limits

Resources

openAI platform - openAI vision
Google AI Studio - Gemini vision
GroqCloud - Llama vision