Generative AI Video

备注

image_3rd_party "Generative AI Video" 由 RTKSG SD3 与 ChungYi Fu(高雄,台湾) 联合开发

image_ameba_iot 特别感谢所有开发者的努力与贡献。

材料

  • AMB82-mini x 1

  • MicroSD 卡

  • 按钮 x1

  • 220 欧姆电阻 x1

范例

GenAIVideo

在本范例中,我们将使用开发板录制视频和音频,并将其发送到 LLM 服务器进行分析。

File -> Examples -> AmebaNN -> MultimediaAI -> GenAIVideo 中打开 Generative AI Video 范例。

将 "ssid" 填入您的 WiFi 网络 SSID,并将 "pass" 填入网络密码。

../../_images/image017.png

然后,填入您的 Gemini API 密钥。您也可以修改录制时长和文件名。

../../_images/image027.png

按如下方式连接按钮和电阻。

../../_images/image056.png

编译并运行范例。

打开串口监视器查看日志。

按下按钮一次,蓝色 LED 闪烁 3 秒后开始录制,在预设的录制时长内录制您周围的环境和声音。

录制完成后,将保存为 MP4 并发送到 Gemini 在线服务器。

Gemini 的响应将打印在串口监视器上。

Online LLM Models

SDK 中集成的各种在线服务器和 LLM 模型:

主机

转录端点

翻译端点

模型

速率限制

定价

generativelanguage.googleapis.com

/v1beta/models/<model>

gemini-2.5-flash

10 RPM

免费

速率限制参考

Google AI Studio: https://ai.google.dev/gemini-api/docs/rate-limits

Resources