gemini-web-cli: 把 web 版本的 gemini 转换为 OpenAI compatible 的 API 或者 MCP Server
gemini-web-cli 把 Gemini 网页版的全部能力程序化:对话、图片/视频/音乐生成、Deep Research、Notebook 知识库管理。只要从浏览器 DevTools 复制一段 cookie 导入即可开始。
三种使用模式
- CLI 模式 —— 直接在终端使用
gemini-web-cli ask "Explain quantum computing"
gemini-web-cli ask --mode image "Draw a sunset"
gemini-web-cli research run "Compare Rust and Go"
gemini-web-cli reply c_abc123 "Tell me more"
对话流式输出、多模态生成、Deep Research、Notebook 管理,全部一条命令完成。适合脚本集成和 agent 流程。
- OpenAI API 兼容模式 —— 本地 HTTP 服务
gemini-web-cli serve --port 8080
暴露 OpenAI 兼容的 /v1/ REST API(含 Swagger UI 于 /docs),任何支持 OpenAI 协议的客户端(Cursor、VS Code、各类 SDK)无需改动即可接入 Gemini。
- MCP 模式 —— AI 客户端工具集成
同一个 serve 实例在 /mcp 提供 Model Context Protocol 端点(Streamable HTTP),让 Claude Desktop、Cursor 等 AI 客户端把 Gemini 当作工具调用。
能力一览
- 对话:单轮/多轮、流式输出、附件上传(注意:不支持 tool call / 工具调用)
- 多模态生成:图片、视频、音乐、图生视频
- Deep Research:提交任务、查进度、导出报告
- Notebook:创建知识库、添加文档/URL 源、基于知识源提问
- Pi 集成:自带 pi-provider-gemini-web 扩展,把 serve 实例变成 Pi 的模型 provider
适合谁
不想为 API 付费、或需要网页端独有功能(Notebook、媒体生成)的用户;想把 Gemini 接入现有 AI 工具链但不想折腾配额的开发者;需要在脚本/agent 流程里程序化调用 Gemini 的场景。
https://github.com/Leechael/gemini-web-cli/releases/tag/v0.1.2

