ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

gemini-web2api 模型选择指南:Flash、Thinking、Pro、Auto、Lite 完整对比与实战

gemini-web2api 模型选择指南:Flash、Thinking、Pro、Auto、Lite 完整对比与实战 gemini-web2api 模型选择指南Flash、Thinking、Pro、Auto、Lite 完整对比与实战【免费下载链接】gemini-web2apiConvert Google Gemini web into OpenAI-compatible API. Zero auth, cross-platform, single file.项目地址: https://gitcode.com/gh_mirrors/ge/gemini-web2apigemini-web2api把 Google Gemini 网页端转换成了 OpenAI 兼容 API——零授权、跨平台、单文件即可运行。它内置了 7 个可选模型Flash、Thinking、Pro、Auto、Lite 等但新手往往不知道该在什么场景选哪个模型。本文用一张对比表 实战建议帮你在 5 分钟内选对模型。一、模型在哪里选所有模型名都通过请求体里的model字段指定完全兼容 OpenAI 客户端Cherry Studio、ChatBox 等Base URL 填http://localhost:8081/v1即可。你随时可以访问/v1/models接口查看当前支持的模型清单源码定义见 gemini_web2api/models.py。二、五大模型横向对比表模型名定位输出长度适合场景gemini-3.6-flash⭐ 默认全能款最新~1.2 万字日常问答、写作、通用任务gemini-3.5-flash3.6-flash 的别名~1.2 万字与上一行完全等价老配置可沿用gemini-3.5-flash-thinking 深度思考模式~2 万字长文写作、复杂推理、数学难题gemini-3.5-flash-thinking-lite⚡ 自适应动态思考~1.5 万字想要思考能力但嫌纯 Thinking 太慢gemini-3.1-pro 专业版高级数学/代码~1.2 万字硬核代码、竞赛级数学需 Cookiegemini-auto 自动选择不定不确定用哪个时的自动挡gemini-flash-lite 最轻量最快~1 万字高频调用、批量任务、简单问答 默认模型是gemini-3.6-flash可在 config.example.json 的default_model字段修改配置加载逻辑见 gemini_web2api/config.py。三、逐个模型实战解析1️⃣ Flash闭眼选的默认款gemini-3.6-flash是目前项目里最均衡的模型速度、质量、输出长度三平衡。如果你的应用场景不确定就选它这也是default_model的默认值。2️⃣ Thinking要长文和深度推理时必选gemini-3.5-flash-thinking开启扩展思考输出可达~2 万字是其他模型的一倍半以上。写长报告、做复杂问题拆解时优先用它。3️⃣ Lite速度与成本的最优解gemini-flash-lite响应最快、输出最精简适合批量生成、高频调用注意 Google 有限流服务端会自动重试简单分类、摘要、意图识别等轻量任务4️⃣ Pro先看看你有没有资格⚠️重要提醒没有Gemini Advanced 付费订阅的 Cookie 时gemini-1-pro会静默回退到 Flash——Pro 只是界面标签不是真正的模型切换。免费账号 Cookie 可以认证但效果等同 Flash。配置方式获取 Cookie 的详细步骤见 README_CN.mdpython gemini_web2api.py --cookie-file cookie.txt5️⃣ Auto不想动脑就选它gemini-auto把选择权交给 Gemini 后端自动路由输出长度不定。适合快速搭建原型、不想纠结模型的阶段。四、隐藏技巧thinkN 思考深度调节任何模型名都可以追加thinkN后缀微调思考深度0 最深4 最浅gemini-3.5-flash-thinkingthink0 # 最深思考默认 gemini-3.5-flash-thinkingthink2 # 中等速度与深度折中 gemini-3.6-flashthink4 # Flash 也能临时降档思考解析逻辑同样在 gemini_web2api/models.py 的resolve_model函数中未知模型名会自动回退到默认模型而不会报错。五、场景速查到底该选哪个你的需求推荐模型日常问答 / 写周报gemini-3.6-flash写 1 万字以上长文gemini-3.5-flash-thinking复杂逻辑 / 数学题gemini-3.5-flash-thinking或gemini-3.1-pro付费简单问答、批量跑量gemini-flash-lite不想配置、图省事gemini-auto思考太久想加速任意模型 think4六、避坑指南 ✅别名别混淆gemini-3.5-flash就是gemini-3.6-flash的别名后端已升级旧教程里的写法照样能用。Pro 不是免费的无付费 Cookie 时 Pro 会静默回退 Flash别以为自己在用 Pro。限流问题高频请求可能被 Google 限流服务端会自动重试批量任务建议选 Lite 或配置 Cookie。图片输入多模态消息使用 Gemini 网页端的图片上传接口匿名上传失败时需配置 Cookie。多轮对话每次请求是独立会话多轮上下文靠把历史消息塞进 prompt 模拟。七、快速上手三步走pip install httpx python gemini_web2api.py服务启动在http://localhost:8081/v1在客户端填入 Base URL 任意密钥未配置api_keys时免密 模型名即可开始对话。完整文档见 README_CN.md支持 Docker 部署Dockerfile。一句话总结日常用Flash长文用Thinking跑量用Lite拿不准用Auto想要真Pro先问自己有没有付费订阅 【免费下载链接】gemini-web2apiConvert Google Gemini web into OpenAI-compatible API. Zero auth, cross-platform, single file.项目地址: https://gitcode.com/gh_mirrors/ge/gemini-web2api创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表