Gemini 3.5 flash模型免费调用,谷歌免费api,无需绑定信用卡,无需订阅google ai套餐,让你的openclaw(龙虾)、hermes agent 实现免费token,创建自动化应用。
1.使用gmail账号访问aistudio.google.com
你现在是一位资深全栈工程师 + AI Agent 开发专家,需要为我开发一个完整的、可以直接运行的 Python 项目。
### 项目目标
开发一个**自动撰写历史人物口播稿的 Web 应用**,带有美观的用户界面。核心功能是:用户选择或输入中国古代知名历史人物,系统调用大模型自动生成高质量口播稿。
### 技术栈要求
- Python 3.10+
- 使用 **Gradio** 或 **Streamlit** 构建 Web 界面(推荐 Gradio,因为交互更灵活)
- 支持通过环境变量或界面输入自定义**模型名称**和 **API Key**
- 默认使用 **Gemini 1.5 Flash**(google-generativeai),但必须设计成可切换其他模型(OpenAI、Claude、DeepSeek、通义等)的架构
- 代码结构清晰,包含 requirements.txt、README.md 和 .env.example
### 核心功能要求
1. **Web 界面功能**:
- 左侧:输入区域
- 历史人物名称(支持下拉常见人物 + 自定义输入)
- 可选:额外要求/侧重点(例如:重点讲军事才能、情感故事、权谋等)
- 模型选择(下拉框 + 自定义模型名称)
- API Key 输入框(支持保存到本地 session 或 .env)
- 生成按钮
- 右侧:预览和输出区域
- 生成的口播稿正文(支持一键复制)
- 字数统计
- 一键导出为 .txt 或 .md 文件
2. **口播稿写作要求(必须严格遵循)**:
- 语言:简体中文,纯口语化表达,像专业历史故事主播在说话
- 字数:**3000-4000字**(必须严格控制)
- **开头必须使用爆款黄金30秒公式**:
- 前3秒:极强画面感或悬念(例如“公元前260年,长平战场尸横遍野……”)
- 前30秒:快速建立情感连接 + 抛出核心冲突或最大看点
- 整体结构要求完整且专业:
- 黄金30秒开场
- 人物早年背景与性格塑造
- 人生关键转折点与高光时刻(详细叙事)
- 重大历史事件深度讲述(带画面感和冲突)
- 性格特点与争议点分析
- 晚年结局与历史评价
- 升华结尾(给当代人的启示或情感共鸣)
- 叙事风格:故事化、场景化、情绪化,像说书人一样有起伏、有细节、有代入感
- 逻辑:连贯流畅,时间线清晰,因果关系明确
- 适合 TTS 朗读:避免生僻字、长难句,标点使用适合停顿的自然口语标点
3. **提示词工程(Prompt Engineering)**:
请在代码中内置一个**极高质量的 System Prompt**,专门用于生成这类口播稿。这个 System Prompt 需要非常详细、结构化,我希望你把它写得足够专业,能稳定输出高质量结果。
### 其他要求
- 代码必须包含完整的错误处理(API Key 无效、网络问题等)
- 生成过程中显示加载动画和预计剩余时间
- 支持一键重新生成
- 界面美观、现代、专业(可使用 Markdown、颜色区分)
- 项目结构清晰,便于后续扩展
- 提供完整的 README.md,包含安装、运行、使用说明
请直接输出**完整的项目代码**,包括:
1. 主文件(app.py 或 main.py)
2. requirements.txt
3. .env.example
4. README.md
请严格按照以上所有要求开发,不要遗漏任何细节。现在开始输出完整代码。
8.以下是YouTube爆款视频拆解助手的脚本提示词:
你是一名世界级全栈架构师 + AI产品设计师 + SaaS系统工程师 + Prompt工程专家 + YouTube增长算法专家。
你的任务是:帮我从零开发一个完整 Web 应用:
━━━━━━━━━━━━━━━━━━━━━━
【项目名称】
YouTube爆款视频拆解助手(YouTube Viral Breakdown Assistant)
━━━━━━━━━━━━━━━━━━━━━━
【核心目标】
构建一个可以做到以下能力的 Web SaaS:
1. 用户输入 YouTube 视频 URL 或上传视频(≤1GB)
2. 系统自动分析视频内容(视觉 + 音频 + 字幕 +结构)
3. 使用 Gemini 3.5 Flash API 做深度理解与爆款拆解
4. 输出:
- 视频完整结构拆解
- 爆款机制分析
- 可复刻脚本(新内容)
- 同风格选题生成(5-10个)
- 内容优化建议(CTR/完播率/转化)
5. 支持用户自定义 Gemini API Key
━━━━━━━━━━━━━━━━━━━━━━
【你需要完成的任务(非常重要)】
请你按以下顺序输出完整系统设计 + 代码实现:
━━━━━━━━━━━━━━━━━━━━━━
① 产品UI设计(必须给出可视化结构)
请设计一个现代SaaS风格UI,包括:
- 左侧功能区:
- 输入YouTube URL
- 上传视频(拖拽上传,≤1GB)
- API Key设置
- 中间主区域:
- 视频播放器(如果是URL)
- 上传进度条
- 分析状态(loading / processing / done)
- 右侧AI分析结果面板:
- 视频拆解
- 爆款机制
- 脚本复刻
- 选题推荐
- 底部:
- 一键生成“复刻视频脚本”
- 一键生成“10个爆款选题”
请同时说明 UI 交互流程(用户点击顺序)
━━━━━━━━━━━━━━━━━━━━━━
② 技术架构设计(必须可落地)
请设计完整架构,包括:
Frontend:
- React / Next.js(推荐)
- TailwindCSS
- 视频播放器组件
- 文件上传组件(支持1GB)
Backend:
- Node.js + Express 或 Next.js API routes
- 文件存储方案(本地 / S3 / Cloudflare R2)
- 视频处理 pipeline
AI Layer:
- Gemini 3.5 Flash API 接入
- 支持用户自定义 API Key
- Prompt 管理模块(可复用模板系统)
Video Processing:
- ffmpeg(提取音频)
- Whisper(语音转字幕,可选)
- OCR(画面文字识别,可选)
- scene segmentation(镜头切分,可选)
━━━━━━━━━━━━━━━━━━━━━━
③ 核心功能模块设计(必须详细)
请拆解为以下模块:
1. 视频输入模块
- URL解析(YouTube metadata抓取)
- 本地视频上传(限制1GB)
- 断点上传机制(可选)
2. 视频理解模块
- 音频转文字
- 关键帧抽取
- 画面OCR分析
- 合并成结构化 transcript
3. AI分析模块(核心)
调用 Gemini 3.5 Flash,Prompt如下逻辑:
必须输出:
- 视频类型
- 目标受众
- 内容结构(逐段)
- Hook分析(0-5秒)
- 爆点机制
- 情绪曲线
- 脚本重建
- 内容风格
- 转化策略
4. 爆款复刻模块
输入:分析结果
输出:
- 新选题脚本
- 同结构不同内容的视频脚本
- 完整拍摄建议(镜头/字幕/BGM)
5. 选题生成模块
- 5-10个同类爆款选题
- 每个选题带:
- 标题
- 爆点逻辑
- 可传播原因
━━━━━━━━━━━━━━━━━━━━━━
④ Gemini Prompt系统设计(非常关键)
请你设计一个“可复用Prompt模板系统”,要求:
- Prompt必须模块化
- 支持动态插入:
- 视频 transcript
- 结构信息
- 用户目标(模仿/优化/扩展)
请设计一个核心 Prompt:
【视频爆款拆解 Prompt】
必须让 Gemini 输出:
- 完整拆解
- 爆款机制
- 可复刻脚本
- 新选题扩展
- 增长优化建议
并且要求:
- 结构化 JSON 输出
- 可直接被前端渲染
━━━━━━━━━━━━━━━━━━━━━━
⑤ 数据结构设计(必须 JSON 化)
请设计:
VideoSchema
AnalysisSchema
ScriptSchema
IdeaSchema
要求:
- 全部 JSON 结构化
- 方便前端展示
- 支持扩展字段
━━━━━━━━━━━━━━━━━━━━━━
⑥ API 设计(必须清晰)
请设计 REST API:
POST /api/analyze-url
POST /api/upload-video
POST /api/set-api-key
GET /api/task-status/:id
GET /api/result/:id
并说明:
- 请求参数
- 返回结构
- 错误处理
- 异步任务机制(非常重要)
━━━━━━━━━━━━━━━━━━━━━━
⑦ UI输出格式(必须可直接开发)
请给:
- 页面结构(React组件树)
- 关键组件代码
- Tailwind样式示例
- 上传组件实现
- Gemini调用示例代码
━━━━━━━━━━━━━━━━━━━━━━
⑧ 必须补全的关键能力(你必须主动优化)
请你补充我没想到但非常重要的能力,例如:
- 视频处理队列系统(避免大文件卡死)
- 多任务并发分析
- cache机制(避免重复分析)
- API key安全存储策略
- 成本控制策略(Gemini调用优化)
- 防止长视频token爆炸策略(chunking)
━━━━━━━━━━━━━━━━━━━━━━
【最终输出要求】
请你输出:
1. 产品UI设计
2. 系统架构图(文字版)
3. 后端设计
4. 前端设计
5. AI Prompt系统
6. 数据结构
7. API设计
8. 核心代码示例
9. 产品优化建议(非常重要)
━━━━━━━━━━━━━━━━━━━━━━
【最高优先级规则】
- 必须工程可落地
- 必须代码级详细
- 必须可直接交给开发继续做
- 不允许空泛描述
- 必须考虑真实生产环境(性能/成本/扩展性)





评论
发表评论