界面
- Playground:就是类似于常规的 Chat 窗口,但功能更强大。首次进入记得”saving”,不然聊天记录是不保存的。记录都保存在你的 Google Drive 云端硬盘中,方便随时回溯
- Build:点击进入后,你可以通过简单的提示词(Prompt),让 Gemini 协助你从零开始编写代码并构建一个完整的应用程序。在 Gallery 页面,你还能查看并下载他人构建的 App 源代码。即使没有编程经验,也能快速实现从想法到产品的落地。
针对 Gemini 3.0 Pro 的深度设置
目前可选的模型非常丰富,包括 Gemini 系列、图像生成模型、视频模型(如 Veo)以及语音模型。
推荐选择:Gemini 3.0 Pro Preview。目前该模型在 AI Studio 中免费开放,且拥有高达 100万 Token 的上下文窗口,足以处理几十万字的长文档或撰写中篇小说。
注:列表中的 Gemini 1.5 Pro 或其他旧版本模型可能在某些配额下需要付费。
System Instruction(系统指令)的深度调教
设定“人设”与“规则”
在界面顶部的 System Instruction 框中输入:
“你是一位拥有 20 年经验的高级全栈工程师。在回答我的问题时,优先考虑代码的可维护性和性能。如果我上传了代码,请先进行安全性审计,然后再给出优化方案。所有回复必须包含 Markdown 格式的代码块。”
多模态生产力:绘画、视频与语音
Google AI Studio 将多模态能力整合得非常丝滑。
4.1 AI 绘画:Imagen 3
在右侧选择图像模型。你可以利用刚才设定的“绘画专家”人设生成提示词,直接在同一个界面内生成高分辨率图片。它支持:局部重绘(Inpainting):修改图片中的特定部分。风格迁移:保持物体不变,改变艺术风格。
4.2 视频生成:Veo 系列
在 Generate Media 模块中,你可以输入文本描述来生成短视频。这在制作短视频素材、广告原型时具有极高的价值。相比其他工具,Veo 的动态连贯性和光影真实感表现卓越。
4.3 语音合成
支持多角色、多情感的文本转语音。你可以模拟一段采访,设定角色 A 为主持人,角色 B 为嘉宾,AI 会自动生成带情感起伏的对话音频。
一键从代码到应用(Build with Code Apps)
这是 Google AI Studio 区别于所有竞品的“杀手锏”功能:它不只是写代码,它还在帮你运行代码。
5.1 实时预览与迭代
当你选择 “Build with Code Apps” 界面时,左侧输入需求(例如:“帮我做一个加密货币实时行情监控器”),右侧会立即分屏显示 Web 页面预览。
- 如果你觉得字体太小,直接说:“调大字体,把背景改成深色模式”。
- 右侧预览窗口会立即刷新,不需要你搭建任何本地开发环境。
5.2 GitHub 与部署闭环
-
一键同步 GitHub:点击右上角 Save to GitHub,AI 会自动帮你创建 Repo,并在你的 GitHub 账号下生成对应的文件,连 .gitignore 都会帮你配好。
-
一键部署到云端:这是最震撼的一步。通过 Google Cloud 的集成,你可以点击 Deploy。AI 会自动配置服务器环境,给你生成一个带 HTTPS 的公网网址。