NotebookLM(Gemini Notebook)完全使用指南
2026 年 8 月更新Source-grounded research🎯 学习目标
掌握 Google NotebookLM 当前的来源管理、基于来源问答、Fast / Deep Research、Audio 与 Video Overviews、Studio 产物、移动端,以及与 Gemini Apps 的差异和数据边界。
NotebookLM 是 Google 面向阅读、研究和内容转化的 AI 工具。其核心体验是把用户选择的来源作为问答依据,并在多数回答中提供可点击引用;右侧 Studio 则把同一批来源转化为音频、视频、报告、思维导图、幻灯片、信息图、闪卡和测验等产物。
⚠️ Grounding 不等于零幻觉
来源约束能降低无依据回答,但不能保证每句话都有引用,也不能消除误读、遗漏、错误综合或生成产物中的事实错误。官方明确提示 Audio / Video 等 AI 生成内容可能不准确;重要结论仍需打开引用核对原文。
📌 关于产品名称
Google 的官方帮助中心当前已出现 Gemini Notebook Help 命名,而产品入口和大量页面仍使用 NotebookLM。本文保留用户更熟悉的 NotebookLM,并在需要时标注 Gemini Notebook。
一、📊 产品与功能总览
1.1 核心定位
| 维度 | 说明 |
|---|---|
| 核心对象 | Notebook:由来源、聊天记录、笔记和 Studio 产物组成的独立研究空间 |
| 问答边界 | NotebookLM 聊天以当前选中的 Notebook 来源为依据;Gemini Apps 中调用 Notebook 时还可能使用网页搜索和其他工具 |
| 证据机制 | 回答通常附带可点击引用,但短来源等情况可能只引用整份文档,不保证逐句引用 |
| 差异化特性 | 来源发现、跨来源综合,以及从同一批材料生成多种可分享的学习与表达产物 |
1.2 核心功能模块
| icon | 模块 | 功能说明 |
|---|---|---|
| 📚 | 多源 Notebook | 混合导入本地文件、Google Drive、网页、YouTube、音频、图片、ePub、粘贴文本和 Gemini Chats |
| 🔍 | 来源发现 | Fast Research 快速找资料;Deep Research 浏览更多网站、生成报告,并让用户决定导入哪些来源 |
| 💬 | 基于来源的聊天 | 选定全部或部分来源后提问,通过引用回到原文核查 |
| 🎙️ | Audio Overview | 生成 Deep Dive、Brief、Critique、Debate 等音频格式;支持 80 多种输出语言 |
| 🎬 | Studio | 生成 Video Overview、报告、Mind Map、Flashcards、Quizzes、Infographic、Slide Deck 和 Data Table 等产物 |
| 🔗 | 分享与集成 | 分享 Notebook 或部分产物,并可在支持的 Gemini Apps 中继续与 Notebook 对话 |
| 📱 | 移动端 App | iOS / Android 支持核心阅读与生成流程,但并非所有桌面功能都可用 |
二、🚀 当前核心能力
2.1 来源发现:Fast Research 与 Deep Research
来源面板不仅能导入已有材料,也能从研究问题开始发现资料:
- Fast Research:快速搜索网页,适合建立初始来源清单。
- Deep Research:自动规划检索并浏览更多网站,生成多页研究报告与候选来源;完成后由用户审阅并选择导入。
- 导入后再验证:研究报告本身也可成为来源,但它仍是 AI 综合产物。关键事实应回到报告引用的原始网页确认。
2.2 Studio 创作套件
Studio 把同一组来源转换成不同用途的产物:
- Audio / Video Overviews:用于听学和观看讲解。
- Reports / Briefing Docs:用于整理摘要、FAQ、学习指南和结构化报告。
- Mind Maps:浏览主题与概念关系。
- Flashcards / Quizzes:用于复习与自测。
- Infographics / Slide Decks:把内容转成视觉表达;部分方案支持更高额度、修订或去除水印。
- Data Tables:把来源中的可比较信息组织成表格。
这些产物不是来源原文的无损转换。发布、教学或决策前,应检查事实、引用、版权、版式和无障碍可用性。
2.3 Audio Overview
- 格式:Deep Dive、Brief、Critique、Debate。
- 定制:可指定关注主题、受众水平、语言和时长;Shorter / Longer 时长选项目前仅限英语。
- 语言:可生成 80 多种语言,包括简体中文和繁体中文。
- 交互模式:可以用语音加入主持人对话,但当前仅支持英语;交互内容不会成为可分享音频的一部分。
- 局限:官方明确提示音频可能包含事实错误、第三个声音、随机切换说话人等音频瑕疵。
2.4 Gemini Apps 集成
在支持的地区,可以从 Gemini Apps 与 Notebook 对话,但要注意两个产品的边界:
| 能力 | NotebookLM | Gemini Apps 中的 Notebook |
|---|---|---|
| 回答依据 | 只以 Notebook 来源为依据 | 可能同时使用 Notebook 来源、网页搜索和其他工具 |
| Studio 产物 | 可生成 Audio、Video、Infographic、Slide Deck 等 | 不能生成 NotebookLM Studio 产物 |
| 活动与保留 | 按 NotebookLM 的数据规则 | Gemini 对话按 Gemini Apps Activity 设置处理 |
三、💳 方案、额度与来源限制
NotebookLM 的额度由账号类型、Google One / AI 方案、Workspace 或 Education 版本共同决定。官方帮助目前用 Standard / More / Higher / Expanded / Highest 描述访问级别,个人界面还可能显示 Pro、Plus、Expanded 或 Ultra 徽章;不要再用旧的“Free / Plus / Enterprise”三档表推断权益。
3.1 方案对比
以下是官方 2026 年 8 月公布的用量层级,且明确标注 可能变化:
| 用量 | Standard | More | Higher | Expanded | Highest |
|---|---|---|---|---|---|
| Notebooks | 100 | 200 | 500 | 500 | 500 |
| 每本 Sources | 50 | 100 | 300 | 400 | 600 |
| Chats / 日 | 50 | 200 | 500 | 1,000 | 5,000 |
| Audio / 日 | 3 | 6 | 20 | 40 | 200 |
| Video / 日 | 3 | 6 | 20 | 40 | 200 |
| Reports、Flashcards、Quizzes、Mind Maps / 日 | 10 | 20 | 100 | 200 | 1,000 |
| Deep Research | 10 / 月 | 3 / 日 | 20 / 日 | 30 / 日 | 200 / 日 |
Expanded 与 Highest 还提供更多视觉产物额度,并可在部分 Infographic / Slide Deck 场景去除水印。实际权益以账号头像旁的徽章、管理员配置和官方额度说明为准;价格会随地区、税费和套餐调整,不在本文写死。
3.2 支持的文件类型与限制
| 类型 | 格式/来源 | 说明 |
|---|---|---|
| 本地文件 | PDF、DOCX、TXT、Markdown、PPTX、CSV、音频、图片、ePub 等 | 每个来源最多 50 万词;本地上传文件最多 200 MB |
| Google Drive | Docs、Slides、Sheets | Drive 来源会定期自动同步;评论和脚注等内容可能不会导入 |
| Web | 网页 URL | 通常导入页面正文,不代表保存网页全部布局、交互与附件 |
| YouTube | 公开视频链接 | 主要依赖可用字幕或转录内容,不等同于完整理解所有画面 |
| Gemini Chats | 从 Gemini 导入的对话 | 进入 Notebook 后作为来源使用,隐私边界需同时考虑两个产品 |
| 粘贴文本 | 手动复制内容 | 适合短资料,但要保留标题、作者、日期和原始链接以便追溯 |
⚠️ 导入成功不代表完整保真
受保护 PDF、超限文件或缺少可提取内容的来源可能导入失败。扫描件、表格、多栏排版、公式和图表应抽样核对;来源太短时,聊天可能引用整份文档而不显示具体文本片段。
四、🔥 核心功能使用详解
4.1 Audio Overviews (AI 播客)
杀手级功能把选中的来源转成音频讲解。Deep Dive 是双主持人深入讨论,Brief 是短篇单人概览,Critique 用于建设性评价,Debate 用于呈现不同立场。
- 使用场景:通勤听论文、做家务听财报、睡前听复习资料。
- 自定义:选择格式、输出语言、时长,并用提示指定重点和受众水平。
- 加入对话:Interactive mode 可用英语向主持人追问;中文音频生成与英语交互模式是两个不同能力。
- 核对:听到数字、引语、法律或医疗结论时,返回聊天并打开引用,不要把音频当作原始证据。
4.2 Deep Research Agent
适合 “从零开始” 的研究任务。
- 新建笔记本,点击左侧来源区的 "Web" 或 "Deep Research"。
- 输入宽泛的研究目标(例如:“2026年全球固态电池技术突破与商业化进展”)。
- AI 自动制定搜索计划并浏览候选网页;复杂主题可能涉及数百个网站。
- 审阅生成的多页报告、候选来源、站点质量与日期。
- 只导入可信且与问题相关的来源,再继续提问或制作 Studio 产物。
💡 先写研究约束
在问题中明确时间范围、地区、来源类型、排除条件和最终交付格式。对于“最新进展”,还要检查网页的发布日期与事件发生日期是否一致。
4.3 Studio 创作工坊
位于界面右侧的 "Studio" 面板,是从输入到输出的关键。
- 先选择来源:只勾选真正支撑当前交付物的材料,避免无关来源稀释重点。
- 再选择产物:学习用 Flashcards / Quizzes / Mind Map,汇报用 Report / Slide Deck / Infographic,听学用 Audio,讲解用 Video。
- 最后做人工验收:检查事实和引用、去重、术语一致性、版权、图片表达、色彩对比和目标受众。
⚠️ 分享权限
公开 Notebook 分享通常只对个人账号开放,Workspace Enterprise / Education 可能禁用;组织账号还会受管理员策略影响。分享前确认来源版权、内部信息和生成产物是否允许对外发布。
五、🎓 场景化最佳实践
5.1 学术科研:Gap Hunter
- 上传:导入 20-50 篇特定领域的 PDF 论文。
- 提问:
"Synthesize the limitations mentioned in these papers and identify 3 major research gaps that have not been addressed yet." (综合这些论文中提到的局限性,识别出 3 个尚未解决的主要研究空白。)
- Deep Research:针对识别出的空白,限定日期和数据库,搜索最新论文与预印本。
- 验证:回到论文方法、样本和限制章节,不把 AI 总结直接写成“尚无人研究”的结论。
5.2 投资分析:财报侦探
- 上传:上传目标公司过去 3 年的财报(PDF)和分析师会议录音(MP3)。
- 对比:选中今年的财报和去年的财报。
- 提问:
"Compare the 'Risk Factors' section of 2024 and 2025. What new specific risks were added this year? Highlight changes in management tone regarding AI investment." (对比2024和2025年的风险因素章节。今年新增了哪些具体风险?高亮管理层在AI投资方面的语气变化。)
- 复核:逐条打开引用,记录页码和原文;投资判断还需结合监管文件、实时市场信息和专业意见。
5.3 播客/视频创作者:内容再利用
- 上传:上传你过去写的 10 篇公众号文章或博客。
- Audio Overview:生成回顾音频,检查事实、发音、节奏和音乐平台要求。
- Studio Video / Slide Deck:为热门文章制作视觉版本,补充品牌规范、字幕、版权信息和人工编辑后再发布。
六、📂 常见问题 (FAQ)
Q: NotebookLM 会用我的数据训练模型吗? A: Google 说明,NotebookLM 中的文件、生成内容和聊天不会直接用于训练基础生成式 AI 模型,除非用户提交反馈。个人账号提交赞或踩反馈时,相关提示、来源、上传和输出可能被收集并由人工审核,去除账号关联后最长保留 3 年;不要在反馈中附带机密信息。Workspace / Education 用户的上传、查询和回答即使随反馈提交,也不会由人工审核或用于训练模型。
Q: 上传的 PDF 是扫描件(图片)怎么办? A: 可以尝试导入,但不要假设 OCR、表格和图表解析一定完整。抽样核对页码、数字、公式和多栏阅读顺序;受复制保护或没有可提取内容的 PDF 可能导入失败,必要时先在受信任工具中完成 OCR。
Q: 生成的内容支持中文吗? A: 支持。Audio Overview 可生成 80 多种语言,包括简体中文和繁体中文;但加入主持人对话的 Interactive mode 当前仅支持英语,音频 Shorter / Longer 时长控制也仅限英语。不同 Studio 产物的语言质量仍需人工检查。
Q: 幻觉率大概有多少? A: 官方没有提供适用于所有来源和任务的统一“幻觉率”。更可靠的做法是:选定最相关来源、要求回答区分事实与推断、打开引用核对原文,并对没有引用或跨文档推导的句子做二次验证。
Q: 为什么有时看不到逐句引用? A: 引用粒度取决于来源和回答。官方 FAQ 说明,来源内容太短时可能引用整份文档而不显示具体文本片段。这也是“有来源”不等于“每句话可追溯”的原因。
Q: 移动端和网页端完全一样吗? A: 不一样。移动端覆盖主要的聊天、来源阅读和部分 Studio 生成能力,但仍有功能限制;需要批量管理来源、精细分享或完整 Studio 控制时优先使用网页端。
七、参考资源
| 资源 | 链接 |
|---|---|
| 官方入口 | notebooklm.google.com |
| 官方帮助中心 | Gemini Notebook Help |
| 来源导入与发现 | Add or discover new sources |
| Audio Overview | Generate Audio Overview |
| 账号层级与额度 | Use NotebookLM with a work or school Google account |
| 隐私与使用条款 | Privacy and Terms of Use |
| Gemini Apps 集成 | Notebooks in Gemini Apps |
📌 额度与功能会变
本文记录的是 2026 年 8 月 9 日的官方状态。若产品内显示与本文不同,以账号页面、管理员设置和官方帮助中心为准。