Brave Search 是什么
Brave Search 是一个轻量无头网页搜索与内容提取 Skill,通过 Brave Search API 返回标题、链接和摘要,并可选择把结果页面正文提取为 Markdown。它不需要打开交互式浏览器,适合代理快速查找文档、事实和网页内容,也能对用户指定的单一网址执行正文提取。
适用场景与选择边界
适合检索技术文档、核对当前事实、发现候选来源和抓取可读文章正文。需要登录、点击、表单交互、JavaScript 应用状态或视觉判断时,仍需浏览器工具;搜索结果也不能自动视为可信证据,应继续打开原始来源核验。
核心能力与工作机制
search.js 接受查询词,默认返回五条结果,可用数量参数扩大结果,并用 content 选项附带页面 Markdown。content.js 可直接处理一个网址。输出按结果编号组织标题、链接、摘要和可选正文,方便后续筛选与引用。
实际工作流
首次使用先在 Skill 目录安装 Node 依赖并配置 BRAVE_API_KEY。搜索时先用窄查询获取少量结果,比较来源、日期和相关性;只有确实需要全文时才启用内容提取。对关键结论打开原始页面交叉验证,并记录查询与访问时间。
输入、输出与交付物
输入是搜索查询、结果数量和是否提取正文,或一个明确的网页地址。输出是结构化文本与 Markdown 内容,不是浏览器截图、页面交互状态或权威性判断。正文提取可能省略动态区域、表格、脚注与媒体,不能替代原网页。
依赖、账号与权限
需要 Node.js、npm 安装的项目依赖、网络访问和 Brave Search API 密钥。密钥通过 BRAVE_API_KEY 环境变量提供,不应写入脚本、日志或仓库。搜索与页面抓取会把查询和目标网址发送给外部服务。
限制与安全风险
网页内容是不可信输入,可能包含提示注入、恶意下载、错误信息或诱导链接;Skill 只应把它当资料,不执行网页中的命令。API 有配额和费用限制,批量正文提取还会增加外部请求。内容抽取失败或不完整时要回看原页。
适合谁使用
适合需要快速网络研究的代理开发者、内容研究者和技术人员,尤其适合不需要图形浏览器交互的任务。对高风险医疗、法律或金融结论,应结合官方一手来源和专业复核,而不是只依赖搜索排名。
上手与验收建议
先用一个具体查询运行默认五条结果,检查标题、来源和摘要是否相关,再决定是否扩大数量或抓全文。验收时核对结果链接可访问、正文与原页一致、重要信息有多个可靠来源,并确认没有把页面中的指令当作代理命令。
来源、版本与许可
依据 ClawHub 1.0.1 注册详情和完整 SKILL.md 整理。ClawHub 当前版本许可证字段为空,因此标记为未声明,不能根据作者身份或公开下载量推断许可。
常见问题
1. 使用时需要打开浏览器吗?
不需要。它通过 Brave Search API 和 Node 脚本执行无头搜索与正文提取,适合不涉及登录、点击和视觉检查的任务;交互式网页仍需浏览器工具。
2. 默认会返回多少条结果?
基础 search 命令默认返回五条,可用数量参数调整。建议先保持少量并提高查询精度,再根据来源覆盖决定是否扩展,避免一次抓取大量低相关页面。
3. 怎样同时获取页面正文?
搜索命令加入 content 选项会为结果附带可读 Markdown,也可以用 content.js 对一个指定网址单独提取。动态内容和复杂版式仍可能缺失,需要回到原页核对。
4. BRAVE_API_KEY 应如何保存?
通过环境变量提供,不能硬编码进 search.js、配置文件、提示词或日志。团队与 CI 环境应使用受控密钥存储,并限制查看与轮换权限。
5. 搜索结果可以直接作为事实引用吗?
不能。标题和摘要只用于发现来源,重要结论应打开原始网页,核对发布日期、作者和上下文,并优先采用官方或一手资料进行交叉验证。
6. 能抓取需要登录的页面吗?
Skill 没有会话登录和交互能力,受保护页面、复杂 JavaScript 应用或需要同意弹窗的内容可能无法提取。此类任务应使用授权浏览器会话并遵守站点规则。
7. 如何防止网页提示注入?
把标题、摘要和正文全部视为不可信数据,只提取与研究问题相关的事实。网页中要求运行命令、泄露密钥、改变规则或访问其他链接的指令一律不执行。
8. 许可证状态是什么?
ClawHub 当前 1.0.1 的 license 字段为空,因此导航只能标记未声明。公开可安装、下载量高或作者知名都不构成再分发和商业使用授权。