AI Agent 日报生成
一客户一Agent,支持三档定时(晨/午/晚),自动生成含语义评分和摘要的PPT/PDF报告。
一客户一Agent,支持三档定时(晨/午/晚),自动生成含语义评分和摘要的PPT/PDF报告。
覆盖23+政府/高校网站,支持Puppeteer/Playwright自动化及多种采集引擎,适配复杂页面结构。
集成AI视觉、Python脚本或自建服务三种OCR后端,自动识别验证码,确保持续采集能力。
利用大模型从正文中提取预算、采购人、截止时间等关键字段,并进行相关性语义评分。
支持邮件(双附件)和Webhook自动投递,具备失败重试机制,确保信息触达。
提供仪表盘、来源健康监控、任务调度、Agent定义编辑器及完整的历史执行时间线查看功能。
面向订阅客户打造专属智能情报推送引擎,全流程自动化生成、解析、投递招标日报,内置容错与幂等机制保障稳定运行。
为每个付费订阅客户分配独立隔离Agent实例,绑定专属关键词、数据来源、投递档位三重配置。
固定时段自动执行:晨报 07:30(昨日全量数据)· 午报 12:30(当日上午增量数据)· 晚报 18:00(当日全天完整数据)
同步生成PPT、PDF两份报告文件,基于统一数据契约完成字段校验,杜绝数据错乱。
支持企业邮箱(PPT+PDF双附件)、Webhook接口推送,投递失败自动重试一次。
各环节独立故障隔离,单一模块异常不阻塞整体任务:LLM评分失败自动切换关键词兜底过滤;摘要生成失败直接跳过概述模块;单条招标点评异常仅跳过本条,不影响整份报告。
数据库添加UNIQUE唯一约束,确保同一个Agent、同一天、同一档位仅执行一次任务,避免重复生成报告。
存储每一轮任务全链路日志,包含可视化节点状态、各阶段耗时、完整解析详情。
分布式爬虫引擎,覆盖全国官方招标渠道,多采集引擎适配各类网站结构,支持可视化配置无需修改业务代码。
内置23+国内政府、高校官方招标站点,底层基于 Puppeteer / Playwright 浏览器自动化实现动态页面抓取。
puppeteer-dom 表单搜索动态页面
api-direct 标准JSON开放接口
list-page / homepage-list 静态列表页
url-param 参数分页接口
mixed 混合模式多引擎组合
每个数据源可独立配置识别后端,三方案可选:
超时、网络波动、5xx服务异常、验证码识别失败等临时故障自动重试2次,采用30s + 2min指数退避策略。
系统全局默认并发上限3个采集任务,超出上限任务进入队列,遵循FIFO先进先出规则排队执行。
新增招标渠道仅需新增配置文件 sources/{id}.json,无需改动底层爬虫代码。
内置多LLM调度底座,支持AI自动配置爬虫规则、招标信息结构化抽取,多模型热备自动故障切换。
仅输入站点URL即可自动生成爬虫配置,4步可视化操作向导:输入链接 → 模板预览 → 手动微调 → 确认添加。
Playwright浏览器启动超时会自动降级为 HTTP + cheerio 静态页面解析模式,保障兼容性。
自动从招标公告正文提取关键结构化字段:预算金额、采购单位、投标截止时间、供应商资格要求。
配置规则:1主模型槽位 + 2备用模型槽位,每个槽位独立选择协议类型:
自动故障切换逻辑:401鉴权失败、400参数错误不切换模型;5xx服务报错、429限流、接口超时自动切换至备用槽位。
系统产品介绍页面:http://www.xwit-ai.com/products/
| 采集网站数量 | 23+ |
|---|---|
| 日报生成频率 | 三档定时 (07:30/12:30/18:00) |
| 输出格式 | PPT + PDF |
| 并发限制 | 全局默认3个任务 |
| 重试策略 | 指数退避 (30s + 2min),最多2次 |
| 数据库类型 | SQLite |
| LLM协议支持 | OpenAI兼容 / Anthropic Messages |