// 应用场景 · 数据与分析

用 AI 智能体自动化公共数据流水线在数据上线前逐一验证。

Census、BLS 和 CDC 的数据分散在五个机构门户里,用五种不同的查询语言,大多数团队至今仍要在每个报告周期手动把数据复制进表格。Melaya 的 research_team 团队按计划安排数据拉取,DataScientist 直接查询各机构的 API,每一次数据提取在存入共享数据库之前都要经过 JSON 和 CSV 验证。MarketAnalyst 在此基础上补充市场解读,跨运行记忆会延续上周拉取的发现,让同一份报告永远不用从零重建。

01
// 现状的痛点

人工工作流的成本,比智能体还贵。

每个销售与BD团队每周都会遇到的三个痛点。每一个都是你的代表实际抱怨的内容,而不是功能页面会用的措辞。

  1. 01

    每个报告周期都要手动把 Census、BLS 和 CDC 的数据逐个机构门户复制进表格。

  2. 02

    每次公共数据集刷新,都要重新编写同样的 SoQL、数据系列编号或地理位置查询。

  3. 03

    要先验证政府机构导出的杂乱 CSV 和 JSON 数据,下游流程才能信任这些数据。

  4. 04

    要交叉核对分散在五个机构、使用五种不同查询语言的贸易、就业和宏观数据集。

  5. 05

    构建的是一次性的图表或导出结果,而不是下个月还能照样运行的流水线。

02
// 你可以构建的流水线

智能体工作流:组合、审批、回放。

下方每条流水线都是你在画布上使用智能体团队与工具连接出的形态。不是我们替你交付的功能,而是你配置的模式。

P01

公共经济指标拉取

DataScientist 安排计划任务,同时拉取 Census ACS5 人口统计数据以及 BLS 就业和 CPI 数据系列,把结果存入共享数据库,而不是本地下载文件夹。MarketAnalyst 在同一组数字之上补充市场解读。

P02

公共卫生信号监控

DataScientist 按计划查询 CDC 基于 Socrata 的数据集,比如每周流感活动或按州划分的用药过量死亡率,并在结果送达看板之前对其做数据画像分析。CDC 不需要 API key;一个免费的 Socrata 应用令牌只是用来提高速率限制。

P03

贸易与能源宏观数据交叉核对

DataScientist 把联合国 Comtrade 贸易流数据、FRED 宏观数据系列和 EIA 石油天然气基准价格,融合成一个跨机构数据集,而不是手动拼接三份独立的导出文件。

P04

上线前先做验证

每一次数据提取在存入数据库之前,都要经过 JSON 和 CSV 验证以及一次快速的统计画像分析,防止某个格式错误的机构导出数据悄悄污染下游报告。

P05

计划任务报告,无需手动重跑

同一条流水线在 Melaya Agents 内部通过 cron 触发器运行,MarketAnalyst 总结自上次运行以来的变化,人类分析师在 Melaya Assistant 中查看结果,而不用手动重新运行五个不同机构的查询。跨运行记忆会延续上周拉取的发现。

03
// 多智能体团队

公共数据分析师团队

来自 research_team 智能体团队的真实角色。每个角色都带有调优过的系统提示词和默认工具白名单。你可以在画布上按角色更换模型。

数据科学家

DataScientist

提出新特征,包含公式、数据来源、衰减半衰期、伪代码,以及工程师当天就能实现的统计检验设计。

市场分析师

MarketAnalyst

基于资金费率、未平仓合约和链上资金流构建市场结构简报,并给出明确的看多、看空或中性判断,列明相关风险。

04
// 受限工具

工具授权范围:只允许你授权的操作。

下方每个工具都是 Melaya 工具包中的真实共享工具。按智能体设置白名单;对写入操作设置 HITL 门控;任意工具一键撤销。

shared/工具/census_tools/

拉取 ACS5 人口统计数据和人口估算。免费的 Census API key 可解锁完整的每日配额;匿名调用每个 IP 每天上限为 500 次。

census_acs5census_population_estimates
shared/工具/bls_tools/

按数据系列编号查询单个或多个 BLS 就业和 CPI 数据系列。无需 key 也能使用,但限额会降低。

bls_seriesbls_series_multi
shared/工具/cdc_tools/

搜索并查询 CDC 基于 Socrata 的公共卫生数据集,比如每周流感活动或按州划分的用药过量死亡率。常规使用量无需任何凭证。

cdc_search_datasetscdc_query_datasetcdc_dataset_metadata
shared/工具/comtrade_tools/

Pulls UN Comtrade trade-flow data by partner and product.

comtrade_tradecomtrade_top_partners
shared/工具/fred_tools/

Cross-checks the macro backdrop against FRED series.

fred_series_observations
shared/工具/eia_tools/

Pulls EIA oil and gas benchmark prices.

eia_serieseia_wti_brent_spot
shared/工具/data_utils/

在数据进入下游之前,通过 JSON 和 CSV 格式检查以及统计画像分析验证每一次提取,防止某个格式错误的机构导出数据悄悄污染报告。

json_validatecsv_lintdf_describe
shared/工具/database/

把经过验证的数据存入共享表格,而不是本地下载文件夹。sql_query 和 sql_schema 按智能体设定范围。

sql_querysql_schemasql_export_csv
shared/工具/core/

通过 cron 触发器运行流水线,并在 MarketAnalyst 总结出变化后,把摘要发布到 Slack。

slack_post_text
05
// 三层知识

智能体团队只读取你给它的内容。

每条流水线都附带三层知识访问。在画布上按智能体混搭。不与其他租户共享向量空间,无意外读取,无不透明检索。

L1

静态上下文

includeContext

按流水线配置的文档,在每次运行时附加到指定智能体的输入。ICP 简报、行动手册、报价单或赢单邮件语料。任何需要在智能体开始思考前就到位的内容。你决定哪个角色拿到哪份文档。

L2

RAG 检索工具

rag_retrieve

按智能体授予的受限工具。当智能体判断需要更深入信息时,它会按需查询当前工作流的向量库。与静态上下文同源知识库,只在模型主动请求时访问。

L3

跨运行记忆

pipeline_memory

流水线级别的状态,从一次运行延续到下一次。昨天的研究在今天的跟进中依然在范围内。智能体团队会记得它已经处理过哪些潜在客户、获得了哪些审批、发送过什么内容。审计日志就是二阶知识库。

07
// FAQ

每周都有人问的 AI 智能体问题。

有专门用于拉取 Census、BLS 或 CDC 数据的团队吗?

目前还没有一个专门命名的团队。当前是由 Melaya 的 research_team 团队,具体来说是 DataScientist 和 MarketAnalyst 角色,负责这些数据拉取;专门的 data_team 团队尚未发布。

智能体能在我信任之前,先验证政府机构导出的杂乱 CSV 或 JSON 数据吗?

可以。每一次数据拉取在进入任何下游流程之前,都要经过 csv_lint、json_validate 和 df_describe,让格式错误的字段在污染报告之前就被发现。

Melaya 智能体能拉取的 Census 数据有多新?

ACS 5 年期端点默认使用最新发布的版本;2020/2010 年十年一次的人口普查和年度人口估算数据也都可用。免费的 Census API key 可解锁完整的每日配额(匿名调用每个 IP 每天上限为 500 次)。

我能在一份报告里合并 BLS 就业数据和 CDC 健康数据吗?

可以。两者是各自独立的工具调用(bls_series、cdc_query_dataset),一条流水线可以依次调用它们,并把结果存入同一张共享表格。

这些公共数据拉取需要 API key 吗?

取决于具体机构。Census 用免费 key 效果更好(配额更高),BLS 不用 key 也能使用但限额较低,CDC 在常规使用量下完全不需要任何凭证。

这能按计划运行,让我不用再手动重新拉取数据吗?

可以。流水线可以在 Melaya Agents 内部通过 cron 触发器、webhook 或应用事件运行,每一次运行都有记录且可供审阅。

在 Melaya 上构建 数据与分析团队 流水线。

Sandbox 套餐免费,无需信用卡。加入等候名单,一旦有名额开放,我们就会立刻发邮件通知你。

← 返回所有用例
加入社区
// Cookie
Melaya 使用一小组第一方 cookie,仅用于身份验证、维持会话和保护平台。默认不使用广告 cookie、跨站追踪器或第三方分析。完整 cookie 清单见我们的 隐私政策.