News
首页  -  资讯  - 
从结构化到多模态:Apache Flink,多模态信息处理的流式底座
过去很长一段时间里,资料处理系统主要围绕结构化记录展开:订单、日志、点击、交易、指标、维表、事实表。数据被抽象成一行行 schema 清晰的记录,核心任务是清洗、关联、聚合、统计。这类链路支撑了搜索、BI、风控、推荐、广告等大量传统业务,也塑造了我们对数据工程的默认想象:数据处理首先是对结构化字段的加工。...

过去很长一段时间里,资料处理系统主要围绕结构化记录展开:订单、日志、点击、交易、指标、维表、事实表。数据被抽象成一行行 schema 清晰的记录,核心任务是清洗、关联、聚合、统计。这类链路支撑了搜索、BI、风控、推荐、广告等大量传统业务,也塑造了我们对数据工程的默认想象:数据处理首先是对结构化字段的加工。...