数据源共1篇
为 PySpark 注册按行和 Arrow 批次读取的数据源-未完纪

为 PySpark 注册按行和 Arrow 批次读取的数据源

完整实现两个Python批读取数据源:以元组逐行产出,或直接yield Arrow RecordBatch,理解注册、schema、分区与序列化约束。
彩雨伞的头像-未完纪钻石会员彩雨伞5小时前
0250