read (DataSourceStreamReader)

Создает данные для заданной секции и возвращает итератор кортежей или строк.

Этот метод вызывается один раз на секцию для чтения данных. Реализация этого метода требуется для средств чтения потоков. Вы можете инициализировать любые несериализируемые ресурсы, необходимые для чтения данных из источника данных в этом методе.

Добавлено в Databricks Runtime 15.2

Синтаксис

read(partition: InputPartition)

Параметры

Параметр Тип Описание
partition InputPartition Раздел для чтения. Оно должно быть одним из значений секций, возвращаемых partitions().

Возвраты

Iterator[Tuple] или Iterator[RecordBatch]

Итератор кортежей или строк. Каждый кортеж или строка будут преобразованы в строку в окончательном кадре данных. Он также может возвращать итератор объектов PyArrow RecordBatch , если источник данных поддерживает его.

Примечания

Этот метод является статическим и без отслеживания состояния. Не получите доступ к изменяемым членам класса или не сохраняйте состояние в памяти между различными вызовами read().