
本文介绍如何将日本电视广播中使用的“30小时制”时间(如 25:25 表示次日 01:25)准确、向量化地转换为标准带时区的 datetime,重点提供 Pandas 和原生 Python 的高性能实现方案。
本文介绍如何将日本电视广播中使用的“30小时制”时间(如 `25:25` 表示次日 01:25)准确、向量化地转换为标准带时区的 datetime,重点提供 pandas 和原生 python 的高性能实现方案。
日本电视节目表常采用“30小时制”(30時間制)表示深夜时段——即凌晨 0:00 至 6:00 的时间被记为 24:XX 至 29:XX,逻辑上视为前一日的延续(例如 25:25 等价于次日 01:25)。这种非标准格式若直接用 pd.to_datetime() 解析会报错,必须先做语义校正。手动逐行处理(如 df.apply())虽可行,但严重损害性能;理想方案是完全向量化,充分利用 Pandas 的底层优化。
✅ 推荐方法:timedelta 向量化加法(Pandas)
核心思想:将日期部分转为 datetime64[ns],时间部分转为 timedelta64[ns],二者相加自动完成跨日进位:
import pandas as pd
df = pd.DataFrame({
'date_str': ['2024-12-20', '2024-12-20', '2024-12-21'],
'time_30h': ['20:25', '25:25', '28:47']
})
# 向量化拆分与类型转换(推荐)
df['datetime_jst'] = (
pd.to_datetime(df['date_str'])
+ pd.to_timedelta(df['time_30h'] + ':00')
).dt.tz_localize('Asia/Tokyo') # 显式绑定日本标准时间(JST)
print(df[['date_str', 'time_30h', 'datetime_jst']])输出:
date_str time_30h datetime_jst 0 2024-12-20 20:25 2024-12-20 20:25:00+09:00 1 2024-12-20 25:25 2024-12-21 01:25:00+09:00 2 2024-12-21 28:47 2024-12-22 04:47:00+09:00
✅ 优势:零循环、全向量化、自动处理 24+ 小时进位、天然支持时区本地化。
⚙️ 原生 Python 函数(兼容 Polars / 自定义场景)
若需脱离 Pandas(如 Polars 中使用 map_elements),或需更高可控性,可封装为纯 datetime + timedelta 函数:
from datetime import date, datetime, timedelta
from zoneinfo import ZoneInfo
def parse_30hour(date_obj: date, time_str: str) -> datetime:
"""安全解析 30小时制时间字符串,返回带 JST 时区的 datetime"""
try:
h, m = map(int, time_str.split(':'))
if not (0 <= m <= 59):
raise ValueError(f"Invalid minute: {m}")
# timedelta 自动处理 h >= 24 的跨日逻辑
return datetime.combine(
date_obj, datetime.min.time(), ZoneInfo("Asia/Tokyo")
) + timedelta(hours=h, minutes=m)
except (ValueError, TypeError) as e:
raise ValueError(f"Failed to parse '{time_str}' with date {date_obj}: {e}")
# 示例
print(parse_30hour(date(2024, 12, 20), "25:25"))
# → 2024-12-21 01:25:00+09:00⚠️ 注意事项:
-
不要手动减 24:早期方案中
if h > 23: h -= 24; d += 1易出错(如30:15需加 2 天),而timedelta会自动处理任意正整数小时; -
时区必须显式指定:
ZoneInfo("Asia/Tokyo")比ZoneInfo("Japan")更可靠(后者在某些系统上可能不可用); -
输入校验不可省略:实际数据中可能存在
24:60或空值,建议在 DataFrame 处理前用df['time_30h'].str.contains(r'^\d{1,2}:\d{2}$')过滤异常格式; -
Polars 用户:可直接用
pl.duration(hours=pl.col('h'), minutes=pl.col('m'))实现等效向量化。
掌握这一模式后,你不仅能正确解析日本广播时间,更能举一反三处理全球各类非标时间表达(如 48:12 表示两天后中午),让时间维度真正成为数据分析的可靠基石。

















