PIPELINE
实验闭环
- 01清洗、关键句与英文翻译删除模板和技术噪声,保留规则、原句、译文与词频
- 02稀疏词共现网络单篇去重后,全部不同词两两建立原始计数边
- 03质量约束与自然单元结合来源集中度、大小、稳定性和区分度选择聚类
- 04概率质量与绝对强度文章级 q(d,u) 汇总为日级 p(t,u),同时保留加权文章量
- 05变化预测与滚动验证分开验证完整分布、份额变化和新出现/增强事件
SEMANTIC ATTENTION · DISTRIBUTION FORECAST
每篇新闻先形成总和为 1 的单元概率分布,再汇总为日级注意力分布;系统同时保留 绝对报道强度,预测未来主导、形成、增强与减弱主题,并接受严格样本外验证。
PIPELINE
ATTENTION DISTRIBUTION
FROZEN SEMANTIC FIELDS
单元展示当前份额、绝对强度、变化状态、质量、稳定性、区分词、来源覆盖和滞后关系。
ARTICLE TRACE
追踪清洗片段、有效词、校正前后得分、文章级概率质量、预测与后续真实分布。
INERTIA-CONTROLLED LAG RELATION
选择有方向单元对,查看控制目标自身历史后的偏相关、增量预测收益、支持度、稳定性与置信区间。
CURRENT FORECAST
CURRENT DISTRIBUTION
DISTRIBUTION · CHANGE · EVENTS
MODEL VS BASELINES
CALIBRATION
TIME WINDOWS
UNIT FREQUENCY
DAILY CASES
SUCCESS CASES
FAILURE ANALYSIS