一种可训练的知识图嵌入模型,用于编码案例 2025-137857 的统一证据超图。
该模型将金融交易、邮件通信、法律证据和实体关系链接到一个统一超图中,编码为单一的可训练知识表示。
| 组件 | 详情 |
|---|---|
| 节点嵌入 | 128 维结构 + 256 维文本 |
| 隐藏维度 | 256 |
| 文本编码器 | 2 层 Transformer,4 头 |
| 图注意力 | 2 层 GAT,4 头 |
| 链接预测器 | 带边缘排序损失的 2 层 MLP |
| 总参数 | 34,762,497 |
| 指标 | 数量 |
|---|---|
| 总节点数 | 198,019 |
| 总边数 | 13,415 |
| 交叉链接数 | 3,664 |
| 实体数 | 16 |
| 邮件数 | 197,993 |
| 财务文档数 | 0 |
| 时间线事件数 | 10 |
| LEX 方案数 | 0 |
| 法律文件数 | 0 |
| 子系统 | 节点数 |
|---|---|
| 核心(实体) | 16 |
| Fincosys(财务) | 0 |
| Comcosys(通信) | 197,993 |
| RevStream1(证据) | 0 |
| Ad-Res-J7(法律) | 10 |
该模型可在链接预测任务上进行微调:
from model.unicosys_model import UnicosysHypergraphModel, UnicosysConfig
model = UnicosysHypergraphModel.from_pretrained("hyperholmes/unicosys-hypergraph")
# ... prepare training data ...
# model.forward(node_ids, node_type_ids, subsystem_ids, edge_index, edge_type_ids,
# pos_edge_index=pos, neg_edge_index=neg, labels=labels)model.safetensors — 模型权重config.json — 模型配置graph_data.safetensors — 编码后的图张量(节点、边)tokenizer.json — 节点标签的字符级分词器node_id_mapping.json — 节点 ID 字符串到整数索引的映射model_summary.json — 精简统计摘要由 Unicosys 智能流水线生成。