优化前
Model Optimization Workspace
会计实训大模型优化验证
代表性案例回放同题封存结果;逐题结论可追溯到评测 ID、源队列行和 SHA256。
Training Replay
Qwen3 会计模型训练回放
依据 D6 留存记录,回放工作区检查、训练包处理、QLoRA/SFT 训练、checkpoint-126 选择与 Formal R5 评测流程。
配图根据文字题干制作,仅辅助阅读;正式评测使用文字输入,两组回答按原始结果回放。
优化后
会计实训优化模型
先看原始模型
登录评审账号后可在线验证。登录后继续
把业务展开,
让回答有据可循。
以固定资产转固为例,
看看模型如何理解条件、组织分录与核对金额。
固定资产转固
封存案例节选先看业务事实
已经达到可使用状态,
还需要等待竣工决算吗?
A 项目已达到预定可使用状态,竣工决算尚未完成,可靠暂估金额为 1,800,000 元。
- 使用状态
- 已达到预定可使用状态
- 竣工决算
- 尚未完成
- 可靠暂估金额
- 1,800,000 元
形成分录草稿
按可靠暂估金额转固,
把判断落实到分录。
已达到预定可使用状态的 A 项目转入固定资产;B 项目仍在建设中,继续保留在在建工程。
| 借 | 固定资产 | 1,800,000 元 |
|---|---|---|
| 贷 | 在建工程 | 1,800,000 元 |
回到金额关系
分录之外,
再核对期末账面价值。
完成转固后,将固定资产原价、累计折旧和减值准备放在一起复核。
- 调整后原价
- 14,400,000
- 减:累计折旧
- 2,150,000
- 减:减值准备
- 350,000
- 期末账面价值
- 11,900,000 元
以上为 Formal R5 案例的内容节选与展示编排,完整题面、原始回答和评分可在案例对比中查看。
关于模型
了解模型,
也了解它的边界。
面向会计实训中的状态判断、分录生成、条件推演与学生复盘,支持课堂任务验证和人工复核。
怎样进行领域优化?
以 Qwen3-8B 为开源基座,通过 QLoRA / SFT 进行轻量化领域适配,让输出贴近会计任务与课程评分要求。
- 整理领域样本统一业务条件、任务提示与参考答案。
- 进行轻量适配结合领域数据、输出约束与课程量规训练。
- 逐题检查变化比较同题回答,记录改善、持平和回退。
优化前后,有哪些变化?
Formal R5 使用 60 道同题配对评测,对照基础模型与 checkpoint126 的原始回答。
本轮均分增加 2.84 分;17 题提高、33 题持平、10 题下降。
95% 置信区间为 [-3.65, 9.57],仍跨越 0。当前结果不足以推断更大题目总体上有统计显著提升。
哪些地方需要人工复核?
模型输出用于教学辅助。关键业务条件、科目、金额关系与适用制度,需要结合原始材料和教师判断复核。
材料缺失、条件模糊或需要适用具体制度时,应补充依据后再作判断。模型建议不直接用于真实财务审批。
如何查看依据与原始记录?
案例对比保留题目编号、两组原始回答、评分与 SHA256。训练过程提供本轮训练配置和过程记录。
当前版本使用来源索引与知识库上下文注入。向量化 RAG、DPO 和 Self-Instruct 属于后续研究方向,未计入当前成果。
我们的期许
让小模型,
走进更广阔的课堂。
我们相信,小模型在专业教学中仍有值得探索的潜力。
从会计实训出发,我们希望持续打磨可复核的专业能力,在未来拓展到更多课程、学校与学习场景,让更多人用得上、学得会。