API 开放平台 登录页 返回官网

Model Optimization Workspace

会计实训大模型优化验证

代表性案例回放同题封存结果;逐题结论可追溯到评测 ID、源队列行和 SHA256。

云财实训领域模型

会计实训,
从理解业务开始。

理解业务条件,生成分录草稿,
给出可复核的依据与反馈。

基于 Qwen3-8B 的会计领域优化

把业务展开,
让回答有据可循。

以固定资产转固为例,
看看模型如何理解条件、组织分录与核对金额。

固定资产转固

封存案例节选

先看业务事实

已经达到可使用状态,
还需要等待竣工决算吗?

A 项目已达到预定可使用状态,竣工决算尚未完成,可靠暂估金额为 1,800,000 元。

使用状态
已达到预定可使用状态
竣工决算
尚未完成
可靠暂估金额
1,800,000

以上为 Formal R5 案例的内容节选与展示编排,完整题面、原始回答和评分可在案例对比中查看。

关于模型

了解模型,
也了解它的边界。

面向会计实训中的状态判断、分录生成、条件推演与学生复盘,支持课堂任务验证和人工复核。

怎样进行领域优化?

以 Qwen3-8B 为开源基座,通过 QLoRA / SFT 进行轻量化领域适配,让输出贴近会计任务与课程评分要求。

  1. 整理领域样本统一业务条件、任务提示与参考答案。
  2. 进行轻量适配结合领域数据、输出约束与课程量规训练。
  3. 逐题检查变化比较同题回答,记录改善、持平和回退。
优化前后,有哪些变化?

Formal R5 使用 60 道同题配对评测,对照基础模型与 checkpoint126 的原始回答。

基础模型74.47
优化模型77.31

本轮均分增加 2.84 分;17 题提高、33 题持平、10 题下降。

95% 置信区间为 [-3.65, 9.57],仍跨越 0。当前结果不足以推断更大题目总体上有统计显著提升。

哪些地方需要人工复核?

模型输出用于教学辅助。关键业务条件、科目、金额关系与适用制度,需要结合原始材料和教师判断复核。

材料缺失、条件模糊或需要适用具体制度时,应补充依据后再作判断。模型建议不直接用于真实财务审批。

如何查看依据与原始记录?

案例对比保留题目编号、两组原始回答、评分与 SHA256。训练过程提供本轮训练配置和过程记录。

当前版本使用来源索引与知识库上下文注入。向量化 RAG、DPO 和 Self-Instruct 属于后续研究方向,未计入当前成果。

米白底色上的细线地球插画

我们的期许

让小模型,
走进更广阔的课堂。

我们相信,小模型在专业教学中仍有值得探索的潜力。

从会计实训出发,我们希望持续打磨可复核的专业能力,在未来拓展到更多课程、学校与学习场景,让更多人用得上、学得会。

管理模型 API

连接保存在当前账号,刷新或再次登录可继续使用。使用本站 API 开放平台创建的 Key。