JEV 中文指南 · 独立资料与开发者社区 官方信息请以 TypeSafe AI 为准
← 返回真实案例库

CASE FILE / 文档与 OCR

与Jev一起构建税务文件分类器

与Jev一起构建税务文件分类器。 我们使用我上个纳税季节建立的LLM管道获取了数千份税务文件。 直到今年四月,我还阅读了多篇文章,声称人工智能在税务文件分类方面失败。当时不是这样,现在又被证明是错误的。 Jev将我们100%的税务文件库归类为每页0.001美元。 比LLM设置便宜34倍,速度快6倍。 开源:

作者:Nakshatra Saxena @nedwize
● ● ●CASE FILEGUIDE
Nakshatra Saxena · @nedwize

案例拆解

与Jev一起构建税务文件分类器。 我们使用我上个纳税季节建立的LLM管道获取了数千份税务文件。 直到今年四月,我还阅读了多篇文章,声称人工智能在税务文件分类方面失败。当时不是这样,现在又被证明是错误的。 Jev将我们100%的税务文件库归类为每页0.001美元。 比LLM设置便宜34倍,速度快6倍。 开源:https://t.co/gInVHudFRn

阅读 48,770喜欢 903转发 43

原帖内容

Built a tax document classifier with Jev. We ingest thousands of tax documents using an LLM pipeline I built last tax season. I read multiple articles as late as April this year claiming AI fails at tax document classification. Wasn't the case back then, and it's proved wrong again now. Jev classifies 100% of our tax document corpus at $0.001 per page. 34x cheaper and 6x faster than the LLM setup. Open sourcing it: https://t.co/gInVHudFRn

这个案例说明了什么?

  • 文档流水线需要的是分类和路由,不是长文
  • 用 choice/score 把文件送进对的下游
  • 不确定时再交给更重的模型

原帖中的外链