• 我的订阅
  • 科技

浩鲸科技鲸智BI大模型发布,从算法炫技到价值落地

类别:科技 发布时间:2024-09-23 09:53:00 来源:量子位

国内行业大模型的“江湖风云”,如今已悄然从纯算法网络PK转向了“实战派”较量。这不再是单一的技术炫技场,而是看谁能在现实世界中大展拳脚,舞出最炫的“应用落地”舞步,从真正意义上实现提效,创造出实实在在的社会价值。

9月20日,浩鲸科技·鲸智大模型发布会在云栖大会举行,其中,BI大模型受到行业广泛关注。据了解,基于鲸智BI大模型构建的鲸智ChatBI工具在中国信通院可信AI评估中,跨越四大智能领域门槛,通过20项能力测试,成为首批首个通过基于大模型的商业智能系统评估的产品,评级达业内最高4+级,彰显其综合能力与智能技术的领先地位。

浩鲸科技数据智能首席专家吴名朝在发布会现场称,BI场景拥抱大模型过程中,在知识构建、问数准确、模型泛化等层面其实还存在很多技术挑战。

浩鲸科技鲸智BI大模型发布,从算法炫技到价值落地

BI大模型落地仍存在诸多挑战

随着数字化转型的持续推进,企业面临数据量与业务复杂度双重增长的挑战。数据架构需升级以支持高效决策,并应对跨部门、跨流程、跨系统的复杂数据分析需求,这要求分析人员具备高阶数据分析能力,提供整合的数据分析、商业智能及机器学习解决方案,确保各类数据需求获得统一、流畅的体验。

浩鲸科技鲸智BI大模型发布,从算法炫技到价值落地

传统的解决方法是建立端到端的Text2SQL模型,通过语义理解用户的数据请求,通过模型翻译成可执行的SQL语句输出所需数据。然而,这一方式虽有所成效,却也暴露出显著局限:

问法多样,容错性小:面对用户多样化的、口语化的数据需求,端到端的Text2SQL模型在架构层面略显单薄; 知识点多,逻辑复杂:大量的BI知识分散在报表,指标元数据,视图和脚本中,关系断裂,知识缺失。

为解决上述问题,浩鲸科技积极探索大模型技术与数据分析工程化的深度融合。通过结合大模型强大的自然语言理解能力和BI领域多年的经验积累,实现对话式的数据查询与快速分析,降低用户获取数据、理解数据的门槛。用户只需简单表述其需求,系统便能迅速生成专业且美观的数据图表。

据吴名朝介绍,浩鲸科技鲸智ChatBI围绕“取数、看数、用数”全分析流程,打造智能意图识别、智能图表生成、智能数据推荐、智能数据洞察等能力,帮助用户建设易用的数据分析“副驾”,让企业用户可以像聊天一样只需一句话提问,即可轻松地获取所需的数据分析结果,无需编写复杂的查询语句。

技术实现:标准化数据管理,规范数据入口是第一步

从BI大模型的技术实现上看,基于语义理解的SQL生成任务需要精准理解用户查询的指标和相关维度。为了增强问数服务层的数据精度与效能,浩鲸科技的BI大模型团队聚焦于构建一套全面的BI知识数据管理体系。

该体系深刻涵盖了业务术语、同义词汇、原子术语、关键指标、多维数据以及库表模型等核心要素的精细化管理。这一举措旨在通过深化行业知识的嵌入,弥补基础大模型在垂直行业的知识短板,以及促进上下文间精确而紧密的互联,为大数据分析与用户决策提供更加坚实的信息基石。

浩鲸科技鲸智BI大模型发布,从算法炫技到价值落地

通过整理并优化行业专属术语库,确保每一个业务概念都能得到准确表达。同时,建立同义词语数据管理系统,以解决自然语言处理中的语义模糊问题,使模型能够灵活应对多样化的语言表述。此外,针对关键性能指标和多维度数据的精细化管理,浩鲸科技构建了一套高效的指标与维度数据管理体系,助力用户深入挖掘数据价值,发现潜在趋势与规律。

更为关键的是,通过库表模型数据管理的实施,为大模型注入了强大的结构化数据支持,这不仅增强了模型对于复杂数据关系的理解能力,还赋予了其基于先验知识的推理与推断能力。这一过程实现了知识数据与大模型的深度融合与相互促进,使得机器能够更加精准地把握人类语言的深层含义,并在实际应用中展现出更高的精准度与鲁棒性。

智能化知识识别和召回,解决多指标查询难题

在BI问数的业务分析过程中,经常需要精确判断用户提及的指标是否涉及多个。面对用户描述模糊、意图表达不够明确的情况,特别是当提问中包含了复杂的多主语、多层定语等结构时,通常需要先将这些提问细致拆解,随后进行准确的识别与合理的组合,以确保能够准确捕捉到用户实际想要分析的所有指标。处理用户查询时识别和处理多指标的难点主要体现在以下几个方面:

自然语言的不确定性和模糊性:用户往往会用自然语言模糊表达问题,可能并未明确指出多个指标或条件。这种情况下,需要通过语言理解技术来推断用户潜在的意图,并识别出其中涉及的多个主语、谓语或定语成分。 多指标的拆解与组合:当用户的查询涉及多个指标时,需要将这些指标进行拆解,并分别识别出它们的意义。这一过程要求智能分析系统具备良好的句法分析能力和上下文理解能力,以便确定不同成分间的关系,然后将这些指标重新组合成搜索条件进行查询。

浩鲸科技鲸智BI大模型发布,从算法炫技到价值落地

与许多开源方案相比,浩鲸科技鲸智BI大模型进一步采用了知识召回模块和轻度弱化Text2SQL的整体架构。旨在通过构建一系列高精度、高容错的RAG组件,降低大模型在垂直领域下实现复杂场景的难度,并最大程度地优化了Text2SQL的幻觉问题:

术语识别模块:根据术语构建的专有词典进行专有术语分词并对存在连接词的短语进行句子拆分。 语义解析模块:构建针对查询时间(时间标准化),行政区域,组织,排序条件,展示图表,查询目标,对比时间,统计函数(数学运算),数值条件(百分比,金额,身高,体重)等场景化的实体识别任务模块,挖掘用户提问中的关键信息点。 术语召回模块:用户语义语句中关键实体的查询和召回,与元数据进行关联匹配并实现一系列召回增强操作。 转换融合模块:对召回的多组信息进行特定策略融合,对query进行改写并形成提供大模型推理的标准信息。

虚拟视图构建BI大模型全新范式

在BI问数的实践中,查询信息数据往往分布在多个维度表中,每个维度表都包含了描述数据的不同统计粒度或特有属性。

浩鲸科技首创融合虚拟视图技术,基于BI问数场景独有的数据分布特性,通过智能化方法整合查询过程中涉及的各类字段,包括但不限于维度字段、业务指标、度量值以及查询条件等,构建出一系列针对特定查询需求的临时视图作为大模型推理基础依据。

这种“按需构建”的视图策略,使大模型推理信息中仅包含查询所必需的字段,不仅大幅减少了数据处理过程中的冗余信息,还提高了大模型执行效率和精确度。

浩鲸科技BI大模型聚焦于为特定业务领域量身打造并优化SQL生成模型,通过深度融合行业特定的数据库架构(包括库表结构)、业务逻辑中的语义信息、以及庞大的数据量等核心要素,旨在输出针对该行业最为适配且高效的SQL查询语句。与广泛应用的Text2SQL模型形成鲜明对比,此方案巧妙地借助了大型预训练模型对复杂行业语言模式的强大理解能力,并进一步利用精细化的业务数据资源进行微调,从而显著提升模型在捕捉并转化业务需求为精确SQL语句方面的能力,成功将行业相关用语的SQL正确转换率推高至92%的卓越水平。

这一创新不仅代表了自然语言处理与BI数据库查询优化领域的深度融合与技术创新,更预示着在实际应用中,它能够极大地提升业务系统的数据处理效率与准确性,为企业级用户带来前所未有的数据洞察能力与业务决策支持,无疑是技术与应用双重价值并重的典范。

在发布会的最后,吴名朝表示,“BI大模型要完美的融入场景,还有很长的路要走,但我们愿意与行业伙伴、技术伙伴携手共进,克服更多复杂场景下的应用难题”。

以上内容为资讯信息快照,由td.fyun.cc爬虫进行采集并收录,本站未对信息做任何修改,信息内容不代表本站立场。

快照生成时间:2024-09-23 11:45:08

本站信息快照查询为非营利公共服务,如有侵权请联系我们进行删除。

信息原文地址:

以“价值创造”为导向,医渡科技自研大模型即将发布
...念,公司自研医疗垂域大模型将于近期正式发布。“数据+算法+算力+场景”闭环医渡科技在医疗智能领域深耕近10年,从解决数据可计算性,到安全可信的大规模计算,再到多任务的专业AI
2023-12-08 10:17:00
交行副行长钱斌:生成式AI在算力算法、数据安全等领域面临...
...技术在金融领域的落地应用。钱斌指出,生成式AI在算力算法、数据安全、人才等领域面临着诸多痛点和难点。比如,如何实现大规模算力模式下的绿色低碳供给,如何提供适合大模型的大规模、
2023-12-09 19:39:00
人工智能产业决胜与 Data&AI 数据基础设施建设——科杰科技于洋中国国际数字经济博览会主题演讲
...在大国竞争中,人工智能产业是核心竞争领域,其由算力、算法、数据三大要素构成。目前我国在算力领域已有竞争方案与大规模计算方式,算法领域已实现混合专家突破,而数据作为人工智能产业
2025-10-31 08:51:00
解读大模型赋能自动驾驶各个环节及相关产业链玩家的投资机会
...节及相关产业链玩家的投资机会。大模型赋能自动驾驶,算法、数据闭环、仿真全面受益—1、自动驾驶算法、数据不断迭代,长尾问题处理成为关键目前自动驾驶算法历经多年演变,呈现出几大特
2023-06-06 13:00:00
盘古矿山大模型,首次!山东能源云鼎科技!
...字化建设批量复制?山东能源发现,这急需一套可复用的算法模型流水线式应用到各种场景,不仅解决各煤矿大规模复制问题,还可以实现减人提效的目的,这是山东能源的挑战,更是煤炭行业共同
2023-07-26 11:57:00
市场规模将达万亿级!自动驾驶产业发展进入“黄金十年”
...能力以及完善的工具链,帮助整车厂构建自己的自动驾驶算法和数据闭环系统,让相关汽车产品的自动驾驶水平大幅度提升。 整体来看,我国乘用车自动驾驶正在由L2向L3+过渡。数据显示
2023-07-12 18:14:00
金融大模型重新定义金融科技!度小满CTO许冬亮:落地仍需解决三大挑战
...练,然后做私有化的部署和应用”。大模型时代,算力、算法、数据构成了新范式的“三驾马车”,北京大学光华管理学院商务统计与经济计量系教授王汉生也表示,好的人工智能算法、模型最终要
2023-08-24 11:56:00
傅盛捅破AI行业窗户纸!百模大战靠数据背后是什么逻辑?
...底层模型和上层应用之间的重要桥梁。一直以来,数据、算法、算力作为大模型发展的三驾马车缺一不可,如今算法、算力的差距明显缩小,数据的重要性愈发凸显。相比于算法和算力,数量充足、
2024-11-29 09:26:00
本文转自:人民日报新模式助力人工智能落地应用算法做“减法” 应用做“加法”(创新故事)本报记者 赵永新《 人民日报 》( 2023年07月10日 第 19 版)新药研发风险大、周
2023-07-10 05:16:00
更多关于科技的资讯:
鸿蒙版皖事通升级 上线“高效办成一件事”服务入口
大皖新闻讯 近日,安徽省一体化政务服务平台“皖事通”(移动端)已经全面适配鸿蒙系统,依托鸿蒙意图框架实现“功能一步达”创新服务模式
2026-02-12 20:45:00
随着春节的临近,采购年货成了消费者近期最主要的消费行为。伴随着即时零售的迅速发展,越来越多的商家加入了“春节不打烊”服务阵营
2026-02-12 21:23:00
从参与“墨子号”项目到助力“祖冲之三号” 这位“80后”博士眼中的量子科技“很有趣”
大皖新闻讯 丙午马年春节的脚步越来越近,“80后”博士李东东依然忙碌着,身为科大国盾量子技术股份有限公司(以下简称“国盾量子”)的高级技术专家
2026-02-12 21:53:00
莱芜农商银行雪野旅游区公司业务营销中心:金融夜校进企业 岁末赋能助扬帆
鲁网2月12日讯年关将至,购置年货、返乡出行、储蓄规划、消费理财成为企业员工的核心关切。为破解上班族“白天忙工作、无暇办金融”的困扰
2026-02-12 22:01:00
“电影想象力消费”入选2025年度“人文学科十大学术热点”
中国青年报客户端讯(中青报·中青网记者 余冰玥)日前,由中国人民大学书报资料中心人文编辑部策划组织的2025年度“人文学科十大学术热点”公布
2026-02-12 22:46:00
中新经纬2月12日电 12日,商务部召开例行新闻发布会。商务部新闻发言人何亚东在会上提到,持续推进出海服务资源的优质供给和高效匹配
2026-02-12 18:24:00
“万物科普”精彩继续 “智造”妙趣点亮新春 扫码阅读手机版
2月11日上午,河西区图书馆“万物科普课堂”迎来第二场精彩活动。本次“神奇‘印’记——3D打印共塑马年新章”专场,将前沿的3D打印技术与激光切割工艺深度融合
2026-02-12 14:30:00
中新经纬2月12日电 (张宁)据韩联社12日报道,12日,路易威登(LV)、迪奥(DIOR)、蒂芙尼(Tiffany&
2026-02-12 14:50:00
5 厘米高精度建模!中建八局以倾斜摄影技术为雄安数字建设注入新动能
近日,在雄安新区启动区国家能源集团雄安基地项目施工现场,一架搭载五镜头传感器的无人机平稳降落,标志着项目施工总包单位中国建筑第八工程局有限公司顺利完成本月第三次全域实景数据采集工作
2026-02-12 14:54:00
索乙家政服务是扩大内需的重要支点。随着居民人均服务性消费支出占比已接近居民消费的“半壁江山”,家政行业也迎来战略机遇期
2026-02-12 15:00:00
胡欣红最近,“要不要对AI说谢谢”引发社会热议。这场讨论并非空穴来风,据媒体报道,对于AI来说,每一次“谢谢”都相当于一次指令
2026-02-12 15:00:00
鲁网2月12日讯近日,华为智能生活馆·青岛乐客城店盛大启幕。作为青岛地区首个超千平智能生活馆,该店以约1317平方米的超大体量
2026-02-12 15:28:00
岚图汽车成功完成港股上市前置审批 即将登陆香港联交所
2月12日,岚图汽车宣布已获得香港联交所的原则性同意,标志着其港股上市的全部前置监管审批流程已顺利完成。这一进程仅用四个月
2026-02-12 16:20:00
高端润滑油的智造密码
2月9日,润滑油北京有限公司员工加紧节前生产,确保高质量交付客户产品。本报记者 程阳 摄 郑德辉 文2月9日,中国石化报记者来到润滑油北京有限公司
2026-02-12 11:53:00