• 我的订阅
  • 科技

浩鲸科技鲸智BI大模型发布,从算法炫技到价值落地

类别:科技 发布时间:2024-09-23 09:53:00 来源:量子位

国内行业大模型的“江湖风云”,如今已悄然从纯算法网络PK转向了“实战派”较量。这不再是单一的技术炫技场,而是看谁能在现实世界中大展拳脚,舞出最炫的“应用落地”舞步,从真正意义上实现提效,创造出实实在在的社会价值。

9月20日,浩鲸科技·鲸智大模型发布会在云栖大会举行,其中,BI大模型受到行业广泛关注。据了解,基于鲸智BI大模型构建的鲸智ChatBI工具在中国信通院可信AI评估中,跨越四大智能领域门槛,通过20项能力测试,成为首批首个通过基于大模型的商业智能系统评估的产品,评级达业内最高4+级,彰显其综合能力与智能技术的领先地位。

浩鲸科技数据智能首席专家吴名朝在发布会现场称,BI场景拥抱大模型过程中,在知识构建、问数准确、模型泛化等层面其实还存在很多技术挑战。

浩鲸科技鲸智BI大模型发布,从算法炫技到价值落地

BI大模型落地仍存在诸多挑战

随着数字化转型的持续推进,企业面临数据量与业务复杂度双重增长的挑战。数据架构需升级以支持高效决策,并应对跨部门、跨流程、跨系统的复杂数据分析需求,这要求分析人员具备高阶数据分析能力,提供整合的数据分析、商业智能及机器学习解决方案,确保各类数据需求获得统一、流畅的体验。

浩鲸科技鲸智BI大模型发布,从算法炫技到价值落地

传统的解决方法是建立端到端的Text2SQL模型,通过语义理解用户的数据请求,通过模型翻译成可执行的SQL语句输出所需数据。然而,这一方式虽有所成效,却也暴露出显著局限:

问法多样,容错性小:面对用户多样化的、口语化的数据需求,端到端的Text2SQL模型在架构层面略显单薄; 知识点多,逻辑复杂:大量的BI知识分散在报表,指标元数据,视图和脚本中,关系断裂,知识缺失。

为解决上述问题,浩鲸科技积极探索大模型技术与数据分析工程化的深度融合。通过结合大模型强大的自然语言理解能力和BI领域多年的经验积累,实现对话式的数据查询与快速分析,降低用户获取数据、理解数据的门槛。用户只需简单表述其需求,系统便能迅速生成专业且美观的数据图表。

据吴名朝介绍,浩鲸科技鲸智ChatBI围绕“取数、看数、用数”全分析流程,打造智能意图识别、智能图表生成、智能数据推荐、智能数据洞察等能力,帮助用户建设易用的数据分析“副驾”,让企业用户可以像聊天一样只需一句话提问,即可轻松地获取所需的数据分析结果,无需编写复杂的查询语句。

技术实现:标准化数据管理,规范数据入口是第一步

从BI大模型的技术实现上看,基于语义理解的SQL生成任务需要精准理解用户查询的指标和相关维度。为了增强问数服务层的数据精度与效能,浩鲸科技的BI大模型团队聚焦于构建一套全面的BI知识数据管理体系。

该体系深刻涵盖了业务术语、同义词汇、原子术语、关键指标、多维数据以及库表模型等核心要素的精细化管理。这一举措旨在通过深化行业知识的嵌入,弥补基础大模型在垂直行业的知识短板,以及促进上下文间精确而紧密的互联,为大数据分析与用户决策提供更加坚实的信息基石。

浩鲸科技鲸智BI大模型发布,从算法炫技到价值落地

通过整理并优化行业专属术语库,确保每一个业务概念都能得到准确表达。同时,建立同义词语数据管理系统,以解决自然语言处理中的语义模糊问题,使模型能够灵活应对多样化的语言表述。此外,针对关键性能指标和多维度数据的精细化管理,浩鲸科技构建了一套高效的指标与维度数据管理体系,助力用户深入挖掘数据价值,发现潜在趋势与规律。

更为关键的是,通过库表模型数据管理的实施,为大模型注入了强大的结构化数据支持,这不仅增强了模型对于复杂数据关系的理解能力,还赋予了其基于先验知识的推理与推断能力。这一过程实现了知识数据与大模型的深度融合与相互促进,使得机器能够更加精准地把握人类语言的深层含义,并在实际应用中展现出更高的精准度与鲁棒性。

智能化知识识别和召回,解决多指标查询难题

在BI问数的业务分析过程中,经常需要精确判断用户提及的指标是否涉及多个。面对用户描述模糊、意图表达不够明确的情况,特别是当提问中包含了复杂的多主语、多层定语等结构时,通常需要先将这些提问细致拆解,随后进行准确的识别与合理的组合,以确保能够准确捕捉到用户实际想要分析的所有指标。处理用户查询时识别和处理多指标的难点主要体现在以下几个方面:

自然语言的不确定性和模糊性:用户往往会用自然语言模糊表达问题,可能并未明确指出多个指标或条件。这种情况下,需要通过语言理解技术来推断用户潜在的意图,并识别出其中涉及的多个主语、谓语或定语成分。 多指标的拆解与组合:当用户的查询涉及多个指标时,需要将这些指标进行拆解,并分别识别出它们的意义。这一过程要求智能分析系统具备良好的句法分析能力和上下文理解能力,以便确定不同成分间的关系,然后将这些指标重新组合成搜索条件进行查询。

浩鲸科技鲸智BI大模型发布,从算法炫技到价值落地

与许多开源方案相比,浩鲸科技鲸智BI大模型进一步采用了知识召回模块和轻度弱化Text2SQL的整体架构。旨在通过构建一系列高精度、高容错的RAG组件,降低大模型在垂直领域下实现复杂场景的难度,并最大程度地优化了Text2SQL的幻觉问题:

术语识别模块:根据术语构建的专有词典进行专有术语分词并对存在连接词的短语进行句子拆分。 语义解析模块:构建针对查询时间(时间标准化),行政区域,组织,排序条件,展示图表,查询目标,对比时间,统计函数(数学运算),数值条件(百分比,金额,身高,体重)等场景化的实体识别任务模块,挖掘用户提问中的关键信息点。 术语召回模块:用户语义语句中关键实体的查询和召回,与元数据进行关联匹配并实现一系列召回增强操作。 转换融合模块:对召回的多组信息进行特定策略融合,对query进行改写并形成提供大模型推理的标准信息。

虚拟视图构建BI大模型全新范式

在BI问数的实践中,查询信息数据往往分布在多个维度表中,每个维度表都包含了描述数据的不同统计粒度或特有属性。

浩鲸科技首创融合虚拟视图技术,基于BI问数场景独有的数据分布特性,通过智能化方法整合查询过程中涉及的各类字段,包括但不限于维度字段、业务指标、度量值以及查询条件等,构建出一系列针对特定查询需求的临时视图作为大模型推理基础依据。

这种“按需构建”的视图策略,使大模型推理信息中仅包含查询所必需的字段,不仅大幅减少了数据处理过程中的冗余信息,还提高了大模型执行效率和精确度。

浩鲸科技BI大模型聚焦于为特定业务领域量身打造并优化SQL生成模型,通过深度融合行业特定的数据库架构(包括库表结构)、业务逻辑中的语义信息、以及庞大的数据量等核心要素,旨在输出针对该行业最为适配且高效的SQL查询语句。与广泛应用的Text2SQL模型形成鲜明对比,此方案巧妙地借助了大型预训练模型对复杂行业语言模式的强大理解能力,并进一步利用精细化的业务数据资源进行微调,从而显著提升模型在捕捉并转化业务需求为精确SQL语句方面的能力,成功将行业相关用语的SQL正确转换率推高至92%的卓越水平。

这一创新不仅代表了自然语言处理与BI数据库查询优化领域的深度融合与技术创新,更预示着在实际应用中,它能够极大地提升业务系统的数据处理效率与准确性,为企业级用户带来前所未有的数据洞察能力与业务决策支持,无疑是技术与应用双重价值并重的典范。

在发布会的最后,吴名朝表示,“BI大模型要完美的融入场景,还有很长的路要走,但我们愿意与行业伙伴、技术伙伴携手共进,克服更多复杂场景下的应用难题”。

以上内容为资讯信息快照,由td.fyun.cc爬虫进行采集并收录,本站未对信息做任何修改,信息内容不代表本站立场。

快照生成时间:2024-09-23 11:45:08

本站信息快照查询为非营利公共服务,如有侵权请联系我们进行删除。

信息原文地址:

以“价值创造”为导向,医渡科技自研大模型即将发布
...念,公司自研医疗垂域大模型将于近期正式发布。“数据+算法+算力+场景”闭环医渡科技在医疗智能领域深耕近10年,从解决数据可计算性,到安全可信的大规模计算,再到多任务的专业AI
2023-12-08 10:17:00
交行副行长钱斌:生成式AI在算力算法、数据安全等领域面临...
...技术在金融领域的落地应用。钱斌指出,生成式AI在算力算法、数据安全、人才等领域面临着诸多痛点和难点。比如,如何实现大规模算力模式下的绿色低碳供给,如何提供适合大模型的大规模、
2023-12-09 19:39:00
人工智能产业决胜与 Data&AI 数据基础设施建设——科杰科技于洋中国国际数字经济博览会主题演讲
...在大国竞争中,人工智能产业是核心竞争领域,其由算力、算法、数据三大要素构成。目前我国在算力领域已有竞争方案与大规模计算方式,算法领域已实现混合专家突破,而数据作为人工智能产业
2025-10-31 08:51:00
解读大模型赋能自动驾驶各个环节及相关产业链玩家的投资机会
...节及相关产业链玩家的投资机会。大模型赋能自动驾驶,算法、数据闭环、仿真全面受益—1、自动驾驶算法、数据不断迭代,长尾问题处理成为关键目前自动驾驶算法历经多年演变,呈现出几大特
2023-06-06 13:00:00
盘古矿山大模型,首次!山东能源云鼎科技!
...字化建设批量复制?山东能源发现,这急需一套可复用的算法模型流水线式应用到各种场景,不仅解决各煤矿大规模复制问题,还可以实现减人提效的目的,这是山东能源的挑战,更是煤炭行业共同
2023-07-26 11:57:00
市场规模将达万亿级!自动驾驶产业发展进入“黄金十年”
...能力以及完善的工具链,帮助整车厂构建自己的自动驾驶算法和数据闭环系统,让相关汽车产品的自动驾驶水平大幅度提升。 整体来看,我国乘用车自动驾驶正在由L2向L3+过渡。数据显示
2023-07-12 18:14:00
金融大模型重新定义金融科技!度小满CTO许冬亮:落地仍需解决三大挑战
...练,然后做私有化的部署和应用”。大模型时代,算力、算法、数据构成了新范式的“三驾马车”,北京大学光华管理学院商务统计与经济计量系教授王汉生也表示,好的人工智能算法、模型最终要
2023-08-24 11:56:00
傅盛捅破AI行业窗户纸!百模大战靠数据背后是什么逻辑?
...底层模型和上层应用之间的重要桥梁。一直以来,数据、算法、算力作为大模型发展的三驾马车缺一不可,如今算法、算力的差距明显缩小,数据的重要性愈发凸显。相比于算法和算力,数量充足、
2024-11-29 09:26:00
本文转自:人民日报新模式助力人工智能落地应用算法做“减法” 应用做“加法”(创新故事)本报记者 赵永新《 人民日报 》( 2023年07月10日 第 19 版)新药研发风险大、周
2023-07-10 05:16:00
更多关于科技的资讯:
传统城市形象传播中,政府是主导者。而具创新性的广州“城市合伙人”计划则打破传统赞助模式的边界,向全球征集“奋斗共同体”
2026-01-06 11:04:00
河北日报讯(记者刘英)近日,《廊坊市人工智能产业聚集区建设方案》(以下简称《方案》)正式发布,系统谋划布局人工智能产业发展新蓝图
2026-01-06 08:14:00
京津研发河北转化进行时(五):创新种子何以在这里开花结果
近三年间,12项京津研发成果在晨光生物完成转化创新种子何以在这里开花结果近日,位于曲周县的晨光生物科技集团股份有限公司中试中心内
2026-01-06 08:18:00
四中全会精神在基层|“产业大脑”高效协同 线缆企业多重受益
2025年12月6日,宁晋县河北易缆网络科技有限公司展厅,易缆网平台负责人王洪喜介绍平台功能。 河北日报记者 闫德见摄2025年12月6日10点30分
2026-01-06 08:25:00
福建省“最美科技工作者”、厦门金鹭研发工程师高兰兰:微米之间磨刃 宝刀谁与争锋
高兰兰介绍立铣刀切削的弧度和精度。用UP300系列通用高性能立铣刀切削而成的“青鸾”金属雕塑。厦门网讯 (文/厦门日报记者 李晓平 图/厦门日报记者 黄晓珍)在金属切削的微观世界里
2026-01-06 08:38:00
厦门网讯 (厦门日报记者 林露虹)2025年12月以来,厦门企业融资捷报频传,主要涉及人工智能、新材料领域,彰显厦门在培育新质生产力方面的蓬勃活力
2026-01-06 08:38:00
临沂圣陶高级中学举行高三英语教学传承分享会
鲁网1月5日讯近日,临沂圣陶高级中学“杏坛薪火·师道赓续”专家教师教学传承分享会如期举行,为高三英语一轮复习注入新动能
2026-01-06 09:37:00
20个福建品牌入选中国消费名品其中5个来自厦门,分别为银鹭、暴龙、鹭岛卫浴、瑞尔特和燕之屋东南网1月6日讯(海峡导报记者 黄奕琳)昨日
2026-01-06 10:33:00
厦门网讯(厦门日报记者 沈彦彦)新年伊始,政策红利与节庆消费碰撞出红火“好市”。据厦门市商务局发布的数据显示,2026年元旦假期
2026-01-06 08:38:00
国补山东落地 山东消费者来京东换新单人至高可省11000元
1月4日,2026年国家以旧换新补贴落地山东,京东线上线下全面承接国家补贴落地。山东消费者到京东APP搜索“山东以旧换新”即可进入国补页面
2026-01-06 10:12:00
内存硬盘身价翻倍 存储产品成“年度理财产品” 业内预测:今年手机、电脑将迎来涨价
移动固态硬盘价格比一年前明显上涨“年初买的内存条年底价格已经翻倍!”“不看购买记录不知道,一看吓一跳,连固态硬盘的‘身价’都在一直上涨
2026-01-06 08:09:00
前不久,“魔搭社区”(杭州)开发者中心在杭州云谷中心正式启用。“魔搭社区”是在2022年云栖大会上由中国计算机学会(CCF)开源发展技术委员会与阿里巴巴共同发起的AI模型开源平台
2026-01-06 08:09:00
从春晚舞台上16台机器人甩手绢扭秧歌的惊艳亮相,到机器人半程马拉松的耐力角逐,再到拳击擂台上的对攻,2025年的机器人产业以肉眼可见的速度“狂飙突进”
2026-01-06 07:34:00
君同未来推出“AI+大模型全生命周期智能治理应用”,为AI装上“方向盘”和“安全带”;炽橙科技自主研发的“炽橙AIDT工业多智能体开发平台”
2026-01-06 07:38:00
2026年1月1日,国际顶尖学术期刊《Science》在线发表了中国科学院院士、中国科学院杭州医学研究所所长、浙江省肿瘤医院院长谭蔚泓与吴芩研究员团队合作取得的重要突破
2026-01-06 07:08:00