• 我的订阅
  • 科技

Jina AI 推出全球首个开源 8K 文本嵌入模型

类别:科技 发布时间:2023-10-26 20:28:00 来源:瘦子财经

10月26日消息,JinaAI在其官网发布新闻稿,宣布推出jina-embeddings-v2模型,号称是目前是唯一支持8K(8192个token)上下文长度的开源产品,在功能和性能上与OpenAI的text-embedding-ada-002类似。

Jina AI 推出全球首个开源 8K 文本嵌入模型

在大规模文本嵌入基准(MTEB)排行榜方面,IT之家发现,官方进行如下解释:

与OpenAI的8K模型text-embedding-ada-002进行比较,jina-embedding-v2在分类平均值、重排平均值、检索平均值和摘要平均值方面均优于OpenAI的text-embedding-ada-002。

▲图源JinaAI官网

Jina AI 推出全球首个开源 8K 文本嵌入模型

▲图源JinaAI官网

官方表示,jina-embeddings-v2模型,是从头开始构建的。在过去的三个月里,JinaAI团队进行了密集研发、数据收集和调整。

JinaAI同时声称,jina-embeddings-v28K的上下文长度有利于以下应用场景:

法律文件分析:确保对大量法律文本中的每一个细节进行捕捉和分析。

医学研究:为了进行高级分析和发现,全面地嵌入科学论文。

文学分析:深入研究长篇内容,捕捉微妙的主题元素。

财务预测:通过详细的财务报告获得卓越的洞察力。

会话式AI:提升聊天机器人对复杂用户查询的响应能力。

以上内容为资讯信息快照,由td.fyun.cc爬虫进行采集并收录,本站未对信息做任何修改,信息内容不代表本站立场。

快照生成时间:2023-10-26 23:45:03

本站信息快照查询为非营利公共服务,如有侵权请联系我们进行删除。

信息原文地址:

零样本即可时空预测!港大、华南理工等发布时空大模型UrbanGPT | KDD 2024
...计的有效性。具体来看,ChatGPT在预测时主要依赖于历史平均值,而没有明确地将时间或空间数据纳入其预测模型中。Llama-2-70b虽然能够分析特定时间段和区域,但在处理数
2024-08-01 09:40:00
刚炮轰完GPT模式 杨立昆推出首个“世界模型”
...编码器的输出,其权重通过上下文编码器权重的指数移动平均值在每次迭代中更新。 I-JEPA中的预测器可以看作是一个原始的(受限制的)世界模型,它能够从部分可观察的环境中对静态
2023-06-14 18:02:00
EMQ 如何用DeepSeek大模型重构可观测性数据分析?
...户直观地理解数据,快速定位问题。示例1:计算duration的平均值在脚本模式下,用户发送了一个「计算当前追踪数据中duration字段(耗时)的平均值」的请求
2025-02-27 14:45:00
谷歌DeepMind研究再登Nature封面,隐形水印让AI无所遁形
...测文本:把所有的token扔进所有的水印函数中,最后计算平均值,则带水印的文本通常应该得分高于无水印的文本。由此可知,水印检测是一个程度的问题。影响评分函数检测性能的主要因素
2024-11-09 13:34:00
王小川公布最新大模型,号称全球最长上下文,是GPT-4的14倍|钛媒体焦点
...模型公司“百川智能”宣布,推出Baichuan2-192K大模型,其上下文窗口长度高达192K,能够处理约35万个汉字
2023-10-30 15:02:00
《红楼梦》里有大量东北方言?实测AI大模型“长文阅读”
...,国内通用人工智能“初创明星”月之暗面宣布在大模型上下文窗口技术上取得新突破,旗下的Kimi智能助手可支持200万字超长无损上下文,并开启产品内测,随即引发市场关注和热议,并
2024-03-28 10:06:00
GPT-4劲敌,谷歌进入高能+高产模式
...内的大模型而言,只有Minimax采用了MoE架构。二、扩容的上下文窗口意味着什么?虽然Gemini 1.5 Pro是 Gemini 1
2024-02-21 14:05:00
梁文锋杨植麟论文撞题,“注意力机制”对大模型意味着什么
...于NSA(Natively Sparse Attention,原生稀疏注意力)。据DeepSeek,上下文建模对于下一代语言模型至关重要
2025-02-19 18:43:00
检索总结能力超博士后,首个大模型科研智能体PaperQA2开源了
... LitQA2 问题时,PaperQA2 平均每道题解析并使用 14.5 ± 0.6(平均值 ± SD,n = 3)篇论文
2024-09-13 13:33:00
更多关于科技的资讯:
普阳钢铁工程机械用高强高韧宽厚板全国市场占有率名列前茅一块宽厚板的靶向发力——“铁疙瘩”怎样变成“金娃娃”(十)从矿山到港口
2025-10-05 07:47:00
人气旺 厦门多个商场假日客流爆棚、销售额亮眼
集美大悦城商圈内,小朋友和机器人亲密互动。(本组图/厦门日报记者 黄晓珍 摄)国庆中秋假期, 厦门SM购物中心潮玩店内人气火爆
2025-10-04 09:20:00
省数据和政务服务局发布公告公开征集一批河北省高质量数据集河北日报讯(记者解楚楚)9月26日,河北省数据和政务服务局发布公告
2025-10-04 08:03:00
央媒看太原9月30日,央视财经频道《经济信息联播》栏目以《双节市场备货足美食特产受青睐》为题,报道了假期到来,太原市各大综合市场提前备货
2025-10-04 07:17:00
厦门网讯(厦门日报记者 朱道衡)近日,2025鼓浪屿世遗文创作品征集活动启动。此次活动面向全国(含港澳台地区)高校、企业
2025-10-03 08:37:00
厦门网讯(厦门日报记者 楚燕 通讯员 石青青)长假期间,许多人从忙碌的工作中解脱出来,趁机好好休息。可是,如果休息方式不得当
2025-10-03 08:37:00
渤海之潮涌动着澎湃的脉搏,海河之畔镌刻着科技的印记。10年前,一颗带有“清华”基因的种子在天津这片沃土扎根;10年后,它长成一棵枝繁叶茂的参天大树
2025-10-03 09:25:00
太燃了!无人机空中展旗!高新区国庆“氛围组”已上线!
2025-10-03 23:48:00
抖音生活服务联合北京卫视发起“老板驾到”直播活动,吸引用户下单超100万元团购券
9月29日,抖音生活服务联合北京卫视发起“老板驾到”直播活动,助力北京国庆中秋消费。抖音用户在@北京卫视 直播间下单超1万次
2025-10-03 18:36:00
“FutureBOT未来引力”2025北京机器人文化节首日盛况 打造国庆科技打卡新地标
国庆首日,“FutureBOT未来引力”2025北京机器人文化节在北京昌平超极合生汇正式拉开帷幕,成为国庆假期极具科技温度的打卡地
2025-10-03 19:06:00
走到白石山巅的尽头,这家建在悬崖边的“云端咖啡厅”绝对让你惊呼。
2025-10-03 11:37:00
泰康人寿发布新品“泰康百万药无忧(庆典版)医疗保险”(以下‬简称“百万药无忧”),以广覆盖、易投保、强保障、低费率为优势
2025-10-03 09:17:00
厦门网讯(厦门日报记者 翁华鸿 通讯员 林雨新)在近日举行的2025全球数据管理峰会“数据要素分论坛暨大数据统计与人工智能技术创新管理研讨会”上
2025-10-03 08:38:00
兴趣-实践-视野:达芬奇金奖少年带来的教育启示录
摘要:2025“你是达芬奇”全球青少年科学与艺术创新赛圆满落幕,其中金奖获奖少年的亲身实践告诉我们,在AI赋能的新时代
2025-10-02 16:22:00
单日调用近1万亿次,高德助力北斗规模化民用跨入新量级
2025年10月1日,随着国庆长假首日出行高峰的到来,高德基于北斗卫星导航系统的定位数量接近1万亿次,支撑导航总里程数超90亿公里
2025-10-02 22:31:00