• 我的订阅
  • 科技

kimi开放平台contextcaching功能将启动内测

类别:科技 发布时间:2024-06-20 10:35:00 来源:浅语科技

6月19日消息,月之暗面官宣Kimi开放平台ContextCaching功能将启动内测,届时将支持长文本大模型,可实现上下文缓存功能。

kimi开放平台contextcaching功能将启动内测

▲图源Kimi开放平台官方公众号,下同

据介绍,ContextCaching(上下文缓存)是由Kimi开放平台提供的一项高级功能,可通过缓存重复的Tokens内容,降低用户在请求相同内容时的成本,原理如下:

kimi开放平台contextcaching功能将启动内测

官方表示,ContextCaching 可提升API的接口响应速度(或首字返回速度)。在规模化、重复度高的prompt场景,ContextCaching功能带来的收益越大。

ContextCaching适合于用频繁请求,重复引用大量初始上下文的情况,通过重用已缓存的内容,可提高效率降低费用,适用业务场景如下:

提供大量预设内容的QABot,例如KimiAPI小助手。

针对固定的文档集合的频繁查询,例如上市公司信息披露问答工具。

对静态代码库或知识库的周期性分析,例如各类CopilotAgent。

瞬时流量巨大的爆款AI应用,例如哄哄模拟器,LLMRiddles。

交互规则复杂的Agent类应用,例如什么值得买Kimi+等。

官方后续将发布ContextCaching功能的场景最佳实践/计费方案/技术文档

以上内容为资讯信息快照,由td.fyun.cc爬虫进行采集并收录,本站未对信息做任何修改,信息内容不代表本站立场。

快照生成时间:2024-06-20 12:45:03

本站信息快照查询为非营利公共服务,如有侵权请联系我们进行删除。

信息原文地址:

谷歌「诚意之作」,开源9B、27B版Gemma2,主打高效、经济!
...发者提供了前段时间在I/O大会上官宣的Gemini 1.5 Pro的200万上下文窗口访问权限、Gemini API的代码执行功能
2024-06-29 09:37:00
Mamba再次挑战霸主Transformer!首个通用Mamba开源大模型一鸣惊人
...有效地捕获其关系。这种通过比较文本中每个token来理解上下文的方式,需要更多的计算能力和内存来处理不断增长的上下文窗口。如果资源没有相应扩展,推理速度会变慢,最终无法处理超
2024-08-14 09:43:00
陈天奇团队LLM结构化生成新引擎XGrammar:百倍加速、近零开销
...就是遵循某个特定格式(如 JSON、SQL 等)的数据。但使用上下文无关语法(CFG)来进行约束解码的方法并不高效
2024-11-27 13:37:00
技术解读: vCPU 从 SMP 走向 Hybrid
...可以同时出现母机和子机中,核心思路是基于当前任务的上下文在下一次调度决策前更新其调度上下文。它需要实现特性匹配,在主机侧需要用一种通用的方式完成 vCPU 与 pCPU 的灵
2023-06-30 11:01:00
CMU副教授:在多智能体流行的当下,不要忽视单智能体系统
...完全匹配时,效果会很好,但问题是如果不匹配怎么办?上下文信息的传递:多智能体系统通常在多个智能体之间传递信息,但这可能是信息丢失的原因。例如,如果故障定位器仅将其摘要信息传递
2024-10-11 12:03:00
高德发布MCP Server2.0,已整合12大核心接口
...r(以下简称“高德MCP”)基于MCP(ModelContextProtocol,模型上下文协议)构建,是一个标准化地图服务能力平台
2025-04-30 19:21:00
rtxai助手的进化
...Assist项目可接收玩家的语音或文字输入内容,游戏窗口的上下文信息,并通过AI视觉模型处理数据。这些模型增强了与游戏知识数据库相连的大语言模型(LLM)的上下文感知和对特定
2024-06-07 04:47:00
Anthropic开源MCP:大模型接入数据有了“统一插头”,Agent平台慌了?
...Slack、GitHub等平台的数据了。近日,Anthropic开源了“模型上下文协议”(MCP),该协议将大模型直接连接至数据源
2024-11-27 13:33:00
Kimi爆火出圈,国产大模型首次超越海外!
2024年3月18日,国产AI大模型Kimi将上下文无损输入长度提升至200万字,成为国内大模型首次在部分能力上超越海外主流产品的里程碑。上下文输入长度的增加能够帮助模型更好学习
2024-04-02 18:31:00
更多关于科技的资讯:
京东物流首个海外智狼仓“圣诞季”在英国投用,Joybuy本地最快当日达
12月是“圣诞季”,节日氛围浓厚。为更好服务海外消费者,京东物流首个海外智狼仓在英国正式投用,一件件承载着圣诞祝福的特色礼品已陆续从该仓库发出
2025-12-25 15:02:00
浙江日报讯 (记者 赵静 共享联盟·温岭 梁伟伟 赵碧莹) “我们最新推出的裸足童鞋,就像是孩子脚上的‘第二层皮肤’。”日前
2025-12-25 08:41:00
浙江日报讯 (记者 拜喆喆) 日前,记者从杭州海关了解到,1至11月,浙江省跨境电商进口清单量达2.7亿单,货值达775
2025-12-25 09:12:00
浪潮计算机C86服务器登顶TPCx-IoT榜首,揭秘中国算力领先背后的创新密码
从技术追赶到能力并跑,再到关键领域的创新引领——中国算力产业正稳步实现发展阶段的新跨越。近日,浪潮计算机C86服务器在TPCx-IoT全球测评中登顶榜首
2025-12-25 10:11:00
广域铭岛五周年价值长卷|G+,为工业未来做加法
五年,是时间的刻度,更是价值的纵深。G+,是广域铭岛的符号,也是我们与产业同行的语言——为战略做加法,为技术做加法,为生态做加法
2025-12-25 10:57:00
人机连续对打羽毛球1452次杭州日报讯 “最终成绩为1452次,打破纪录,挑战成功!”12月22日下午,绍兴上虞杭州湾联合创新中心内
2025-12-25 06:39:00
邢翀 贺劭清 中国新闻社在全媒体技术深度重塑传播生态的背景下,短视频、直播等形式凭借其直观、快速、沉浸式的特性,成为体育新闻传播吸引流量的关键抓手
2025-12-25 06:44:00
数览“十四五” 解码杭州59家“新小龙”涌现的动力之源
制图 应茵每日商报讯 12月15日,由浙江省科技厅、省经信厅等部门指导的“浙江省科技新小龙探访和护航行动”正式揭晓结果
2025-12-25 07:10:00
周末日均客流三万人次,线下销量华北门店第一盒马石家庄首店何以领跑华北12月21日,石家庄勒泰中心负一层的盒马鲜生门店内
2025-12-25 07:49:00
当紧固件遇上AI,产业集群变身超级工厂——AI赋能千行百业一线故事(十八)11月19日9时许,位于邯郸市永年区的国智科技(河北)股份有限公司
2025-12-25 07:51:00
杭州日报讯 “快手一姐”蛋蛋(杨润心)在杭州注册新公司、曹颖一个月内组建团队完成首播、林依轮将团队整体南迁至杭州……这些直播电商行业的“重磅事件”
2025-12-25 07:09:00
农行固堤支行积极拥抱金融科技,全力推动网点智能化转型与服务升级。大力推广手机银行、网上银行等线上渠道,引导客户体验转账汇款
2025-12-24 08:41:00
“您站好,用手机拍正面、侧面、背面三张照片。3分钟后,您不仅能知道最适合自己的衣服尺寸,还能在电脑上实时看到自己穿上这件衣服的虚拟效果
2025-12-24 08:42:00
日前,中国进出口银行深圳分行向纵腾集团子公司香港亿格有限公司发放境外投资贷款,精准助力企业提升跨境电商海外仓运营效能,为跨境电商行业高质量发展注入金融活水
2025-12-24 08:44:00
苏州市镇江商会副会长单位【旭智文化】荣膺2025年度省级专精特新中小企业称号
近日,江苏省工业和信息化厅正式公布2025年度省级专精特新中小企业名单。苏州市镇江商会副会长单位苏州旭智新文化科技有限公司凭借在数字展馆领域的创新研发
2025-12-24 09:03:00