• 我的订阅
  • 头条热搜
...分,“2023年度十大网络用语”是基于国家语言资源监测语料库网络媒体部分,采用智能信息处理技术结合领域专家意见和相关站点收录情况的方式获得的。监测语料库中包含了视频弹幕、网络新闻等不同媒体形式的语言资源。...……更多
...分,“2023年度十大网络用语”是基于国家语言资源监测语料库网络媒体部分,采用智能信息处理技术结合领域专家意见、相关站点收录情况的方式获得。监测语料库中包含了视频弹幕、网络新闻等不同媒体形式的语言资源。此...……更多
...境:“2023年度十大网络用语”是基于国家语言资源监测语料库网络媒体部分,采用“智能信息处理技术结合领域专家意见和相关站点收录情况”的方式获得。监测语料库中包含了视频弹幕、网络新闻等不同媒体形式的语言资源...……更多
热词生动记录中国人生活
...胺穿搭、命运的齿轮开始转动、新职人。专家表示,监测语料库中包含了视频弹幕、网络新闻等不同媒体形式的语言资源,分析的语料规模超过80亿字符。王小岩认为,网络新词新语或是偶有出现的旧字新说,彰显出汉语的旺盛...……更多
“汉语盘点2023”在京启动 12月20日揭晓年度字词
...字词为活动预热。国家语言资源监测与研究中心通过监测语料库,推荐国内字“新、复、合、兴、路”和国际字“战、乱、变、债、危”,国内词“一带一路、全球文明倡议、文心一言、亚运会、绿色发展”和国际词“巴以冲突...……更多
...司,这块业务在一季度已经有收入确认。现阶段正在加快语料库的建设,并对合作客户实现语料的批量交付,预计该业务全年在收入和利润端都会有显著贡献。”今年4月,随着Sora概念(文生视频)爆发,以中广天择为代表率先...……更多
...京召开发布会,面向社会发布用于大模型的首批中文基础语料库。据悉,网安协会人工智能安全治理专委会会同国家权威机构,发挥企业、高校和科研单位协同优势,通过“共建-共享”机制,汇聚一批高质量可信数据,经过去...……更多
年度热词,生动记录社会生活
...说,这些词语由国家语言资源监测与研究中心基于大数据语料库选取,语料库包含主流媒体、网络媒体、广播电视媒体和社交媒体等语言资源,每年语料有20多亿字的文本,然后利用语言信息处理技术筛取,经过专家评议选出。...……更多
...少业内人士已嗅到一丝危机:全能,意味着需要更强大的语料库来训练AI,而优质的AI语料已经越来越稀缺。AI语料,简单来说,就是用于训练和优化人工智能模型的数据集合。这些数据可以是文本、语音、图像或视频。高质量的...……更多
网络热词“魅力”当选牛津年度词
...这种造词法在英语中不太多见。声明说,牛津大学出版社语料库数据显示,这个词2023年使用频次显著增加,尤其在今年6月。当时,曾出演《蜘蛛侠》系列影片的英国演员汤姆·赫兰德在采访中被问到保持魅力的秘诀。赫兰德回...……更多
“AI”当选柯林斯年度词汇
...技一般。”报道称,柯林斯表示,文字专家分析了柯林斯语料库,这个资料库涵盖超过200亿个单 字,其中包含来自全球各地网站、报章杂志和书籍的 书面资料。柯林斯也从广播、电视和日常对话搜集口语素材, 按月将新资料输...……更多
《历史铸就统一体》等中国自主的知识体系成果发布
...中国外语教育研究中心研究员刘鼎甲发布《中国英汉平行语料库研究》著作成果。该书是国家社科基金重大项目“大规模英汉平行语料库的建立与加工”的重要成果,荣获第九届高等学校科学研究优秀成果奖一等奖。“中国英汉...……更多
AI价值对齐“五有”框架在世界人工智能大会发布
...全国重点实验室相关负责人表示,建设多维度价值对齐的语料库,应该坚持“以人为本、智能向善、造福人类”的原则,鼓励通过国际合作和实际行动,帮助世界各国加强人工智能能力建设。这个体系分成五个主要维度,分别是...……更多
宋丽云:做好新时代新征程网络文明建设者传播者捍卫者
...技成果。当前,人民网正在依托国重实验室建设主流价值语料库。此外,宋丽云推介了人民网的智能产品“天目”智能识别系统和“人民审校”。宋丽云说:“人民网将加大力度研发建设主流价值语料库,帮助国产AI系统建设安...……更多
...2023年度中国媒体十大新词语”是基于国家语言资源监测语料库,利用语言信息处理技术,结合后期人工确认获得的。语料来源于2023年1月1日至11月30日的10份主流报纸的文章、20家电台和电视台的节目、4家门户网站的新闻,数据...……更多
千行百业加速拥抱大模型(AI前沿观察)
...云、中科创达、蚂蚁集团等17家企业发布《“中文互联网语料库”共建共享倡议书》。数据交易日益兴起,为大模型获取语料资源提供了新途径。《上海市推动人工智能大模型创新发展若干措施(2023—2025年)》提出:“依托上...……更多
首个语料库建设导则面世!近二十家企业共同发布
...场传递专业化、链接型、前瞻性的语料生态设计理念。《语料库建设导则》发布。人民网记者 王初摄为实现“语料数据资源共建共享”“鼓励多元主体共同推动高水平语料数据要素建设”的目标,上海库帕思科技有限公司会同...……更多
AI赋能游戏:问答机器人的设计与实现
...器人的原理前,先说一个前提,就是我们的大语言模型的语料库中,有一种语料是QA形式的,即一问(question)一答(answer),与一般的段落形文章有所区别。关于语料库的介绍,下边章节会继续细说。这里将继续讲机器人的运...……更多
上海:发力语料,建设“模都”
...界共识,发展趋势不可阻挡。2024年7月6日的语料论坛上,语料库建设导则正式发布。人民网记者 王初摄“人工智能训练,不仅要关注数据语料的数量,也要重视’数据配方’,用高质量数据的最优组合,提升AI效能与安全性。”...……更多
星环科技成功举办数据要素市场与大模型语料库论坛
...司主办,上海市数商协会协办的“数据要素市场与大模型语料库论坛暨中国大模型语料数据联盟开放日活动”成功举办,活动上200余家大模型数据、人工智能及技术企业及相关机构代表出席会议。上海市经信委信息化推进处处长...……更多
...媒体行业的安全应用。生成式人工智能合规性评估体系和语料库由传播内容认知全国重点实验室于今年3月研究建立。目前,主流价值语料库的建设取得了阶段性进展,已完成3000多万篇基础语料、5万多道问答语料的建设工作。相...……更多
“弱智吧”成最佳中文AI语料库,究竟什么算优质数据?
...地”的弱智吧,最近竟摇身一变成了——最佳中文AI训练语料库?由此受到启发,是否并不是训练AI的优质数据不够用,而是还有更多宝藏数据资源值得深挖?近日,由中科院深圳先进技术研究院、中科院自动化研究所,滑铁卢...……更多
...规模达到1600GB,是目前国内外最大的基于国标的大型标注语料库,对中国涉藏地区教育、语言研究以及社会文化发展起到积极推动作用。同时,该实验室还构建了大规模藏汉平行语料库,并通过迭代式回译策略等进行数据增强及...……更多
AI数据之战:大模型的“燃料”还能烧多久?
...天荣编辑/ 王昕AI时代,高质量、规模庞大且安全可靠的语料库已成为构建强大AI模型的基石。近日有外媒报道,OpenAI使用所有公开可用的数据来训练ChatGPT,包括来自互联网的书籍和文章。事实上,在大模型发展如火如荼的当下...……更多
知乎 AI 革命:智能搜索与实时问答的融合
...容有更多被采集、使用和预训练的可能。参与国家级中文语料库建设,成为重要的语料建设者。整个社区的激进 AI 化。AI 进行提问,更负责回答。知乎社区将出现大量的 AI 数字人作为独立的 IP ——历史的、科技的、医学的、文...……更多
迈向多语言医疗大模型:大规模预训练语料,开源模型与全面基准测试
...项贡献:1. 创建了一个包含 25.5 Billion tokens 的多语言医疗语料库 MMedC。2. 开发了一个全新的多语言医疗问答评测标准 MMedBench, 覆盖了 6 种语言,21 种医学子课题。3. 推出了一款名为 MMed-Llama 3 的全新基座模型,以 8B 的尺寸在多……更多
人民中科董事长张丹:用技术为基层减负 运用人工智能“为民服务”
...中科董事长张丹发表主题演讲。主办方供图一是主流价值语料库。针对大模型普遍答不了、答不好的重大、敏感、疑难问题,人民网建设了包括基础语料、重点领域语料、敏感问答语料在内的主流价值语料库,目前已完成12万道...……更多
ChatGPT会对知乎、小红书等内容社区造成打击吗?
...社区面前的一道课题。一、知乎:ChatGPT绕不过去的中文语料库?股价“狂飙”之后,沉寂已久的知乎投资者社区又重新活跃起来,围绕“后ChatGPT时代”知乎的前途,唱多与唱衰者争论不休。在看多的投资者看来,知乎是当之无...……更多
...的关键。此外,国家语言资源监测与研究中心基于大数据语料库,利用语言信息处理技术筛取,并经过专家评议,发布2022年度十大流行语、十大新词语。2022年度十大流行语是:党的二十大、中国式现代化、全过程人民民主、端...……更多
2022-12-20 16:46汉语,盘点,年度
...。他们也同样疑惑,为什么许多AI公司会选择弱智吧作为语料库?无界方舟CEO曾晓东说,他们的研究方向是“利用人工智能技术让机器人更像人”,训练AI时一直在寻找口语化、多轮问答的语料。“其实喂给大模型的不只是段子...……更多
更多关于科技的资讯:
华为12月多款新品曝光:两款新手机 还有入门平板
【CNMO科技消息】华为在前段时间带来了多个重磅新品,包括Mate 70系列旗舰和Mate X6折叠屏旗舰。而据CNMO了解
2024-12-03 13:42:00
联想 ZUI 史上最大规模底层革新:ZUXOS 平板操作系统发布
IT之家 12 月 2 日消息,联想 ZUI 官方微博今日官宣全新 ZUXOS 平板操作系统,该微博也更名为了“联想 ZUXOS”
2024-12-03 09:35:00
英伟达四插槽 Ada 显卡带 PCB 原型确认配 RTX 4090 同款核心显存
IT之家 12 月 2 日消息,据外媒 VideoCardz 报道,此前现身的带 PCB 版本四插槽 Ada 显卡配备了与标准 RTX 4090 同规模的核心与显存(IT之家注
2024-12-03 09:35:00
京东京造 M3 Elite 双模人体工学款鼠标发布:PAW3220,99 元
IT之家 12 月 2 日消息,京东京造 M3 Elite 双模人体工学款鼠标现已上架开售,标准价 119 元,下单领取满 99 减 20 元优惠券
2024-12-03 09:36:00
华为将于12月12日举行全球发布会,折叠屏旗舰Mate X6有望亮相
IT之家 12 月 2 日消息,华为即将在海外市场推出其新款旗舰产品,该公司暗示将于 12 月 12 日为全球消费者发布高端折叠屏手机华为 Mate X6
2024-12-03 09:37:00
华硕 ProArt 创艺国度 PA401 木艺版机箱上架,579 元
IT之家 12 月 2 日消息,华硕现已在京东上架一款 ProArt 创艺国度 PA401 木艺版机箱,该机箱采用木质格栅前面板
2024-12-03 09:37:00
小米澎湃 OS 2 焦点通知已支持 20 余个应用
IT之家 12 月 2 日消息,小米澎湃 OS 官方今日发布“小米澎湃 OS 答网友问(第三集)”,对一些系统后续功能进行了回应
2024-12-03 09:37:00
首款AMD B650主板实物,技嘉B650M AORUS ELITE WIFI6E ICE曝光
IT之家 12 月 2 日消息,VideoCardz 的读者向该外媒分享了技嘉 B850M AORUS ELITE WIFI6E ICE 主板的多张图片
2024-12-03 09:39:00
九州风神预告 12 月 5 日发布阿萨辛 IV VC VISION 均热板风冷
IT之家 12 月 2 日消息,九州风神 11 月 29 日预告将于 12 月 5 日正式发布旗舰均热板风冷阿萨辛 IV VC VISION
2024-12-03 09:40:00
华硕中国区总经理预告 CES 2025 推出 AMD X870 背插主板
IT之家 12 月 2 日消息,华硕电脑有限公司中国区总经理、B站 UP 主“普普通通 Tony 大叔”俞元麟在发布于 11 月 29 日的视频中表示
2024-12-03 09:42:00
支付宝上线“学生模式”:专属皮肤、校园卡片等
IT之家 12 月 2 日消息,据IT之家小伙伴反馈,支付宝日前上线了学生模式,用户在支付宝搜索框搜索“学生模式”就可以开启
2024-12-03 09:42:00
千元机别盲目买,这三款几乎“零差评”,顶配版也售价亲民
市场上的千元机,简直是“琳琅满目”——有的看起来像明星,实际却只有小丑的表演;有的刚开机就感觉像是给系统装了“千斤顶”
2024-12-03 09:43:00
小米乱套了,6550mAh+骁龙8Gen3+2K屏,新机仅售2499元起
手机市场的变化可以说非常大,如今越来越多的手机厂商推出高性价比手机,以此来应对竞争激烈的手机市场,作为主打性价比的小米手机
2024-12-03 09:45:00
一加 13满血配置,打造「超Pro」性能体验
手机作为我们日常工作生活中最重要的电子设备之一,用户对其最日常也是最普遍的需求就是流畅。一加 13通过顶级旗舰硬件组合和独家自研技术双管齐下
2024-12-03 09:45:00
荣耀300系列重磅发布 里程碑之作引领档位越级进化
2024年12月2日,全新一代荣耀300系列正式发布,新潮的环球旅拍发布会不仅展现了荣耀追求极致的创新理念,也标志着数字系列迎来科技体验以及美学设计的巨大升级
2024-12-03 09:46:00