• 我的订阅
  • 头条热搜
全球AI安全评估测试有了新基准
...域两项国际标准发布全球AI安全评估测试有了新基准随着人工智能系统,特别是大语言模型成为社会各方面不可或缺的一部分,以一个全面的标准来解决它们的安全挑战变得至关重要。◎本报记者 崔 爽第27届联合国科技大会期间...……更多
中国信通院发布大模型安全基准测试报告 360智脑综合排名第一
...安全基准测试AI Safety Bench是中国信息通信研究院依托中国人工智能产业发展联盟(AIIA)安全治理委员会,联合17家单位发起的,秉持公平公正、产业应用和场景导向的原则,目标建立业内权威大模型安全中文基准测试体系。以提高...……更多
2023 AI现状报告:GPT-4仍最强,监管方向缺乏全球共识
·随着尖端人工智能系统变得更加强大和灵活,比较它们的能力越来越困难。由于基准变得不那么明确,用于评估大语言模型的“基于氛围”的方法在业界越来越普遍。·人工智能安全在2023年首次占据舞台中心。但人工智能界内...……更多
国际组织WDTA首次就大模型安全发布国际标准,蚂蚁集团、OpenAI、科大讯飞等参编
...技术院(WDTA)发布了一系列突破性成果,包括《生成式人工智能应用安全测试标准》和《大语言模型安全测试方法》两项国际标准。这是国际组织首次就大模型安全领域发布国际标准,代表全球人工智能安全评估和测试进入新...……更多
本文转自:法治日报随着人工智能技术的迅猛发展,大模型在各个领域的应用日益广泛。为全力筑牢人工智能安全防线,进一步提高大模型技术的安全风险防范能力,今年2月,中国信息通信研究院(以下简称中国信通院)联合3...……更多
开闭源模型「大乱斗」:看看哪个智能体最能窥见人类真实意图
...通讯作者为从鑫与林衍凯,指导教师为刘知远副教授。在人工智能迅猛发展的今天,我们不断探索着机器的智能化,但却往往忽视了这些智能体如何深层地理解我们 —— 它们的创造者。我们人类在生活中的每一次互动,每一句...……更多
刚刚,OpenAI震撼发布o1大模型!强化学习突破LLM推理极限
...但对于复杂的推理任务来说,这是一个重大进步,代表了人工智能能力的新水平。鉴于此,OpenAI 将计数器重置为 1,并将该系列模型命名为 OpenAI o1。重点在于,OpenAI 的大规模强化学习算法,教会模型如何在数据高度有效的训练...……更多
全球首篇!调研近400篇文献,鹏城实验室&中大深度解析具身智能
...zhou@jiqizhixin.com;zhaoyunfeng@jiqizhixin.com具身智能是实现通用人工智能的必经之路,其核心是通过智能体与数字空间和物理世界的交互来完成复杂任务。近年来,多模态大模型和机器人技术得到了长足发展,具身智能成为全球科技和...……更多
openai发布多语言大规模多任务语言理解
...从而弥补了这一差距。MMMLU数据集意义MMMLU的发布解决了人工智能界的几个相关挑战。它提供了一种更具多样性和文化包容性的方法来评估模型,确保它们在高资源和低资源语言中都能表现出色。MMMLU的多任务特性突破了现有基准...……更多
微软华人团队发布全新基准AGIEval,专为人类考试而生
...在有点小儿科了,有些任务的性能都甩了人类一截。通用人工智能(AGI)的一个重要特点是模型具有处理人类水平任务的泛化能力,而依赖于人工数据集的传统基准测试并不能准确表示人类的能力。最近,微软的研究人员发布了...……更多
从“智能涌现”到“超人类”,通往AGI巅峰的终极设想
...世界会多么接近他的科幻梦想。如今,我们生活在一个由人工智能(Artificial Intelligence, AI)渗透的世界里。AI系统在许多方面已超越阿西莫夫的想象——在家里,私人AI助手不仅可以帮你安排日程,还能根据你的心情推荐娱乐节...……更多
马斯克官宣Grok-2测试版!xAI将继续拥抱开源路线吗?
...颗重磅炸弹。当地时间8月11日晚,马斯克在X平台上透露人工智能模型Grok-2测试版将在不久后发布。事实上,马斯克在7月份就在X平台上确认,Grok-2将于8月发布,在回应用户关于训练数据的提问时,他表示该模型将在这方面做出...……更多
清华领衔发布多模态评估MultiTrust:GPT-4可信度有几何?
...衔的基础理论创新团队发起。长期以来,团队着眼于目前人工智能发展的瓶颈问题,探索原创性人工智能理论和关键技术,在智能算法的对抗安全理论和方法研究中处于国际领先水平,深入研究深度学习的对抗鲁棒性和数据利用...……更多
杭州日报讯 在科技的浪潮中,大模型人工智能(AI)的崛起,如同打开了潘多拉魔盒,释放出无限可能的同时,也带来了前所未有的挑战。从OpenAI的GPT系列到谷歌的BERT,再到国内的百度文心一言、阿里巴巴通义千问、腾讯混元...……更多
无一大模型及格! 北大/通研院提出超难基准,评估长文本理解生成
...能力这块,竟然没有一个大模型及格!北大联合北京通用人工智能研究院提出了一个新基准数据集:LooGLE,专门用于测试和评估大语言模型(LLMs)长上下文理解能力。该数据集既能够评估LLMs对长文本的处理和检索能力,又可以...……更多
MMMU华人团队更新Pro版!多模态基准升至史诗级难度:过滤纯文本问题、引入纯视觉问答
...MMMU)基准测试是一个综合性的数据集,能够评估多模态人工智能模型在需要特定学科知识和深思熟虑推理的大学水平任务上的表现。MMMU由来自大学考试、测验和教科书的1.15万个精心策划的多模态问题组成,涵盖了六个核心学科...……更多
开源大模型新的里程碑!Llama 3.1 模型准时发布
...源:网络斯坦福大学计算机科学系和电子工程系副教授、人工智能实验室主任吴恩达(AndrewNg)在社交媒体上称赞\"Meta和Llama团队对开源的巨大贡献\"。他表示:\"Llama3.1增加了上下文长度和改进了功能,是送给每个人的奇妙礼物...……更多
李彦宏称开源赶不上闭源?Meta发布最强开源模型,马斯克评价“还不错”
...不是与开源模型竞争,而是要超过所有人,打造最领先的人工智能。他提到,今年晚些时候发布的Llama 3-400B将在许多基准测试中领先,并已经在考虑Llama 4和5。英伟达高级科学家Jim Fan认为,Llama 3-400B以上的版本其将成为某种“分...……更多
神仙打架!谷歌新款大模型Gemini 和GPT-4谁能笑到最后?丨科技观察
封面新闻记者 马晓玉 边雪2022年底的人工智能的热潮是OpenAI的ChatGPT带来的,而2023年底,谷歌带着它的Gemini高调杀回人工智能圈。美国时间12月6日早间,谷歌发布了外界期待许久的大语言模型Gemini,在发布会现场,谷歌将Gemini的...……更多
传openai全球招外包大军手把手训练chatgpt取代码农
...」工作——创建大量的图像、音频片段等信息,用来训练人工智能工具或自动驾驶汽车。 另外的40%则是实打实的程序员,他们正在为OpenAI的模型「手搓」数据,从而让AI学习软件工程任务。此前,OpenAI一直是用从GitHub上抓取的...……更多
昆仑万维发布开源13B高质量商用大模型 领先Llama2和Baichuan2
...社区发展提供最佳技术支持,降低大模型商业门槛,推动人工智能技术落地千行百业,为人工智能生态建设添砖加瓦,携手开源社区探索未知世界、创造美好未来。两大模型 领先行业昆仑万维「天工」Skywork-13B系列包括两大模型...……更多
奥林匹克竞赛里选最聪明的AI:Claude-3.5-Sonnet vs. GPT-4o?
...zhou@jiqizhixin.com;zhaoyunfeng@jiqizhixin.com上海交通大学生成式人工智能实验室 (GAIR Lab) 的研究团队,主要研究方向是:大模型训练、对齐与评估。团队主页:https://plms.ai/AI技术日新月异,近来Anthropic公司最新发布……更多
突破数据墙!27岁华裔MIT辍学创业8年,年化收入逼近10亿
...一生中技术领域最根本的变革中在Droege看来,Scale解决了人工智能中最困难的挑战之一:通过数据改进模型。做到这一点需要卓越的人才、复杂的运营和对AI未来发展的强烈愿景。虽然团队迄今已经取得了瞩目成就,但仍处于起...……更多
北大推出全新机器人多模态大模型!面向通用和机器人场景的高效推理和操作
...大模型与具身智能研究,取得了一系列重要研究成果,在人工智能顶级期刊和会议上发表论文 80 余篇,谷歌引用 9700 余次。荣获世界人工智能顶会 AAAI 最佳论文奖,位列世界最大学术源代码仓库 Trending Research 第一位。为了赋予...……更多
全球第一!新华三服务器再破SPEC世界纪录
...日,国际标准性能评估组织SPEC正式公布最新一期CPU性能基准测试结果(截至2023年2月),紫光股份旗下新华三集团H3CUniServerR4900G6服务器在SPECCPU®2017测试中以174分的FloatingPoint最高分,刷新该项测试成绩世界纪录。这是继2022年打...……更多
苹果AI震撼上线iPhone,进化版Siri却没有ChatGPT!47页技术报告揭秘自研模型
...言搜索照片,制作影片为邮件、信息和语音邮件转录生成人工智能摘要此外,还有一些功能,苹果表示将在明年推出,包括ChatGPT集成、图像/Emoji生成、照片自动清理、具有屏幕感知的超强Siri。顺便提一句,目前,iOS18.1测试版(...……更多
Bengio团队提出多模态新基准,直指Claude 3.5和GPT-4o弱点
...;zhaoyunfeng@jiqizhixin.com本文作者张天宇,就读于加拿大Mila人工智能研究所,师从图灵奖得主Yoshua Bengio教授。博士期间的主要工作聚焦于多模态、GFlowNet、多智能体强化学习、AI于气候变化的应用。目前已在ICML、ICLR、ICASSP等机器...……更多
OpenAI o1 模型 PlanBench 规划能力实测:准确率 97.8%
...限性。PlanBench 基准简介PlanBench 开发于 2022 年,用于评估人工智能系统的规划能力,包括 600 个来自 Blocksworld 领域的任务,其中积木必须按照特定顺序堆叠。OpenAI o1 模型成绩在 Blocksworld 任务中,OpenAI 的 o1 模型准确率……更多
12月7日消息,美国当地时间周三,谷歌发布了其新一代人工智能模型Gemini。Gemini反映了谷歌内部多年来在首席执行官桑达尔·皮查伊(Sundar Pichai)的监督和推动下所做的努力。此前负责Chrome和安卓业务的皮查伊是出了名的产品...……更多
马斯克 xAI 推出 Grok-1.5 大语言模型
3 月 29 日消息,马斯克旗下人工智能公司 xAI 今天在官方博客中宣布,正式推出 Grok-1.5 大语言模型。Grok-1.5 具有改进的推理能力和 128k 的上下文长度,其中最显著的改进之一是其在编码和数学相关任务中的表现。Grok-1.5 将在未...……更多
更多关于科技的资讯:
淘宝天猫接入京东物流,预计于10月中旬上线
9月26日,根据晚点LatePost报道,国内两大电商巨头阿里巴巴和京东集团将相互开放。据报道,阿里巴巴旗下的淘宝天猫即将正式接入京东物流
2024-09-26 18:55:00
骁龙8gen4新名字曝光
9月26日,博主@数码闲聊站发了“SnapdragonElite”的内容,暗示下一代骁龙旗舰芯片不叫骁龙8Gen4,而是叫骁龙8Elite
2024-09-26 18:56:00
追觅X50系列全球首创仿生机械足,真正意义上的全屋清洁全覆盖
近几年,智能家居产品发展火热,如果问其中什么产品能显著提升生活品质,那么扫地机器人一定榜上有名。其凭借操作便利性,让消费者能够从日常的家务中抽离出来
2024-09-26 18:59:00
oppofindx8正面造型曝光,预计将于10月正式发布
9月26日,OPPOFind系列产品负责人周意保发微博放出了OPPOFindX8的正面造型,可以看到,该机采用超窄的物理四等边屏幕
2024-09-26 19:00:00
三星折叠屏手机即将来临,为何迟迟不发布?
最近,随着三折叠手机正式亮相消费者市场,折叠屏手机再一次地站在了聚光灯的正中央,引起了广大消费者的热议。实际上,在折叠屏手机技术发展的早期
2024-09-26 19:01:00
安兔兔发现天玑9400处理器oppo新机跑分数据
近日,安兔兔在后台发现了一款搭载天玑9400处理器的OPPO新机,型号为PKC130,这款手机很可能是即将发布的FindX8系列的一员
2024-09-26 19:02:00
荣耀x60将于10月发布,电池比x50升级明显
此前,荣耀终端有限公司中国区CMO姜海荣透露,荣耀X60将于10月发布。而近日,又有消息人士透露:“耀子节后回来先发X60新品
2024-09-26 19:03:00
8月份中国豪华品牌销量top10榜单出炉
近日,CNMO注意到,有汽车博主发布了一份8月份中国市场豪华品牌销量TOP10榜单,揭示了当前豪华车市场的竞争格局。作为豪华车市场的领头羊
2024-09-26 19:04:00
雷军宣布:小米汽车将参加2024天津国际汽车展
9月26日,小米创办人,董事长兼CEO雷军宣布,小米汽车将参加2024天津国际汽车展,时间是9月29日至10月5日,地点是国家会展中心(天津)二期
2024-09-26 19:04:00
vivo下一代折叠屏vivoxfold4正在筹备中
今年4月,vivo在国内发布了vivoXFold3和XFold3Pro,这两款机型分别搭载了高通骁龙8Gen2和骁龙8Gen3
2024-09-26 19:05:00
insta360ace2pro详细规格参数曝光
继两款网络摄像头的成功发布,Insta360正积极筹备推出其新一代Ace2Pro运动相机。9月26日,CNMO根据外媒报道得知
2024-09-26 19:06:00
小鹏p7+价格曝光或23万元左右
P7系列是小鹏旗下的人气车型,随着其他新势力陆续推出类似产品,其市场表现也不再像以前那样出色。不过,据CNMO了解,小鹏想通过P7+这款新车来扳回一城
2024-09-26 19:07:00
oppok12plus将推出续航强劲的“小钢炮”
9月26日,CNMO了解到,据知名爆料人士“数码闲聊站”透露,OPPO将在旗舰大战前夕推出一款续航强劲的“小钢炮”——OPPOK12Plus
2024-09-26 19:08:00
一加13将配备超声波指纹解锁技术、IP69级防尘防水
9月26日,CNMO注意到,有消息人士透露,一加即将推出的新款旗舰机型一加13将配备与iPhone16ProMax相同标准的四重反射潜望长焦镜头
2024-09-26 19:09:00
pocom7pro5g新机曝光:支持wifi和nfc
据外媒报道,POCOM7Pro5G新机近日出现在IMDA认证网站上,型号为2409FPCC4G。数据库显示,这款5G新机将支持蓝牙
2024-09-26 19:11:00