• 我的订阅
  • 头条热搜
起猛了,GPT-4o被谷歌新模型击败,ChatGPT官号:大家深吸一口气
起猛了,GPT-4o被谷歌新模型超越了!历时一周,超1,2000人匿名投票,Gemini 1.5 Pro(0801)代表谷歌首次夺得lmsys竞技场第一。(中文任务也第一)而且这次还是双冠王,除了总榜(唯一分数上1300),在视觉排行榜上也是第一。Gemin...……更多
DeepSeek的一次小更新 堪比发布新模型
...名第一的非推理模型 ” 。让 V3-0324 生成一个网页,模型一口气写了 800 多行代码,运行的时候还没有出错,这什么实力不用多说了吧。在评论区底下,有人仅仅下达了编写登录页面的简单指令,并没有任何其他的附加提示,同...……更多
逆水寒“ai竞技场”将于11月22日正式上线
...日,国风MMO手游逆水寒宣布将在其2.2.2新版本中上线“AI竞技场”功能,这一创新举措旨在通过游戏平台,汇聚广大玩家力量,对当下热门的AI大模型进行客观评估。据悉,逆水寒“AI竞技场”将邀请国内多家知名AI厂商参与,包...……更多
openaigpt-4o登顶竞技场排行榜
...工WilliamFedus周一在社交平台X证实,近期在LMSYS聊天机器人竞技场(ChatbotArena)上表现优异的神秘聊天机器人“gpt-chatbot”,正是他们刚刚发布的全新人工智能模型GPT-4o。Fedus还透露,GPT-4o在测试中登顶了竞技场排行榜,取得了有史以...……更多
国产大模型竞技场首超GPT-4o!零一万物GLM共同跻身Top10
...式对外发布新旗舰模型——Yi-Lightning(闪电)。在大模型竞技场(Chatbot Arena)上,Yi-Lightning性能直冲总榜单并列第6,数学分榜并列第3,代码等其它分榜也名列前茅。总成绩几乎与马斯克最新xAI大模型Grok-2-08-13持平,超越GPT-4o-20...……更多
...海人工智能实验室联合魔搭社区推出中国大语言模型评测竞技场Compass Arena,首度集齐国内主流大模型全阵容,阿里通义千问、百度文心一言、腾讯混元、字节跳动豆包、书生·浦语等20款国产大模型出战,角逐中国大模型“最强...……更多
GPT-4o mini登顶大模型竞技场,奥特曼:两个月内微调免费
...刚,GPT-4o mini版迎来“高光时刻”——登顶了lmsys大模型竞技场,和满血版并列第一,还把Claude 3.5甩在了身后。不同于一般的数据集测评,大模型竞技场是用户自己出题、用脚投票的结果,无法通过“刷题”来走捷径,因此更为...……更多
奥特曼晒“草莓”引热议 神秘新模型现身竞技场 网友第一波实测来了
...新模型,真的藏不住了!先是有匿名聊天机器人现身lmsys竞技场,声称自己是GPT-4系列模型一部分,吊足了大家的胃口。随后奥特曼又发了一个浮想联翩的推文,正是他花园里的草莓照片,并配文:i love summer in the garden。上个月Op...……更多
GPT-4omini为啥登顶竞技场?OpenAI刷分秘诀被扒,奥特曼早有暗示
为啥GPT-4o mini能登顶大模型竞技场??原来是OpenAI会刷分呀。这两天,lmsys竞技场公布了一份充满争议的榜单。其中才面世不久的GPT-4o mini和满血版并列第一,把Claude 3.5 Sonnet甩在身后。结果网友炸锅了,大家凭体感觉得这不可能...……更多
阿里Qwen3登顶全球最强开源模型,用8款模型夺回中国AI话语权
出品 | 搜狐科技作者 | 梁昌均编辑 | 杨锦一口气开源8款模型,阿里通义又上新!4月29日一大早,阿里开源发布Qwen3,包括两款MoE(混合专家架构)模型,其中具备2350亿参数规模的Qwen3-235B-A22B,在对比测试中成为目前最强大的开...……更多
多模态竞技场对标90B Llama 3.2!Pixtral 12B技术报告全公开
【新智元导读】以开源极客之姿杀入江湖的Mistral AI,在9月份甩出了自家的首款多模态大模型Pixtral 12B,如今,报告之期已至,技术细节全公开。作为欧洲的OpenAI,Mistral最近压力不小。端侧小模型端不出来,对比评测的结果又遭...……更多
OpenAI 再成“榜一大哥”:o1-preview AI 模型驾驭数学等任务
... Decoder 昨日(9 月 19 日)发布博文,报道称在聊天机器人竞技场(Chatbot Arena)上,OpenAI 的新人工智能模型 o1-preview 和 o1-mini 问鼎榜首。聊天机器人竞技场简介聊天机器人竞技场是一个比较人工智能模型的平台,它利用 6000 多个...……更多
神秘模型“小熊猫”一夜刷屏:排名超Flux、Midjourney
...”(小熊猫)的神秘文生图模型狠狠火了!!登顶文生图竞技场,直接将Flux、Midjourney等一众顶尖模型踩在脚下——其ELO得分比Flux 1.1 Pro高出100多,胜率高达79%,每7秒就能生成一张图像。生成效果be like:啥概念呢?按网友的话...……更多
腾讯混元首次上榜Chatbot Arena排名:跻身全球Top 15
...,腾讯官方发文宣布,腾讯混元首次上榜海外权威大模型竞技场 Chatbot Arena最新排名,跻身全球 Top 15。Chatbot Arena 发起方 LMSYS Org (加州大学伯克利分校等机构支持的非营利组织)通过官方X账号对腾讯混元的加入表示欢迎。跟其...……更多
...数智时代未来图景。从技术“秀场”中走出,迈向产业“竞技场”。本届创新大赛获奖的731个团队中有不少已经进入商业化落地阶段。研而优则实战,创而优则“变现”,数字创新打破学科边界、理论藩篱后,又用市场选择和人...……更多
奥林匹克竞赛里选最聪明的AI:Claude-3.5-Sonnet vs. GPT-4o?
...人工智能实验室(GAIR Lab)推出的OlympicArena[1] (奥林匹克竞技场)满足了这个需求。奥林匹克学科竞赛不仅是对人类(碳基智能)思维敏捷性、知识掌握和逻辑推理的极限挑战,更是AI(“硅基智能”)锻炼的绝佳练兵场,是衡...……更多
开源版OpenAI再出「神作」,小模型吊打Llama 3!Ministral系列问世,边缘AI革命开启
...及前辈模型Mistral 7B。而且Ministral 3B和Ministral 8B在大模型竞技场中的测试,均拿下了媲美Gemma 2、Llama 3.1开源模型的成绩。 世界上最好的边缘模型Ministral 3B和Ministral 8B都支持高达128k上下文(目前在vLLM上为32……更多
腾讯混元一口气开源5个3D生成模型:最快30秒生成!
快科技3月19日消息,腾讯最新公告,一口气开源5个3D生成模型,通过腾讯混元3D官网即可体验。据介绍,这5个开源模型均基于Hunyuan3D-2.0打造:Turbo系列模型:在保证高精度和高质量的基础上,对几何生成模型进行了数十倍的加...……更多
全国技能大赛:不仅是竞技场还是“风向标”
...专业发展建设 提升人才培养标准全国技能大赛:不仅是竞技场还是“风向标”第二届职业技能大赛选手正在进行木工项目比赛。新华社记者 赵子硕摄◎本报记者 孙明源 陈 曦第二届全国技能大赛近日在天津闭幕。与首届大赛相...……更多
三个大模型组队挑战o1,实测360多模型协作干掉提示词工程
...务的版本。还是在360AI浏览器中,AI助手还上线了“模型竞技场”(bot.360.com),支持54款大模型产品的“同台竞技”,最新版本中还上线了“组队较量”、“匿名比拼”、“随机对战”等功能。总的来说,360AI搜索还是360AI浏览器...……更多
...,360 通过 CoE 技术架构,构建了大模型竞技平台——模型竞技场(bot.360.com),目前已经入驻360AI浏览器,成为国内大模型领域的基础设施。在多模型协作模式下,用户可以从 16 家国内主流大模型厂商的 54 款大模型中任意选择 3 款...……更多
大厂加码落地大模型,京东云一口气发了10个AI应用
...nchmark。" 京东云新发布的AI应用,图片由公司提供为什么一口气发这么多AI产品,京东云言犀相关人士的回答是:"电商需要的是一整套的系统的AI应用,而不是某一款提供单点功能的产品。需要从闭环的电商运营效果出发来设计A...……更多
苹果开源7B模型,训练过程数据集一口气全给了,网友:很不像苹果
苹果最新杀入开源大模型战场,而且比其他公司更开放。推出7B模型,不仅效果与Llama 3 8B相当,而且一次性开源了全部训练过程和资源。要知道,不久前Nature杂志编辑Elizabeth Gibney还撰文批评:许多声称开源的AI模型,实际上在...……更多
字节版Sora终于来了!一口气两款视频模型,带来的震撼不只一点点
...字节跳动旗下的火山引擎在深圳办了一场 AI 创新巡展,一口气发布了两款视频生成大模型,正式宣告进军 AI 视频生成。这两款模型,一个名为 PixelDance(以下简称 P 模型),一个名为 Seaweed(以下简称 S 模型),不仅在审美、动...……更多
天下手游哪个职业适合平民 天下手游六大职业心得推荐
...,全体加点一个字就是用天机玩法要注意控制衔接,不能一口气连续放控制技能,要有一个衔接,这是手感和意识的问题。还有不要无脑冲,可进可退。魍魉战场套很强,但是属性要洗完美,主要洗会心和穿透,还有力必须要有...……更多
谷歌开源最强端侧小模型:2B参数越级跑赢GPT-3.5-Turbo
...2 模型系列,并且自亮相以来,27B 版本迅速成为了大模型竞技场 LMSYS Chatbot Arena 中排名最高的开放模型之一,在真实对话任务中比其两倍规模以上的模型表现还要好。如今,仅仅过去了一个多月,谷歌在追求负责任 AI 的基础上...……更多
新版Llama 3 70B反超405B!Meta开卷后训练,谷歌马斯克都来抢镜
...谷歌的Gemini也上线了新的实验版模型,再一次登上大模型竞技场榜首。有网友感叹,o1、Llama 3.3和新版Gemini接连发布,马斯克的Grok3也要来,还有GPT-4.5初露端倪……这简直是最棒的一个圣诞季。Llama 3.3:70B实现405B效果Llama 3.3目前...……更多
Meta AI首席科学家杨立昆谈DeepSeek:不是中国AI超越美国 而是开源模型超越专有模型
...风格控制类模型(StyleCtrl)分类中与OpenAI o1并列第一,其竞技场得分达到1357分,略超OpenAI o1的1352分。DeepSeek-R1的发布极大震动了美国科技界,不仅因其性能上比肩OpenAI o1,且完全开源,还以极低的成本实现了这一突破。【本文...……更多
国产模型指令跟随全球第一!来自LeCun亲推的最难作弊LLM新榜单
...而且它登上的这个排行榜LiveBench,虽然现在还没有大模型竞技场(LMSYS Chatboat Arena)那么广为人知,但资格杠杠的——图灵奖得主、Meta首席AI科学家杨立昆(Yann LeCun),联合纽约大学等在今年6月推出。号称是“全球首个无法作...……更多
OpenAI空降视频生成模型:一口气生成60s,风格画质尺寸灵活定制 | 最前线
文 | 周鑫雨编辑 | 苏建勋2023年4月,成立于纽约的Runway AI发布了一段用AI生成的视频:模糊卡顿、物体扭曲,且仅4秒;四个月后,Runway将文生视频的视频效果拉到了4K的超逼着高度,实现了镜头的连贯稳定。而视频的最大长度也...……更多
更多关于科技的资讯:
8月1日,一家名为“三五而栗”的店铺正式开业,这家宣称“只招35+员工”的企业在引发社会广泛关注后,最终承诺未来保持35岁以上员工比例不低于70%
2025-08-04 11:19:00
据海关总署初步测算,上半年,中国跨境电商进出口约1.32万亿元,同比增长5.7%。其中,出口约1.03万亿元,同比增长4
2025-08-04 11:25:00
当前,新一轮科技革命方兴未艾,通用人工智能、新能源、大数据等前沿技术正深刻改变着工业生产全流程,为各领域、各产业探索新场景
2025-08-04 11:45:00
产业链上的山东好品牌 | 阳信县:小县城崛起针状焦产业“大巨人”
大众网记者 黄新宇 通讯员 陈瑞 朱超峰 滨州报道在山东北部,一座曾以农业为主的县城——阳信县,正以“针尖”之力撬动全国炭素新材料市场
2025-08-04 11:52:00
aigo爱国者精彩亮相2025政法展,以科技赋能推动智慧法治新进程
2025年7月25日,为期两天的2025政法智能化建设技术装备及成果展在北京国家会议中心圆满落幕。作为政法领域极具影响力的年度专业盛会
2025-08-04 11:57:00
大众网记者 郑健 潍坊报道在新科技革命迅猛发展、创新浪潮不断涌现的今天,企业想要求生存、求发展,唯有突破技术壁垒与专利封锁
2025-08-04 12:38:00
权威专家团免费在线问诊,“未来医生”正式上线
2025年8月2日,医联集团正式推出 “未来医生”权威专家在线问诊免费医疗服务。让专家问诊,从“难约”到“免费”在“未来医生”
2025-08-04 13:02:00
喜茶携手大热IP《CHIIKAWA》,带来夏日限定治愈体验
近日,喜茶官宣了与大热IP《CHIIKAWA》的联名合作,引发广泛关注。这是喜茶2025年来首个联动项目,也是近年来走红的《CHIIKAWA》的首个中国大陆茶饮品牌合作
2025-08-04 13:03:00
今年盛夏,全国高温持续,多地气温屡破历史极值,空调市场销售火爆。据权威机构GfK中怡康监测数据显示,空调行业线上销售额同比飙升50%
2025-08-04 13:31:00
大学生机器人大赛上演“比舞”大会 前八名将登陆“冰丝带”参加世界人形机器人运动会外围赛
机器人盛装出场 摄影/本报记者 宋霞近日,2025年华北五省(市、自治区)大学生机器人大赛舞蹈专项赛在北京信息科技大学举行
2025-08-04 13:58:00
搜狐Q2总收入1.26亿美元 净亏损同比收窄超40%
2025年8月4日,搜狐公司公布2025年第二季度财务报告。搜狐第二季度总收入为1.26亿美元,净亏损净亏损同比收窄超40%
2025-08-04 13:58:00
在2025年的按摩椅推荐榜单中,艾力斯特凭借其创新科技和卓越体验,稳居按摩椅品牌排名前列。今天,我们重点推荐三款艾力斯特旗舰机型——M6超凡大师
2025-08-04 13:02:00
大辰学员上岸分享,从失业焦虑到低空行业新星,95后女孩的3个月破局之路
01 | 失业回老家,刷到“人生转折点”2023年12月,dangdang拖着行李箱回到老家。此前,她在北京某互联网公司做前端开发
2025-08-04 13:02:00
今夏遛娃天花板!奈尔宝x抖音心动大牌日打造沉浸式\
暑期遛娃何处去?奈尔宝打破“游乐场”刻板印象,用互动带教课堂+职业角色扮演解锁成长新体验!借势抖音“心动大牌日”,打造线上线下联动的玩+学盛宴
2025-08-04 13:02:00
理想汽车回应理想i8与乘龙卡车安全性碰撞测试
8月3日晚间,理想汽车官方微博发布《关于理想i8安全性碰撞测试的说明》,全文如下:理想i8碰撞安全性测试视频发布后,引起了社会各界的关注与讨论
2025-08-04 10:36:00