• 我的订阅
  • 头条热搜
ChatGPT o1满血版上线!实测中它竟然败给了国产AI?
...请来了两位国产AI友情参赛(kimi和文心一言)。o1满血版实测体验并非「无敌」o1模型的强项在于数学等方面的高级推理,那么就先从擅长的地方开始,一道并不算困难的数学计算题:假设一个公司生产某种商品,生产成本与产...……更多
9.11和9.9哪个大?实测12个大模型8个都答错,ChatGPT也翻车了
一道小学生难度的数学题难倒了一众海内外AI大模型。9.11和9.9哪个更大?就此问题,第一财经记者测试了12个大模型,其中阿里通义千问、百度文心一言、Minimax和腾讯元宝答对,但ChatGPT-4o、字节豆包、月之暗面kimi、智谱清言、...……更多
文心一言“点评”李彦宏发布会紧张原因:对AI掌握不充分,担心被误解作秀
...计算能力、推理能力等方面为大家带来文心一言的深度真实测评!中文理解能力1.“今朝牙里相,老重光,老地方,吾请侬切饭哦”,这句话是哪个地方方言,什么意思?文心一言回答:总结:文心一言对于中文地方方言无法识...……更多
搜狐科技“实测”中外两款大模型:GPT-4写藏头诗失败,文心一言更懂中文?
...结果就已出现,更像是提前录制好的“DEMO”,而非现场实测。“不能说我们完全ready了,文心一言对标ChatGPT、甚至是对标GPT-4,门槛是很高的,全球大厂还没有一个做出来的,百度是第一个。”发布会上,李彦宏坦言,自己测试...……更多
大模型“翻车”小学题?
...和13.8谁大?9家大模型,3家已翻车7月16日下午,南都记者实测阿里通义千问、百度文心一言、智谱清言、腾讯元宝、科大讯飞星火、字节跳动豆包、学而思九章大模型、面壁智能Luca、月之暗面Kimi等9家国产大模型。当南都记者输...……更多
文心一言发布百度市值蒸发200亿,外界称缺乏亮点,应用前景难超ChatGPT
...发布仅仅是一小步,更大的挑战还在后面。具备多模态,实测后或将暴露更多问题在发布会现场,李彦宏通过提前录制的视频演示了文心一言在文学创作、商业文案创作、数理推算、中文理解、多模态生成等五个方面的能力。从...……更多
推理性能直逼o1,DeepSeek再次出手,重点:即将开源
...波,不知道大家如何顶住。耐心等待的时间里,我们先来实测一下。一手实测体验与 OpenAI o1 相同的是,根据问题的复杂程度,它也需要「思考」数十秒后再回答。虽然有些过程中的思路在人类看来可能毫无意义,甚至是错误的...……更多
Kimi爆火背后:访问量仅次于文心一言和阿里通义,国内外大模型都在卷上下文
...tman)接受莱克斯·弗里德曼(Lex Friedman)采访的万字长文实测,输入文章网址,并要求整理出文章核心观点和所在原文,支持20万长度的Kimi基本能理解指令要求,并就话题和观点、原文,在不到十多秒内就进行了输出。就此实测...……更多
百度文心一言发布会详细纪要
...过去的十几年当中,一直在AI的研发上坚持投入。文心大模型第一个版本2019年就发布了,此后每年都要发布一个新版本。所以从这个意义上说,文心一言的发布只是我们过去多年努力的自然延续。但毕竟今天的文心一言,是要对...……更多
国产大模型首发中文逻辑推理,「天工大模型4.0」o1版来了
...然,Skywork o1 的成色如何,我们还是得看实战效果。一手实测这次 Skywork o1 彻底拿捏住了推理机器之心提前拿到了测试资格,对 Skywork o1 系列模型,尤其是 Lite 和 Preview 版本的推理能力进行了全方位的考察。下图为 Skywork o1 Lite ...……更多
智源评测体系发布 国内外“百模”评估结果出炉
...。在多模态理解图文问答任务上,开闭源模型平分秋色,国产模型表现突出。国产多模态模型在中文语境下的文生图能力与国际一流水平差距较小。多模态模型的文生视频能力上,对比各家公布的演示视频长度和质量,Sora有明...……更多
跟文心一言讨论庄周梦蝶,它让我拥抱美好世界
...作能力,更能凸显文心一言的语言处理能力。文心一言大模型的训练数据包括万亿级网页数据,数十亿搜索数据和图片数据,以及百亿级语音日均调用数据,在5500亿事实的知识图谱的训练下,文心一言能够实现“读万卷书”的...……更多
全球都在搞AI,为什么是百度挣到钱?
...际产生价值”将成为所有人无法回避的难题。对此,作为国产大模型代表的百度,正在给出自己的答案。2月28日,百度2023年第四季度及全年财报正式发布。不仅业绩数据亮眼,在同日举行的业绩报告会上,百度创始人、董事长...……更多
三个大模型组队挑战o1,实测360多模型协作干掉提示词工程
OpenAI o1的横空出世,开启了大模型演化的新范式——Inference law(推理定律)。正如英伟达AI科学家Jim Fan所说,o1的出现标志着大模型研发者开始把集中在训练阶段的投入,开始转移到了推理过程。Jim还引用了机器学习先驱Rich Sut...……更多
...16、Mac系统和ios18提供AI功能。苹果曾与阿里以及另外一家国产大模型公司进行过洽谈,最后确定由百度提供这项服务。受此影响,昨日百度港股直线拉升,午盘大涨6.42%,截至收盘涨幅回落至2.8%。而A股市场的大模型概念股则全...……更多
...搜”所说那样完全不及格,讯飞星火、阿里巴巴Qwen2-72b等国产大模型在高考数学客观题中具有较高的准确率,令人眼前一亮。当然,LLMEVAL团队在评测后也指出,大模型在数学推理任务中的鲁棒性与准确性仍有很大的提升空间。...……更多
百度与优必选合作,人形机器人“大脑”有了AI大模型
...实现难度,在全球范围内属于行业第一梯队水平。百度是国产大模型领导者,其研制的文心产业级知识增强大模型,具备跨模态、跨语言的深度语义理解与生成能力。在近日弗若斯特沙利文发布的《2024年中国大模型能力评测》...……更多
大模型应用疯狂加速,洗牌却在静悄悄进行了
...讯飞就与华为共同发布星火一体机,让所有企业都可以在国产自主创新平台上私有化部署大模型。一来,星火一体机基于星火认知大模型,针对污语料和幻觉问题,形成了“立体化”的内容安全机制。二来,星火一体机基于昇腾...……更多
“整活”保险业务,AI大模型哪家强?
一款款AI大模型横空出世,各行各业都在尝试下棋落子,保险业也不例外。号称神通广大的AI大模型能否完美“适配”保险行业?10月10日发布的《人工智能大模型保险行业应用评测报告》(以下简称《报告》)便揭晓了答案。根...……更多
李彦宏:百度AI构架有优势,性能较低的国产芯片仍可高效运作!
...司能有效地进行模型训练和推理,即使是使用性能较低的国产芯片仍能维持高效率。资料显示,虽然百度之前主要依赖于英伟达的AI芯片,但是百度也有自己的自研的XPU架构的AI芯片——昆仑芯,2021年7nm的昆仑2代芯片就已经量产...……更多
倒计时10天!百度世界2023五大亮点全剧透
...月发布以来,文心一言在一个月内即完成四次升级,让大模型的推理成本降低至原来的十分之一;文心大模型升级至3.5版本后,训练速度提升到原来的3倍,推理速度达到原本的30多倍。它是否还能更进一步,追超GPT-4,在生活生...……更多
顶流大模型应用!天工AI不炫技,实测真正的生产力工具
近日,OpenAI宣布,为了维护服务质量和安全性,7月9日起将采取额外措施来限制来自当前不支持的国家和地区的API流量,其中就包括中国。这意味着国内大量“套壳”大模型将无法使用,而自研大模型凸显价值。这无疑给国内的...……更多
李彦宏发布文心大模型4.0工具版,推理成本降到1%
...彦宏在Create2024百度AI开发者大会上,正式宣布发布文心大模型4.0的工具版。李彦宏表示,相比一年前,文心大模型的算法训练效率提升到了原来的5.1倍,周均训练有效率达到98.8%,推理性能提升了105倍,推理的成本降到了原来的1...……更多
体验报告来了!记者亲测百度“文心一言”
...顺地问答完整。随后,我们又问了关于国内涉足预训练大模型的公司有哪些?文心一言回答得也较为全面。记者尝试了一个需要涉及信息搜索的问题。特斯拉在国内过去五个月、过去一年的销量是多少?文心一言的答案是:而记...……更多
国产大模型加速落地,争夺“中国版ChatGPT”心智定位
...主要角色介绍、情节分析、影响等角度列出概述大纲。在实测过程中,一篇169页的全英文财报,万知小程序可在3秒内对内容重点进行提炼,对财报中的财务数据进行解读,并按照财报叙述逻辑总结重点。除此之外,万知还可以...……更多
11项指标击败GPT-4o!360攒局让16家大模型联手作战
终于,国产大模型能在综合能力上也能与GPT-4o一决雌雄了。在12项指标的测试中,这个模型有11项都超过了GPT-4o,综合能力则高出了10个百分点。而且在诗词赏析等中文特色领域优势更加明显,“最难中文Benchmark”弱智吧也有重...……更多
文心大模型赋能千行百业,自主进化
...出世,各行各业的生产力似乎都将被AI大模型再次点燃。国产大模型的数量快速增长,截至10月,国内已发布238个大模型。尽管围绕AI大模型技术变革之力的讨论层出不穷,但行至今日,AI大模型技术的发展重点已然在于“如何赋...……更多
OpenAI发布最新技术研究,AI“黑盒”不再是难题!
...随着ChatGPT在法律、金融、营销等领域的广泛使用,确保模型的安全、准确输出同时被很好理解变得非常重要。但由于神经网络的复杂和多变性,我们根本无法验证其生成内容的准确性,这也就会出现输出“黑盒”的情况。为了...……更多
生成式AI慢人一步的苹果,选择与百度合作,是正确的选择吗?
...不是苹果第一次“落后”,比如充电功率过低、拍照不如国产旗舰机,标准版高刷的缺失等等,这几年在很卷的国产手机面前,苹果好像就剩下了一个“生态”的优势。苹果的落后不止一次,但这次不同。2023年以ChatGPT为代表的A...……更多
文心大模型4.0 Turbo来了!百度推出文心快码2.5,已覆盖内部80%程序员
...度在WAVE SUMMIT深度学习开发者大会2024上,正式发布文心大模型4.0 Turbo版本,其同步上线网页端和API接口,App端也将陆续上线。▲文心大模型4.0 Turbo API开放同时,飞桨平台发布新一代飞桨框架3.0 Beta版本,具备大模型训推一体、动...……更多
更多关于科技的资讯:
你借的共享充电宝那么贵 它们公司却穷得快退市了
不断涨价,业绩却越做越差,共享充电宝品牌怪兽充电无奈选择了私有化退市。1 月 6 日,怪兽充电宣布收到来自信宸资本( 中信集团旗下 )和公司管理层联合发出的私有化要约
2025-01-11 15:21:00
甲流高发 医生提醒:奥司他韦不能乱吃!
近期,甲型流感(简称甲流)的发病率有所上升。奥司他韦作为一种常用的抗流感药物,在预防和治疗甲流方面发挥着重要作用。然而
2025-01-11 15:51:00
群晖备份一体机发布:开箱即用 一机即可实现多种备份
快科技1月11日消息,中小企业在业务发展过程中,随着数据量增加和备份设备增多,面临成本增长和运维效率降低的挑战。对此,群晖推出了备份一体机DP7400
2025-01-11 16:21:00
春节新风尚!百果园济南区苏绣春节礼盒发布会,传递健康年味
临近春节,年味渐浓,百果园济南区2025 年春节系列礼盒发布会圆满落幕。发布会上,百果园×非遗苏绣传承人卢建英春节联名系列礼盒惊艳亮相
2025-01-11 16:30:00
华为解决5G最大弊端:不怕演唱会没信号了
快科技1月11日消息,随着5G深入建设,大型体育场馆和演唱会等高容量场景面临覆盖范围和上下行容量的挑战。近日,浙江电信携手华为在宁波完成了FDD Massive MIMO的创新商用测试
2025-01-11 16:51:00
索尼本田联手造了台66万的车 卖这么贵你就给我这个
快到年边了,没想到这位日本新势力抢在年前,给我们拉了坨大的。这次 CES ( 国际消费类电子产品展览会 )上,索尼本田又带着它的 AFEELA 来秀存在了
2025-01-11 16:51:00
搞这么厉害怎么不早点告诉我,ces上极氪展台都挤爆了
有幸围观了一下,不看不知道,极氪展台这是要晋升车界的甜甜圈吗,每个人都想来尝一尝看一看,这么多人,还有外国友人来凑热闹
2025-01-11 17:17:00
奢侈品牌大变动!据称普拉达正在考虑收购范思哲
据媒体周五(1月10日)报道,全球时尚奢侈品集团Capri Holdings计划出售旗下的范思哲(Versace),普拉达(Prada)正在考虑收购
2025-01-11 17:21:00
开门红!2025年电影总票房破10亿
快科技1月11日消息,根据灯塔专业版的数据,截至1月11日14时47分,今年的总票房(含预售)已经突破10亿元大关。其中
2025-01-11 17:21:00
本文转自:人民网-科普中国量子计算机,这一曾被视为科幻的技术奇迹,如今正逐步从理论走向现实,并在不断迭代中展现其颠覆性的计算潜力。
2025-01-11 17:25:00
全球首款骁龙8至尊版折叠屏!OPPO Find N5下周官宣:产品足够惊艳
快科技1月11日消息,今天,OPPO周意保预告,OPPO Find N5会在下周公布发布时间。周意保与网友互动时表示,OPPO Find N5足够惊艳
2025-01-11 17:51:00
辽宁移动旗舰店·沈阳十一纬路店:焕新绽放,重启极致用户体验
本文转自:人民网-辽宁频道近日,辽宁移动旗舰店·沈阳十一纬路店(以下简称“十一纬路旗舰店”)完成了全面的升级改造,以新型智慧营业厅的形象惊艳亮相
2025-01-11 18:18:00
当然有的,主要是以下三个渠道,大家可以根据自己的需要来选择。一、查询中标公告的官方渠道:①政府采购网站:中国政府采购网及其省级和市级分支是最权威的信息来源
2025-01-11 18:18:00
点击查看视频星品入驻,全球共享。旅游零售市场是国产品牌向世界展现东方风土、中国味道的绝佳窗口。本期《每周探店》来到了cdf海口国际免税城——这里正在举行长城五星G家族入驻中免集团的首发仪式
2025-01-11 18:41:00
蚂蚁集团完成收购好大夫:帮8亿用户找到28万好医生
快科技1月11日消息,在今天举办的2025年度好大夫峰会现场,蚂蚁集团和好大夫在线完成收购后首度同台亮相。双方共同宣布
2025-01-11 18:51:00