• 我的订阅
  • 头条热搜
苹果发布 OpenELM,基于开源训练和推理框架的高效语言模型
...,苹果在 Hugging Face 平台上发布了一个“具有开源训练和推理框架的高效语言模型”,名为 OpenELM。当然,这是一项开源语言模型,其源码及预训练的模型权重和训练配方可在苹果 Github 库中获取。IT之家将官方简介翻译如下:参...……更多
百川智能发布baichuan3稳定语言模型
...处理和代码生成领域的强大实力。不仅如此,其在对逻辑推理能力及专业性要求极高的MCMLE、MedExam、CMExam等权威医疗评测上的中文效果同样超过了GPT-4,是中文医疗任务表现最佳的大模型。Baichuan3还突破“迭代式强化学习”技术...……更多
...AI)系统在编码、战略规划和机器人科学三个领域执行复杂推理任务。聊天生成预训练转换器(ChatGPT)和“克劳德3-奥普斯”(Claude 3 Opus)等大语言模型(LLM),根据人类输入“提示词”处理和生成文本。研究人员说,过去18个月,这些技...……更多
苹果的封闭生态为大模型打开!发布开源多模态大模型、每天为 AI 烧百万美元,零碎的 Android 生态打得过吗?
...布了两篇新的研究论文,介绍了 3D 头像和高效语言模型推理的新技术,被认为可能带来更身临其境的视觉体验,并允许复杂的人工智能系统在 iPhone 和 iPad 等消费设备上运行。 AI 社区中的许多人后来才注意到 Ferret 的发布,他...……更多
苹果大模型,不藏了
...存中的大型语言模型:在有限内存下高效的大型语言模型推理》的论文,直指大模型落地iPhone等“内存有限”设备的方法。进入新年,Siri助手将搭载生成式模型Ajax的消息,再次不胫而走。去年六月和九月的两次重要发布会,苹...……更多
百度文心一言发布会详细纪要
...话体现出文心一言各方面的能力,比如总结分析的能力、推理的能力。事实性的东西对于一个搜索引擎来说不是那么难,但是对于一个生成式预训练大模型来说,出错的概率还是挺高的,这些问题都答对相当不容易,因为百度的...……更多
本周硅谷发生了什么?|苹果Vision Pro正式开售;Neuralink完成人类脑机接口植入;字节Coze国内版上线;
...推出数据分析工具“办公小浣熊”面壁智能发布2B模型,推理成本仅为GPT-4的1/360科大讯飞发布全民开放大模型星火V3.5百川智能发布Baichuan 3大模型,更好理解中文阿里巴巴开发的自主多模态AI代理MobileAgent上线苹果Vision Pro正式在...……更多
...Bootstrap3D 数据集已全面开源。北大博士生等全新 BoT 框架推理暴涨 70 倍,24 点图形推理一步成神:BoT 可有效提升 LLM 在多个任务上的性能,在 BoT 的加持下,Llama3-8B 在多项任务中的性能甚至超越了 Llama3-70B,且 BoT 的成本相对较...……更多
苹果展示ferret-uiai系统可理解应用程序
...指令来设计的,以便于精确引用和接地。为了增强模型的推理能力,我们进一步编制了高级任务数据集,包括详细描述、感知/交互对话和功能推理。苹果在论文中表示相比较现有的GPT-4V,以及其它MLLMs模型,Ferret-UIAI模型更为优...……更多
苹果300亿参数大模型首亮相,还买了家AI公司|焦点分析
...模有30亿、70亿、300亿三种大小,有图像识别和自然语言推理能力。其中,参与该论文的作者有30人,一半以上都是华人。 MM1测试效果不如Gemini和GPT4V和市面上其他大模型相比,MM1亮点并不在惊艳的效果上,也没有提出特别的技...……更多
系统级玩家微软、苹果先后出牌,端侧大模型路径清晰了?
...MGSM(跨语言数学能力)提升 2.3%,而DROP(文本段落分析推理)则下降了 3%。但与此同时,杀手级应用仍未出现。根据第三方网站SimilarWeb的监测数据,早在去年6月,ChatGPT流量即已见顶,当月其网站与移动客户端的全球流量(PV)...……更多
北大推出全新机器人多模态大模型!面向通用和机器人场景的高效推理和操作
...码仓库 Trending Research 第一位。为了赋予机器人端到端的推理和操纵能力,本文创新性地将视觉编码器与高效的状态空间语言模型集成,构建了全新的 RoboMamba 多模态大模型,使其具备视觉常识任务和机器人相关任务的推理能力,...……更多
英伟达地表最强,黄教主被称作AI界“霉霉”
...来支持高达10万亿参数的AI模型训练和大语言模型的实时推理。有望在数据处理、工程模拟、电子设计自动化、计算机辅助药物设计、量子计算和生成人工智能等领域实现新的突破。用黄仁勋的原话来说,它就是“当今世界上最...……更多
小红书技术副总裁王晓博:大模型让AI越来越像人,更懂小红书的内容与用户
...数据对用户和内容进行建模,会导致新笔记分发难,缺乏推理能力导致信息茧房等问题。在小红书的推荐系统中,率先将大模型作为笔记的语义编码器来使用,通过语义压缩提示词(prompt)结合对比学习技术,让大模型能够把笔...……更多
探索终端操作系统领域AI大模型创新趋势 OpenHarmony技术大会OS原生智能分论坛召开
...发展带来了崭新的机遇,有望通过强大的语义理解和常识推理能力大大提升智能个人代理支持功能的广度和深度。”清华大学助理研究员李元春主题分享中软国际有限公司智能物联网军团产品研发管理部总经理、OpenHarmony项目群技...……更多
苹果公司公布“mm1”多模态大模型
...0亿、70亿、300亿三种参数规模,拥有图像识别和自然语言推理能力。IT之家注意到,苹果研究团队相关论文主要是利用MM1模型做实验,通过控制各种变量,找出影响模型效果的关键因素。研究表明,图像分辨率和图像标记数量对...……更多
摆脱Transformer依赖?这家AI初创公司推出国内首个非Attention机制大模型
...能效果——记忆能力提升3倍、速度提升7倍的同时,实现推理吞吐量的5倍提升。 至于为何另辟蹊径,寻求非Transformer的大模型路径,岩芯数智CEO刘凡平指出,以大规模著称的Transformer,在实际应用中的高算力和高成本,让不少中...……更多
位列第一梯队,腾讯混元再度领跑国内大模型
...维度的综合性测评基准,由十大基础任务组成,包括逻辑推理、代码、语言理解、长文本、角色扮演等。本次报告选取了国内外具有代表性的32个大模型4月份的版本,通过多维度综合性测评,真实准确地反映了国内外大模型在中...……更多
...展开紧密协作,共同致力于本土算力和大型模型的训练与推理技术的发展。11月初,云从科技在投资者关系平台上答复投资者关心的问题时称,公司已与华为签署了全面合作框架协议,并已联合发布了从容大模型训推一体化解决...……更多
ChatGPT大流行的思考-解析篇
...器人的本质区别。2. ChatGPT如何实现知识的获取、存储、推理及实时更新那究竟GPT如何有如此优秀的表现呢?我们不妨从人类学习思路入手,我们学习一般可分为获取知识-存储知识-推理知识-更新知识,而这也是GPT发展及学习的...……更多
奥林匹克竞赛里选最聪明的AI:Claude-3.5-Sonnet vs. GPT-4o?
...异,近来Anthropic公司最新发布的Claude-3.5-Sonnet因在知识型推理、数学推理、编程任务及视觉推理等任务上设立新行业基准而引发广泛讨论:Claude-3.5-Sonnet 已经取代OpenAI的GPT4o成为世界上”最聪明的AI“(Most Intelligent AI)了……更多
昇思MindSpore 2.3全新发布
...级实现脚本、分布式策略,运行时的统一,Baichuan2-13B的推理部署只需1天。在大模型推理上,通过LLMServing实现推理吞吐提升2倍多;升级模型压缩工具金箍棒2.0实现千亿大模型压缩至十倍。 为降低开发门槛,昇思持续升级MindSpore...……更多
中国也有Sora同款训练架构公司,清华班底,智谱也投了 | 36氪首发
...经理。CTO鲍凡在清华大学计算机系获得博士学位,在加速推理、可控生成、基础架构、训练策略等方面已发表十余篇顶会论文。首席科学家为清华大学计算机系人工智能实验室主任、智源研究院首席科学家朱军。可以说,2023年...……更多
对话王田苗:万亿市场之下,大模型 + 机器人还有四大问题未解决
...务设定多个小模型,并提供不同的参数训练,端到端减少推理成本。另外,将专用小 GPU 芯片置入到机器人中,也可提高任务实时性,目前特斯拉已在自动驾驶中尝试了这种做法。硬氪:今年有哪些细分场景的模型值得关注?王...……更多
NPU全球出货超1亿颗!芯原如何迎战大模型时代的边缘计算变革?
...C9X00AI是AI-GPU/AI-PC,Tensor Core GPU IP CCTC-MP则面向大语言模型推理、训练。芯原NPU IP研发副总裁查凯南谈道,NPU的发展近年来大概有三个方向:首先是DEEP AI,在很多嵌入式设备里面,要把AI跟其它的处理IP做比较紧耦合的绑定,可以...……更多
优刻得首个「国产千卡智算集群」落地,支持智源千亿大模型训练
...环境,可支持超千卡规模、千亿参数级别的大模型训练和推理任务,旨在突破算力瓶颈,加速AI算力的国产化进程。国产千卡智算集群采用软硬件一体化的架构设计,提供低延迟、高吞吐、高可用的IB组网环境,支持GDR技术,使...……更多
OpenAI机器人亮相,大模型有了“肉身”,英伟达微软都有投资
...学习还能决策可以看到,Figure 01不管是在理解能力,还是推理反应都非常强大。团队特别强调,所有这些行为都没有经过远程操作,而是通过机器人自主学习。并且整段视频没有任何加速,也没有任何剪辑,全部一镜到底拍摄。...……更多
...思维搜索的领域知识。策略和价值网络指导搜索过程。在推理过程中,预训练的MCTS模块使用策略网络来探索LLM的思想轨迹。随后,LLM审查MCTS的思想并识别任何错误,然后进行额外的MCTS模拟以生成修改后的想法。最后,将修改后...……更多
英特尔推出新款AI芯片:推理性能比英伟达H100快50%
...加速器将为寻求大规模部署生成式AI的企业带来AI训练和推理方面的重大飞跃。英特尔Gaudi 3预计可大幅缩短70亿和130亿参数Llama2模型,以及1750亿参数GPT-3模型的训练时间。英特尔表示,Gaudi 3能够比英伟达上一代H100处理器训练特定...……更多
科大讯飞大模型新升级:20秒制作PPT,拟人语音能力超越ChatGPT|最前线
...台训练的全民开放大模型。升级后的讯飞星火V3.5在逻辑推理、语言理解、文本生成、数学答题、代码、多模态等七大能力上均有提升。升级之后,讯飞星火的文本生成能力和数理运算能力都有提升,可以轻松回答初三的数学物...……更多
更多关于科技的资讯:
土耳其首次发射自研通信卫星:全球第11家
北京时间7月9日7点半,SpaceX利用一枚猎鹰九号火箭,发射了土耳其的通信卫星Türksat 6A。这是土耳其第一颗完全独立自研的通信卫星
2024-07-10 23:41:00
5岁娃独自乘飞机:空姐地勤接力陪护
7月10日消息,据媒体报道,一名5岁男童独自从重庆飞深圳,空姐地勤接力陪护。孩子妈妈表示,买的是南航儿童无人陪伴机票,让孩子体验自己出门坐飞机
2024-07-10 23:41:00
燃油车香起来了!吉利怒掀价格战:新帝豪卷出新高度
家用B级轿车一直是中国汽车市场最大的蛋糕,自今年以来,比亚迪陆续推出“灭霸级”新品秦PLUS和秦L之后,该市场便开始了血雨腥风
2024-07-10 23:41:00
良品铺子联合支付宝,开启“碰一下”支付新体验
在快速迭代的都市生活中,科技的每一次创新都深刻影响着我们的日常习惯,而移动支付的普及和创新无疑是极具代表性的事件之一。2024年7月8日
2024-07-10 23:55:00
腾势Z9GT来袭:内饰豪华感油然而生
腾势Z9 GT即将在7月17日正式上市,它的目标显然奔着保时捷Panamera而来。当然,以腾势的家底自然不可能去造一台山寨版“Panamera”
2024-07-11 00:11:00
《植物大战僵尸杂交版》作者初中毕业:是名00后
快科技7月11日消息,微博话题“植物大战僵尸杂交版作者初中毕业”冲上热搜榜。据媒体报道,《植物大战僵尸杂交版》作者名叫曾佳伟
2024-07-11 00:11:00
三星Galaxy Z Flip6奥运版发布:支持eSIM 免费赠送给运动员
快科技7月10日消息,今晚,三星在法国发布Galaxy Z Flip6巴黎奥运会特别版。据悉,这款折叠屏新品将赠送给参加巴黎奥运会
2024-07-11 00:11:00
《植物大战僵尸杂交版》作者初中毕业:靠做游戏找到人生第二条路
前段时间,一款B站up主潜艇伟伟迷开发的同人游戏《植物大战僵尸杂交版》爆火,甚至被官方扶正,玩家现已可在《植物大战僵尸》创意模式进行游玩
2024-07-11 00:11:00
大江奔涌|美的“灯塔工厂”全面数字化,每1.5秒下线一台电冰箱
1.5秒能做什么?在美的冰箱荆州工厂,每1.5秒就有一台冰箱下线。7月10日,参加“大江奔涌·沿着长江经济带看中国”网络主题宣传活动的媒体代表走进位于湖北荆州经开区的美的冰箱超级工厂
2024-07-11 00:21:00
周杰伦代言!腾讯《极品飞车:集结》今日公测:安卓、iOS最低配置公布
快科技7月11日消息,由周杰伦代言的腾讯首款开放世界赛车手游《极品飞车:集结》将于今早8:00正式开启公测。本次公测为全平台公测
2024-07-11 00:41:00
保险中介机构正掀起一轮上市潮。上半年,小雨伞保险经纪的母公司手回科技和海尔集团旗下的众淼创科陆续冲刺港股,有家保险和致保科技先后上岸纳斯达克
2024-07-11 01:03:00
7月10日,小米、格力之间再起硝烟,继董明珠在股东大会上质疑小米后,一款米家电风扇侵权事件让双方再次上了热搜。在采访中
2024-07-11 01:03:00
半年开店12家 GAP卷土重来?
宝尊电商主导下的美式快时尚品牌GAP正在加速开店。据北京商报记者不完全统计,今年上半年GAP已经在国内开设12家新店。从最受年轻人欢迎的快时尚品牌之一
2024-07-11 01:03:00
中国首次实现!超越经典计算机量子模拟器:与高温超导有关
快科技7月11日消息,据中国科学技术大学官网介绍,中国科学技术大学潘建伟院士团队成功构建了求解费米子哈伯德模型的超冷原子量子模拟器
2024-07-11 01:11:00
天玑9400中杯工程机后置居中大圆哈苏三摄
7月10日消息,博主@数码闲聊站今日发文爆料,天玑9400中杯工程机搭载6.5英寸1.5K+120Hz国产直屏,无等深四曲盖板
2024-07-11 01:12:00