• 我的订阅
  • 头条热搜
迎战GPT-4V!谷歌PaLI-3视觉语言模型问世,更小、更快、更强
... Research、Google DeepMind 和 Google Cloud 共同推出了一个更小、更快、更强大的视觉语言模型(VLM)——PaLI-3,该模型与相似的体积大 10 倍的模型相比具有显著竞争力。研究人员使用分类目标预训练的视觉变换器(ViT)模型与对比性...……更多
英伟达开源NVLM 1.0屠榜多模态!纯文本性能不降反升
...lama 3-V 70B相媲美。NVLM-X1.0还有一个优势:训练和推理速度更快。开源的多模态大型语言模型,如LLaVA-OneVision 72B和InternVL-2-Llama3-76B,在多模态训练后在纯文本任务上表现出显著的性能下降;相比之下,NVLM-1.0模型的纯文本性能甚至.……更多
更快、更强、更可控:智谱“起舞弄清影”,视频生成卷出新高度!
...也进一步推动AI普惠风。 一、智谱“清影”上线:速度更快、更为可控、画面更连贯速度上,智谱生成式视频模型的推理速度提升了6倍,生成6s视频只需花费30s,这意味着更快的创作周期、更高的实时性、更流畅的生成,以及...……更多
AI PC是噱头还是更快的马车?
...tra5125H包含7个。而且,这一代核显还支持AV1硬编码,可以更快速地输出高质量、高压缩率的视频。凭借领先的编解码能力,ArcGPU确实在视频剪辑行业积累的良好的口碑。随着矢量引擎能力的大幅度提升,大量内容创作ISV的演示了...……更多
北大推出全新机器人多模态大模型!面向通用和机器人场景的高效推理和操作
...的 7B MLLM (e.g., LLaVA1.5 和 SPHINX),但我们优先使用更小更快的 Mamba-2.7B 来平衡机器人模型的效率。在未来,我们计划为资源不受限制的场景开发 RoboMamba-7B。 2. 机器人推理能力评估(RoboVQA Benchmark)另外,为了全面比……更多
AI大模型行业报告:大模型发展迈入爆发期,开启AI新纪元(附下载)
...PT-4o。GPT-4o 将文本、音频和视觉集成到一个模型中,提供更快的响应时间、更好的推理能力以及在非英语语言中的更佳表现,不仅在传统文本能力上与GPT-4 Turbo性能相当,还在API方面更快速,价格便宜50%。与GPT-4 Turbo相比,GPT-4o...……更多
oppo首个端侧应用70亿参数大模型findx7系列
...式的视觉模型,在保障用户隐私安全的情况下,带来响应更快、处理能力更强、生成质量更高的本地AI体验。” 得益于完整的端侧应用的AndesGPT70亿参数大语言模型,FindX7系列将带来自然语言理解、文本内容摘要、通话语音摘要...……更多
云测数据:为人工智能提供专业、高效的AI数据服务
...值数据支持,实现场景数据专业化、高质量交付,帮助企业更快更好地实现AI应用成功落地。与此同时,云测数据也一直推动着AI数据标准化体系建设,先后参与编制了《智能网联汽车激光雷达点云数据标注要求及方法》、《智能网联...……更多
最新美国国家人工智能科学院院士介绍
...她专注于元学习和强化学习,致力于让机器学习系统能够更快地适应新任务和环境。Finn的研究有助于提升人工智能系统的灵活性和泛化能力,为未来的智能系统发展开辟了新的道路。DaniYarowsky,来自约翰斯·霍普金斯大学(JohnsH...……更多
黄仁勋明天登港!沈向洋3小时重磅演讲:发布多款大模型,具身智能激情碰撞
...学革命推向聚光灯下。好的AI工具,可以帮助科学家做出更快、更好的科学发现。IDEA团队选择了化学领域,从预测能力和数据能力入手,进行了研究和产业化实践。在预测方面,IDEA研发的多个化学领域专家大模型,分子属性预...……更多
撞墙还是新起点?自回归模型在图像领域展现出Scaling潜力
...比,掩码建模由于采样迭代次数较少,因此推理速度明显更快,而二元目标的扩散过程需要更多时间。这种生成与判别的统一能带来什么好处呢?齐宪标举了两个例子,如果我们想让模型生成一张「飞翔的熊猫」图,那么这种自...……更多
击败Gemini-1.5-Pro、GPT-4V,从容大模型多模态能力跻身全球前三
...能和响应速度,使得模型的训练过程更加高效,收敛速度更快,性能更稳定。同时也得益于云从科技长期在视觉、语言领域的深厚积累和不断创新。图 4:从容大模型 - 2.0 多模态能力示例此前,从容大模型已在视觉、跨模态领域...……更多
创新奇智大模型工业落地初显成效,探索工业智能机器人新方向
...经走到了比拼技术商业化的攻坚阶段,比拼的是谁落地得更快,谁的落地更实用。就在这波降低技术门槛、优化模型的大潮中,国内的一家公司脱颖而出,它从创立之初就确立了大模型「工业化落地」的方向,并已经取得了一系...……更多
人均年薪100万,手机厂商数百亿开卷大模型
...据不用上传到云端。与此同时,端侧大模型的响应速度会更快,一种最极端的情况就是即便在没有网络的情况下,端侧大模型依然可以使用,而云上大模型在没有网络情况下则无法使用。此外,云上大模型的调用成本高昂。“一...……更多
小模型正在成为AI界的新宠
...相对较小,可以在本地机器上运行模型,训练和推理速度更快,适用于资源有限的环境。 可解释性更好:小模型的结构相对简单,更容易理解其决策过程。 适用范围广:小模型可以应用于各种任务,包括嵌入式设备、移动应...……更多
马斯克官宣Grok-2测试版!xAI将继续拥抱开源路线吗?
...同的专家子模块进行推理,在吞吐量一定的情况下,可以更快地完成推理、给出回答。这让Grok-1拥有了更快的生成速度和更低的推理成本,简而言之就是更好的使用体验和性价比。根据xAI公布的数据,在GSM8K、HumanEval和MMLU等一系...……更多
扩散模型训练方法一直错了!谢赛宁:Representation matters
...型模型中提供了更显著的加速,与普通模型相比,实现了更快的 FID-50K 改进。此外,增加模型大小可以在生成和线性评估方面带来更快的增益。REPA 显著提高训练效率和生成质量最后,该研究比较了普通 DiT 或 SiT 模型与使用 REPA ...……更多
GPT-4劲敌,谷歌进入高能+高产模式
...预训练计算效率的同时提升大模型处理复杂任务的性能,更快地学习复杂任务的同时保证准确性。与稠密模型相比,MoE模型的预训练速度更快;使用MoE 层代替transformer 中的前馈网络(FFN)层。因而对的采用可以弥补Transformer架构...……更多
跨模态大升级!少量数据高效微调,LLM教会CLIP玩转复杂文本
在当今多模态领域,CLIP 模型凭借其卓越的视觉与文本对齐能力,推动了视觉基础模型的发展。CLIP 通过对大规模图文对的对比学习,将视觉与语言信号嵌入到同一特征空间中,受到了广泛应用。然而,CLIP 的文本处理能力被广...……更多
Meta首款多模态Llama 3.2开源!1B羊驼宝宝,跑在手机上了
...点在于,Llama 3.2成为羊驼家族中,首个支持多模态能力的模型。Connect大会上,新出炉的Llama 3.2包含了小型(11B)和中型(90B)两种版本的主要视觉模型。正如Meta所说,这两款模型能够直接替代,相对应的文本模型,而且在图像...……更多
苹果的封闭生态为大模型打开!发布开源多模态大模型、每天为 AI 烧百万美元,零碎的 Android 生态打得过吗?
...构成威胁,Arm 和台积电将获胜。”有网友说到苹果在大模型发展上的状况。也有网友认为,苹果在大模型上的发力将为其在未来的手机市场竞争中带来优势。他们认为,开源模型加上移动设备的本地数据,即本地化的原生 LLM,...……更多
清华团队提出大模型“密度定律”;足球领域首个视觉语言基础模型
今日值得关注的大模型前沿论文SwiftEdit:50 倍速文本引导图像编辑清华团队提出大模型“密度定律”足球领域首个视觉语言基础模型Aguvis:首个完全自主的纯视觉 GUI agentGoogle DeepMind:利用运动轨迹控制视频生成大模型数学新基...……更多
Bengio团队提出多模态新基准,直指Claude 3.5和GPT-4o弱点
...想要达成通用人工智能 AGI 的终极目标,首先要达成的是模型要能完成人类所能轻松做到的任务。为了做到这一点,大模型开发的关键指导之一便是如何让机器像人类一样思考和推理。诸如注意力机制和思维链(Chain-of-Thought)等...……更多
真香!智谱大模型,有了首个免费的API
...。与此同时,GLM-4 支持了更长的上下文、更强的多模态、更快的推理速度,以及更多并发请求,大大降低了推理成本。在此基础上发展出的 GLM-4-Flash,则带来了一系列技术优势:数据预训练:引入大语言模型进入数据筛选流程,...……更多
昆仑万维:“天工大模型3.0”将于4月17日正式发布 同步开源4000亿参数MoE超级模型
...他模型,MoE大模型应对复杂任务能力更强、模型响应速度更快、训练及推理效率更高、可扩展性更强。 在上一代“天工2.0”MoE大模型的领先基础上,“天工3.0”更是实现了全面的性能升级,其采用4000亿级参数MoE混合专家模型架...……更多
大模型重构生命科学!最大基础模型面世,解锁DNA超长序列
...样,生命科学领域正迎来全行业的重塑,甚至比其他领域更快。仅过去一年时间,传统药企巨头拥抱AI,像辉瑞、礼来等全球药企巨头任命首席AI官;科技巨头纷纷出手布局,诸如谷歌Meta英伟达也早已相关探索。还有像赛诺菲,...……更多
苹果300亿参数大模型首亮相,还买了家AI公司|焦点分析
...武静静编辑|邓咏仪放弃造车后的苹果,正在加速入局大模型战争。当地时间3月15日,苹果就披露了两个关键大模型动作。其中一个值得关注的是苹果的收购事件。彭博社报道称,苹果已经收购了一家加拿大AI初创公司DarwinAI。...……更多
Meta提出“可持续思维链”,让大模型在连续潜空间中推理
今日值得关注的大模型前沿论文北大团队提出「自定义漫画生成」框架UniReal:通过学习真实世界动态实现通用图像生成和编辑苹果团队提出「可扩展视频生成」方法利用扩散 Transformer 进行视频运动迁移ObjCtrl-2.5D:无需训练的「...……更多
支持1024帧、准确率近100%,英伟达「LongVILA」开始发力长视频
现在,长上下文视觉语言模型(VLM)有了新的全栈解决方案 ——LongVILA,它集系统、模型训练与数据集开发于一体。现阶段,将模型的多模态理解与长上下文能力相结合是非常重要的,支持更多模态的基础模型可以接受更灵活...……更多
llava-1.6与gpt-4vmp面硬刚的性能,一起来看看
...-Plus,与GPT-4V正面硬刚,这个有着SOTA级别性能的多模态大模型真正做到了“人无我有,人有我优”。继2023年4月的初级版本、2023年10月的LLaVA-1.5之后,2024年1月31日,微软研究院又联合威斯康星大学麦迪逊分校和哥伦比亚大学的研...……更多
更多关于科技的资讯:
《最终幻想7》蒂法新3D美图 穿《GTA6》女主服装更性感迷人
近日游戏博主Sreliata分享了《最终幻想7》蒂法新3D美图。蒂法穿上了《GTA6》女主露西娅的亮片包臀裙礼服,展现出她更大胆自信
2025-05-28 17:27:00
小鹏高管:不要过于迷恋单一某个传感器 脑后的辫子是时候考虑剪掉了
快科技5月28日消息,今晚,小鹏MONA M03 Max版将要上市,这款车配备满血版图灵AI驾驶辅助功能,应用双英伟达Orin-X芯片
2025-05-28 17:27:00
在Z世代的数字世界里,游戏不仅是娱乐,是青春的战旗,更是自我表达的舞台。当新生代玩家对电竞装备的要求愈发严苛,新一代华硕天选6X台式机破界而来
2025-05-28 17:55:00
PS5 Pro拆解分析:曝物料清单成本仅比普通PS5高出2%
研究机构TechInsights近日发布了对PS5 Pro的拆解分析文章。搭载了基于AMD RDNA 3.0 GPU架构的定制处理器
2025-05-28 17:57:00
iOS 18.5翻车 网友称升级后烫手+耗电快!玩10分钟烫得像铁板
快科技5月28日消息,苹果近日发布了iOS 18.5更新,修复了图像处理、通话记录、蓝牙、FaceTime、WebKit等31个漏洞
2025-05-28 17:57:00
贾静雯否认丈夫修杰楷酒驾:太荒谬
快科技5月28日消息,近日,中国台湾女星贾静雯出席活动时,回应了丈夫修杰楷被指酒驾一事。她笑称:“太荒谬了,我们怎么可能去做不该做的事
2025-05-28 17:57:00
消费环境优化与技术升级双轮驱动 一季度电商消费维权指数显著回落
中国消费者报报道(记者桑雪骐)今年第一季度,我国经济发展向新向好。日前,《中国消费者报》联合淘天集团发布的《电商消费维权指数2025年第一季度报告》(以下简称《报告》)显示
2025-05-28 18:01:00
2025年5月16日至18日,第二十六届中国国际照相机械影像器材与技术博览会(CHINAP&E)在北京盛大开幕
2025-05-28 18:12:00
职场如战场,多任务堆叠、频繁商务差旅、高强度加班……每个用机场景都在考验职场人的装备实力。备受好评的华硕灵耀142025
2025-05-28 18:25:00
经典外观保持不变!全新路虎卫士官图发布:现款68.8万起
快科技5月28日消息,日前,全新路虎卫士官图发布,新款依旧保持了其经典的外观设计,仅对外观细节进行了微调,但内饰配置得到升级
2025-05-28 18:27:00
“诅咒领导猝死”正在收割第一波流量红利
本文首发于虎嗅年轻内容公众号“那個NG”(ID:huxiu4youth)。在这里,我们呈现当下年轻人的面貌、故事和态度
2025-05-28 18:27:00
小米2025年第一款折叠屏来了:曝MIX Flip 2 6月登场 女生最爱
快科技5月28日消息,博主数码闲聊站暗示,小米MIX Flip 2将在6月发布,这是小米今年第一款折叠屏机型。据爆料,小米MIX Flip 2配备6
2025-05-28 18:27:00
女子驾驶宝马轿车误操作:一脚油门冲到大厅狠狠撞柱
快科技5月28日消息,早些年曾有人调侃称“女子无车便是德”,这话说得确实极端了些,不过现实生活中一些女司机的操作确实匪夷所思
2025-05-28 18:27:00
618购物狂欢节开启,还在为加购一台合适的AIPC发愁?小编精选了华硕旗下三款热门AIPC新品,覆盖学生党、办公族及创作者三大群体
2025-05-28 18:28:00
5月20日,2025年台北国际电脑展(2025COMPUTEX)盛大召开!作为全球科技领域备受瞩目的行业盛会,吸引了众多知名品牌与厂商参展
2025-05-28 18:30:00