• 我的订阅
  • 头条热搜
Motiff妙多发布国内首个UI大模型,效果跑分超越苹果、GPT-4o
...模型Motiff妙多大模型具备出色的UI理解能力和执行开放式指令的能力。在五个行业公认的UI能力基准测试集中,Motiff妙多大模型的各项指标均超过了GPT-4o和苹果的Ferret UI,同时在Screen2Words(界面描述与推断)和Widget Captioning(部件...……更多
鬼手操控着你的手机?大模型GUI智能体易遭受环境劫持
...追求通用人工智能改变生活的同时,需要关注 AI 对用户指令的忠实性。具体而言,AI 是否能够在复杂的多模态环境中不受眼花缭乱的内容所干扰,忠实地完成用户预设的目标,是一个尚待研究的问题,也是实际应用之前必须回...……更多
百万鲁棒数据训练,3D场景大语言模型新SOTA!IIT等发布Robin3D
【新智元导读】Robin3D通过鲁棒指令数据生成引擎(RIG)生成的大规模数据进行训练,以提高模型在3D场景理解中的鲁棒性和泛化能力,在多个3D多模态学习基准测试中取得了优异的性能,超越了以往的方法,且无需针对特定任务...……更多
...经济网中国经济网北京5月22日讯 近期,OpenAI发布全新大模型GPT-4o,再度引发市场对于AI的关注。对此,景顺长城基金股票投资部基金经理张雪薇分析了GPT-4o对于AI行业的发展意义,并指出,AI目前看仍是比较确定的长期主线。 投...……更多
Sam Altman或筹数十亿美元自造AI芯片,DeepMind首席科学家或将辞职创业
...据集上,GLM-4的得分为72分,超过了GPT-3.5和GPT-4。在中文指令跟随方面,GLM-4达到了GPT-4的88%至90%水平。此外,GLM-4在对齐能力上也超过了GPT-4的早期版本,并接近最新版本的表现。此外,GLM-4还增强了多模态能力,其CogView3模型在...……更多
智谱AI的双轨驱动:从基座大模型出发,以共创理念推进商业落地
...智谱AI推出了GLMs 个性化智能体定制,用户用简单提示词指令即能创建属于自己的 GLM 智能体,无需编程基础;面向B端客户,GLM-4已登陆MaaS(Model as a Service)平台,提供API访问。要充分释放大模型的价值,从基础大模型到上层应...……更多
小米“小爱同学”与阿里云通义大模型展开合作
...汽车SU7为例,车上的“小爱同学”可遵从乘客的自然语言指令,在车载中控屏画出“小猫爬上窗台”等画面,增加亲子互动和乘车乐趣。通过优化算法、蒸馏模型,大模型在确保图片质量的前提下可做到5秒出图,将出图时间缩...……更多
7个第一,11个首发,讯飞星火放大招,大模型规模化落地可期!
...发者节开幕式上,科大讯飞董事长刘庆峰公布讯飞星火大模型应用成绩单,并发布讯飞星火4.0 Turbo:七大核心能力全面超过GPT-4 Turbo,数学和代码能力超越GPT-4o,国内外中英文14项主流测试集中讯飞星火4.0 Turbo实现9项第一。与此...……更多
讯飞星火V3.0发布,打造每个人的AI助手
...动提炼规律、小样本学习、代码项目级理解能力、多模态指令跟随与细节表达等能力,进一步提升星火的落地应用能力。升级AI人设、启发式对话,打造每个人的AI助手自讯飞星火9月5日全民开放后,当前已有1200万用户,也对认...……更多
...臂协作系统RTACS,该模型能使机器人理解推理抽象的语义指令,并调度双臂协作系统执行任务。此前,仅OpenAI等国外人工智能头部企业发布了类似成果。此次发布,标志着成都在我国多模态模型应用于人形机器人领域率先取得突...……更多
Sora再度颠覆AI视频行业,A股哪些公司有相关布局?
...性的标题。因此,该模型能够更精准遵循生成用户的文本指令。OpenAI表示,Sora是能够理解和模拟现实世界的模型基础,相信这一功能将成为实现AGI(通用人工智能)的重要里程碑。券商建议关注多模态技术Sora视频一出,立刻震...……更多
中国也有Sora同款训练架构公司,清华班底,智谱也投了 | 36氪首发
...雨编辑 | 邓咏仪全球首家发布Sora同款底层架构的清华系模型公司,近期完成了新一轮融资。投资名单中,也出现了大模型独角兽智谱AI的身影。36氪获悉,近日多模态AI模型公司生数科技完成新一轮数亿元融资。该轮融资由启明...……更多
...B可以处理最多32k的长文本输入,研发团队优化了Qwen-72B的指令遵循、工具使用等技能,使之能更好地被下游应用集成。比如,Qwen-72B搭载了强大的系统指令(System Prompt)能力,用户只用一句提示词就可定制AI助手,要求大模型扮...……更多
突破视频多模态大模型瓶颈!「合成数据」立大功,项目已开源
...这一问题,我们提出了一种替代方法,创建一个专为视频指令跟随任务设计的高质量合成数据集,名为 LLaVA-Video-178K。该数据集包含详细的视频的描述、开放式问答(QA)、和多项选择题。通过在该数据集和现有的视觉指令微调...……更多
国产地表最强视频模型震惊歪果仁,官方现场摇人30s直出!视觉模型进入上下文时代
【新智元导读】全球首个支持多主体一致性的多模态模型,刚刚诞生!Vidu 1.5一上线,全网网友都震惊了:LLM独有的上下文学习优势,视觉模型居然也有了。来自中国的视频生成模型,再一次震惊了全球大模型圈。生数科技推出...……更多
始于去年的AI(人工智能)大模型浪潮热度再次升温。农历春节期间,AI领域利好不断,以Open AI为首的诸多国内外互联网龙头公司均迎来AI大模型技术的新进展。多家机构及业内人士称,看好未来AIGC(人工智能生成内容)产业发...……更多
林达华谈大模型发展之路:未来会有更高效的模型结构出现
...,它需要建立在一个非常坚实的基础模型上,具有很强的指令跟随能力、理解能力、反思能力和执行能力。在计算环境方面,林达华表示,芯片进入到后摩尔定律时代,未来算力会变成体量的拓展,越来越多的芯片连接在一起,...……更多
昆仑万维:“天工大模型3.0”将于4月17日正式发布 同步开源4000亿参数MoE超级模型
...3.0”AI搜索的研究模式中,模型能够围绕用户的某个简单指令进行相关问题的延伸,并实时判断该段落信息是否需要联网搜索,能够实现如对某个行业进行细致的拆解分析,总结相关事件、拆解产业链地图等复杂功能,并以结构...……更多
中国杀出全球首个烹饪大模型“食神”
...模型了解各种设备性能、参数知识;还有场景任务、控制指令学习,让大模型掌握设备执行、任务规划和推理的能力。掌握了多设备协同控制的能力,那么再结合菜谱知识,温度感知等方面的能力,那么菜谱生成也就不在话下了...……更多
最强国产多模态刚刚易主!腾讯混元把GPT-4/Claude-3.5都超了
国产大模型,多模态能力都开始超越GPT-4-Turbo了??权威榜单,中文多模态大模型测评基准SuperCLUE-V,新鲜出炉:特别是腾讯的hunyuan-vision、上海AI Lab的InternVL2-40B,分别成为国内闭源和开源界两大领跑者,甚至超过Claude-3.5-Sonnet..……更多
零一万物Yi-1.5来了,国产开源大模型排行榜再次刷新
...持续预训练版本,使用 500B 个 token 来提高编码、推理和指令执行能力,并在 300 万个指令调优样本上进行了精细调整。刚一发布,就已经有开发者跃跃欲试:并收获了好评: 与前序模型相比,Yi-1.5 系列模型进一步提升了编码、...……更多
...工作人员通过华藏输入“帮我生成一张万里长城的照片”指令,华藏即时给出了相应的图片。而当他继续提出“把万里长城变成雪景”指令时,华藏可以根据上下文语境,对图片进行相应指令的修改——万里长城瞬间平添皑皑雪...……更多
若愚科技推出九天机器人大脑,大模型总参数规模达130亿 |项目报道
...致大模型对机器人执行代码与外部环境不适配,从而降低指令分解能力和执行成功率。同时,云端加载的大模型也会带来时延的问题,制约了基于大模型驱动的多型机器人的域适应能力。若愚科技致力于通用机器人大脑的研究,...……更多
自然语言处理:大模型理论与实践
...自编码,优化参数设置和可扩展训练技术。- 微调:涵盖指令微调概念、构造指令实例的方法和数据集,指令微调任务中的自然语言理解和生成任务,多模态指令微调的数据构造和模型微调方法,以及指令微调优化方法和效果。-...……更多
英伟达开源NVLM 1.0屠榜多模态!纯文本性能不降反升
...冻结;在SFT阶段,MLP投影器和LLM都需要训练以学习带有新指令的新视觉-语言任务,且保持视觉编码器冻结。以往文献中很少讨论的是,在多模态SFT训练期间不冻结LLM权重通常会导致纯文本性能显著下降,NVLM-D模型通过整合高质...……更多
中国版GPT-4o 来了,抢先OpenAI落地,8月底全民开放
...语音交互中机器声音无法调整的情况,现在只要语音发出指令,就可以控制超拟人在情感、风格、方言、强度等表达方式上做出变化。“用调侃的方式给我说个笑话”、“用东北话给外地朋友介绍下锅包肉”、“说的更快一点”...……更多
...“深数所”)发布了500个垂直行业多模态算料集,按照大模型应用的不同阶段(训练、推理、调优),有的放矢地提供数据源,让国产大模型厂商“寻数有路”。此次深数所发布的首批500个人工智能大模型高质量训练数据集,由...……更多
WOT全球技术创新大会2024北京站:探索AI 的无限可能
2024年过半,大模型、AIGC这场考试,你交卷了吗?成绩如何?大模型厂商们虽然把价格战“卷”出了白菜价——普通开发者或许会为低价疯狂,但企业用户关心的依旧是产品、应用与自身业务的匹配度;大模型是否能够真正解决...……更多
苹果发布新型开源人工智能模型:可根据自然语言指令编辑图像
...“MGIE”的新型开源人工智能模型,它可以根据自然语言指令编辑图像。图源:VentureBeat与Midjourney合作制作MGIE的全称是MLLM-GuidedImageEditing,利用多模态大型语言模型(MLLM)解释用户指令并执行像素级操作。MGIE可以理解用户下达的...……更多
Sora炸圈后哑火,国产视频大模型接棒降门槛
OpenAI旗下文生视频模型Sora推出时引发的行业爆炸仿佛还在昨日,但至今Sora也未对外正式开放使用。与之相对的是国内视频大模型在2024年密集发布,虽然技术更新不断,但成品多数仍需后期人工剪辑合成,影响技术在应用端的...……更多
更多关于科技的资讯:
00后整顿不了的职场 它能
人类正在通过 AI 重塑文明。或许很多人还不大认可这个说法,但在前两天,差评君受邀参加了火山引擎 Force 原动力大会之后
2024-12-26 00:06:00
华为:全球首个海拔5000米高原露天矿无人驾驶成果发布
快科技12月25日消息,华为中国发文宣布,与西部矿业、中铁十九局在西藏昌都玉龙铜矿三方共同建设的全球首个5000米高原露天矿无人驾驶项目成果交付
2024-12-26 00:06:00
不能摸也不能烧!这棵树全株有毒太魔性 树下躲雨也会中毒
世界上最倒霉的事情是只在树下躲了个雨,4个学生的皮肤和眼睛就被莫名“灼伤”,出现不同程度的炎症,有的部位甚至还起了水泡
2024-12-26 00:06:00
华为推出FreeBuds Pro 4蛇年典藏版:自带灵动小蛇 云杉绿、曜石黑双色
快科技12月26日消息,华为FreeBuds Pro 4蛇年典藏版已经在京东平台上架,目前尚未公布售价。从目前信息来看
2024-12-26 00:36:00
凯迪拉克女销售涉嫌私收购车款“跑路” 有人转账26万无法提车
快科技12月26日消息,据报道,近日,有不少在江苏南京一凯迪拉克4S店购车的市民在网络上反映,自己购车时被店内一女销售陈某某忽悠
2024-12-26 00:36:00
春节档“神仙打架”!2025年五部大片定档 前作票房一个比一个牛
快科技12月26日消息,今年春节档可谓神仙打架,目前已有5部大片定档2025年春节档上映。分别为《封神第二部:战火西岐》《射雕英雄传
2024-12-26 00:36:00
帝都、魔都双双押宝 年底了AI圈居然还有高手
好好好,本以为 OpenAI 直播已经是 24 年 AI 领域的尾声,没想到还有高手,国内 AI 圈又传出个大新闻。就在前几天
2024-12-26 00:36:00
都别喷萤火虫了 人家可能压根没想卖国内
要说这几天哪台新车心里最难受,那肯定是蔚来的 ET9 。在上周的 Nio Day 2024 上市,定价超过 80 万,身上集合了蔚来迄今为止所有最强的技术
2024-12-26 00:36:00
雷军公布小米su7冬测新成绩:全能之星、智能安全之星
12月25日晚,小米集团CEO雷军公布了小米SU7冬测新成绩。在中国汽研2024极北寒测挑战中,小米SU7被评为全能之星
2024-12-26 01:27:00
联想将推出legiongos掌上游戏机
联想正紧锣密鼓地为2025年国际消费类电子产品展览会(CES2025)做准备,并宣布将推出LegionGoS掌上游戏机
2024-12-26 01:32:00
小米15ultra电池曝光:超级微距、全焦段大光圈
随着2025年的脚步日益临近,各大品牌的Ultra机型也将陆续登场,相关爆料信息也随之涌现。近日,博主“智慧皮卡丘”透露
2024-12-26 01:34:00
特斯拉公布限时员工购车福利,需要在12.31之前提车
2月25日,据汽车博主@胖虎Shawn消息,特斯拉刚刚公布了限时员工购车福利:除了原本的赠送FSD(全自动驾驶)之外,额外增加了赠送两个选配
2024-12-26 01:51:00
一加与redmi又要对上了!新机均将配备1.5koled直屏
OPPO子品牌一加与小米子品牌REDMI算是一对老对手了。2024年,双方就在中高端和旗舰市场展开了多轮交锋,一加Ace3Pro与REDMIK70至尊版
2024-12-26 02:55:00
华为2024年全球文件存储和对象存储报告发布
据@华为数据存储消息,近日,国际权威研究机构ColdagoResearch发布了2024年全球文件存储和对象存储报告。在这两个榜单中
2024-12-26 03:27:00
华为freebudspro4开启年货节活动
最近想入手TWS耳机的同学有福利了,随着新年将至,华为音频也开启了年货节活动,多款华为音频产品开启了不同力度的促销活动
2024-12-26 03:35:00