• 我的订阅
  • 头条热搜
商汤绝影在行业内率先实现了原生多模态大模型的车端部署
...家王晓刚17日宣布,商汤绝影在行业内率先实现了原生多模态大模型的车端部署。车载端侧8B模型首包延迟在300毫秒以内,推理速度40Tokens/秒,覆盖主流算力平台。商汤绝影为多模态大模型打造计算引擎“HyperPPL”,目前扩展并支...……更多
AI翻译界杀手诞生!阿里国际翻译大模型吊打谷歌和GPT-4
...采用了多语言数据筛选技术。比如,特别增强语种识别、多维度数据质量评估,由此,就获得了高质量、大规模多语言数据。与此同时,通过利用多语言MoE、参数扩展方法,从而保证主导语言(如中英)性能不下降的情况下,提...……更多
对比学习滥用隐私数据!中科院等发布「多步误差最小化」方法 | ACM MM2024
...出了一种新颖的多步误差最小化(MEM)方法,用于生成多模态不可学习样本,以保护个人数据不被多模态对比学习模型滥用。通过优化图像噪声和文本触发器,MEM方法有效地误导模型,降低其对隐私数据的学习能力,并在不同模...……更多
超级汇川杨怀渊:持续AI投入 高效链接“真需求”与“好供给”
...本、广告效果数据和行业定制模型,帮助细分行业提升多模态模型能力,实现高效创意的激发。在生成创意内容的测试中,整体创意制作时间缩减50%,竖版视频的点击率(CTR)提升150%。提升营销效率方面,超级汇川的公私域联...……更多
10分钟速成专家,「Kimi智能助手」正式支持200万上下文,对话窗口提升10倍 | 最前线
...就是简历——此前曾有用户让Kimi分析多份简历,让Kimi从多维度进行分析。而在长文本提升到200万后,一个公司 HR 可以基于业务需求,就可以快速从最近的 500 份简历中,让 Kimi 快速找出有某个行业从业经历,同时从计算机类专...……更多
零成本突破多模态大模型瓶颈!多所美国顶尖高校华人团队,联合推出自增强技术CSR
新智元报道编辑:LRST【新智元导读】现有多模态大模型在对齐不同模态时面临幻觉和细粒度感知不足等问题,传统偏好学习方法依赖可能不适配的外源数据,存在成本和质量问题。Calibrated Self-Rewarding(CSR)框架通过自我增强学...……更多
给机器人装上大模型大脑,「若愚科技」获超5000万天使轮融资|36氪首发
文|武静静编辑|邓咏仪36氪获悉,多模态大模型公司「若愚科技」完成超5000万天使轮融资,本轮融资由东方精工领投,昆仲跟投,源合资本担任独家融资顾问。公司称,资金将主要用于产品研发,业务拓展以及团队搭建等方...……更多
无问芯穹开源全球首款端侧全模态理解模型 Megrez-3B-Omni
...,无问芯穹今日宣布,开源无问芯穹端侧解决方案中的全模态理解小模型 Megrez-3B-Omni 和它的纯语言模型版本 Megrez-3B-Instruct。官方表示,Megrez-3B-Omni 是一个为端而生的全模态理解模型,同时具备图片、音频、文本三种模态数据的...……更多
●多模态使人形机器人能融合图像、语义、力感知、环境感知等多种因素,综合判断、生成任务并执行任务,是让人形机器人具有自主思考能力的关键核心技术●标志着成都在我国多模态模型应用于人形机器人领域率先取得突...……更多
全国首个 成都创新团队发布机器人多模态模型
中国首个机器人多模态模型,可以相对明确地将水果和非水果进行区分和分拣如果你想吃苹果,根据语音指令,机器人会把苹果送到你手上;如果想收拾干净桌面,机器人就会把桌上所有的东西归置好……这个关于人工智能描...……更多
...板苏州科达:公司的KD-GPT大模型相对于谷歌Gemini的通用多模态大模型在服务对象上存在明显区别 【五连板苏州科达:公司的KD-GPT大模型相对于谷歌Gemini的通用多模态大模型在服务对象上存在明显区别】财联社12月13日电,苏州科...……更多
开年“王炸”!智能体再升级,科大讯飞打造办公新范式
...化应用的标准化平台产品。通过集成大模型、虚拟人、多模态语音、知识库等技术,利用人机对话的交互方式,轻松完成展厅和展会的讲解互动,实现用户行为分析,精准定位商机。在团队碰头会场景,星火快答可通过问答快速...……更多
MMMU华人团队更新Pro版!多模态基准升至史诗级难度:过滤纯文本问题、引入纯视觉问答
...候选选项、引入纯视觉输入设置)更严格地评估模型的多模态理解能力;模型在新基准上的性能下降明显,表明MMMU-Pro能有效避免模型依赖捷径和猜测策略的情况。多模态大型语言模型(MLLMs)在各个排行榜上展现的性能不断提...……更多
meta开源多感官大模型,ai用6种模态体验虚拟世界
Meta最新 6模态大模型,让AI以更接近人类的方式理解这个世界。比如当你听见倒水声的时候就会想到杯子,听到闹铃声会想到闹钟,现在AI也可以。尽管画面中没有出现人类,AI听到掌声也能指出最有可能来自电脑。这个大模型 I...……更多
东方证券:谷歌发布多模态模型Gemini,多模态应用前景广阔
...办公、法律、医疗有望率先落地。东方证券:谷歌发布多模态模型Gemini,多模态应用前景广阔12月6日晚,谷歌正式发布了Gemini大模型,是谷歌目前最强大最通用的模型。其尺寸最大的版本GeminiUltra在32项基准测试中有30项能力都超...……更多
科学家开发多模态音乐理解和生成大模型,兼具理解和创作音乐能力
...音乐理解和生成结合在一起的想法比较新颖,论文也是多模态大模型领域的先期工作之一。并且,除了大模型本身,我们提出的针对模型训练的数据集制作流程和整理的数据集,对学术界也具有较大价值。”腾讯 ARC Lab 刘山松研...……更多
北大等发布多模态版o1!首个慢思考VLM将开源,视觉推理超闭源
北大等出品,首个多模态版o1开源模型来了——代号LLaVA-o1,基于Llama-3.2-Vision模型打造,超越传统思维链提示,实现自主“慢思考”推理。在多模态推理基准测试中,LLaVA-o1超越其基础模型8.9%,并在性能上超越了一众开闭源模型...……更多
阿里多模态检索智能体,自带o1式思考过程!复杂问题逐步拆解
多模态检索增强生成(mRAG)也有o1思考推理那味儿了!阿里通义实验室新研究推出自适应规划的多模态检索智能体。名叫OmniSearch,它能模拟人类解决问题的思维方式,将复杂问题逐步拆解进行智能检索规划。随便上传一张图,...……更多
润建股份:公司曲尺平台开发的AI行业模型支持多模态 【润建股份:公司曲尺平台开发的AI行业模型支持多模态】财联社12月20日电,润建股份在互动平台表示,公司曲尺平台开发的AI行业模型支持多模态,多模态底座具备文生图...……更多
理想汽车多模态认知大模型Mind GPT正式上线 【理想汽车多模态认知大模型Mind GPT正式上线】财联社3月28日电,理想汽车今日宣布,全自研多模态认知大模型Mind GPT已正式上线,成为首个通过备案的汽车厂商自研大模型。(财联社...……更多
百灵大模型多模态能力全面提升
...IT之家从蚂蚁集团获悉,蚂蚁集团自研的百灵大模型的多模态能力全面提升。多模态能力让大模型能“看”会“听”,能“说”会“画”,可支持音、视、图、文等多模态理解与生成,可以让大模型更像人一样感知和互动,未来...……更多
多模态模型评测框架lmms-eval发布!全面覆盖,低成本,零污染
...qizhixin.com随着大模型研究的深入,如何将其推广到更多的模态上已经成为了学术界和产业界的热点。最近发布的闭源大模型如 GPT-4o、Claude 3.5 等都已经具备了超强的图像理解能力,LLaVA-NeXT、MiniCPM、InternVL 等开源领域模型也展现...……更多
李未可科技正式推出WAKE-AI多模态AI大模型
...科技正式发布为眼镜等未来终端定向优化等自研WAKE-AI多模态大模型,具备文本生成、语言理解、图像识别及视频生成等多模态交互能力。 该大模型围绕GPS轨迹+视觉+语音打造新一代LLM-Based的自然交互,同时多模态问答技术的加...……更多
云鼎科技:公司盘古矿山大模型自然语言处理和多模态能力方面应用场景处于研发阶段 【云鼎科技:公司盘古矿山大模型自然语言处理和多模态能力方面应用场景处于研发阶段】财联社12月12日电,云鼎科技发布股价异动公告,...……更多
大华股份:星汉大模型以视觉为核心支持多模态分析
...里!公司回答表示:公司星汉大模型是以视觉为核心的多模态大模型。不仅能对视频图片中的目标、场景和事件等进分析分析理解,还能根据用户提示完成特定分析功能,同时也支持文本等其它模态数据的理解,支持人机交互等...……更多
跨模态大模型“白泽”学会藏语
...新藏语内容理解与应用技术,人民网人民中科“白泽”跨模态大模型与青海师范大学的“班智达”藏语识别与翻译引擎深度融合后,显著提升了“白泽”对藏语内容的理解和处理能力,为网络空间藏语内容处理提供了全新的技术...……更多
Sora再度颠覆AI视频行业,A股哪些公司有相关布局?
...实现AGI(通用人工智能)的重要里程碑。券商建议关注多模态技术Sora视频一出,立刻震惊业界。360集团创始人、董事长周鸿祎2月16日在微博发文表示,这意味着AGI实现将从10年缩短到1年。其实,Sora出现之前,也有其他类似的AI...……更多
网达软件:公司“视联网数字化智能平台”不涉及多模态模型 【网达软件:公司“视联网数字化智能平台”不涉及多模态模型】财联社12月8日电,网达软件发布异动公告,近日市场对于AI视频生成、多模态模型等相关概念较为...……更多
微软新专利:构建多模态3d面部模型
...单,微软公司获得了一项新的专利,通过深度学习构建多模态3D面部模型,可以创建非常逼真的虚拟肖像。这项专利全称为《多模态三维面部建模和跟踪,生成富有表现力的虚拟肖像》,该系统涉及处理器和存储系统,处理器负...……更多
云知声推出山海多模态大模型:实时生成文本、音频和图像
IT之家 8 月 26 日消息,云知声于 23 日宣布推出山海多模态大模型。通过整合跨模态信息,山海多模态大模型能够接收文本、音频、图像等多种形式作为输入,并实时生成文本、音频和图像的任意组合输出。▲云知声山海助手微...……更多
更多关于科技的资讯:
“学而思长公主”宣布离职:曾在直播间被连升4级成高管
快科技1月16日消息,据媒体报道,近日,“学而思长公主”橙橙宣布离职,她表示由于个人原因选择离开学而思优品主播的职位。在视频中
2025-01-16 17:56:00
小车没拉开距离就强行见缝插针变道:大货车被逼翻横躺高速
科技1月16日消息,学过交规,考过驾照的都应该知道,超车变道时一定要留出足够的安全距离,不能强挤硬挤,然而开车上路后,总有人行车不规范
2025-01-16 17:56:00
长江存储致态TiPro9000 2TB SSD评测:长江首款PCIe 5.0 SSD 登场即是最强
一、前言:长江存储致态首款PCIe 5.0 SSD终于发布不少品牌的PCIe 5.0 SSD上市已经有一段时间,但一直没有普及开来
2025-01-16 17:56:00
学历出处都是浮云!马斯克在线Boss直聘:直接甩代码给我就行
快科技1月16日消息,马斯克在社交平台发布了一则招聘启事,招聘资深软件工程师。马斯克表示招聘标准非常简单直接,不关心应聘者的学历背景
2025-01-16 17:56:00
全球最薄折叠机!OPPO Find N5渲染图出炉:对称式潜望三摄设计
快科技1月16日消息,今日数码博主定焦数码曝光了OPPO Find N5的设计假想图。根据该博主放出的图片来看,OPPO Find N5的摄像头模组采用了对称式设计
2025-01-16 17:56:00
中央经济工作会议提出,要加强监管,促进平台经济健康发展。平台与商家之间共生共赢的互惠关系,一直以来都是推动行业蓬勃发展的不竭动力
2025-01-16 18:14:00
快科技1月16日消息,近日,一段有关极越07的视频在网络上引起了关注,视频中一位极越的供应商展示了这样一幕:有人分享了一份高中物理期末试卷
2025-01-16 18:26:00
灵感源自中国农历龙年!劳斯莱斯幻影“祥龙贺瑞”定制版官宣:现款986万元
快科技1月16日消息,劳斯莱斯发布了幻影“祥龙贺瑞”定制版车型的官方图片。这是一款由中国客户委托定制的车型,由劳斯莱斯上海专属定制中心主导设计
2025-01-16 18:26:00
育碧被曝大多数老员工已离开!留下的只知道推动“觉醒”
快科技1月16日消息,据YouTuber AccolonnTV爆料,育碧内部动荡持续,许多资深开发者已离开公司,转而寻找更好的发展机会
2025-01-16 18:26:00
联发科天玑9400荣膺快科技王者性能大奖!天玑9300+也有斩获
近日,快科技重磅推出2024年年终评奖,分为PC电脑、手机数码、汽车三大品牌类,其中联发科在手机SoC列别中表现突出,天机9400
2025-01-16 18:26:00
解读鸿蒙智行2024智驾报告:华为迈入智驾时代
2024年无疑是智能驾驶领域具有里程碑意义的一年,在过去一年,智能驾驶不仅在技术实现了持续升级迭代,还在市场中实现了快速渗透
2025-01-16 18:26:00
外卖小哥接到奇怪订单 地址是桥下!结果顾客开着大船来取餐
快科技1月16日消息,近日,江苏南通,一位外卖小哥站在桥上精准向大船投送外卖的视频火了。视频中,一位外卖小哥拿着外卖站在桥上等人
2025-01-16 18:26:00
很多人不知道肾脏很怕6种食物:高盐第一个上榜
快科技1月16日消息,肾脏是我们身体里非常重要的“过滤器”,是排出身体废物的重要器官之一,要想保护肾脏,就得尽量远离对肾脏不友好的食物
2025-01-16 18:26:00
本文转自:人民网人民网北京1月16日电 (记者许维娜)30年前,中国开启了互联网新时代。如今,无论是网络购物的便捷,还是移动支付的普及
2025-01-16 18:46:00
青年计算机图像处理专家全宇晖逝世 年仅39岁 曾参与多项国家科研项目
快科技1月16日消息,今日,据澎湃新闻报道,青年计算机图像处理专家、华南理工大学计算机学院副教授全宇晖,于2025年1月14日在广州因病逝世
2025-01-16 18:56:00