• 我的订阅
  • 头条热搜
“试用完谷歌的新AI模型,再也不爱GPT”
...号,憋了好久的谷歌开大了,直接推出了最新的人工智能模型 Gemini ( 双子座 )。这个被谷歌称为规模最大、能力最强的人工智能模型,如果光看官方的演示视频,那真的过于高级了点。在视频里, Gemini 不仅秒识别演示者画的...……更多
疯狂一夜!美国AMD、谷歌纷纷亮出大杀器,人类迎来巨变前夜?|钛媒体焦点
...迄今为止功能最强大、最通用的多模态人工智能(AI)大模型:Gemini(中文称“双子座”)。具体来看,谷歌最新发布的Gemini 1.0系列,主要是英语模型,共包括三个不同尺寸版本:Ultra(超大杯)、Pro(大杯)和Nano(中杯),将...……更多
Meta首款多模态Llama 3.2开源!1B羊驼宝宝,跑在手机上了
...点在于,Llama 3.2成为羊驼家族中,首个支持多模态能力的模型。Connect大会上,新出炉的Llama 3.2包含了小型(11B)和中型(90B)两种版本的主要视觉模型。正如Meta所说,这两款模型能够直接替代,相对应的文本模型,而且在图像...……更多
Gemini的展示是剪辑造假?我们亲测了一下,发现…
...重推出他们史上“规模最大、能力最强”的原生多模态大模型Gemini 1.0。并称已在多项基准测试中打败GhatGPT,综合能力称霸目前市面上所有AI大模型。官方放出的一段6分22秒演示视频更是震撼:Gemini能流畅而准确地识别出视频中...……更多
多模态竞技场对标90B Llama 3.2!Pixtral 12B技术报告全公开
...杀入江湖的Mistral AI,在9月份甩出了自家的首款多模态大模型Pixtral 12B,如今,报告之期已至,技术细节全公开。作为欧洲的OpenAI,Mistral最近压力不小。端侧小模型端不出来,对比评测的结果又遭到质疑。上个月震撼登场的自家...……更多
阿里多模态检索智能体,自带o1式思考过程!复杂问题逐步拆解
...检索策略,这种设计不仅提高了检索效率,也显著增强了模型生成内容的准确性。为评估OmniSearch,研究团队构建了全新Dyn-VQA数据集。在一系列基准数据集上的实验中,OmniSearch展现了显著的性能优势。特别是在处理需要多步推理...……更多
MMMU华人团队更新Pro版!多模态基准升至史诗级难度:过滤纯文本问题、引入纯视觉问答
...题、增加候选选项、引入纯视觉输入设置)更严格地评估模型的多模态理解能力;模型在新基准上的性能下降明显,表明MMMU-Pro能有效避免模型依赖捷径和猜测策略的情况。多模态大型语言模型(MLLMs)在各个排行榜上展现的性...……更多
哪里不会扫哪里!全球最强数学大模型在线玩,阿里多模态模型加持
现在,最强数学大模型,人人都可上手玩了!一觉醒来,阿里千问大模型团队发布了Qwen2-Math的Demo,抱抱脸在线可玩。惊喜的是,如果嫌输入数学公式比较麻烦,可以把想问的题截图or扫描,上传即可解题。整得挺方便。试玩界...……更多
最强国产多模态刚刚易主!腾讯混元把GPT-4/Claude-3.5都超了
国产大模型,多模态能力都开始超越GPT-4-Turbo了??权威榜单,中文多模态大模型测评基准SuperCLUE-V,新鲜出炉:特别是腾讯的hunyuan-vision、上海AI Lab的InternVL2-40B,分别成为国内闭源和开源界两大领跑者,甚至超过Claude-3.5-Sonnet..……更多
北大等发布多模态版o1!首个慢思考VLM将开源,视觉推理超闭源
北大等出品,首个多模态版o1开源模型来了——代号LLaVA-o1,基于Llama-3.2-Vision模型打造,超越传统思维链提示,实现自主“慢思考”推理。在多模态推理基准测试中,LLaVA-o1超越其基础模型8.9%,并在性能上超越了一众开闭源模型...……更多
多模态LLM视觉推理能力堪忧,浙大领衔用GPT-4合成数据构建多模态基准
...的关注,但最近浙大、中科院等机构的学者们提出,先进模型在视觉推理方面同样不足。为此他们提出了一种多模态的视觉推理基准,并设计了一种新颖的数据合成方法。无论是语言模型还是视觉模型,似乎都很难完成更抽象层...……更多
AI“明星”选手巅峰对决!记者实测最新谷歌Gemini与GPT-4o
...代”。GPT-4o的“o”代表“omni”,一词意为“全能”,该模型能够实现无缝的文本、视频和音频输入,并生成相应模态的输出,真正意义上实现了多模态交互。紧随其后一天,年度Google I/O开发者大会如期而至,谷歌CEO Sundar Pichai...……更多
多模态模型评测框架lmms-eval发布!全面覆盖,低成本,零污染
...稿邮箱:liyazhou@jiqizhixin.com;zhaoyunfeng@jiqizhixin.com随着大模型研究的深入,如何将其推广到更多的模态上已经成为了学术界和产业界的热点。最近发布的闭源大模型如 GPT-4o、Claude 3.5 等都已经具备了超强的图像理解能力,LLaVA-……更多
全模态对齐框架align-anything来啦:实现跨模态指令跟随
...、张钊为、汪明志、钟伊凡等。团队就强化学习方法及大模型的后训练对齐技术开展了一系列重要工作,包括 Aligner(NeurIPS 2024 Oral)、ProgressGym(NeurIPS 2024 Spotlight)以及 Safe-RLHF(ICLR 2024 Spotlight)等系列……更多
Bengio团队提出多模态新基准,直指Claude 3.5和GPT-4o弱点
...想要达成通用人工智能 AGI 的终极目标,首先要达成的是模型要能完成人类所能轻松做到的任务。为了做到这一点,大模型开发的关键指导之一便是如何让机器像人类一样思考和推理。诸如注意力机制和思维链(Chain-of-Thought)等...……更多
让大模型能听会说,国内机构开源首个端到端语音对话模型Mini-Omni
...非与启元世界多模态负责人吴昌桥,研究兴趣为多模态大模型、LLM Agents 等。本论文上线几天内在 github 上斩获 1000+ 星标。随着多类型大模型的飞速发展,全球 AI 已经进入到了多模交互时代。2024 年 5 月,OpenAI 推出了全新的多模...……更多
大模型的未来,快手在自己身上找答案
...检票口久违的出现了许多黄牛,这一切都意味着国内对大模型的关注从 2023 年小圈子里的迅速升温,到现在的白热。所有人都在想尽办法靠近大模型,所有公司都在寻找一种对大模型来说合适的描述方式,但从目前来看,大多都...……更多
llava-1.6与gpt-4vmp面硬刚的性能,一起来看看
...-Plus,与GPT-4V正面硬刚,这个有着SOTA级别性能的多模态大模型真正做到了“人无我有,人有我优”。继2023年4月的初级版本、2023年10月的LLaVA-1.5之后,2024年1月31日,微软研究院又联合威斯康星大学麦迪逊分校和哥伦比亚大学的研...……更多
百万鲁棒数据训练,3D场景大语言模型新SOTA!IIT等发布Robin3D
...数据生成引擎(RIG)生成的大规模数据进行训练,以提高模型在3D场景理解中的鲁棒性和泛化能力,在多个3D多模态学习基准测试中取得了优异的性能,超越了以往的方法,且无需针对特定任务的微调。多模态大语言模型(Multi-mo...……更多
AWS搭载“最强大模型”!40亿美元投向OpenAI竞对
...与AI创企Anthropic合作的最新进展,并现场演示了Claude 3大模型的多模态、长文本、语境理解等能力。AWS近日宣布向Anthropic追加投资27.5亿美元,截至目前已经向这家OpenAI强力竞对累计注资40亿美元。此外,双方的合作关系也再次加...……更多
科学家打造多模态模型,7B和1.3B小模型均开源,可部署手机等终端
在最近一项研究中,DeepSeek-AI 团队针对多模态大模型展开了深入探索。选择这一研究方向,背后有着多重考量。最初,该团队围绕是否聚焦于多模态生成、多模态理解、或是两者的统一框架进行了广泛讨论。基于对通用人工智...……更多
智源评测体系发布 国内外“百模”评估结果出炉
5月17日,智源研究院举办大模型评测发布会,正式推出智源评测体系,发布并解读国内外140余个开源和商业闭源的语言及多模态大模型全方位能力评测结果。本次智源评测,分别从主观、客观两个维度考察了语言模型的简单理...……更多
全国首个 成都创新团队发布机器人多模态模型
中国首个机器人多模态模型,可以相对明确地将水果和非水果进行区分和分拣如果你想吃苹果,根据语音指令,机器人会把苹果送到你手上;如果想收拾干净桌面,机器人就会把桌上所有的东西归置好……这个关于人工智能描...……更多
手机上能跑的「GPT-4V」来啦!多图、视频理解首次上端!面壁小钢炮开源史上最强端侧多模态
...再次刷新端侧多模态天花板,面壁「小钢炮」 MiniCPM-V 2.6 模型重磅上新!仅8B参数,取得 20B 以下单图、多图、视频理解 3 SOTA 成绩,一举将端侧AI多模态能力拉升至全面对标超越 GPT-4V 水平。更有多项功能首次上「端」:小钢炮...……更多
...工智能研究院理事长、北京大学教授黄铁军表示,构建大模型生态首先要建立数据流通机制,推动从数据到智能的正反馈。汇聚数据超700万亿字节“如果没有开源数据集,很难想象人工智能怎样才能实现如此快速的迭代,然而,...……更多
全球首个多模态地理科学大模型“坤元”发布:可据指令生成专业地理图表
...理科学与资源研究所正式发布全球首个多模态地理科学大模型“坤元”。作为专为地理科学领域量身打造的专业语言大模型,“坤元”不仅精通地理学的精髓,更在“懂地理”、“精配图”、“知人心”、“智生图”四大核心功...……更多
GPT-4V暴露致命缺陷?JHU等发布首个多模态ToM 测试集
...即理解人们思维的能力,是开发具有类人社会智能的 AI 模型的重要基础。近日,来自 JHU, NYU, MIT, Harvard 等机构的研究团队开创了第一个多模态的 ToM 测试基准,发现现有的多模态模型和 LLM 都表现存在系统性缺陷,同时他们提出...……更多
...但很可能永远都达不到;有专家认为,大家对大数据和大模型关注度太高了,现在的人形机器人应该更多关注机器人本体。而关于具身智能,身为北京大学计算机学院前沿计算研究中心(CFCS)助理教授、博士生导师,同时又是...……更多
小红书技术副总裁王晓博:大模型让AI越来越像人,更懂小红书的内容与用户
...下午,由中国信息通信研究院承办的WAIC 2024“迈向AGI:大模型焕新与产业赋能”论坛在上海徐汇西岸拉开帷幕。小红书技术副总裁王晓博在论坛上发表主题演讲,分享了小红书在大模型领域的最新布局与探索。目前小红书社区拥...……更多
AIGC工具测评:生成式AI的产品表现如何
...这一年,AI展现出了前所未有的发展势头,无论是在基础模型能力、实际应用场景,还是资本投入方面都取得了显著进展。特别是在2022年11月30日,OpenAI发布了ChatGPT,标志着AI技术的一个新纪元。紧接着,在2023年1月,ChatGPT的月...……更多
更多关于科技的资讯:
全系标配激光雷达+高阶智驾!极氪007GT实车正式首发亮相
快科技2月24日消息,极氪007GT实车在杭州Ed Sheeran演唱会上正式首发亮相,预计4月中旬上市并交付。作为极氪007的猎装版车型
2025-02-24 23:33:00
不要乱用 女子喷“生发神器”后变“小毛人”
2月24日消息,据媒体报道,一名女子最近使用了“生发神器”——米诺地尔,然而她发现用完后自己发量并没有改善,反而额头、脸颊
2025-02-24 23:33:00
建议睡觉时把手机放1.5米以外:睡前不要放床头充电
快科技2月24日消息,据媒体报道,手机、电脑等散发的辐射能量很低,不足以使物质的原子或分子产生电离。研究发现,当手机距离人体50厘米时
2025-02-24 23:33:00
15万级支持高速NOA+自动泊车!奇瑞iCAR全新车型计划曝光
快科技2月24日消息,奇瑞汽车即将推出代号为iCAR的全新车型,瞄准15万元级别的市场。这款新车最大的卖点是其搭载的先进智能驾驶辅助系统
2025-02-25 00:03:00
三方携手, “合肥造”低空飞行器越飞越高
大皖新闻讯 低空飞行器常被称为“空中汽车”,未来将发展为具有大众化属性的新型交通工具。2月24日下午,亿航智能、江淮汽车与合肥国先控股有限公司正式签署战略合作协议
2025-02-25 00:29:00
网友怒斥遇一男团插队登机 Loong9致歉:避免造成拥挤事故
快科技2月25日消息,今日,词条#网友怒斥遇一男团插队登机#登上微博热搜,引起网友热议。对此,Loong9组合官微发文回应
2025-02-25 00:33:00
听!“耳朵”里的新经济(创新赋能新质生产力)
本文转自:人民日报海外版李 贞 宋佳航 郭 晗2024年12月7日,在陕西省西安市碑林区太阳庙门上演了一场浪漫的阳台音乐会
2025-02-25 05:03:00
本文转自:人民日报本报北京2月24日电 (记者申少铁)工业和信息化部与国家卫生健康委主导的“便携式一体化生命支持系统”高质量发展专项启动
2025-02-25 05:46:00
本文转自:人民日报本报记者 窦瀚洋“去年,我们用生物基尼龙代替传统尼龙,实现了面料的生物降解,环保附加值更高。”“能否对面料中间层的薄膜进一步优化
2025-02-25 05:46:00
本文转自:人民日报本报记者 王 珂 原韬雄国家搞“以旧换新”,政策挺好,但也有一些“吐槽”,有人担心商家会不会先涨价后打折
2025-02-25 05:47:00
史上最抽象的飞行汽车 今年就要量产了
这大概是我最近这几年见过的,最抽象的汽车了,没有之一。就在前几天,一家名叫 ALEF 的美国初创公司发布了一段视频,表示自家的飞行汽车 Model A 已经成功试飞
2025-02-25 07:03:00
用Excel玩《王者荣耀》 在这个比赛里可能都算小儿科了
如果我告诉你,最近差评君迷上了电竞比赛,我想,你可能会让我分享下 ~ 但如果我告诉你,这个电竞比赛是 Excel 比赛呢
2025-02-25 07:03:00
网友曝航班发放过期坚果包 签保密协议后补偿1千!吉祥航空回应
快科技2月25日消息,据报道,日前有网友发帖爆料称,他乘坐吉祥航空H01256号航班,从乌鲁木齐飞往上海虹桥时,乘务人员给乘客发放的坚果包过期了10天
2025-02-25 07:03:00
小米15 Ultra三配色真机首发上手:黑、白、双拼
快科技2月25日消息,小米15 Ultra已经定档2月27日发布,日前官方已经公布了外观。魏思琪甚至还发布了一段视频,直接展示了小米15 Ultra全配色真机
2025-02-25 07:03:00
你年薪能上20W+吗!全国人均GDP十强城市一览:北京只能排第三
快科技2月25日消息,据国内媒体报道称,全国人均GDP十强城市,又洗牌了。根据各地统计局公布的2024年经济运行数据和国家统计局公布的2023年各省的常住人口数进行粗略计算
2025-02-25 07:33:00