• 我的订阅
  • 头条热搜
最强国产多模态刚刚易主!腾讯混元把GPT-4/Claude-3.5都超了
国产大模型,多模态能力都开始超越GPT-4-Turbo了??权威榜单,中文多模态大模型测评基准SuperCLUE-V,新鲜出炉:特别是腾讯的hunyuan-vision、上海AI Lab的InternVL2-40B,分别成为国内闭源和开源界两大领跑者,甚至超过Claude-3.5-Sonnet..……更多
智慧芽垂直领域大模型通过国家网信办“双备案”
...、C-Eval,以及智慧芽面向业内首次提出的专利大模型测试基准(Patent-bench)的测评结果显示,智慧芽垂直领域大模型在问答、总结、写作、翻译、分类等方面能力整体优于商业通用大模型。图:智慧芽垂直领域大模型专业考试成...……更多
腾讯开源最大MoE大语言模型!3D大模型同时支持文/图生成,晒混元模型及应用全家桶
...混元API服务调用,可满足文生文、图生文、文生图等不同模态以及角色扮演、FunctionCall、代码等不同专项的模型需求。2024年年初,腾讯混元就宣布在国内率先采用MoE架构模型,总体性能比上一代密集模型提升50%。此后,腾讯混...……更多
商汤升级“日日新5.0”大模型,对标GPT-4Turbo
...金融、数据分析等场景落地提供基础。“日日新5.0”的多模态能力在多模态大模型权威综合基准测试MMBench中综合得分排名首位,在多模态榜单MathVista、AI2D、ChartQA、TextVQA、DocVQA、MMMU中取得领先成绩。“日日新5.0”支持高清长图...……更多
WOT全球技术创新大会2024北京站:探索AI 的无限可能
...里巴巴、Fabarta、商汤科技的三位老师带来精彩分享。多模态AIGC前沿探索专题竞技世界在直播亮点和舆情感知两个真实场景中,如何使用多模态AIGC在实际应用中获取价值?万物云如何通过结合文本和图像输入,利用AI算法自动生...……更多
数字人说武汉、AI画建议 两会现场注入科技“创新力”
...两会版数字人。武汉人工智能研究院大模型是全国产、全模态,除了语音、图像和文本,还可以识别视频、3D点云等模态数据,与长江日报联合开发武汉两会版3D数字人,进行大模型语料训练,更懂两会,更懂大武汉。代表委员...……更多
2B多模态新SOTA!华科、华南理工发布Mini-Monkey,专治「切分增大分辨率」后遗症
【新智元导读】Mini-Monkey 是一个轻量级的多模态大型语言模型,通过采用多尺度自适应切分策略(MSAC)和尺度压缩机制(SCM),有效缓解了传统图像切分策略带来的锯齿效应,提升了模型在高分辨率图像处理和文档理解任务的...……更多
讯飞星火V4.0整体超越GPT-4 Turbo,8个国际权威测试集测评第一
...但具备了多语种多方言的“自由交互”,还具备多情感多模态的超拟人交互,让人车交互更有温度。当前,讯飞语音交互产品国内市占率稳居第一,同时广泛出口到世界各地。星火大模型为一汽、奇瑞、广汽、江淮、长城等车企...……更多
什么影响大模型安全?NeurIPS\\\'24新研究提出大模型越狱攻击新基准
...融等关键行业,评估并保障这些领域中LLMs的安全性。 多模态扩展:探索多模态数据的越狱评估,结合文本、图像、音频等多种数据类型,全面评估LLMs在多模态环境下的安全表现。 协作防御机制:开发基于多Agent的协作防御机...……更多
字节跳动豆包大模型发布,火山引擎全栈AI服务助力企业智能化转型
...现最佳效果和性价比。为此,豆包大模型提供的是一个多模态模型家族,企业可根据自身业务场景需求灵活选择,实现模型使用及成本控制的正循环。人人用得起 才是好模型谭待认为,降低成本是推动大模型快进到“价值创造...……更多
打造全球智能消费决策社区,「阿尔特科技」希望提供“像闺蜜一样”有针对性的消费决策辅助 | 早期项目
...评测和信息验证;在需求端,这款App以团队内部开发的多模态模型为支撑,能捕捉细微的用户行为,进而根据用户的实际需求和消费习惯精准推送用户可能感兴趣的产品,帮助用户挑选更合适的、更高性价比的产品,降低客户遇...……更多
讯飞星火首发AI合同助手,大模型时代的“超级知识助手”来了
...均已经超过 GPT-4 Turbo,代码能力达到 GPT-4 Turbo 的 96%,多模态理解达到 GPT-4V 的 91%,处在国际领先水平。 但除了模型能力的提升之外,想要收获 C 端用户的欢迎还要具备好用、易用等特点。讯飞星火发布之初,针对用户不知道...……更多
...“爱尔名医陪伴数字人”,可支持视频、文本和语音等多模态交互,也即将投入应用。“爱科(Eyecho)”的名字既体现爱尔“创新驱动,科技爱尔”的发展战略,也起英文Echo“回音”之意,蕴含爱尔运用最新的人工智能技术,...……更多
文生图参数量升至240亿!Playground v3发布:深度融合LLM,图形设计能力超越人类
...nd v3(简称PGv3),将模型参数量扩展到240亿,在多个测试基准上达到了最先进的性能,更擅长图形设计。与传统依赖于预训练语言模型如T5或CLIP文本编码器的文本到图像生成模型不同,PGv3完全集成了大型语言模型(LLMs),基于...……更多
CVPR最佳论文被生成式AI占领,清华武大华南农大上科校友获奖
...并得到最终反馈标签。之后,设计了一种基于ViT和T5X的多模态Transformer模型RAHF,使用三种预测器预测上述丰富的人类反馈信息:使用卷积层和上采样层预测失真和不匹配的热力图 使用卷积层和全连接层预测4个方面的评分 使用Trans...……更多
多款技术产品问世!山东省新型智慧媒体重点实验室亮点纷呈
...”“基于主流价值观的党媒算法研究”“基于AI技术的多模态内容风控研究”“基于区块链技术的版权确权研究”五个方向,深入开展底层技术攻关研究,力求探索出一条能够使主流媒体与用户重新建立“深度连接”,重塑核心...……更多
疯狂一夜!美国AMD、谷歌纷纷亮出大杀器,人类迎来巨变前夜?|钛媒体焦点
...布,谷歌公司正式发布迄今为止功能最强大、最通用的多模态人工智能(AI)大模型:Gemini(中文称“双子座”)。具体来看,谷歌最新发布的Gemini 1.0系列,主要是英语模型,共包括三个不同尺寸版本:Ultra(超大杯)、Pro(大...……更多
谷歌 Gemini 1.5 AI 模型再进化:成本更低、性能更强、响应更快
...了 Gemini-1.5-Flash-8B-Exp-0924升级版,进一步增强了文本和多模态应用。用户可以通过 Google AI Studio、Gemini API 和 Vertex AI(面向 Google Cloud 客户)访问新的 Gemini 模型……更多
讯飞星火:致力于成为每个人的AI助手
...能力明显提升、数学能力再升级;8月15日,代码能力、多模态交互能力升级;10月24日,实现中文能力超越,英文能力相当。升级后的讯飞星火认知大模型V3.0从文本生成、语言理解、知识问答,到逻辑推理、数学能力、代码能力...……更多
记者实测|速度更快成本更低,人机交互更自然,OpenAI新模型免费开放
...列新模型GPT-4o以及AI聊天机器人ChatGPT的桌面版本,聚焦多模态和端侧应用。此前OpenAI公司CEO奥尔特曼(Sam Altman)就已经否认了公司将会发布GPT-5,他表示新版GPT非常“神奇”。根据OpenAI官方网站介绍,GPT-4o中的“o”代表Omni,也...……更多
Gemini引领多模态AI热潮,产业发展有望加速
12月11日,多模态AI概念股继续活跃,苏州科达(603660.SH)三连板。截至当日中午收盘,因赛集团(300781.SZ)涨13.32%,苏州科达涨9.96%,宣亚国际(300612.SZ)涨9.7%。消息面上,GoogleAI大模型Gemini近日发布,Gemini是Google到目前为止规……更多
讯飞星火V3.0发布,打造每个人的AI助手
...学自动提炼规律、小样本学习、代码项目级理解能力、多模态指令跟随与细节表达等能力,进一步提升星火的落地应用能力。升级AI人设、启发式对话,打造每个人的AI助手自讯飞星火9月5日全民开放后,当前已有1200万用户,也...……更多
阿里CEO吴泳铭:生成式AI让世界有了一个统一的语言——Token
...为了AI发展的最大障碍。当前的数字化世界,信息以多种模态存在——自然语言、程序代码、图像、视频、音频、3D模型、数学符号……这些信息形式各自独立,彼此之间的“对话”几乎不存在。AI虽然能够在单一模态下表现出色...……更多
谷歌版贾维斯即将问世,最强Gemini 2.0加持!AI自主操控电脑时代来临
...,最后就可以完成用户任务。可见,想要把类似GPT-4V的多模态大模型应用于操作系统上,模型还需要具备强大的屏幕解析能力,主要包括两方面:1、准确地识别用户界面中的可交互图标;2、理解屏幕截图中各种元素的语义,并...……更多
马斯克官宣Grok-2测试版!xAI将继续拥抱开源路线吗?
...来,于今年3、4月陆续推出了Grok-1.5大语言模型和首个多模态模型Grok-1.5 Vision,整体迭代速度已足够惊人。但要超越当前所有AI大模型,Grok-2要面对的问题或许远没想象中简单。所有指标超越当前AI大模型,真的假的?2023年11月,x...……更多
Sora爆火96小时国内大模型进场
...车面临不小的难度。碾压同行2月16日,谷歌发布新一代多模态大模型Gemini 1.5 Pro,在性能上超越OpenAI的GPT-4 Turbo,堪称业界最强大模型。然而,OpenAI在同一日发布Sora大模型,风头直接盖过谷歌,仅需通过文本即可自动生成视频,...……更多
OpenAI史诗级更新!最强大模型炸场,128K上下文、价格暴降2/3
...、知识更新鲜,而且能一次性输入一整本书。2、开放新模态API:包括接受图像输入的GPT-4 Turbo、文生图模型DALL·E 3、 文本转语音模型TTS,不久后还将支持自动语音识别模型Whisper v3。 3、GPT定制化服务:支持用户5分钟内、无代码...……更多
本周硅谷发生了什么?|OpenAI推出5项更新;微软组建新的AI团队;Googe发布文生视频模型Lumiere
...GenAI团队研发小模型,减少对OpenAI的依赖。Adept AI发布多模态模型Fuyu-Heavy,官方称跑分表现仅次于GPT4-V和Gemini Ultra。同时,国内大模型也有不少进展,通义千问团队升级了视觉语言模型Qwen-VL,图片内文字处理能力得到提升。此外...……更多
Gemini的展示是剪辑造假?我们亲测了一下,发现…
...场,隆重推出他们史上“规模最大、能力最强”的原生多模态大模型Gemini 1.0。并称已在多项基准测试中打败GhatGPT,综合能力称霸目前市面上所有AI大模型。官方放出的一段6分22秒演示视频更是震撼:Gemini能流畅而准确地识别出...……更多
超越扩散模型!自回归新范式仅需2.9秒就生成高质量图像
...VAR指出是因为自回归模型逐个预测token的行为不符合图像模态的特点,提出“next-scale prediction”范式,将视觉自回归建模为逐个预测更大尺度scale的token map。这一方式避免了原始基于next-token的自回归方案难以建模图像模态的问题...……更多
更多关于科技的资讯:
马化腾内部透露:把广告当内容来看待 看好未来AI带给广告的提升空间
快科技1月13日消息,据媒体报道,腾讯在今天下午召开了2024年度员工大会。在大会现场,腾讯公司董事会主席兼首席执行官马化腾发表了重要讲话
2025-01-13 18:53:00
放手让车自己去停:华为泊车代驾全球首个机场商用试点发布
快科技1月13日消息,华为乾崑智能汽车解决方案官方官宣,华为乾崑智驾ADS 3.0泊车代驾(VPD)在深圳宝安国际机场正式启动首个商用试点
2025-01-13 18:53:00
曝iPhone 17 Air堪称“实验机”!设计大改为可折叠iPhone铺路
快科技1月13日消息,马克·古尔曼最新曝光了苹果2025年计划,将推出一款全新的iPhone 17 Air,这款设备在设计上有所突破
2025-01-13 18:53:00
黄子韬回应持续掉粉:没抽中就取关会很伤心
1月13日消息,据媒体报道,艺人黄子韬在直播间送出30台车,其中10辆捐给妇女儿童基金会。直播送车后,黄子韬掉粉超百万
2025-01-13 18:53:00
英特尔CES又发新品 14代酷睿/酷睿Ultra怎么搭配主板
英特尔最近几年先后发布了12、13、14代酷睿,去年又带来了酷睿Ultra 200S系列处理器,而在今年又在CES上发布酷睿Ultra 200S系列的非K版本和B860/H810芯片组
2025-01-13 18:53:00
华恒隆科技固废检测:智能化与绿色化的深度融合
在环境保护和资源循环利用日益受到重视的今天,固废检测成为了确保工业废弃物合规处理、资源高效回收的关键环节。华恒隆,作为固废检测领域的先行者
2025-01-13 18:59:00
华恒隆科技铁矿石快速筛查系统:铁矿石筛查的核心引擎
在铁矿石资源日益紧张的今天,高效、准确地识别与分类铁矿石对于资源的高效利用和环境保护至关重要。华恒隆,作为矿石检测技术的领航者
2025-01-13 19:05:00
推动科普连接赋能 业内聚焦创新人才贯通式培养
本文转自:人民网人民网北京1月13日电 (记者孙阳)近年来,整合产学研多方优势资源,着力打造协同规范的科学素质建设生态
2025-01-13 19:13:00
路人在日本被火车撞或反遭铁路公司索赔:最高可达数百万
1月13日消息,媒体报道,近日在日本兵库县,两名中国女游客在铁路道口等红绿灯时遭列车撞击,一名当场身亡,另一名送医后也不幸身亡
2025-01-13 19:23:00
公园观赏鱼大量死亡 一男子被刑拘:嫉妒同行 投放杀虫剂
快科技1月13日消息,日前,重庆一公园观赏鱼大量死亡引发关注。网友晒出的画面显示,公园原本生机勃勃的湖面如今却成了一片死寂
2025-01-13 19:23:00
腾讯2024海外游戏大调整 马化腾点评:非常争气 海外业务已接近国内一半
快科技1月13日消息,今日下午,腾讯召开了以“凝心聚力”为主题的2024年度员工大会。会上,腾讯公司董事会主席兼首席执行官马化腾发表了重要讲话
2025-01-13 19:23:00
本月13日,拉卡拉支付股份有限公司(300773.SZ,以下简称“拉卡拉”)宣布斥资2.5亿+战略入股天财商龙,双方签署框架协议
2025-01-13 19:31:00
机器人灵巧手“肌腱”,谁在布局?关注恒辉安防、南山智尚
特斯拉灵巧手的驱控方案已经基本定型,用腱绳实现三级传动连接模组和末端手指,克服了重量与灵活性的问题。 根据“中国机器人网”
2025-01-13 19:45:00
三轮全责撞宾利被代位追偿引热议 网友:应借鉴美国的“无过错制度”
快科技1月13日消息,据报道,近日,浙江衢州,一位卖猪肉的老人开三轮车逆行下山,撞上了正常行驶的宾利欧陆GT轿车。事后
2025-01-13 19:53:00
周鸿祎AI短剧女一号演员亮相:气质美女演女王陛下
快科技1月13日消息,今晚,周鸿祎在最新视频中揭晓了海选胜出的女王陛下。此前,他宣布将拍摄一部约60集的穿越题材短剧,女主角是一位女皇帝
2025-01-13 19:53:00