• 我的订阅
  • 头条热搜
这才是真开源模型!公开后训练一切,性能超越Llama 3.1 Instruct
开源模型阵营又迎来一员猛将:Tülu 3。它来自艾伦人工智能研究所(Ai2),目前包含 8B 和 70B 两个版本(未来还会有 405B 版本),并且其性能超过了 Llama 3.1 Instruct 的相应版本!长达 73 的技术报告详细介绍了后训练的细节。在...……更多
小米大语言模型MiLM-6B首次现身!同参数量级排名第一
快科技8月11日消息,近日,小米的大语言模型MiLM-6B首次现身C-Eval、CMMLU两大AI模型评测榜单。截至本文成稿,MiLM-6B在C-Eval总榜单排名第10、同参数量级排名第1,在CMMLU中文向大模型排名第1。根据C-Eval给出的信息,MiLM-6B模型在各...……更多
...绩报告,财报指出:“腾讯混元已经发展成为领先的基础模型,在数学推导、逻辑推理以及多轮对话中性能卓越。”并首度披露腾讯混元采用混合专家模型结构,已扩展为万亿参数规模。自亮相以来,腾讯混元大模型持续迭代升...……更多
宁蒗两光伏发电项目全容量并网发电
...有限公司投资建设的宁蒗县木香坪56兆瓦光伏发电项目、分水岭70兆瓦光伏发电项目实现全容量并网发电。木香坪项目额定装机容量56兆瓦,配套送出线路工程25.66千米,项目建成投产后,每年可向电网输送约1.04亿千瓦时绿色电能...……更多
...,一项衡量美国制造业活动的指标连续第14个月低于荣枯分水岭。周三发布的数据显示,得益于产量回升,12月供应管理协会(ISM)制造业指数微升0.7点至47.4。这是自2000-2001年互联网泡沫破裂引发经济衰退以来制造业经历的最长萎...……更多
...的重要作用,设计灌溉面积99.3万亩,灌溉范围覆盖江淮分水岭脊背地区的定远县和肥东县,主要由灌溉系统工程、引江水源骨干泵站及输水工程、城乡供水水源工程组成,工程总投资115.428亿元,建设总工期为48个月。据悉,该...……更多
阿里巴巴即将开源目前国内参数规模最大的大模型 【阿里巴巴即将开源目前国内参数规模最大的大模型】《科创板日报》9日讯,阿里巴巴集团CEO吴泳铭今日在2023年世界互联网大会乌镇峰会上透露,阿里巴巴即将开源720亿参数...……更多
浪潮AI 人工智能“小源” 破“杀猪盘”诈骗套路
日前,由浪潮AI研究院研发的大规模中文语言模型“源1.0”在某次反诈行动中发挥出了出色的实效。期间,在“源1.0”的基础上,开发者开发了一个能够无障碍进行微信聊天的人工智能“小源”,并在与骗子的真实对话场景中进...……更多
阿里Qwen3登顶全球最强开源模型,用8款模型夺回中国AI话语权
出品 | 搜狐科技作者 | 梁昌均编辑 | 杨锦一口气开源8款模型,阿里通义又上新!4月29日一大早,阿里开源发布Qwen3,包括两款MoE(混合专家架构)模型,其中具备2350亿参数规模的Qwen3-235B-A22B,在对比测试中成为目前最强大的开...……更多
天垓100率先完成百亿级参数大模型训练,天数智芯迎来新的里程碑
...院(以下简称“智源研究院”)70亿参数的Aquila语言基础模型,使用代码数据进行继续训练,稳定运行19天,模型收敛效果符合预期,证明天数智芯有支持百亿级参数大模型训练的能力。图 天数智芯产品线总监宋煜在北京市海淀...……更多
GPT-4被破解 训练成本 模型架构的秘密都被挖出来了?
...字节跳动、百度等在短期内都将拥有与 GPT-4 一样强大的模型。不要误解我们的意思,OpenAI 拥有令人惊叹的工程技术,他们构建的东西令人难以置信,但他们得出的解决方案并不神奇。这是一个优雅的解决方案,具有许多复杂的...……更多
安徽向新丨滁州来安:“四好农村路”绘出大蓝图
...,指着路边的货车讲述以往种桃的辛酸。陡山村地处江淮分水岭,非常适合冬桃生长,但地理位置偏僻、交通闭塞,他种了近20亩冬桃,以前大车进不了村,每年都要为冬桃的销售“挠头”,只能用手扶拖拉机一车车向县城和镇...……更多
随着AI技术的不断突破和迭代,先前涌现的各大模型迎来了进一步的落地应用。近日,小i机器人在上海正式发布华藏通用大模型生态体系,迈出了通用大模型商业化变现的重要一步。在发布会上,工作人员通过华藏输入“帮我...……更多
贾扬清:大模型尺寸正重走CNN的老路;马斯克:在特斯拉也是这样
Transformer大模型尺寸变化,正在重走CNN的老路!看到大家都被LLaMA 3.1吸引了注意力,贾扬清发出如此感慨。拿大模型尺寸的发展,和CNN的发展作对比,就能发现一个明显的趋势和现象:在ImageNet时代,研究人员和技术从业者见证...……更多
比Stable Diffusion便宜118倍!1890美元训出11.6亿参数高质量文生图模型
...研究人员,利用延迟掩蔽、MoE、分层扩展等策略,将扩散模型的训练成本降到了1890美元。训练一个扩散模型要多少钱?之前最便宜的方法(Wuerstchen)用了28400美元,而像Stable Diffusion这样的模型还要再贵一个数量级。大模型时代...……更多
垂直大模型竞争,能突破数据“卡点”吗?
AI大模型火遍全球,中国产业也激发了对人工智能应用的新热情。随着各大厂商参与竞逐,市场正在分化为通用与垂直两大路径,两者在参数级别、应用场景、商业模式等方面差异已逐步显现。01 企业涌入垂直大模型赛道通用AI...……更多
我国发布首个亿级参数量地震波大模型:名为“谛听”
...,据成都科技局官方公众号介绍,日前“谛听”地震波大模型在四川成都发布。“谛听”由国家超级计算成都中心、中国地震局地球物理研究所以及清华大学联合开发,是首个亿级参数量的地震波大模型。同时,“谛听”也是目...……更多
深耕AI框架创新土壤 华为打造开放计算生态
...时,18家单位在会上发布了基于昇思AI框架的原生开发大模型成果,这意味着AI框架生态已走深向实,加速融入千行百业。彭红华在会上致辞。主办方供图华为ICT战略与业务发展部总裁彭红华在会上表示,华为一直坚持打造开放的...……更多
谷歌开源最强端侧小模型:2B参数越级跑赢GPT-3.5-Turbo
谷歌也来卷「小」模型了,一出手就是王炸,胜过了比自己参数多得多的GPT-3.5、Mixtral竞品模型。今年 6 月底,谷歌开源了 9B、27B 版 Gemma 2 模型系列,并且自亮相以来,27B 版本迅速成为了大模型竞技场 LMSYS Chatbot Arena 中排名最...……更多
20亿参数!谷歌发布轻量级开源人工智能模型Gemma
...CNMO新闻】近日,谷歌发布了其首个重要的开源大型语言模型Gemma,这标志着自从OpenAI的ChatGPT引领了人工智能聊天机器人热潮以来,在2022年取得了重要突破。Gemma是由谷歌DeepMind和其它团队共同开发的,旨在为开发人员和研究者提...……更多
...近年来,生成式人工智能的兴起,迅速掀起全球范围的大模型技术发展热潮。生成式人工智能,是指基于算法、模型、规则生成文本、图片、声音、视频、代码等内容的技术。具有上千万甚至百万亿参数的深度学习或机器学习模...……更多
国产首台GPU千亿参数大模型训推一体机发布,优刻得提供灵活算力部署方案
...称“沐曦”)、智谱华章共同发布国产首台GPU千亿参数大模型训推一体机。国产首台GPU千亿参数大模型训推一体机发布仪式优刻得与沐曦、智谱华章共同在宁夏的开放平台上面向第一批用户:航天医院、数字宁夏建设运营有限公...……更多
阿里巴巴智能信息事业群发布千亿级参数夸克大模型 【阿里巴巴智能信息事业群发布千亿级参数夸克大模型】财联社11月14日电,记者今日获悉,阿里巴巴智能信息事业群正式发布全栈自研、千亿级参数夸克大模型,将应用于通...……更多
微软推出14b参数“最先进”小型语言模型
...13日消息,微软今天宣布推出14B参数“最先进”小型语言模型(SLM)Phi-4,除了传统的语言处理外,它还擅长数学等领域的复杂推理。Phi-4是Phi系列小型语言模型的最新成员,官方表示其展示了微软继续探索SLM边界的可能性。官方...……更多
“灯火通明”推进大模型产业落地应用
本文转自:文汇报全国首个大模型生态社区“模速空间”开张4个月入驻企业50家,创始团队80%来自知名高校“灯火通明”推进大模型产业落地应用“模速空间”争分夺秒地推动各类大模型创新项目落地应用。 均本报记者 沈湫莎...……更多
Intel三条线优化阿里云通义千问2模型:720亿参数轻松拿捏
?Intel三条线优化阿里云通义千问2模型:720亿参数轻松拿捏快科技6月7日消息,Intel官方宣布,旗下数据中心、客户端、边缘AI解决方案均已经为阿里云通义千问2(Qwen2)的全球发布提供支持,已取得ModelScope、阿里云PAI、OpenVINO等...……更多
Meta推出Llama 3,号称“最强开源大模型”
Meta发布最新开源模型Llama3,号称“有史以来最强大的开源大模型”。在Llama3发布后没多久,就破纪录地登顶了全球开源AI社区HuggingFace排行榜,还使Meta股价在大盘小跌的情况下上涨了1.54%,影响力可见一斑。据了解,此次Meta推...……更多
腾讯正式发布混元大模型,号称拥有超千亿的参数规模
...办的2023腾讯全球数字生态大会上,腾讯正式发布混元大模型,号称拥有超千亿的参数规模、超2万亿tokens的预训练语料。在发布会上,腾讯宣布混元大模型今日起对外开放,用户可通过腾讯云进行体验,支持直接调用API接口,或...……更多
高文院士:鹏城实验室已训练3个大模型,今年底将拥有两万多块卡
...城实验室主任高文发表演讲,分享了鹏城实验室在打造大模型平台上的进展。他表示,大模型训练首先需要一个平台。“现在要想训练一个大模型,需要有几千块卡,甚至上万块卡。”他介绍到,鹏城实验室在2020年就搭建了这...……更多
产品周报260期 | 阿里云通义千问开源,美团2024届校园招聘将录用6000人
...!来看看这周发生了什么吧~阿里云开源通义千问70亿参数模型,包括通用模型Qwen-7B和对话模型Qwen-7B-Chat,两款模型均已上线魔搭社区,开源、免费、可商用。美团启动2024届校园招聘,此次招聘面向毕业时间在2023年11月至2024年10...……更多
更多关于科技的资讯:
原佳星摘要:互联网行业的迅速发展使数据成为企业核心资源,统计学专业的重要性随之提升。企业在产品运营、用户分析和商业预测中高度依赖统计能力
2025-12-09 05:45:00
近年来,商品过度包装问题引发社会广泛关注。部分商家为提升商品附加值,通过增加包装层数、扩大空隙率、使用高成本材料等方式制造“包装溢价”
2025-12-09 07:18:00
在杭州,两位潜心科研的博士后,不约而同地将目光投向了地球上空数百公里处的低轨卫星。来自西安电子科技大学杭州研究院的孙冉冉博士
2025-12-09 07:49:00
我省交通行业首个自主创新研发的交通数智大模型太行交通数智大模型发布河北日报讯(曹智、谭磊)12月6日,河北交投集团发布太行交通数智大模型
2025-12-09 08:00:00
“小丰”又一次在走位中撞到了同伴。在杭州市滨江区大丰科创中心的实验室里,这个站在C位的人形机器人突然停顿——它的“大脑”
2025-12-09 08:19:00
浙江日报讯 (记者 应磊 通讯员 崔宁 洪映映) 外形酷似“机械战警”,行动稳健有力,即便遭遇人为干扰也“不动如山”。近日
2025-12-09 08:20:00
产业炬光灯聚焦新诺北斗:坚持自主创新 为船舶装上“智慧大脑”
厦门网讯(厦门日报记者 林露虹)茫茫大海上,船舶的行踪与航向,由船载北斗终端精准“掌舵”。位于火炬高新区的新诺北斗航科信息技术(厦门)股份有限公司(以下简称“新诺北斗”)
2025-12-09 08:57:00
厦门跨境电商出海加速 多家厦企亮相2025亚马逊全球开店跨境峰会
2025亚马逊全球开店跨境峰会。(主办方 供图)提供亚马逊出海服务的厦门企业AMZ123服务台前围满咨询的客商。(受访企业 供图) 厦门网讯 (厦门日报记者 沈彦彦 通讯员 周晓雅) “每年的亚马逊全球开店峰会
2025-12-09 08:57:00
长白时评评论员 久泰平“方向盘装饰贴”竟成“夺命杀器”!凌晨1点28分,一车辆在高架行驶时,主驾驶位空无一人,王某某竟在副驾驶酣睡
2025-12-09 11:09:00
根据工业和信息化部的数据,近年来我国互联网数据中心(IDC)产业规模年均增速达30%左右。然而,高速增长累积的高能耗问题也逐渐暴露
2025-12-09 14:21:00
第十一届全国大学生物理实验竞赛:西工大荣获三个“国赛一等奖”
近日,第十一届全国大学生物理实验竞赛(创新)决赛成绩公布,西北工业大学三支代表队进入决赛,均荣获国赛一等奖,获奖数量与质量位居全国高校前列
2025-12-09 14:29:00
西安建大学子创新研发“膜法湿法磷酸净化技术” 获全国特等奖
近日,西安建筑科技大学“膜达”环境与市政工程学院学生科创团队凭借自主研发的“膜法湿法磷酸净化技术”,在第十九届“挑战杯”全国大学生课外学术科技作品竞赛“揭榜挂帅”擂台赛中荣获特等奖
2025-12-09 14:30:00
重要提醒:杭州小红车租借有新变化!大家务必转知
2025年12月31日起,杭州小红车“绑卡租车”功能(即“绑卡免押金”服务)将正式停止服务,已开通“绑卡租车”功能的用户也将无法使用
2025-12-09 14:57:00
优路教育荣膺腾讯教育“2025年度职业教育领航品牌”
近日,2025腾讯新闻教育·新回响年会在北京圆满落幕。本届年会以“智变之时”为主题,汇聚了众多教育行业专家、学者及头部教育机构代表
2025-12-09 15:05:00
二元魂×金鹰卡通破界联动,AI+IP重构Z世代家庭陪伴新场景
2025年12月3日,AI潮玩创新品牌二元魂与湖南广播电视台旗下金鹰卡通卫视在长沙正式签署战略合作协议。双方将聚焦国民级亲子IP“麦咭”
2025-12-09 15:33:00