TAG:开源大模型
DeepSeek-V4-Flash正式版上线国家超算互联网:支持一键调用,性能媲美最强闭源模型
DeepSeek-V4-Flash-0731正式版上线国家超算互联网,支持一键API调用和模型文件下载。其在智能体能力、指令遵循方面大幅增强,多项基准测试成绩已媲美最强闭源模型。平台汇聚1700余款开源大模型,提供一站式Notebook开发环境,助力开发者降低门槛、加速国产AI应用落地与生态构建。
韩国最大AI模型问世:LG发布7500亿参数K-EXAONE 2.0 以Apache协议开源直面中国模型
7月31日,LG AI研究院正式发布K-EXAONE 2.0,这款采用MoE混合注意力架构、总参数7500亿的韩国最大AI基础模型以Apache 2.0完全开源。在24项基准测试中平均得分提升至70.1分,多项能力超越或对标智谱GLM-5.1、Qwen3.5等中国头部开源模型,标志着韩国以主权AI名义加入东亚开源AI竞争格局。
从万亿开源到国产算力协同:Kimi K3与摩尔线程智算卡完成全栈适配
月之暗面于7月28日晚开源2.8万亿参数的Kimi K3模型,这是全球首个开源的约3万亿级别大模型,配备100万token上下文窗口,原生支持视觉理解,并融合KDA混合线性注意力、注意力残差、Gated MLA和Stable LatentMoE等创新架构,专为长程编程、复杂推理等场景优化。同时,摩尔线程基于MTT S5000智算卡和MUSA软件栈,率先完成Kimi K3的极速全栈适配。这一成果不仅展示了国产GPU在万亿级模型上的硬核能力,也彰显了高性能国产算力与顶尖开源生态的协同创新,正加速推动大模型产业
国产开源大模型 Kimi K3 有何优势,何时向新用户开放?
文章围绕国产开源大模型Kimi K3展开,解读其2.8万亿参数规模、技术路线与实际能力,分析其在编程、视觉理解和长程任务中的优势,并说明因请求量激增暂停新用户订阅、后续将随算力扩容逐步开放。
现场直击APEC数字周:AI治理亟待达成共识 开源生态加速亚太“数智”交融
2026年APEC数字周在成都举行,多国代表聚焦AI治理共识达成。俄罗斯专家呼吁制定各方均能接受的综合性文本,泰国代表分享AI治理实践中心及基于开源模型的本土大模型开发经验,探讨如何跨越数字鸿沟、推动法规落地与数智融合。该文现场直击亚太地区在AI浪潮下的治理挑战与务实创新路径。
Kimi发布全球最大规模开源模型,国产大模型景气度有望持续走高
文章围绕Kimi发布参数达2.8万亿的全球最大开源模型K3展开,介绍其在视觉理解、长上下文和复杂任务处理上的能力提升,并结合券商观点分析国产大模型调用量增长、商业化提速及国产替代趋势,梳理三六零、昆仑万维等相关受益公司。
Kimi K3 以2.8万亿参数和100万词元上下文,将开源大模型能力上限推至全球最高
文章聚焦月之暗面发布新一代开源大模型Kimi K3,解析其2.8万亿参数、100万词元上下文及多模态能力带来的技术突破,并梳理国产大模型商业化提速、资本预期升温及相关上市公司的产业机会。
德国研究联盟发布开源大模型Soofi S,推动AI主权实现新突破
文章聚焦德国研究联盟发布的开源大模型Soofi S,介绍其基于混合专家架构的高效设计、德语强化训练策略、长上下文与代码生成等优势表现,以及其在欧洲主权AI基础设施和工业应用落地中的重要意义。
中国大模型何时能达到Fable级别?马斯克预计明年Q1,唐杰称不用那么久
本文围绕智谱发布开源大模型GLM-5.2展开,探讨了中国大模型何时能达到Anthropic的Fable级别这一热点辩论。马斯克预计明年第一季度,而智谱创始人唐杰则认为时间更短,展示了行业内的不同预期。文章分析了GLM-5.2在性能和成本上的优势,强调了中国AI在追赶进程中的信心及其对全球竞争格局的影响。
DeepSeek完成A轮融资510亿元,腾讯京东等巨头参与
国内领先的开源大模型研发商DeepSeek宣布完成A轮融资,融资金额高达510亿元人民币,估值飙升至4000亿元。投资方阵容豪华,包括腾讯、京东、网易等互联网巨头及宁德时代,竞争激烈到由公司筛选准入资格。DeepSeek成立于2023年,专注于大语言模型和多模态AI技术,是开源大模型领域的领头羊。母公司幻方量化背景深厚,此次巨额融资将加速其在通用人工智能基础技术领域的研发与创新。
智谱凭GLM-5.2押注长上下文与国产算力生态跻身全球大模型头部阵营
智谱发布新一代开源大模型GLM-5.2,在Artificial Analysis榜单位列开源模型SOTA。其核心突破在于将百万级上下文窗口做到工程可用,通过注意力结构创新降低计算量,实测能高效完成软件开发和深度调研等复杂长任务。在编程场景中,GLM-5.2与OpenAI、Anthropic形成竞争新格局,标志国产模型关键进展。此外,模型以MIT协议开源,Day 0适配八大国产算力平台,推动算力生态发展,尽管在数理推理方面仍有技术代差。
国产多模态大模型 MiniMax M3 正式开源,响应速度倍增
稀宇科技MiniMax正式开源其原生多模态旗舰模型M3,该模型拥有428B总参数,是行业内首个从底层训练初期即进行多模态混合训练的开源大模型。发布后迅速在全球综合智能指数排行榜上斩获开源模型第一,响应速度从30 TPS优化至80 TPS。M3在编码与智能体能力评测中表现顶尖,能自主拆解复杂任务并调用工具,输出代码可直接交付,显著提升开发者生产力,标志着国产多模态大模型的重要里程碑。
全球AI“黑马神话”一夜反转,被指套壳阿里千问
巴西里约市政府旗下IplanRIO推出的开源大模型Rio-3.5-Open-397B,本应成为拉美AI黑马,Hugging Face发布后迅速走红,却仅24小时被指为NexN2Pro与Qwen3.5权重混合版“套壳”产物。开源社区Nex-AGI公开揭露真相,并指控无任何自研训练痕迹。IplanRIO已致歉承认操作失误并修正版本。该事件引发对开源模型自主性与创新的质疑,凸显AI领域合规与透明度的重要性。
摩尔线程发布并开源首个全链路自研代码大模型MusaCoder
摩尔线程发布并开源首个全链路自研代码大模型MusaCoder,基于国产全功能GPU完成训练与验证,在KernelBench评测中表现优异。文章介绍了其技术突破、性能优势及对国产AI算力生态和自主可控研发体系的推动作用。
谷歌发布Gemma 4,E2B架构让手机本地运行AI实现质变
谷歌发布开源大模型Gemma 4,其创新的E2B架构通过参数卸载技术大幅降低显存需求,使高达300亿参数的模型能在手机等端侧设备本地高效运行。该架构将有效参数减少到仅需2GB显存,突破了移动设备的AI部署瓶颈,支持离线AI应用如本地代码编写,提升数据隐私。Gemma 4还具备多语言和多模态能力,未来有望在智能手机上实现高性能AI体验,推动下一代消费级应用变革。