TAG:开源大模型

DeepSeek-V4-Flash正式版上线国家超算互联网:支持一键调用,性能媲美最强闭源模型

DeepSeek-V4-Flash正式版上线国家超算互联网:支持一键调用,性能媲美最强闭源模型

DeepSeek-V4-Flash-0731正式版上线国家超算互联网,支持一键API调用和模型文件下载。其在智能体能力、指令遵循方面大幅增强,多项基准测试成绩已媲美最强闭源模型。平台汇聚1700余款开源大模型,提供一站式Notebook开发环境,助力开发者降低门槛、加速国产AI应用落地与生态构建。

2026-08-03 21:30
9
0

韩国最大AI模型问世:LG发布7500亿参数K-EXAONE 2.0 以Apache协议开源直面中国模型

韩国最大AI模型问世:LG发布7500亿参数K-EXAONE 2.0 以Apache协议开源直面中国模型

7月31日,LG AI研究院正式发布K-EXAONE 2.0,这款采用MoE混合注意力架构、总参数7500亿的韩国最大AI基础模型以Apache 2.0完全开源。在24项基准测试中平均得分提升至70.1分,多项能力超越或对标智谱GLM-5.1、Qwen3.5等中国头部开源模型,标志着韩国以主权AI名义加入东亚开源AI竞争格局。

2026-07-31 15:42
51
0

从万亿开源到国产算力协同:Kimi K3与摩尔线程智算卡完成全栈适配

从万亿开源到国产算力协同:Kimi K3与摩尔线程智算卡完成全栈适配

月之暗面于7月28日晚开源2.8万亿参数的Kimi K3模型,这是全球首个开源的约3万亿级别大模型,配备100万token上下文窗口,原生支持视觉理解,并融合KDA混合线性注意力、注意力残差、Gated MLA和Stable LatentMoE等创新架构,专为长程编程、复杂推理等场景优化。同时,摩尔线程基于MTT S5000智算卡和MUSA软件栈,率先完成Kimi K3的极速全栈适配。这一成果不仅展示了国产GPU在万亿级模型上的硬核能力,也彰显了高性能国产算力与顶尖开源生态的协同创新,正加速推动大模型产业

2026-07-29 11:12
5
0

国产开源大模型 Kimi K3 有何优势,何时向新用户开放?

国产开源大模型 Kimi K3 有何优势,何时向新用户开放?

文章围绕国产开源大模型Kimi K3展开,解读其2.8万亿参数规模、技术路线与实际能力,分析其在编程、视觉理解和长程任务中的优势,并说明因请求量激增暂停新用户订阅、后续将随算力扩容逐步开放。

2026-07-21 15:11
1
0

现场直击APEC数字周:AI治理亟待达成共识 开源生态加速亚太“数智”交融

现场直击APEC数字周:AI治理亟待达成共识 开源生态加速亚太“数智”交融

2026年APEC数字周在成都举行,多国代表聚焦AI治理共识达成。俄罗斯专家呼吁制定各方均能接受的综合性文本,泰国代表分享AI治理实践中心及基于开源模型的本土大模型开发经验,探讨如何跨越数字鸿沟、推动法规落地与数智融合。该文现场直击亚太地区在AI浪潮下的治理挑战与务实创新路径。

2026-07-20 18:16
5
0

Kimi发布全球最大规模开源模型,国产大模型景气度有望持续走高

Kimi发布全球最大规模开源模型,国产大模型景气度有望持续走高

文章围绕Kimi发布参数达2.8万亿的全球最大开源模型K3展开,介绍其在视觉理解、长上下文和复杂任务处理上的能力提升,并结合券商观点分析国产大模型调用量增长、商业化提速及国产替代趋势,梳理三六零、昆仑万维等相关受益公司。

2026-07-17 10:23
8
0

Kimi K3 以2.8万亿参数和100万词元上下文,将开源大模型能力上限推至全球最高

Kimi K3 以2.8万亿参数和100万词元上下文,将开源大模型能力上限推至全球最高

文章聚焦月之暗面发布新一代开源大模型Kimi K3,解析其2.8万亿参数、100万词元上下文及多模态能力带来的技术突破,并梳理国产大模型商业化提速、资本预期升温及相关上市公司的产业机会。

2026-07-17 10:21
932
0

德国研究联盟发布开源大模型Soofi S,推动AI主权实现新突破

德国研究联盟发布开源大模型Soofi S,推动AI主权实现新突破

文章聚焦德国研究联盟发布的开源大模型Soofi S,介绍其基于混合专家架构的高效设计、德语强化训练策略、长上下文与代码生成等优势表现,以及其在欧洲主权AI基础设施和工业应用落地中的重要意义。

2026-07-14 10:44
342
0

中国大模型何时能达到Fable级别?马斯克预计明年Q1,唐杰称不用那么久

中国大模型何时能达到Fable级别?马斯克预计明年Q1,唐杰称不用那么久

本文围绕智谱发布开源大模型GLM-5.2展开,探讨了中国大模型何时能达到Anthropic的Fable级别这一热点辩论。马斯克预计明年第一季度,而智谱创始人唐杰则认为时间更短,展示了行业内的不同预期。文章分析了GLM-5.2在性能和成本上的优势,强调了中国AI在追赶进程中的信心及其对全球竞争格局的影响。

2026-06-19 13:21
4
0

DeepSeek完成A轮融资510亿元,腾讯京东等巨头参与

DeepSeek完成A轮融资510亿元,腾讯京东等巨头参与

国内领先的开源大模型研发商DeepSeek宣布完成A轮融资,融资金额高达510亿元人民币,估值飙升至4000亿元。投资方阵容豪华,包括腾讯、京东、网易等互联网巨头及宁德时代,竞争激烈到由公司筛选准入资格。DeepSeek成立于2023年,专注于大语言模型和多模态AI技术,是开源大模型领域的领头羊。母公司幻方量化背景深厚,此次巨额融资将加速其在通用人工智能基础技术领域的研发与创新。

2026-06-18 11:28
4
0

智谱凭GLM-5.2押注长上下文与国产算力生态跻身全球大模型头部阵营

智谱凭GLM-5.2押注长上下文与国产算力生态跻身全球大模型头部阵营

智谱发布新一代开源大模型GLM-5.2,在Artificial Analysis榜单位列开源模型SOTA。其核心突破在于将百万级上下文窗口做到工程可用,通过注意力结构创新降低计算量,实测能高效完成软件开发和深度调研等复杂长任务。在编程场景中,GLM-5.2与OpenAI、Anthropic形成竞争新格局,标志国产模型关键进展。此外,模型以MIT协议开源,Day 0适配八大国产算力平台,推动算力生态发展,尽管在数理推理方面仍有技术代差。

2026-06-17 19:50
3
0

国产多模态大模型 MiniMax M3 正式开源,响应速度倍增

国产多模态大模型 MiniMax M3 正式开源,响应速度倍增

稀宇科技MiniMax正式开源其原生多模态旗舰模型M3,该模型拥有428B总参数,是行业内首个从底层训练初期即进行多模态混合训练的开源大模型。发布后迅速在全球综合智能指数排行榜上斩获开源模型第一,响应速度从30 TPS优化至80 TPS。M3在编码与智能体能力评测中表现顶尖,能自主拆解复杂任务并调用工具,输出代码可直接交付,显著提升开发者生产力,标志着国产多模态大模型的重要里程碑。

2026-06-16 12:48
78
0

全球AI“黑马神话”一夜反转,被指套壳阿里千问

全球AI“黑马神话”一夜反转,被指套壳阿里千问

巴西里约市政府旗下IplanRIO推出的开源大模型Rio-3.5-Open-397B,本应成为拉美AI黑马,Hugging Face发布后迅速走红,却仅24小时被指为NexN2Pro与Qwen3.5权重混合版“套壳”产物。开源社区Nex-AGI公开揭露真相,并指控无任何自研训练痕迹。IplanRIO已致歉承认操作失误并修正版本。该事件引发对开源模型自主性与创新的质疑,凸显AI领域合规与透明度的重要性。

2026-06-15 19:18
1
0

摩尔线程发布并开源首个全链路自研代码大模型MusaCoder

摩尔线程发布并开源首个全链路自研代码大模型MusaCoder

摩尔线程发布并开源首个全链路自研代码大模型MusaCoder,基于国产全功能GPU完成训练与验证,在KernelBench评测中表现优异。文章介绍了其技术突破、性能优势及对国产AI算力生态和自主可控研发体系的推动作用。

2026-06-10 17:45
3
0

谷歌发布Gemma 4,E2B架构让手机本地运行AI实现质变

谷歌发布Gemma 4,E2B架构让手机本地运行AI实现质变

谷歌发布开源大模型Gemma 4,其创新的E2B架构通过参数卸载技术大幅降低显存需求,使高达300亿参数的模型能在手机等端侧设备本地高效运行。该架构将有效参数减少到仅需2GB显存,突破了移动设备的AI部署瓶颈,支持离线AI应用如本地代码编写,提升数据隐私。Gemma 4还具备多语言和多模态能力,未来有望在智能手机上实现高性能AI体验,推动下一代消费级应用变革。

2026-06-03 14:53
3
0

推荐专栏

爱力方

爱力方

机器人前沿资讯及信息解读
机器人大讲堂

机器人大讲堂

中国顶尖的机器人专业媒体服务平台
关注爱力方,掌握前沿具身智能动态

© 2025 A³·爱力方

https://www.agentren.cn/