TAG:开源

Feyn团队推出全新背景移除开源模型FeyNoBg

Feyn团队推出全新背景移除开源模型FeyNoBg

Feyn团队推出开源背景移除SOTA模型FeyNoBg,基于BiRefNet架构深度优化并融合10个数据集训练。模型参数263M,在权威基准测试中多项S-measure夺冠,边缘细节(如毛发)处理更强。同时开源NoBg库,批处理效率大幅提升。开发者可通过Hugging Face免费获取,开启高效抠图新时代。

2026-07-30 12:02
2
0

月之暗面正式开源Kimi K3模型权重与技术报告

月之暗面正式开源Kimi K3模型权重与技术报告

月之暗面正式开源Kimi K3模型权重、技术报告及支撑其训练的关键底层基础设施技术。Kimi K3参数规模约为Kimi K2.5的3倍,在计算资源有限条件下通过Kimi Delta Attention、Attention Residuals和Moon EP等创新实现规模化效率提升2.5倍。所有个人可免费下载部署,用于内部研发或嵌入终端用户产品,降低AGI技术获取门槛,推动开放创新生态。

2026-07-28 17:44
12
0

Kimi K3 开源首夜至少18家美国企业迅速部署

Kimi K3 开源首夜至少18家美国企业迅速部署

Kimi K3开源权重昨晚登陆Hugging Face后,引发全球热议。至少18家美国企业首夜即完成部署并提供商业服务,打破了美国政府与Anthropic封杀中国模型的政治叙事。2.8万亿参数巨兽虽需数千万元基础设施投入,却以顶级性能与极致性价比重塑企业AI战略:从闭源API依赖中解放,掌控推理成本。

2026-07-28 15:44
6
0

2026年7月16日,月之暗面发布Kimi K3大模型,该模型拥有2.8万亿参数,登顶全球最大开源模型,特斯拉CEO马斯克点赞

2026年7月16日,月之暗面发布Kimi K3大模型,该模型拥有2.8万亿参数,登顶全球最大开源模型,特斯拉CEO马斯克点赞

月之暗面开源 Kimi K3:2.8万亿参数 MoE 混合专家模型,首创视觉理解与100万token上下文,支持AgentEnv智能体沙箱、MoonEP与FlashKDA训练基础设施。发布权重与技术报告,登顶AI代码评测榜首,马斯克留言称赞,拓展大模型训练与智能体生态全体系,降低国产开源门槛。

2026-07-28 10:31
5
0

小红书开源 BigMac:实现多模态训练显存与速度的统一优化

小红书开源 BigMac:实现多模态训练显存与速度的统一优化

小红书开源 BigMac 多模态流水并行训练范式,彻底打破多模态 LLM 训练的显存与速度二选一困境。通过准依赖安全的嵌套流水线,将 LLM 主干 schedule 保留为底层时间线,把编码器与生成器嵌入到输入就绪且不打断执行的位置,实现显存 O(1) 压缩与零空泡。提供全局 operator 表、算法友好的流水并行接口及专业 profiler/simulator,助力从单卡验证自然扩展到大规模流水并行训练。MLLM-Understanding 与 Generation 代表性负载验证下,相比 Optim

2026-07-23 18:39
854
0

Poolside 重磅开源,Laguna S 2.1 免费上线 OpenCode,1M 超长上下文与 118B MoE 模型引领代理编码新阶段

Poolside 重磅开源,Laguna S 2.1 免费上线 OpenCode,1M 超长上下文与 118B MoE 模型引领代理编码新阶段

Poolside 推出 Laguna S 2.1 免费开源!118B MoE 模型 1M 超长上下文 + 每 token 激活 8B 参数,支持 thinking/no-thinking 模式,单台 NVIDIA DGX Spark 即可高效运行,性能直逼更大参数模型。OpenMDW-1.1 完全开放,在 OpenCode 和 Hugging Face 立即免费使用,Terminal-Bench2.1 达 70.2%,DeepSWE 等基准展现强劲代理编码能力。引领本地代理 AI 新纪元,加速软件工程长周

2026-07-22 11:54
617
0

杨植麟在GTC 2026上正式公布,月之暗面已将Adam优化器、全注意力机制以及残差连接全部替换为新架构,并完成开源。

杨植麟在GTC 2026上正式公布,月之暗面已将Adam优化器、全注意力机制以及残差连接全部替换为新架构,并完成开源。

月之暗面CEO杨植麟在GTC2026演讲中,首度摊牌:将Adam优化器、注意力机制和残差连接三个Transformer基石全部重新设计并开源。推出MuonClip提升数据利用效率、QK-Clip确保万亿参数稳定、Kimi Linear实现百万Token上下文高效、Agent Swarm让多Agent并行协作。视觉反哺文本的创新进展,将为中国开源大模型训练带来全新范式。

2026-07-20 10:45
4
0

面壁智能开源MiniCPM-Robot:1.5B参数VLA模型完整发布 个人开发者可在真实机器人上运行操作

面壁智能开源MiniCPM-Robot:1.5B参数VLA模型完整发布 个人开发者可在真实机器人上运行操作

7月19日,面壁智能开源MiniCPM-Robot系列首个1.5B VLA模型,让个人开发者在真实机器人上直接运行操作与目标跟踪。从此具身智能不再是实验室专属,模型权重和代码已完全开放,效率与实用性大幅提升,推动AI机器人应用走向大众。

2026-07-20 10:26
641
0

xAI开源Grok Build源代码,支持自行编译和本地离线运行,工具调用细节可见

xAI开源Grok Build源代码,支持自行编译和本地离线运行,工具调用细节可见

xAI已将Grok Build(SpaceXAI打造的AI编程代理及其TUI终端界面)完整开源,源码挂在GitHub上。开发者可自由编译、本地离线运行,完全掌控代理循环、工具调用、代码编辑流程及扩展机制。无论构建技能、插件还是自定义子代理,都能从源码中清晰理解每一行实现。这份公开代码不仅揭开黑盒真相,还为本地优先的AI编码代理提供了权威实践指南。

2026-07-16 09:13
133
0

商汤开源SenseNova-Vision统一视觉大模型,可单模型覆盖四大核心视觉任务

商汤开源SenseNova-Vision统一视觉大模型,可单模型覆盖四大核心视觉任务

文章介绍了商汤全面开源SenseNova-Vision统一视觉大模型,强调其以单模型覆盖目标检测、分割、深度估计和多视角3D重建四大核心视觉任务,并在多项权威评测中领先同类通用模型及部分专家模型,同时同步开源5000万条视觉指令数据集。

2026-07-13 14:20
970
0

两家大模型公司发布内部信:智谱创始人提出“摸高计划”,MiniMax创始人宣布暂停自己薪酬

两家大模型公司发布内部信:智谱创始人提出“摸高计划”,MiniMax创始人宣布暂停自己薪酬

7月11日,智谱创始人唐杰发布《巨浪已来》内部信,提出“摸高计划”,宣布未来两年不追求短期商业变现,直指AGI下一个高地。该计划聚焦长程任务、自治智能体系统、完全自我训练与安全治理四大方向。前一日,MiniMax创始人闫俊杰宣布暂停个人薪酬至AGI实现,并计划拿出5%个人股份激励团队与支持开源。两封内部信展现了两家大模型公司在上市后资本市场考验下的长期主义与技术雄心。

2026-07-12 07:47
12
0

开源OfficeCLI让AI智能体自主驾驭文档

开源OfficeCLI让AI智能体自主驾驭文档

本文介绍了一款名为OfficeCLI的开源工具,它是全球首款专为AI智能体定制的Office套件。通过内置高保真HTML渲染引擎,OfficeCLI让AI能够像人类一样直观理解文档版式与结构,实现“渲染—观察—修正”的视觉闭环。该工具轻量级、无需第三方依赖,支持CLI和自然语言操作,可无缝接入Claude Code、Cursor等主流AI编程环境,显著降低AI处理文档时的错误率,为企业自动化办公和AI智能体能力释放提供了强大技术支撑。

2026-07-07 10:47
19
0

国产算力新里程碑:美团LongCat-2.0大模型正式开源

国产算力新里程碑:美团LongCat-2.0大模型正式开源

美团正式开源其基础大模型LongCat-2.0,这是业界首个依托国产算力芯片完成训练与推理的万亿参数级大模型,采用MIT开源协议,开发者可免费商用。华为昇腾、摩尔线程等国产芯片已同步完成适配,标志着“国产芯片+国产大模型”的软硬件协同生态走向成熟,为中国AI产业自主可控提供坚实支撑。

2026-07-07 10:23
11
0

美团开源万亿参数模型LongCat-2.0,算力界的巨无霸来了

美团开源万亿参数模型LongCat-2.0,算力界的巨无霸来了

美团正式开源万亿参数大模型LongCat-2.0,该模型在五万卡国产算力集群上完成训练,总参数1.6T,采用动态范围设计(激活参数约48B),预训练数据超30T tokens,原生支持1M超长上下文。这一举措不仅验证了国产软硬件在大规模分布式计算中的可靠性,也为行业提供了超大规模模型构建的参考范式,将推动开发者社区创新应用的发展。

2026-06-30 14:17
1
0

DeepSeek发表重磅论文,提出两项互补机制,大模型推理最高提速85%

DeepSeek发表重磅论文,提出两项互补机制,大模型推理最高提速85%

DeepSeek联合北大提出DSpark推测解码框架,通过半自回归生成架构与置信度调度验证两项互补机制,实现大模型推理速度提升60%-85%。该技术已部署于V4系列及Qwen、Gemma等主流模型,配套开源DeepSpec全栈代码库,有效降低中小企业大模型落地门槛。

2026-06-28 17:23
13
0

推荐专栏

爱力方

爱力方

机器人前沿资讯及信息解读
机器人大讲堂

机器人大讲堂

中国顶尖的机器人专业媒体服务平台
关注爱力方,掌握前沿具身智能动态

© 2025 A³·爱力方

https://www.agentren.cn/