AI资讯新闻榜单内容搜索-Ash

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: Ash
Flash模型又添一员大将:实测MiniMax M3.1

Flash模型又添一员大将:实测MiniMax M3.1

Flash模型又添一员大将:实测MiniMax M3.1

MiniMax于9月27日上线Flash级别模型M3.1-Flash-Preview,本文通过试衣间项目改造、机器人视频拆解、北京夜光可视化和A股市场观测台四个实测任务,将其与DeepSeek V4.1 Flash和GLM-5.3-Flash对比,结果显示M3.1速度仅次于DeepSeek但成本最低,成为Flash赛道上DeepSeek的新对手。

来自主题: AI资讯
7484 点击    2026-09-30 15:44
DeepSeek开源昇腾基础组件:计算、通信与编译工具同步发布

DeepSeek开源昇腾基础组件:计算、通信与编译工具同步发布

DeepSeek开源昇腾基础组件:计算、通信与编译工具同步发布

DeepSeek开源面向华为昇腾算力平台的基础设施组件,涵盖TileLang编译工具及DeepGEMM、DeepEP、TileKernels、FlashMLA、DeepSelect等计算与通信库,华为亦在CANN社区开源双方围绕昇腾950及超节点的联合创新实践。

来自主题: AI资讯
9456 点击    2026-09-30 15:43
用AI造的!刚刚,代季峰团队首个模型开源Naive-N0.5-Flash

用AI造的!刚刚,代季峰团队首个模型开源Naive-N0.5-Flash

用AI造的!刚刚,代季峰团队首个模型开源Naive-N0.5-Flash

代季峰创立的Naive AI开源首个模型Naive-N0.5-Flash,总参数量309B、激活参数量15.5B,原生支持百万token上下文,面向编程与AI研发任务,由AI参与研发并在论文复现等评测中表现优异,权重与代码采用MIT许可开源。

来自主题: AI资讯
9437 点击    2026-09-29 11:53
可灵憋了8个月,放出一只“参数怪”:30秒一镜到底,10个关键帧,HDR和双声道也来了

可灵憋了8个月,放出一只“参数怪”:30秒一镜到底,10个关键帧,HDR和双声道也来了

可灵憋了8个月,放出一只“参数怪”:30秒一镜到底,10个关键帧,HDR和双声道也来了

可灵AI发布时隔8个月大版本更新的旗舰视频生成模型Kling 4.0及轻量版Kling 4.0 Flash,单次原生生成时长提升至30秒,最多支持10个关键帧输入,新增双通道立体声输出,并将很快推出4K 10-bit HDR格式。

来自主题: AI资讯
8141 点击    2026-09-29 11:52
Pi 爆火真相 :为什么只给模型一个 bash,反而赢了 Claude Code 和 Codex

Pi 爆火真相 :为什么只给模型一个 bash,反而赢了 Claude Code 和 Codex

Pi 爆火真相 :为什么只给模型一个 bash,反而赢了 Claude Code 和 Codex

欧洲开发者 Mario Zechner 开发的极简 Coding Agent Harness Pi 只给模型一个 bash,却在多项 Benchmark 中击败 Claude Code 和 Codex,凭借极简设计和高可扩展性在 2025 年底爆火,团队来自维也纳而非硅谷。

来自主题: AI资讯
8641 点击    2026-09-29 11:16
DeepSeek mHC多流残差坍塌失效了?

DeepSeek mHC多流残差坍塌失效了?

DeepSeek mHC多流残差坍塌失效了?

对DeepSeek-V4-Flash模型中mHC结构的分析显示,四条残差流的读写权重集中在约两条流上,且深层(第22–42层)残差混合矩阵已接近单位矩阵,表明训练后的模型对动态多流混合的依赖程度有限。

来自主题: AI技术研报
8272 点击    2026-09-28 16:22
我让 Qoder 剪了条口播,打开剪映还能接着改

我让 Qoder 剪了条口播,打开剪映还能接着改

我让 Qoder 剪了条口播,打开剪映还能接着改

作者用 Qoder 搭配 Qwen3.8-Flash 模型调用开源工具 capcut-cli,在剪映 5.9 中自动完成口播视频的字幕识别、贴字和音效添加,生成可继续手动修改的分轨草稿。

来自主题: AI资讯
8829 点击    2026-09-27 23:11
梁文锋狙击战:深扒那些梁文锋署名的论文有多牛

梁文锋狙击战:深扒那些梁文锋署名的论文有多牛

梁文锋狙击战:深扒那些梁文锋署名的论文有多牛

过去三年,梁文锋极少以第一作者或通讯作者身份,出现在 V3.2、V4、V4.1-Flash 这些动辄上百人署名的旗舰模型整体报告中;却始终把名字签在 MLA 注意力、MoE 路由机制、mHC 拓扑流形、DSpark 推理算子、DSec 智能体沙盒这些最底层的原子技术论文上。

来自主题: AI技术研报
9055 点击    2026-09-25 10:13
Kimi 和 DeepSeek,为什么出现在同一张模型架构图里?

Kimi 和 DeepSeek,为什么出现在同一张模型架构图里?

Kimi 和 DeepSeek,为什么出现在同一张模型架构图里?

GLM-5.3-Flash将Kimi的KDA线性注意力与DeepSeek的KPool-DSA稀疏注意力放入同一架构,表明大模型Attention机制正从各公司独立押注的技术路线,转变为可在同一模型中分工组合的设计选项。

来自主题: AI技术研报
6831 点击    2026-09-25 10:11
PCIe显卡被低估了!内核补齐+通信重构,DeepSeek推理吞吐直接翻近7倍

PCIe显卡被低估了!内核补齐+通信重构,DeepSeek推理吞吐直接翻近7倍

PCIe显卡被低估了!内核补齐+通信重构,DeepSeek推理吞吐直接翻近7倍

是石科技自研Meta-Infer高效推理引擎通过内核补齐、算子通信重构、并行调优与缓存复用等纯软件手段,在不改动模型前提下将DeepSeek-V4.1-Flash在PCIe显卡上的推理吞吐提升近7倍,该方法论同样适用于DeepSeek-V4-Flash、GLM5.3及国产GPU。

来自主题: AI资讯
8062 点击    2026-09-25 10:09