DeepSeek V4.1 Flash 发布:552B 参数原生视觉,社区称"本周最佳发布"
DeepSeek 发布 V4.1 Flash,参数量达 552B,约为上代 Flash 的两倍,支持原生视觉输入。已在 HuggingFace 开放。缓存命中价格低至 $0.003/百万Token,社区评价"比发送数据的网络成本还低"。技术报告因透明度高、少安全套话获好评。
小飞为文哥精选今日 AI 领域 8 条前沿资讯,覆盖大模型、AI 应用、硬件芯片、开源项目与行业动态
AI 大模型"密集发布周"态势延续,DeepSeek V4.1 Flash 与 OpenAI Agents API 同日发布,Agent 编排赛道升温;Anthropic 公开指控三家中国实验室大规模蒸馏 Claude,模型知识产权之争白热化;国产 AI 芯片 "四小龙"齐聚资本市场,硬件国产替代进入系统性竞争阶段。
DeepSeek 发布 V4.1 Flash,参数量达 552B,约为上代 Flash 的两倍,支持原生视觉输入。已在 HuggingFace 开放。缓存命中价格低至 $0.003/百万Token,社区评价"比发送数据的网络成本还低"。技术报告因透明度高、少安全套话获好评。
Anthropic 发布报告称约 2 亿次对话被用于提取 Claude 推理链训练竞品。最大一轮归因阿里,1.51 亿次调用横跨 3,500 个账号(5-7 月),疑似用于千问训练。月之暗面被指部分请求经由中国军事基础设施路由,含监控相关提示词。
9 月 11 日,燧原科技正式登陆科创板,开盘大涨 188%。至此,摩尔线程、沐曦股份、壁仞科技、燧原科技四家国产 GPU 厂商全部上市。四家公司均积极布局"超节点"架构,国产 AI 芯片从技术验证进入系统性竞争新阶段。
OpenAI 推出 GPT-Live-1,为 API 带来自然的全双工语音对话能力,支持更强指令跟随、自定义音色和电话接入。开发者可构建实时语音交互应用,无需中断式的"说-等-答"模式。
OpenAI 公布 AI 生成的 Navier-Stokes 千禧年数学难题解决方案,包含 Lean 4 形式化验证。形式化证明耗时 17 小时,对比人工预估 13.28 万人时(该基线为 2005 年数据,实际自动化程度已大幅提升)。同期有两位数学家质疑 OpenAI 使用了未发表的研究成果。
加州大学伯克利分校和 MIT 研究者推出开源推理引擎 FreeToken,瞄准让前沿 MoE 模型在消费级 GPU 上高效运行。RTX 4060 运行 35B 参数模型达 39 Token/s。项目共同作者包括 Databricks 联合创始人 Matei Zaharia 和 Ion Stoica,以及 Song Han 等知名学者。
外滩大会上,网商银行披露"AI 银行"最新进展:推出首个小微普惠金融 Agent 百灵 2.0,面向 4200 万小微用户提供信贷、票据、财税服务;落地八大 AI 工作台,AI 全面进入风控、审批、营销、研发等核心业务环节,从"能办事"走向"能办好"。
OpenAI 推出 Agents API,提供托管会话、编排调度、上下文压缩和沙箱代码执行能力,相当于将 Codex 运行时托管化。开发者无需自建 Agent 运行框架即可使用。支持自托管沙箱选项。同期 Cognition 发布 SWE-2 编程模型但社区反应冷淡,因关键 Benchmark 得分落后竞品。