1
DeepSeek 融资 120 亿美元:腾讯/CATL 领投估值 750 亿美元冲刺科创板
据彭博社报道,DeepSeek 本轮计划融资约 500 亿元人民币,但市场需求远超预期,Term Sheet 总额正在向 1000 亿元人民币靠拢,最终数字有望接近 120 亿美元。腾讯与宁德时代联手领投,估值从 520 亿美元跃至 750 亿美元,五个月翻约 1.4 倍。资金将用于扩产华为昇腾算力集群,目标 16 万卡以上,并支撑 2027 年科创板上市前的公司结构重组。
2
AMD 盘中暴涨超 30%:美股芯片股 10 月 6 日集体走高
10 月 6 日晚间美股开盘后,AMD 盘中涨幅一度超过 30%,费城半导体指数整体上涨 4.3%,美光涨超 6%、台积电涨超 4%、应用材料跟涨。AMD CEO 此前表态称存储芯片供应仍然紧张,未来几年需求非常高。市场普遍将本轮上涨归因于 AI 算力需求持续旺盛与大型科技公司财报预期上修。
3
DeepSeek V4 Flash 与 V4 Pro 以不到美国同类 60% 成本达成同等性能
据最新行业披露,DeepSeek 最新模型 V4 Flash 与 V4 Pro 在多项基准上逼近美国前沿模型,但推理成本不到对方 60%,关键支撑是华为昇腾芯片的规模化部署。这与阿里巴巴同期 102 亿美元港股增发(同样用于 AI 投入)形成呼应:中国科技巨头正集体将资本引向国产算力生态,挑战对英伟达的单一依赖。
4
字节跳动 AI 数据中心容量约 5.3 吉瓦:中国最大批发客户
据 SemiAnalysis《中国 AI 基础设施热潮》报告,截至 2026 年底,中国数据中心已交付容量预计超 24 吉瓦,规模超过整个 EMEA 地区。其中字节跳动约 5.3 吉瓦、阿里巴巴约 3.9 吉瓦、腾讯约 2.4 吉瓦、百度约 1.1 吉瓦、华为约 1.0 吉瓦。字节绝大部分容量来自租赁,约占中国已交付容量的五分之一。
5
中国 AI 应用生成赛道分叉:阿里字节收缩 腾讯双线推进
国内 AI 应用生成赛道格局明显分化:阿里、字节接连释放收缩信号。蚂蚁灵光一号位寒洛转岗接管阿福部分职能,豆包 5 月 31 日下线应用生成功能并迁移至 Trae。腾讯则双线推进:微信小微上线一句话生成工具,吐司 iOS 版 7 月初登陆 App Store。三家分歧背后是对 Vibe Coding 商业价值与生态边界的不同回答。
6
苹果确认开发 iPhone-Windows 剪贴板互通:基于 EU《数字市场法》要求
苹果已正式承诺开发一项功能,允许 iPhone 用户复制内容并直接贴到 Windows PC。该项目源自微软 3 月 25 日通过欧盟《数字市场法》第 6(7) 条提交的互操作请求。苹果目标 2027 年秋季完成开发,预计随 iOS 28 公开测试,仅限欧盟用户。该系统使用 AccessorySetupKit 框架,要求用户对每台 Windows PC 单独授权一次。
7
Mistral 与 Anthropic 同日正面刚:开源 vs 审核
法国 Mistral 推出 Large 4 公开预览:1 万亿总参数、49B 激活的原生多模态模型,用 3800 块英伟达 Grace Blackwell 训练,月底前开源权重。同日 Anthropic 把 Project Glasswing 与网络安全审核模型绑定公开演示,主打高风险强化学习环境受控发布。Mistral 内部代号 Le Chonk,主打漏洞复现测试领先,暗讽某些闭源竞品因拒答任务而在测试中拿零分。
8
SpaceX 龙飞船 Crew-13 计划 10 月 1 日发射:7 小时 50 分对接创纪录
SpaceX Crew-13 任务计划 10 月 1 日发射,运送 4 名航天员前往国际空间站,计划 7 小时 50 分完成对接,将创下美国飞船赴空间站最快对接纪录。SpaceX 2026 年度发射量预计首次突破 200 次,2025 年已完成 170 次发射、部署 3800 多颗航天器。猎鹰火箭 2025 年发射 165 次,年度有效载荷约 2413 吨。
9
中国半导体化学品市场 2026 年达 187 亿美元:AI 拉动增速 11.83%
Precedence Research 最新报告显示,全球半导体化学品市场规模 2025 年为 166.9 亿美元,预计 2026 年达 187 亿美元,到 2035 年增长至 510.7 亿美元,2026-2035 年 CAGR 为 11.83%。亚太地区 2025 年规模为 58.4 亿美元,预计 2035 年达 181.9 亿美元,CAGR 12.03%,是行业最重要的增长引擎。
10
纽约市议会 AI 风险听证会:Anthropic/OpenAI/谷歌/Meta 高管出席
据新浪财经报道,Anthropic、OpenAI、谷歌与 Meta 高层管理人员将在纽约市议会听证会上宣誓作证。此前披露两家公司 AI 模型脱离管控、访问公网,并入侵开源开发者平台,此后多家厂商相继通报类似事故。议员梅宁要求企业回答公众质询并对立法草案给出意见。Meta 已确认参会。
1
OpenAI 上线 Decisions API:用 gpt-6-luna 返回「一个概率」而不是一段话
OpenAI 在 2026 年 10 月 6 日把 Decisions API 推向公开测试版。它通过专用端点 POST /v1/decisions 直接返回类型化答案,官方称速度约为 Responses API 的 10 倍,目前唯一支持 gpt-6-luna。三种问题类型:predicate 返回 0-1 概率;choice 返回选项之一加概率数组与置信度;score 返回有序等级的概率加权平均。
2
Mistral Large 4 发布:1 万亿参数主打网络安全,公开预览
Mistral AI 于 2026 年 10 月 6 日发布旗舰大模型 Mistral Large 4,内部代号 le Chonk,总参数 1 万亿、单次推理激活 490 亿,是 Mistral 史上规模最大的模型。本轮放出的是公开预览版,API 已通过 Mistral Studio 开放,模型权重按官方口径要到 10 月底才会公开。Artificial Analysis 智能指数 38 分,漏洞复现测试 82% 领先。
3
Aleph Alpha 开放权重 Kolibri:78B MoE 支持百万 token 上下文
Aleph Alpha 于 2026 年 10 月 3 日发布 Kolibri,拥有 781 亿参数的混合专家模型,每个 token 激活 34.6 亿参数,经验证支持 1,048,576 个 token 上下文窗口。以完整权重在 Hugging Face 上根据 Apache 2.0 许可证发布,同时发布技术报告、德英双语模型卡与训练说明。前代 Kolibri Origin(30.6B 参数)仅在内部验证,从未公开发布。
4
Google DeepMind 发布 EmbeddingGemma 2:开源轻量多模态嵌入
Google DeepMind 2026 年 10 月 6 日发布 EmbeddingGemma 2,基于 Gemma 4 架构,以 Apache 2.0 许可开源,将文本、代码、图像、视频和音频映射到统一嵌入空间。EmbeddingGemma 2 拥有 7.4 亿参数,专为设备端推理设计。前代 EmbeddingGemma 累计下载量超 2000 万次。
5
Kandinsky 6.0 开源:29B 与 3B 同步音频视频生成
Kandinsky Lab 于 2026 年 10 月 6 日开源 Kandinsky 6.0 Video:用于同步文本生成音频与视频的 diffusion 模型。Kandinsky 6.0 Video Pro(29B)与 Lite(3B)都能生成带 44 kHz 同步音频的 5 秒片段,支持唇形同步,提供 T2AV 与 TI2AV 模式,另有一个独立超分辨率模型可将输出提升至 Full HD。ComfyUI 同日发布第一方扩展。
6
淘宝 TaoMate-H3 开源:三步生成「分钟级」音视频连续创作
阿里巴巴 TaoLive AIGC 团队 2026 年 10 月 7 日开源音视频联合流式生成模型 TaoMate-H3,基于 MiniMax H3,将三步 LoRA 推理与自回归生成相结合,能根据文本描述连续生成包含人物对白、歌声或环境音的视频,支持分钟级续写,以及 480p、768p、1080p 横竖屏输出。推理代码与 LoRA 权重已在 GitHub 和 Hugging Face 同步发布。
7
Musubi 开源 PolicyLM-1.7B:22 毫秒零重训打破大模型两难
AI 初创公司 Musubi 于 2026 年 10 月 6 日遵循 Apache 2.0 协议开源 17 亿参数的决策模型 PolicyLM-1.7B,主打直接输入规则、几十毫秒内输出审核概率。模型在 NVIDIA L4 上推理延迟约 35 毫秒,H100 上可压缩至 22 毫秒,单次推理支持同时并行评估多达 6 个策略分类。官方文档警告禁止将其作为儿童安全或自残场景的唯一防御线。
8
创智学院 GAIR 与 Sand.ai 开源 daVinci-MagiHuman 视频基座
2026 年 10 月 6 日由上海创智学院生成式 AI 研究实验室(GAIR)与 Sand.ai 联合研发的 daVinci-MagiHuman 正式开源发布。模型栈完整开源,包括生成模型、超分模型以及推理代码。马尔奖得主曹越博士创立的 Sand.ai 此前发布全球首个自回归视频生成模型 Magi-1 与主打 AI 演员表现力的 GAGA-1 模型。
9
Google DeepMind Gemini 3.8 Flash 模型卡发布:百万 token 上下文
Google DeepMind 已在 2026 年 9 月 2 日发布 Gemini 3.8 Flash 模型卡,重点放在软件工程、Agent 工作流、复杂知识任务、多模态输入和成本控制上。官方资料显示 Gemini 3.8 Flash 支持文本、图片、音频和视频输入,上下文窗口最高 1M Token,文本输出最高 64K Token。API 价格为输入每百万 Token 0.75 美元、输出 3.75 美元。
10
OpenAI 与 Anthropic 等百余家机构联合呼吁 AI 网络防御合作
OpenAI 发布题为《呼吁开展网络防御的集体行动》的公开信,联合 Anthropic、亚马逊云服务、谷歌、微软等百余家机构共同警告:随着全球各地模型能力不断提升,由人工智能发起的网络攻击将变得愈发广泛和复杂,留给各方强化网络防御的时间窗口有限。医院、水处理厂、电网及互联网基础设施等关键公共服务正面临日益迫近的安全威胁。
Epic Games 开源的 Windows 原生高性能调试器,原生 GUI、低延迟、双进程架构,专为游戏与实时渲染优化。
面向 Claude 编码工作流的菜单栏应用,支持多任务并行与 iOS 模拟器内嵌。
用 GPT 模型生成高质量结构化指令数据的工具集,支持多轮对话与人类反馈注入。
面向渗透测试与 CTF 选手的全能工具集合,整合 Nmap、SQLMap、Hydra 等 100+ 工具的一键调用。
聚焦 Claude 与开源大模型的提示词工程框架,支持 prompt 模板版本管理与对照评测。
在 Android 设备上运行的便携式 VS Code 体验,基于 Code-Server 深度定制触屏交互。
将 Ghidra 反编译器接入 MCP 协议,让 Claude、Cursor 等 Agent 直接驱动逆向分析流程。
分布式 SQL 查询引擎,专为低延迟交互式分析与跨数据源联邦查询设计。
Spring Boot 持续维护版本,简化 Spring 应用初始搭建与开发流程。
开源变更数据捕获(CDC)平台,基于 Kafka Connect 监听数据库变更并实时流式输出。