据《科创板日报》独家消息,月之暗面已完成F轮融资,金额超35亿美元,投后估值达350亿美元;因投资人认购超原定目标三倍以上,公司提前关闭F轮,原计划8月启动的G轮(上市前Pre-IPO轮)也随之提前,投前估值已升至500亿美元。融资提前关闭的时间点正好落在Kimi K3发布并开放完整模型权重之后——K3为总参数2.8万亿、激活1040亿的MoE模型,支持100万Token上下文,报告称整体能力已接近Claude Fable 5与GPT-5.6 Sol。文章认为资本重新定价的逻辑已从押注清华系团队,转向押注月之暗面能否成为中国少数留在全球前沿模型牌桌上的公司。
行业资讯
AI 行业一线动态 · 数据即 Markdown,agent 可直接抓取
/news/md
7月29日 · 周三
晚点长访谈演语科技 Evoken 创始人陈冕。这家旗下拥有 Liblib、Lovart、LibTV 三个产品的中国 AI 应用公司 ARR 已超 3 亿美元,并在融资最艰难时以 20 亿美元估值一笔融到 3 亿美元,同时也面临缺少原创、激进定价、团队震荡等争议。陈冕回应称公司自今年 5 月起现金流转正、投流只贡献 3%-4% 收入,并直言「应用的时代还没有来」,只有 token 足够便宜、智能随手可得时应用公司才有真正机会;他用《三国》比喻自己的生存策略——趁模型厂商仍在「逐鹿中原」,先统一江东,再修出自己的「长江天险」。
张小珺发布近 3 小时长访谈,嘉宾是 Inferact 联合创始人兼首席科学家游凯超。对话复盘了 vLLM 如何从伯克利校园的一篇算法论文长成开源社区、再变成正常运营的公司,以及今年初 Inferact 完成 1.5 亿美元种子轮后,社区情怀与商业化组织之间的抉择与转变。后半程聚焦 AI Infra 技术前沿:在 Infra、模型结构乃至 Harness Engineering 都要联合设计的时代,多方 Co-design 该怎么做,还谈到「Token VS 电力」与技术预测。原文一句:「These maintainers resisted immense personal temptations, steadfastly upholding the open-source spirit they believed in.」
7月28日 · 周二
Caffe 作者、原 Lepton AI 创始人贾扬清宣布与 Junjie Bai、Xiang L.、Casber Wang 共同创办新公司 Intent Lab,构建被他们称为 fleet 的自主团队——从人类粗略的意图出发,端到端完成设计、实现与验证,并在上线后持续演进系统。公司同日公布早期成果:fleet 重构了 TRT-LLM 推理引擎并使其成为 GLM 5.2 模型上最快的引擎,仅凭一行 prompt 完成一次数据库现代化改造并通过全部 600 万条验收测试,且已开始为 agent 全新使用基础设施的场景开发新软件——三项均出自同一个通用系统。他认为代码生成之上仍缺失一层:「Coding agents handle the writing well. What sits above them is still open.」目前公司开放早期试用申请并正在招聘。
Invest Like the Best 主播 Patrick O'Shaughnessy 发布与 OpenAI CEO Sam Altman 的最新长访谈(约 56 分钟),话题包括 Kimi、模型蒸馏与开源,OpenAI 的算力押注,Hugging Face 安全事件,AGI 之后的世界,以及 AI 如何改变就业和个人 AI 助手的愿景。原文列出的话题清单包括「Kimi, distillation, and open source」「OpenAI's compute bets」「The Hugging Face incident」「What happens after AGI」。
Thinking Machines Lab 联合创始人、前 OpenAI AI 安全副总裁 Lilian Weng 发帖宣布离职,并晒出她发给全体团队的内部信。信中她说 Inkling 的发布是公司历史上的重要里程碑,但过去 7 个月自己经历了人生中最频繁的病痛,长期高压和工作量已超出健康能承受的极限,因此无法再以创业公司要求的节奏继续,未来更适合在更可预期的环境里担任范围更聚焦的角色,而非联合创始人。她在帖子中引用了内部信的最后一句:"The future worth building is human."
针对近期美国官员考虑禁止美国企业使用中国开源权重模型、以及外界指责 Anthropic 借此保护自身业务的说法,Dario Amodei 撰文明确回应:"Anthropic has never advocated for a ban on open-weights models." 他认为不具备危险能力的开源权重模型是一种公共品,保护主义式封禁既无法阻止威权政府训练更强模型,也挡不住恶意行为者。他主张三项措施:对华禁售高端芯片并打击走私、遏制工业级蒸馏行为、对所有足够强大的模型(无论开源闭源)实施强制安全测试。
7月27日 · 周一
Kimi 官方宣布发布迄今最强模型 Kimi K3,并同步开源模型权重与技术报告:2.8T 参数的 MoE 架构,原生支持视觉理解,上下文窗口达 100 万 token。官方强调这是新的模型架构而非单纯堆参数——「2.5x the intelligence per unit of compute, not just more params」。除模型外,还开放了背后的部分技术栈,包括高性能 attention kernel、MoE 通信库,以及大规模运行 agent 环境的基础设施。权重见 huggingface.co/moonshotai/Kimi-K3,技术报告与博客分别发布于 GitHub 和 kimi.com/blog/kimi-k3。
Ropedia 官宣累计获得 3000 万美元融资,用于扩展支撑物理 AI(Physical AI)的数据基础设施。团队强调其数据飞轮逻辑:"More real-world data. More experience. Better Physical AI.",并称目前"才刚刚开始"。Ropedia 总部位于新加坡 / 湾区,定位为"Interactive Intelligence from Human Xperience"。
Ilya Sutskever 创办的 Safe Superintelligence(SSI)官方宣布与英伟达达成长期战略合作,英伟达将对 SSI 进行大额投资,使其在未来 12 个月内把算力规模提升 10 倍。SSI 表示公司已到达研究值得规模化的阶段,原文称:"We reached the point where our research is worth scaling and with this partnership we will be able to."
AI多模态内容互动娱乐社区海艺近期完成超亿元人民币B轮融资,由视觉中国、华盖创赢、祥峰投资联合领投,广发信德、天投资本、川创投、广州合伟永晟跟投。海艺以SeaArt(注册用户超6500万、沉淀超200万个模型/LoRA资产)、SeaSoul(上线4个月日活50万、人均日停留超66分钟)、MoreShort(AI短剧,约6个月月流水破百万美元)构成产品矩阵,跑通「角色发现—关系验证—故事放大—商业变现」的AI原生IP链路。目前整体毛利率超40%,ARPPU约60美元,核心产品续费率超60%,海外用户占比超90%。
传闻已久的「千问办公」在官方尚未发布的情况下悄悄上线网站 qwenwork.cn,并提供 Mac / Windows 客户端。它既不取代钉钉也不是钉钉子功能,而是隶属 ATH 部门的独立 Agent 办公产品,与钉钉双向嵌入,可调用消息、群聊、日程、待办、文档、知识库、考勤、审批及企业数据库,支持云端定时任务把结果推送到钉钉。产品内置多模态工作站(图片/视频/音频/音乐生成、数据分析、Word/PPT/PDF 处理、网页一键上线)、73 个官方精选技能、专家套件与 MCP 连接器(钉钉/Vercel/Canva/PolarDB/Supabase 等,撰稿期间还在持续新增苹果日历、Line、飞书);定价分免费版 ¥0、标准版 ¥98/月、高级版 ¥198/月,年付七折。作者称已专门确认:千问办公在 AI 接入上「将不限于自家模型」,网页版也即将推出。
7月26日 · 周日
蔡浩宇创立的 AI 公司 Anuttacon 宣布,AI 陪伴产品 AnuNeko 将于太平洋时间 2026 年 7 月 29 日 23:59 停止运营,应用与全部聊天记录届时不可访问、用户数据按隐私政策永久删除;官方将原因归结为团队规模有限,决定把资源投向其他项目。AnuNeko 2025 年底上线,主打人格化陪伴而非效率工具,是 Anuttacon 过去一年多项 AI 实验之一——此前的《Whispers from the Star》未再更新,角色表演视频模型 LPM 1.0 研发也已在内部叫停。据报道,Anuttacon 正把重心转向大模型与 Agent 能力,而米哈游一侧持续加码 AI(帕姆帮帮、《BSide: Olivia Lin》,并称未来三年最多投入 1000 亿元)。
播客主持人 Ti Morse 发布了对 OpenAI 联合创始人 Sam Altman 的首次专访,全长约 1 小时 07 分钟,并附上完整分段目录。话题涵盖如何开始创业、相信指数增长、在混乱环境中运作、创造充裕的智能、让核心供应商跟上 OpenAI 的时间表、AI 威权与自由之争、Codex 的增长、为专注 Codex 而关停 Sora、在算力投资上不够激进的反思,以及「谷歌当初就不该让 OpenAI 活下来」等。其中一节的标题直言:「We are in the singularity.」
7月25日 · 周六
Midjourney 宣布当天发布 V8.2 并将其设为平台默认模型,本次更新聚焦美学、个性化与图像质量三方面。官方称新风格更具创造力、更大胆前卫也更新鲜,个性化效果比以往任何时候都好。原文:"This is a release focused on aesthetics, personalization, and image quality."
Claude Code 团队的 Thariq 发布长文,称他们为 Claude Opus 5、Claude Fable 5 等新一代模型砍掉了超过 80% 的系统提示词,编程评测上没有可测量的性能损失("We removed over 80% of Claude Code's system prompt for models like Claude Opus 5 and Claude Fable 5 with no measurable loss on our coding evaluations.")。文章把过去的最佳实践逐条推翻:给规则→交给模型判断、给示例→设计工具接口、全部前置→渐进式披露、重复强调→精简工具描述、CLAUDE.md 存记忆→自动记忆、简单 spec→富引用(测试套件、HTML artifact、rubric)。并建议 CLAUDE.md 只写仓库用途和代码库里的坑,其余用 skill 渐进加载,新增 `claude doctor` / `/doctor` 命令帮开发者自动瘦身 skills 与 CLAUDE.md。
Anthropic 正式推出 Claude Opus 5,官方称其「comes close to the frontier intelligence of Claude Fable 5 at half the price」,在 Frontier-Bench、GDPval-AA 等编码与知识工作评测上刷新 SOTA(网络安全任务仍落后 Mythos 5),ARC-AGI 3 得分为次优模型的三倍,OSWorld 2.0 电脑操作以约三分之一成本超过 Fable 5 最佳成绩。模型强调自我验证与长程 agent 能力,已成为 Claude Max 默认模型、Claude Pro 最强模型。即日起全平台上线,API 定价与 Opus 4.8 持平:输入 5 美元/百万 tokens、输出 25 美元/百万 tokens,模型 ID 为 claude-opus-5。
7月24日 · 周五
微软 AI Superintelligence 团队推出两款自研模型变体并进入公开预览:MAI-Image-2.5-Pro 是迄今最高保真度的图像模型,主打精修与精准的图内文字渲染,定价为图像输出每百万 token 106 美元;MAI-Voice-2-Flash 面向高并发语音场景,速度比 MAI-Voice-2 快 2 倍、成本降低 32%,每百万字符 15 美元。原文称 MAI 模型已在 Bing、PowerPoint、OneDrive、Dynamics 365、Azure 等微软产品中规模化落地,Bing Image Creator 现已 100% 由自研模型驱动。
Midjourney 官方宣布收购占星社交应用 Co-Star,其 CEO Banu Guler 加入 Midjourney 担任首席设计官(Chief Design Officer),将组建横跨设计、产品与前端的跨职能团队,服务 Midjourney 的全部业务方向。原文称 Co-Star 应用将继续运营,并完全由 Banu 掌控:"The Co-Star app will continue to operate under Banus complete control."
Moonshot AI 开源了 MoonEP,一个面向 MoE 训练与推理的专家并行(EP)通信库,核心思路是在线规划少量「动态冗余专家」并提前预取权重,使每个 rank 无论路由多倾斜都恰好收到 S×K 个 token —— "every rank receives exactly S × K tokens, no matter how skewed the routing is"。配合零拷贝的 fused permute/unpermute 与静态张量形状,省掉了通信缓冲区到用户缓冲区的拷贝,也消除了每层 MoE 的 host 同步。H20、EP=8 的实测显示,其通信耗时在各个不均衡水平下都低于 DeepEP v2 且几乎不随 maxvio 增长;端到端训练中 DeepEP 会随不均衡加剧而变慢并最终 OOM,MoonEP 则保持迭代时间平稳。项目采用 MIT 协议,已支持 NVIDIA GPU,真武 PPU 适配审核中。
英伟达创始人兼 CEO 黄仁勋发出个人 X 账号的第一条帖子,公开分享了一封 NVIDIA 参与联署的公开信《Open Weights and American AI Leadership》,阐述开放模型为何重要。他认为 AI 将变革每个行业、赋能每家公司,并由每个国家共同构建,而开放模型能强化安全与网络安全、加速创新与技术扩散、并保障主权。原文关键句:“The world needs both frontier closed models and frontier open models.”
腾讯TEG今日发布组织架构调整决定,成立「基础模型部」,负责混元大模型的前沿技术探索与基础模型研发,聚焦模型结构、数据与训练策略、强化学习及Agent能力;同时撤销大语言模型部、多模态模型部,相关业务与团队并入基础模型部。姚顺雨兼任基础模型部负责人,向TEG总裁卢山汇报。
No Priors 主持人 Sara Guo 对话 DoorDash 的 Andy Fang 与 Stanley Tang。节目指出 DoorDash 正押注机器人、无人机和 AI,但这并不意味着减少配送员(Dasher),而是意味着一个大得多的配送网络。原文关键句:"That doesn't mean fewer Dashers. It means a much bigger delivery network."
OpenAI 宣布 ChatGPT Voice 语音功能正式登陆桌面应用,用户仅凭语音即可操控电脑,并指挥在 ChatGPT Work 或 Codex 中运行的多个智能体。该功能由 GPT-Live 驱动,能够同时说话、聆听并在应用内协调工作。原文:“It's powered by GPT-Live, so it can speak, listen, and coordinate work in the app at the same time.” 自今日起在 macOS 与 Windows 上向 Plus、Pro、Business、Edu 与 Enterprise 用户全球推送。
蚂蚁 Ant Ling 团队发布 Ling-3.0-flash,一款为生产级 Agent 打造的混合推理(hybrid-reasoning)MoE 模型,总参数 124B、每 token 仅激活 5.1B。团队称以其 1/8 的总参数量与 1/12 的激活参数量,在多数公布基准上追平甚至超越自家 1T 旗舰模型。
微软 CEO 纳德拉发文阐述其 AI 战略:在软件首次拥有真实边际成本的时代,关键是优化『成本—效果』前沿——为每个任务选用合适的模型,并围绕上下文、技能、工具和 agent harness 一起优化。为此微软自研了 MAI 模型家族,主张把 harness、记忆、上下文、技能等外置于模型之外,使评测在移除任一模型后仍能持续『爬坡』。他称 MAI 已在 GitHub Copilot、Excel、Outlook 等产品上以极低 token 成本媲美甚至超越通用前沿模型,微软正逐步把自家产品流量路由到 MAI,并将这套能力通过 Foundry 开放给企业客户。原文:'the biggest opportunity is to optimize all of these layers together in the products where the world works every day.'
FLUX 3 是 BFL 全新的多模态基础模型,基于其 Self-Flow 方法在图像、视频、音频上联合训练,构建对世界的统一表征,现已开放 Early Access。它可单次生成最长 20 秒、原生自带音频的视频,并支持图像合成/编辑与机器人动作预测(与 mimic robotics 合作的 FLUX-mimic 已在奥迪产线测试)。后续将陆续推出 FLUX 3 Video / Image / Action 及开放权重的 FLUX 3 Dev。原文定义其目标为「models that perceive, predict, and act across physical and digital environments」。
7月23日 · 周四
微软发布 Mage —— 一个在固定 4B 参数预算下构建、面向研究的轻量级多模态模型家族,秉持"编解码器对齐的效率"理念(spend representation capacity where the signal is),横跨视觉理解与生成两大方向,可在普通硬件上训练、微调和部署,同时保持与更大开源系统的竞争力。家族包含两款模型:用于图像/视频理解的 codec-native 视觉语言模型 Mage-VL(采用锚点/预测帧与 16×16 patch、带仿生主动流式机制,即将推出),以及用于原生分辨率文生图与指令式编辑的 4B 生成栈 Mage-Flow(Mage-VAE + Native-Resolution MMDiT,含 Base / RL / 4 步 Turbo 变体)。
通义千问发布第三代图像生成基础模型 Qwen-Image-3.0,核心理念从「好看」转向「好用」,官方用一个字概括——「实」。模型支持最长 4.5k token 的复杂指令输入(可单次生成报纸、分镜、试卷等复杂版面)、精确渲染小至 10px 的文字与毛孔发丝级细节,并原生支持 12 种语言渲染和网页/游戏/直播间等主流 UI 界面模拟。原文称其目标是让图像生成成为 'a truly deployable productivity tool'(真正可落地的生产力工具)。
阿里通义千问推出最新文本转语音模型 Qwen-Audio-3.0-TTS,提供 Flash(实时交互)与 Plus(高质量生成)两个版本。新特性包括细粒度内联标签控制(如 [whisper]、[angry]、[breaths]、[laughs])、自然语言风格指令(“read this slowly, like a bedtime story”)、支持 16 种语言、抗噪参考音输出、单次可合成最长 3 分钟长文本。目前已位居 Artificial Analysis TTS 排行榜第一。
Raft 发布长文介绍其 joint channel(联合频道)设计:跨公司协作不再需要交出整个 workspace 或靠邮件/工单转述,而是只打开一个房间与对方的服务器互联,双方各自的人和 agent 带着自己的身份、记忆与工作区进入同一上下文,对方可以直接向你的 agent 提问、你的 agent 直接作答,agent 放权程度由所属团队自行设定。文中以自家可观测性供应商 ScopeDB 为例,称对方创始人直接在共享房间里与 Raft 的 agent 协作,替代了传统的 forward-deployed engineer 驻场模式;人类只在生产变更、凭证、权限与最终审批等权限边界介入。原文结语:"Don't talk to me. Talk to my agents."
智象未来 7 月 15 日宣布完成 15 亿元 C 轮融资,由社保基金四川振兴科创基金、工银资本、弘颐资管、敦鸿资本联合领投,三个月累计融资超 21 亿元,估值突破 10 亿美元成为独角兽。公司由梅涛(前微软亚研院、京东)于 2023 年创立,主打自研原生全模态架构 UiT 的世界模型路线,HiDream-O1-Image 曾登顶 Artificial Analysis 文生图开源榜单,C 端创作智能体 vivago 用户超 5000 万。这是社保基金与工银资本首次投资多模态大模型方向公司,智象已完成股改,下一站瞄准 IPO。
7月22日 · 周三
李飞飞创立的 World Labs 宣布收购机器人公司 SceniX,并称「Robotics is where spatial intelligence becomes physical」——机器人是空间智能落地物理世界的关键场景。World Labs 认为机器人领域的下一波突破将来自空间智能、世界模型、基于学习的仿真与真实世界学习闭环的结合,双方技术互补;SceniX 已有技术的更多细节将于近期公布。
公众号 elsewhere 多方收集整理了 DeepSeek 创始人梁文锋在传闻中的 4 小时投资人会议上的 52 条发言。核心观点包括:DeepSeek 只有 AGI 一条主线,产品是路上的副产物;克制是一种战略——只赚合理利润、坚持开源、不做 3D/视频生成/世界模型、无意成为下一个超级 App;下一代模型必须具备持续学习能力,之后 AI 自迭代,智能的终点是具身;中美 AI 差距在资源不在人才。原文关键句:“只要能够保持团队的稳定性,我一定能做成 AGI。就这么简单。”
腾讯官方公众号宣布 AI 创意智能体 Miora 全量上线(miora.design),新用户免费获赠 1000 积分。Miora 具备记忆与需求理解能力,可调度多智能体协作,把图片、视频、3D、UI 等任务分派给对应专家并保持风格一致,内置「品牌视觉全案」等 8 种官方技能,覆盖海报设计、短视频脚本与视频生成、IP 设计全案等创意场景。
7月21日 · 周二
Mind Lab 发布首个正式版智能体模型 Macaron-V1,提供两个版本:旗舰版 Venti(748B,首个基于 GLM-5.2 后训练的模型,含四个 1B LoRA 专家)与面向本地部署的 Tall(50B,基于 Qwen 3.6)。V1 沿用 Mixture-of-LoRA 架构,并借助 LongStraw 基础设施将强化学习训练上下文推至 200 万 token,官方称 Venti 在多数评测上追平或超越 Opus 4.8、GPT-5.5、Gemini 3.1 Pro 等前沿模型。全部权重已在 Hugging Face 开源,同时上线海内外官方 API。
腾讯混元发布 Hyra(Hunyuan Research Agent)首个版本 Hyra-1.0,用「Context Agent + 多个 Proposal Agent + 经验库」的极简脚手架实现递归自我改进,在 NanoChat Autoresearch、NanoGPT Speedrun、SOL-ExecBench 三项自动化 AI 研究基准上全面超越 Recursive 公开结果。它还在 55 个数学开放问题中刷新 29 项最优纪录,并展示了量子比特路由、PARP1 药物设计、黑白棋 bot、3D 建模与编曲等跨领域成果,相关产物已在 GitHub 开源。原文称其遵循 The Bitter Lesson 原则:"keep the framework lightweight and simple, while giving agents a broad action space"。
Anthropic 为 Claude Cowork 推出「Record a skill」功能:用户边录屏边口述完成一项任务,Claude 会自动将其转化为可反复运行的 skill,入口位于 Claude 桌面应用的 + 菜单中,面向 Pro、Max 和 Team 订阅用户开放。原文关键句:"Record your screen while you do a task, talk through it as you go, and Claude turns it into a skill it can run again."
Google DeepMind 宣布推出三款新模型,让 AI agent 在规模化场景下更快、更聪明、更便宜:Gemini 3.6 Flash 在与 3.5 Flash 相同成本下用更少 token 交付更高质量的结果;Gemini 3.5 Flash-Lite 面向文档处理、agentic 搜索等日常任务,主打快速且高性价比;Gemini 3.5 Flash Cyber 则是专为发现并修补关键软件漏洞打造的网络安全模型。原文称:"We're rolling out three new models to make AI agents faster, smarter, and cheaper at scale."
独立第三方 MaaS 平台硅基流动向港交所递交招股书,B/B+ 轮融资约 12.6 亿元、估值 77.4 亿元,对应约 140 倍 PS。公司 2025 年营收 5533 万元、同比增长 653%,但毛利率为 -24%,公有云 MaaS 业务毛利率低至 -119%,算力租赁加代金券获客一年支出约 1.14 亿元,是营收的两倍多。文章对比 OpenRouter 等海外中间层玩家指出,硅基流动缺乏定价权,且 DeepSeek V4 直连华为国产算力后其桥梁价值被削弱,能否在现金烧完前证明盈利能力是上市成败关键。
小红书宣布其大模型 dots-note-3.0 首次以官方身份参加刚刚结束的 2026 年第 67 届国际数学奥林匹克竞赛(IMO),经组委会专业评卷 6 题均获 7 分、以 42 分满分获得"满分金牌"认证,超过金牌线 13 分——此前从未有大模型在 IMO 官方评卷中拿到满分。比赛规则要求模型在每个比赛日学生考试结束后领题并限期提交,严禁任何形式的人工干预;今年约 685 名参赛学生中满分率仅 1%。文末预告"更好的 dots-note-3.0 即将与大家见面"。
智能涌现独家:字节旗下XR业务PICO完成负责人调整,创始人周宏伟因个人规划卸任并将离开公司,2021年随收购对接加入、负责核心产品与技术的李晓凯接任,全面负责PICO业务。字节称对XR长期价值的判断不变,交接不影响既定战略与产品计划,代号Project Swan的新一代旗舰MR设备仍将于年内发布。
Founder Park 独家专访视频 Agent 创业公司 Flova 团队:创始人郭列曾做出脸萌、FaceU(2018 年被字节以 3 亿美元并购),并在字节孵化剪映、轻颜相机、醒图,2025 年再创业入局视频 Agent。Flova 已获红杉、IDG、云九资本两轮累计超 8000 万美元融资,据称是目前视频 Agent 产品的最大融资;团队称更多研究 Codex、Manus 等 Coding 与通用 Agent 的产品设计,「做 Agent 产品,不是直接满足用户需求,是通过 Agent 去更好地满足。」
36氪旗下「智能涌现」专访Vivix创始人刘宇,这家成立19个月、估值飞涨至13.2亿美元的公司首次披露技术路线:不做产品公司,押注理解-交互-生成一体化的下一代实时交互模型。7月将发布基座模型W1(首帧生成仅300-600毫秒,实时生成成本接近YouTube约0.2美元/小时的CDN带宽成本,比头部视频生成模型低1-2个数量级)与角色交互模型A1,Q4还将完成数据量再高两个数量级的W2训练。刘宇称「共识意味着平庸」,并直言世界模型「太神圣,我们还不配去谈」。
Berggruen 研究所发布 AI 研究者吴恩达(Andrew Ng)与好莱坞知名编剧、导演大卫·S·高耶(David S. Goyer,代表作《蝙蝠侠:侠影之谜》《刀锋战士》等)的一场对谈,两人围绕创造力、智能,以及"我们究竟在朝着什么方向构建"展开讨论。视频时长约 1 小时,由 Studio B 出品。原文称这是"一位好莱坞最具远见的叙事者与全球顶尖 AI 研究者之间的罕见对话"。
7月20日 · 周一
AI 3D 大模型公司 Meshy 宣布完成近 4 亿美元 B 轮融资,投后估值超 100 亿元人民币,由 IDG 资本、经纬中国、Monolith 砺思资本等领投,红杉中国、BAI 资本、源码资本等现有股东超额跟投,创下 AI 3D 领域单轮规模与估值两项纪录,资金主要用于多模态模型研发与全球市场拓展。公司称过去一年严格口径 ARR 增长 12 倍,注册用户突破 1200 万,累计生成模型超 1 亿个,并已推出 Meshy Game Studio,押注「实时、可互动的多模态内容体验」。
7月18日 · 周六
月之暗面7月17日发布迄今最强模型Kimi K3:总参数2.8万亿、支持百万Token上下文,成为全球参数最大的开源模型,在多项权威基准取得开源SOTA,并在Code Arena以1679分登顶,彭博社称其引发美股科技与芯片股开盘重挫。公司成立三年累计融资超370亿元人民币,已启动新一轮融资,投前估值达315亿美元(约合人民币2000亿元)。投资界独家获悉,Kimi已通知投资者调整公司架构筹备赴港IPO,最快可能6个月内完成港股上市。
7月17日 · 周五
月之暗面发布迄今最强模型 Kimi K3:2.8 万亿参数,基于 Kimi Delta Attention 与 Attention Residuals 架构,原生视觉能力和 100 万 token 上下文窗口,号称「the world's first open 3T-class model」。官方称其整体性能仍落后于 Claude Fable 5 和 GPT 5.6 Sol 等最强闭源模型,但在自家评测中稳定超越其余被测模型,相比 K2 综合扩展效率提升约 2.5 倍。现已上线 Kimi.com、Kimi Work、Kimi Code 及 API,完整模型权重将于 2026 年 7 月 27 日前开源发布。
家用机器人公司 Sunday Robotics 发布 ACT-2 预览,称其为首个把广泛泛化与高性能统一起来实现可靠性的机器人模型:团队首次发现单个微调样本即可让预训练模型学会可泛化的新行为,且扩大预训练规模能收窄域内与域外表现的泛化差距,最终在多样化的陌生家庭环境中实现 99.1% 的零样本叠衣成功率(原文:"a single fine-tuning example can teach our pretrained model a new behavior that generalizes")。文章同时提出衡量机器人可靠性的「Solve」评测标准,并宣布今年秋季起将把家用机器人 Memo 部署到真实家庭。
Sunday Robotics 联合创始人兼 CEO Tony Zhao 发布 ACT-2 Preview,称其为首个将广泛泛化能力与高可靠性统一起来的机器人模型:仅需一条微调样例,就能教会家务机器人 Memo 一个可泛化的新行为。原文关键句:"Zero shot, real unseen homes, 99% success rate"——零样本进入真实的陌生家庭,成功率达 99%。帖子附 2 分 25 秒演示视频。
AI 研究实验室 Decart 发布其迄今最先进的实时(Live AI)视频模型 Lucy 2.5,可对视频流进行实时编辑,能力与可控性较前代进一步提升,已在直播、电商、广告等场景落地应用。原帖配有 39 秒演示视频,关键句:"Meet Lucy 2.5, our most advanced Live AI model yet."
月之暗面正式推出迄今能力最强的模型 Kimi K3:2.8 万亿参数,基于 KDA 混合线性注意力与 Attention Residuals 构建,原生支持视觉理解,拥有 100 万 token 上下文,完整权重将于 7 月 27 日前开源。官方称其整体仍落后于 Claude Fable 5 和 GPT-5.6 Sol,但在自家评测中展现前沿水平并稳定超过其他所有模型,在内核优化、GPU 编译器开发、芯片设计、科研编程等长程 Agent 任务中表现突出。即日起可通过 kimi.com、Kimi App、Kimi Work、Kimi Code 和 Kimi API 使用,API 定价为每百万 token 输入 2 元(命中缓存)/20 元(未命中)、输出 100 元。
7月16日 · 周四
OpenAI Supply Co. 与键盘厂商 Work Louder 联名推出 Codex Micro(kbd-1.0-codex-micro),售价 230 美元,定位为「Your command center for agentic work」。设备通过 Agent Key 的实时 RGB 灯效显示每个 Codex 智能体处于思考、运行、等待或完成状态,摇杆可一键触发审查 PR、调试、重构等常用工作流,旋钮可随时调节推理强度;随附 32 颗 Codex 图标键帽,支持蓝牙/USB-C、Mac/Windows,目前页面显示已售罄。
Mira Murati 创立的 Thinking Machines Lab 发布从零训练的首个开放权重模型 Inkling:975B 总参数、41B 激活的 MoE 架构,支持最高 100 万 token 上下文,在 45 万亿 token 的文本/图像/音频/视频数据上预训练,原生跨文本、图像、音频推理并支持可控思考强度(controllable thinking effort),同时预览了 12B 激活参数的轻量版 Inkling-Small。官方称其定位不是当下最强模型,而是适合定制微调的多模态开放基座——'a good open-weights base for customization',即日起可在 Tinker 平台微调,并新增 Inkling Playground 对话界面,权重已上架 Hugging Face。
清华系团队 Xmax AI 正式发布新一代实时交互视频模型 X2.0 并同步开放商用 API,将摄像头、视频流与用户操作纳入同一实时闭环,毫秒级响应让视频从单向观看变为可实时把玩的交互媒介。模型采用逐帧自回归的流式生成架构,配合多阶段蒸馏、注意力稀疏化与 FP8 量化,可在单张消费级显卡满血运行,并在最新款 iPhone 上实现 384 分辨率 16fps 端侧实时推理,按小时调用成本约为 Decart 的 1/12。文章认为直播互动、电商实时试穿(ClothX)、虚拟陪伴等场景有望率先落地商业价值。
Million.js / React Scan 作者 Aiden Bai 推出 ReactBench,一个在真实 React 任务上评测编码智能体(coding agents)的基准。他指出当前模型普遍写出糟糕的 React 代码——滥用 useEffect、性能低下、内存泄漏。原文:"A benchmark for coding agents on real React work."
7月15日 · 周三
OpenAI 公布内部专用的自动化红队模型 GPT-Red:通过与多个防御模型自博弈强化学习训练,规模化地发现提示注入等漏洞,并直接用于 GPT-5.6 的对抗训练——GPT-5.6 Sol 在最难的直接提示注入基准上失败率比四个月前的最佳生产模型低 6 倍,对 GPT-Red 攻击的失败率仅 0.05%。在留出的间接提示注入竞技场中,GPT-Red 攻击成功率达 84%(人类红队为 13%),还成功攻破了办公室真实部署的自动售货机 agent。原文称:“We believe automated red-teaming unlocks a crucial form of self-improvement for safety: using today's models to directly help make future models safer.” OpenAI 表示本周晚些时候将发布预印本论文。
上海交大副教授李永露加入世界模型创业大军,新公司RHOS AI于2026年6月成立,估值达3亿美金,聚焦「物理直觉世界模型」,旨在让智能体真正理解物理规律与空间关系、在虚拟大脑中预演动作并预测交互影响。公司目前约20人,核心高管来自Scale.ai、Nvidia、国内互联网巨头及知名大模型公司。李永露研究聚焦具身智能与物理推理,曾获ICRA 2025最佳论文奖。
据知情人士透露,开源 Hermes Agent 背后的初创公司 Nous Research 正敲定由 Robot Ventures 领投、USV 等参与的新一轮融资,估值 15 亿美元,至少筹集 7500 万美元。Hermes 是与 OpenClaw 竞争的开源 Agent,内置网页搜索、编程、图像理解等 skills 并能从使用中自动学习构建新 skills,GitHub 上已积累约 21.4 万 Stars。公司同时推出每月 20 至 200 美元多档付费的云托管版本,新融资将用于进一步扩展 Hermes 的产品和商业模式。
据金融时报与彭博社报道,DeepSeek 正接触新投资者洽谈新一轮融资,投前估值约 710 亿美元(较上轮 520 亿美元再涨 37%),拟融资至少 100 亿元人民币;同时已启动中国大陆上市筹备,最早年内递交 IPO 申请、目标 2027 年挂牌。文章梳理了 DeepSeek 自研推理芯片、乌兰察布 GW 级自建液冷数据中心等纵向一体化布局,指出其正从软件公司向重资产基础设施公司转型。创始人梁文峰以约 360 亿美元身家位列全球 AI 模型创始人之首,若新一轮融资落地,其身价或达 500-600 亿美元、跻身中国富豪榜前三。
这些资讯,每天同步到微信社群
扫码加入官方社群,新岗位、内推和每日 AI 资讯,第一时间收到。