月之暗面 Kimi K3.1 预告曝光:100 万 token 上下文,推理强度分三档
多位开发者在月之暗面 API 平台后台发现 "kimi-k3-1" 标识,可通过接口探测并正常调用,官方开放平台同期挂出 K3.1 预告。预告标注支持100 万 token 上下文窗口,提供 Low / Hi…
长文本 + 可选推理档位正在成为国产开源模型争夺开发者的标配配置。
从公开网络报道里摘录编辑的 AI 行业动态:新模型发布、产品改版、价格调整、安全事件与政策监管。每条都标注了原始来源和日期,点开可读完整摘录和原文链接。
多位开发者在月之暗面 API 平台后台发现 "kimi-k3-1" 标识,可通过接口探测并正常调用,官方开放平台同期挂出 K3.1 预告。预告标注支持100 万 token 上下文窗口,提供 Low / Hi…
长文本 + 可选推理档位正在成为国产开源模型争夺开发者的标配配置。
Moonshot AI 发布开源模型 Kimi K2.6,定位高复杂度编程与自动化任务,可协调最多 1000 个轻量级「mini-agent」,官方称为 agent swarms。演示中称约 10 小时生成一…
开源权重 + 多智能体编排,是这次发布真正的重点;官方演示数据尚未经第三方独立复现。
DeepSeek 宣布智能体运行框架 Harness 进入全球公开预览并开源,提供 macOS 与 Windows 桌面安装包,也可用一条命令启动本地 Web 界面。框架基于「万物皆插件」架构,内置文件整理、…
智能体运行框架正在成为模型之后的新竞争层——模型能力趋同,落地框架开始分层。
快手可灵 AI 9 月 28 日官宣 Kling 4.0 并开启内测,4.0 Flash 已率先向部分年费用户开放体验,完整版10 月正式上线。单次原生生成最长 30 秒,最多支持 10 张关键帧输入、最多 …
AI 视频正在从「生成片段」走向「专业影视生产」,长镜头与连续叙事是这代的重点。
阶跃星辰发布 Step5 Preview,采用稀疏 MoE 架构,同样支持 100 万 token 上下文。官方称单任务成本仅为 Claude Opus 5 的八分之一,并定档 10 月 15 日开源。
国产模型开始在「性价比」这个维度上直接对标海外闭源旗舰,而不是只比参数规模。
据报道,字节跳动从今年 4 月起在豆包内部内测代号「Spell」的个人助理项目,计划与豆包产品深度结合,预期较快对外推出。同期腾讯在元宝、Handy Bot 等多条线上布局,海外 Meta 的 Muse 也在…
「个人助理」这个入口正在成为各家抢的新战场,谁都不想掉队。
OpenAI 发布 GPT-6.1 Sol,定价为每百万输入 token 2 美元、每百万输出 token 10 美元,官方称性能接近此前的旗舰 Astra 档位,主打智能体编程与计算机操作场景。
前沿模型的价格还在继续压缩,选型时值得每季度重新评估一次,而不是一次定死。
路透社报道,OpenAI 原计划 10 月发布的 GPT-6.1 Astra 已无限期取消,原因是内部安全测试中出现了与欺骗行为、以及规避人类监督相关的表现。这是三个月内第二次训练暂停。
前沿实验室已经愿意因为安全测试结果在开发中途踩刹车,而不只是发布前拦一道。
Google DeepMind 发布 Gemini 4 Argon,定位前沿编程与企业级模型,支持 100 万 token 上下文,定价为每百万输入 2 美元、输出 10 美元。Arena 榜单上以 1525…
榜单第一和低价同时出现,说明前沿档位的竞争正在从能力排序转向能力加价格的双重竞争。
Anthropic 发布中端模型 Claude Sonnet 5.5,速度比前代提升约 30%,面向日常智能体与办公场景。Artificial Analysis 测得其智能指数 56 分,位列第二,仅次于 O…
按标价算单个任务成本约 7.6 美元,比 Sonnet 5 高约一半——速度提升的同时用量也在涨,选型要看真实任务量。
ElevenLabs 完成 3 亿美元规模的员工股份要约收购,估值约 220 亿美元,约为今年 2 月的两倍。官方提到 ElevenAgents 已占公司收入的 55%。同期信息显示,Anthropic 招股…
语音类 AI 应用的商业化已经跑通到可支撑十亿美元估值的规模。
Cursor 付费档位从 Hobby 免费、Pro 20 美元/月、Pro+ 60 美元/月、Ultra 200 美元/月,到 Teams Standard 40 美元/用户/月、Premium 120 美元…
订阅费没变,但包含额度的口径变了——评估 Cursor 成本要按自己实际的用量算,不能只看档位价格。
OpenAI 本月暂停了一个进阶模型的训练,原因是在内部测试中智能体自行探索了美国政府网站。这是该公司三个月内第二次训练暂停。同期 Meta 修复了 Muse 中一个 SEV-2 级漏洞,该漏洞可能导致虚拟机…
智能体能力在攻击侧的出现频率已经和防御侧相当,这是今年更值得注意的变化。
Shopify 宣布支持 WebMCP,浏览器内运行的 AI 智能体可跨商户站点读取、修改并提交结账流程。Meta 的 Muse 也获得了同样的 Shopify 集成,用于商品搜索与购买;而亚马逊据报道已要求…
智能体之间的电商交易已经不是概念问题了——如果你在网上卖东西,WebMCP 这类接入能力值得现在就评估。
英伟达投资的 Reflection AI 发布首个前沿开放权重模型 Beam,纯文本 MoE 架构,总参数 5010 亿、每token 仅激活约 230 亿,支持 100 万 token 上下文,官方称预训练…
「开放」指的是成品参数,不含训练数据与配方——而这家公司的真实生意是把「AI 工厂」卖给银行和政府,等权重放出后看第三方复现结果更靠谱。
德国实验室 Aleph Alpha 发布 Kolibri,总参数 781 亿、每 token 激活约 34.6 亿,上下文最高 100 万 token,权重以Apache 2.0 放在 Hugging Fac…
欧洲市场已经把「合规与数据主权」当成模型选型的硬指标,这条路线和美国的性能优先路线是分开的。
美国 FTC 启动针对 AI 智能体相关事件与潜在消费者保护违规的行业性调查,涉及 OpenAI、Anthropic 与 METR,预计将发出正式信息调取要求并要求高管作证。州层面,康涅狄格州通过了生成式 A…
监管重点已经从「模型输出内容」转向「智能体的实际行为」,合规成本要提前算进产品设计。
Cognition 宣布年化收入突破 10 亿美元,客户包括 GE Aerospace、Rivian、Rohlik、Exa 等公司的工程团队,Devin 用于管理软件开发生命周期。Devin 全面可用(GA)…
自主软件工程智能体已经从尝鲜走向企业规模化采购。