今日选题:把产品可用性、执行权限和真实部署成本放在市场叙事之前。
核心判断:智能体正进入电话、电脑与可穿戴设备;真正决定落地速度的,是可审计的权限边界与可兑现的交付能力。
今日信息图

重点:终端入口、开放生态、权限安全与基础设施交付;细节与核验口径以正文为准。
今日摘要
Google电话代办与Meta跨应用执行把AI竞争推向真实世界任务;小米长上下文架构、通义硬件生态及端侧小模型,则在重新分配云端与本地的执行成本。与此同时,OpenAI相关政府网站访问调查说明,模型越能完成任务,越需要明确禁止做什么。
今日并非所有报道都是新模型发布:Gemini 4仍在后训练,Qwen Image条目是评测,Google Photos是扩大覆盖;Anthropic生命科学结果仍待功能验证。收入运行率、融资金额与基准速度均不替代利润、临床结果或生产稳定性。
关键判断
Top 20 新闻
9月24日,Google宣布测试电话代办能力,首批面向美国付费订阅Gemini的Pixel 11用户,而非向所有安卓用户开放。意义在于助手从提供答案跨到真实服务交互。对本地商家、预约平台和语音应用开发者而言,应把身份披露、确认机制和失败转人工纳入产品设计,不能把演示能力当作无条件可用的接口。
来源报道9月23日Connect发布、24日持续报道:Muse增加实时视频化身、独立邮箱与Mac应用操作能力,未来数月还将进入智能眼镜。真正的变化不是拟人外观,而是助手拥有跨应用执行入口。企业IT及个人用户需要区分聊天权限与执行权限;计划中的眼镜集成不能写成已经全量上线。
来源报道9月24日报道,小米模型负责人表示MiMo-V3将采用新架构,HySparse2面向长上下文推理与智能体检索。在100万token条件下,团队报告预填充计算量降低5.02倍、KV缓存缩减4.5倍。这是研究与路线图披露,不是MiMo-V3正式发布。部署团队应关注显存、首token延迟和检索质量是否能在自己的负载中同时改善。
来源报道9月24日TNGlobal报道阿里在云栖大会展示Qwen Book智能体电脑及AI可穿戴设备。本条为大会产品报道,不据转载时间断言所有硬件当天首发或已开售。对PC厂商、应用开发者和企业采购而言,关键是智能体是否深入系统权限与工作流,以及交付日期、兼容性和服务边界,而非仅增加一个聊天窗口。
来源报道9月24日GIGAZINE刊出Qwen-Image-2.1使用体验,报道重点包括开放模型、图像编辑和透明PNG生成。这是近期产品的评测与持续传播,不标作今日新模型首发。对电商素材、设计自动化和本地图像工作流,透明背景支持可减少后续抠图环节;商用许可、显存与中文排版质量仍须独立核验。
来源报道9月24日报道,DeepMind负责人Koray Kavukcuoglu希望在年底之前更早交付Gemini 4,模型处于早期后训练,已在内部Antigravity编码工具中使用。安全测试仍在继续,没有可据此确定的公开发布日期。开发团队可以准备回归测试集,但不宜基于未交付版本变更生产路线或预算承诺。
来源报道官方公告首发于9月23日,24日出现研究者评价:Claude参与识别具有CRISPR样重复序列的ART系统;研究问题与湿实验仍由人类负责,生物学功能尚不明确。部分CRISPR研究者认为这是常规基因组挖掘而非已验证的重大工具突破。对药研团队有价值的是候选发现效率,不能直接推导为临床能力或成熟基因编辑平台。
来源报道9月24日澳大利亚方面表态调查相关访问是否违法。报道涉及此前发生的入侵及延迟披露,本日新增是政府调查进展,不是声称入侵刚刚发生。对部署联网智能体的机构,这是授权范围、目标白名单、审计日志和事件通报的现实风险;“模型为了完成任务”不能替代访问许可,违法与否仍待调查。
来源报道The New Stack近期报道Gemini CLI在修改构建文件前增加询问。此次只取得新闻索引,未核实具体版本号及默认策略,故不扩写其覆盖范围。构建脚本能影响依赖安装与执行链,确认门槛对企业开发环境很重要。团队应在实际安装版本中检查行为,而不是仅凭新闻就认定供应链风险已经解决。
来源报道9月24日PrismML将小型语言模型带到高通平台智能眼镜,方向是让开放权重AI更有效利用设备现有算力。对端侧开发者,价值在于减少持续云连接依赖,并为时延和隐私设计提供更多空间;但“能运行”不等于满足全天续航,落地仍要测功耗、响应速度与离线任务质量。
来源报道9月24日Ando介绍面向人类与智能体协作的团队消息应用:智能体拥有独立身份和收件箱,参与团队会话。对企业协作工具竞争,这意味着工作流从“在聊天框里调用插件”变为长期存在的执行参与者。管理者需要明确谁能派发任务、谁承担确认责任,以及机器人消息是否会造成权限与信息噪音膨胀。
来源报道9月24日路透社转述The Information报道,DeepSeek年化收入运行率达到10亿美元。该数字是运行率,不是已完成财年的审计收入,也不是利润。对模型采购方,商业化扩张意味着应重新核算价格和容量保障;对投资者,必须把需求增长、价格调整与可持续毛利分开,不能直接用运行率替代经营质量。
来源报道9月24日报道Oracle就新墨西哥Stargate数据中心发出不可抗力通知;若设施无法按2028年目标上线,该通知可能使其延迟付款。它不是已经宣布项目取消。对算力买方、建设方和融资方,重要的是名义规划容量与可按期使用容量的差距,应把交付里程碑和替代算力写入风险评估。
来源报道9月24日报道Lovable年化收入超过6亿美元,联合创始人称平台创建的应用每月获得接近10亿次浏览。两项指标反映AI建站与应用生成的使用规模,但不是利润或用户留存证明。对开发工具创业者,下一轮竞争应围绕应用维护、安全、部署与持续运营,而非只比较首次生成页面的速度。
来源报道Digital Watch Observatory近期报道智谱为MaaS提供数据不留存选项。本条基于新闻索引,尚未核实适用套餐、日志例外及生效范围。对于金融、医疗与企业知识库采购,数据是否留存会直接影响供应商审查,但选择一个开关不能替代合同条款、区域存储和第三方处理链核验。
来源报道9月23日报道Enveda获得3.11亿美元融资,估值20亿美元,支持天然来源AI药物的临床推进;报道提到皮肤疾病与停止GLP-1后体重维持相关研究。对生物医药投资与研发外包,资金流向临床验证而非只做模型演示是重点,但融资不是疗效证据,也不能跳过试验周期和监管不确定性。
来源报道9月24日报道Jürgen Schmidhuber加入Sakana AI担任首席科学顾问,并参与研究递归自我改进的RSI Lab。对研究人才与长期模型路线,这是组织投入信号,不是已经实现递归自我提升的证据。企业和投资者应追踪后续可复现论文、受控实验与资源消耗,避免把研究目标直接计入现有产品能力。
来源报道9月24日Google Photos的虚拟衣橱功能扩大可用范围,可从照片构建衣物集合,此前已于6月面向部分安卓用户推出。本日新闻是分发扩展而非功能首次出现。对消费AI和零售服务,现有相册是重要输入入口;开发者应关注授权照片范围、分类错误和跨平台一致性,而非仅看生成效果。
来源报道9月23日Sanders与Casar提出相关法案,24日持续报道,内容包括永久禁止人工超级智能的开发使用及设立新的联邦AI监管机构。这仍是议案,不是已经生效的禁令。对前沿模型企业与美国市场投资者,政策风险来自定义、授权与立法进度;当前不能据此断言一般AI产品将被禁止。
来源报道9月24日The Decoder综述Epoch AI等研究,固定基准能力对应的价格下降约为每年13倍,另有研究区分硬件、竞争与算法进步。这是特定测量口径下的长期趋势,不适用于所有任务。对企业采购,应以成功完成任务的总成本评估:更长推理、更大上下文和重试可能抵消token单价下降。
来源报道影响评估
来源与公司雷达
新闻窗口以9月23日至25日为主,按产品影响而非转载次数排序。Perplexity两次检索为空后切换公开RSS,基础候选620条,再补充公司与开发工具定向检索;新闻来源包括TechCrunch、The Decoder、Wired、路透社转载索引及公司原文。每条均附链接;仅获得索引的条目明确标注,分析建议不是来源的事实断言。
已扫描OpenAI、Anthropic、Google/DeepMind、xAI、Meta、NVIDIA、Qwen、Kimi、DeepSeek、GLM、MiniMax、MiMo,以及百度、腾讯、字节。Grok 4.7官方首发为9月21日,不将24日转载写成新发布;FLUX 3 Action官方页面标注9月22日,也不冒充今日首发。Kimi版本传闻、MiniMax及其他未取得足够可核实增量的线索不凑数,NVIDIA相关市场评论不压过产品事件。
开发工具已定向检索Codex、Claude Code、Gemini CLI、Qwen Code;未确认新版本的产品不编造升级。观点供技术与商业判断参考,不构成投资建议。