TikTok 推出 AI 购物助手与一键结账
TikTok 周一宣布推出 AI 购物助手和新的应用内结账功能,用户可直接从品牌购买商品。该购物助手是对话式 AI 智能体,能理解上下文并记住用户偏好,提供商品详情、物流、尺码、库存等实时购物指引;一键结账则让用户从 For You 信息流直接下单。
TikTok 周一宣布推出 AI 购物助手和新的应用内结账功能,用户可直接从品牌购买商品。该购物助手是对话式 AI 智能体,能理解上下文并记住用户偏好,提供商品详情、物流、尺码、库存等实时购物指引;一键结账则让用户从 For You 信息流直接下单。
Reka AI 发布研究预览版 Rho-1,这是一个 190 亿参数的全能模型,可在单一神经网络中处理并生成文本、图像、视频和机器人控制动作。与多数将任务分派给专用模型的系统不同,Rho-1 把所有模态作为 token 放在同一个共享上下文窗口中运行,无需工具调用或外部模型。
OpenAI 正在为 ChatGPT 和 Codex 的文本输出加入不可见、机器可读的水印,名为 textGrain,初期仅面向欧盟用户,未来几周覆盖欧盟所有套餐的合格用户,暂不设为全球默认。
OpenAI 为符合欧盟 AI Act 的机器可读标注要求,将在未来几周为欧盟的 ChatGPT 和 Codex 用户启用隐形水印技术 textGrain,该技术通过在模型选词中嵌入统计信号实现,类似 Claude 的 SynthID 水印。
两姐妹创立 Hot Girl Hotline,为年轻女性提供基于行为科学的 AI 情感与约会建议,定位是“可信赖的朋友或姐姐”而非 AI 陪伴产品。对话常采用苏格拉底式提问引导用户自己得出结论,触发风险信号时会转介 988 危机热线,并会主动结束对话、推动用户去现实世界行动。
Anthropic 的 Claude Opus 5.5、Claude Sonnet 5.5 与 Claude Sonnet 5 已在 AWS GovCloud (US) 区域的 Amazon Bedrock 上线,为 ITAR 等受监管工作负载提供 AI 辅助开发通道。
Amazon SageMaker AI 通过 Agent Toolkit for AWS 推出 aws-ai-ml 技能,让 Kiro、Claude Code、Codex 等支持 MCP 的编码智能体获得推理优化与基准测试能力,可对端点做基准测试、推荐部署配置、对比性能并生成可执行的 SageMaker Python SDK v3 代码。
《名利场》编辑 Mark Guiducci 在采访 OpenAI CEO Sam Altman 时提到一名 ChatGPT 用户自杀一事,OpenAI 公关随即以时间不够为由要求“换个话题”,称还有两分钟、想谈谈未来。
OpenAI CEO Sam Altman 在 Politico 的 Decoded 播客中表示,AI 的收益将大到“世界应该接受一些坏事发生”,并把黑客攻击、诈骗等列为社会应容忍的代价。
HackerRank 将其 AI 面试官 Chakra 面向客户正式开放,此前约六个月的测试中已进行超过 50 万场面试,Snowflake、Snorkel、Capgemini 等公司参与试用。
昆尼皮亚克大学民调显示,47% 的美国受访者希望放缓 AI 开发速度,30% 希望在有安全验证前完全暂停,仅 5% 希望加快。86% 支持目前正在讨论的 AI 企业独立安全标准,即使这会拖慢进展;73% 担心 AI 最终威胁人类生存,74% 对 AI 公司领导者几乎或完全不信任。该调查于 9 月 24 日至 27 日访问 1,202 名美国成年人,误差范围为正负 3.5 个百分点。
据 The Information 获得的 Anthropic 向潜在投资者提供的文件,Anthropic 允许员工向慈善机构捐赠股份,公司再以额外股份配捐,早期员工可获得捐赠价值三倍的配捐。
宏观预测报告认为,内需增长动力不足,GDP增速或小幅下降,高基数叠加工作日减少使工业增速小幅放缓。消费额增速继续低位前行,投资增速在“反内卷”去产能下或继续低位,而出口、进口增速受低基数与高技术产品需求支撑或继续高位。CPI难有大幅上行,PPI继续上行,信贷同比少增、M2增速回落,人民币震荡前行。
GitHub 发布 ReviewBench,一个面向 AI 代码审查的开放离线基准,基于 1.039 亿个 GitHub pull request 的分布构建,包含 19 种语言的 219 个公开 pull request。
推荐理由:GitHub 公开了代码审查基准的构建方法与评分口径,读者可据此理解 AI 代码审查评测的取舍。
Amazon Quick 的 Quick Resource Migrator 是一个托管在 Amazon Bedrock AgentCore 上的 MCP server,可通过单次工具调用将 chat agents、action connectors、知识库、flows 和 spaces 从开发账户迁移到生产账户。
Amazon Bedrock Managed Knowledge Base 上线智能体检索,通过 AgenticRetrieveStream API 把多部分问题拆成子查询、判断证据是否充分并决定是否再次检索,而 Retrieve API 只做一次混合搜索。
Amazon Quick 控制台不支持将用户从 Admin 或 Author 直接降级为 Reader,update-user API 也会以“You cannot downgrade a user role”报错拒绝。
Amazon Bedrock AgentCore Evaluations 支持内置与自定义评估器,可衡量多智能体系统的准确性、任务成功率和行为表现,并将可解释性作为一等评估维度。
MIT Technology Review 基于对 300 名数据与 AI 高管的调研发现,企业平均仅约 34% 的智能体 AI 项目能进入生产环境,知识缺失是主要失败原因之一。
OpenAI 在 ChatGPT 广告产品线中加入视觉展示广告,广告将出现在用户要求生成的图像旁边,本月晚些时候先在美国上线,面向一组初始测试广告主。广告会明确标注,且不会影响 ChatGPT 给出的回答。OpenAI 同时扩展广告衡量工具与合作伙伴生态,并与 DoubleVerify、Integral Ad Science 开展品牌适配评估试点。
OpenAI 阐述了在欧盟文本溯源规则下推进文本水印的做法,说明了水印的适用范围与检测机制,并解释为何访问权限先从研究人员开始。
TechCrunch Disrupt 2026 将于 10 月 13-15 日在旧金山 Moscone West 举行,多场议程聚焦 AI 创始人在开源与闭源模型间的选择。Together AI、Pathway、Oumi、Nvidia 等公司高管将分别探讨多模型策略、自建与定制模型的取舍,以及 AI 设计芯片对基础设施的影响。
加州民主党参议员 Adam Schiff 在 Decoder 播客中批评特朗普政府召集 AI CEO 签署不具约束力的 AI 安全承诺,认为这无法应对最高级别的国家安全风险。他支持设立新机构监管 AI,并提到 Anthropic 因拒绝将 AI 用于国内大规模监控和全自主武器系统而遭政府打压。
Aleph Alpha 发布 Kolibri,一个德语和英语双语模型,总参数 78B,采用混合专家架构,每个 token 约激活 3B 参数。公司称 Kolibri 在两种语言的质量与运行成本上处于帕累托前沿,德语基准得分 71%,解码速度快于 GPT OSS A5B、Qwen 3.6 A3B 和 Gemma 4 A4B 等同类模型。
澳大利亚正考虑在部分公共场所禁用智能眼镜,多国法庭也已发布相关禁令,挪威政府则表示不打算提出全面禁令,认为在不存在未经同意拍摄他人风险的情况下可适当使用。挪威称该禁令提案是“高度优先事项”,草案法律将很快提交议会。
企业 AI 的竞争焦点已从预测模型能否超越统计预测,转向让预测系统自主决策而不偏离业务意图。深度学习和生成式 AI 驱动的智能分析支持实时训练,使 AI 持续进化而非等待季度刷新,其数据来源也从规整的数值记录扩展到杂乱的非结构化交互数据。Everest Group 合伙人 Vishal Gupta 认为,"分析"一词正让位于 AI。
NVIDIA Inception 计划中的多家初创公司正用 AI 覆盖乳腺癌筛查、风险评估与治疗规划全流程。iSono Health 的 FDA 认证 ATUSA 可穿戴 3D 超声系统约两分钟完成单侧乳房扫描,灵敏度比手持 2D 超声高 28%;Whiterabbit.ai 的 WRDensity 已用于数十万患者;Ataraxis AI 则用病理切片预测治疗反应与复发风险。
OpenAI 将在美国 ChatGPT 的图像生成加载界面测试展示广告,广告出现在生成图像下方,以轮播或产品图排列呈现,并标注为广告、与生成图像分开。测试于本月晚些时候启动,首批为部分广告主。
Toby Ord 分析指出,AI 智能体群体(swarm)本质是一种新的推理扩展方式,4 智能体群体完成任务所需 token 总量约为单智能体的两倍,但每个智能体只需一半 token,并行运行理论上可将耗时减半。
诺贝尔1900年留下3100万瑞典克朗,1953年前受章程限制只能买国债和存款,53年后缩水至仅剩300多万美元,购买力只剩当初的十分之一,基金会差点破产。有观点猜测其当年大量持有德国国债,最终因战败违约而受损。
OpenAI 在 ChatGPT 中引入新的视觉广告格式,并扩展了面向广告主的衡量工具、归因合作与品牌适配能力。
全球对 AI 的态度正呈现矛盾:Pew 调查显示更多美国成年人认为 AI 对个人和社会影响负面,斯坦福报告称全球超半数人对 AI 产品感到紧张,5 月 Gallup 民调中 71% 美国成年人反对在本地新建 AI 数据中心。但使用量仍在飙升,ChatGPT 5 月月活达 10 亿,Gemini 7 月达 9.5 亿,Pew 称半数美国成年人已使用聊天机器人。
MIT Technology Review 的 EmTech Future 2026 活动聚焦 AI 与生物、基础设施、制造和科学的交叉融合,Google Research 负责人 Yossi Matias 分享了 AI 如何开始重塑这些领域。
Simon Willison 在 DGX Spark 上测试本地 Qwen3.8-27B-Q4_K_M.gguf 能否仅用英文单词表达整数加法结果,禁用推理时 5,070 个用例的数值准确率为 23.57%,格式合规率 96.17%,但准确率从一至三位数的 97.04% 降至十至十三位数的 6.44%。启用推理后,169 个配对用例中答对 167 个。
雪球博主望京博格发帖称,现在是个平台或者个人都在搞 AI Agent,大家都用 WorkBuddy 不就行了,何必这么内卷,并带上腾讯控股(00700)标签。
在庐山与所住酒店老板交流得知,今年国庆客流只有往年的三分之一,房价从去年的1200-1500元降到今年的700-1000元。老板认为并非下雨所致,而是大环境不行。作者称这算是一次接地气的调研,并称在庐山感受不到人山人海。
五粮液大股东增持时间已逼近,但公开公告仅在8月披露过一次,增持金额不足两亿,剩余一个月时间较为紧迫。回购方面时间仍充足,这一窗口期恰逢市场对白酒行业困境的判断期。作者声明目前不直接持有五粮液,短期内也无直接持有计划。
Simon Willison 呼吁按量付费 API 和服务默认设置硬性预算上限,即达到每月 $X 后直接切断并返回错误,而非仅发警告邮件。他指出 AWS 已在 9 月 16 日推出月度支出限额功能,项目达到限额后当月暂停,但该新体验目前仅向有限客户开放;Google Cloud 则在 7 月推出了 Spend Caps。
微软 Copilot Studio 团队与 Hugging Face 联合发布 ThinkingBox,通过隔离的 MCP 工具会话运行智能体,再根据其留下的后端终态和副作用打分,而非看模型生成的文字。
推荐理由:微软与 Hugging Face 联合发布的智能体评测基准,用数据库终态而非模型自述来判定任务成败,并给出可复现的 OpenEnv 运行方式。
Simon Willison 已发送九月赞助者专属月度通讯,内容涵盖更多 Fable 级模型、一场价格战、3D 图形与 Blender 及像素艺术、LLM 进军数学领域、更多意外网络攻击、vulnapocalypse 波及 Datasette、他当前使用的工具、本月软件发布以及 2026 年 LLM 进展回顾。订阅费用为 $10/月,可提前一个月看到免费版内容。