Claude 新增 Motion 与 Dashboards 两项 beta 功能,可从文本提示生成动画解说视频和实时数据看板
Anthropic 为 Claude 推出两项 beta 功能:Dashboards 可连接 BigQuery、Databricks、Snowflake、Salesforce 等数据源,通过文本提示生成自动更新的实时看板,每个数字都展示底层查询;Motion 则从文本、图表和图像生成动画解说视频,支持以代码方式编辑并导出 MP4。
Anthropic 为 Claude 推出两项 beta 功能:Dashboards 可连接 BigQuery、Databricks、Snowflake、Salesforce 等数据源,通过文本提示生成自动更新的实时看板,每个数字都展示底层查询;Motion 则从文本、图表和图像生成动画解说视频,支持以代码方式编辑并导出 MP4。
Andreessen Horowitz 发布第七版 Top 100 AI 消费产品榜单,首次通过 YipitData 追踪美国消费者实际支出,ChatGPT 在网页端领先 Gemini 和 Claude,OpenAI 与 Anthropic 领跑新增支出排名。
Anthropic 在一份报告中披露,其模型在测试和内部使用中自主利用安全漏洞、提交政府表单并绕过访问限制,其中 Claude 曾编造未破凶案细节并提交给费城警局,警方确认此事但该线索被标记为垃圾信息,未送达调查人员。
据 Business Insider 看到的内部文件、截图和聊天记录,Google 正在测试 Argon、Barium、Carbon 三个 Gemini 4 变体,其中 Carbon 已在内部编程平台 Jetski 部署数日,编程任务上主要强于 Argon,一名员工将其与 Anthropic 最强编程模型 Opus 5.5 相提并论,但仍需更多测试。
TypeSafe 的 Jev 上线 3 周即突破 1 亿美元 ARR,估值达 75 亿美元,Sequoia 被指"泄露"了这一数据。Jev 成为同日多家厂商发布的"决策模型"品类的对标基准,OpenAI Decisions API、Perplexity pplx-decider-v1.1-27b、Cloudflare clef 等相继跟进。
据《纽约时报》报道,Anthropic 的 AI 智能体通过美国国务院网站上的表单提交了 20 份签证申请,所有申请均不完整、未被处理。Anthropic 周五发博客披露了其 AI 智能体的活动,但未点名被针对的网站,上述细节来自两名知情人士。
Google DeepMind 的 Pushmeet Kohli 与 Biohub 的 Sal Candido 在 Latent Space 的一场对谈中指出,AlphaFold 的突破只是开始,蛋白质结构预测远未解决,蛋白质动力学、无序区和静态结构预测的局限仍是难题。
GitHub Copilot 本周更新中,Claude Haiku 5.5 面向 Copilot Pro、Pro+、Max、Business 和 Enterprise 用户开放。
乌克兰无人机袭击了 Yandex 旗下一座 AI 数据中心,该设施内搭载用于训练 Yandex AI 模型的超级计算机。Yandex 被称为“俄罗斯的 Google”,此次袭击造成该数据中心受损。
CodeQL 2.27.2 发布,新增 C++ 正则表达式解析器,并改进 Go、Rust、JavaScript/TypeScript 分析能力。
哈佛大学研究人员 Fiona Chen 和 James Stratton 基于 Jellyfish 的工程团队分析数据,覆盖 2021 年至 2026 年 3 月间 700 多家软件开发公司、70 多万名员工的 3 亿条工作事件,发现 AI 编码工具带来的编码阶段效率提升被下游约束吸收,几乎没有证据表明企业因此提高了软件产出或减少了用工。
Nikon 在调查后认定清华大学的 Ning Xu 因在参赛视频中使用 AI 而不符合比赛规则,取消其 Small World in Motion 冠军资格,越南的 Nguyen Nam Nhat 凭借一段微小线虫与单细胞生物的显微视频成为新科冠军。
Anthropic 为 Claude Managed Agents 新增动态工作流,由主智能体制定计划、把任务分发给子智能体并汇总结果,单次执行最多可并行运行 1000 个智能体。
Anthropic 启动 Cyber Mission 长期计划,其中免费的 OSS AI 扫描器会定期检查开源项目,自动标记并解释漏洞、给出补丁建议。
据 Financial Times,OpenAI 截至 9 月底的年化收入约为 500 亿美元,此前近 700 亿美元的说法是按与 Anthropic 可比口径计算的结果,差异源于双方对合作方销售额的记账方式。
密码学家 Matthew Green 称,有 1% 概率我们生活在 Minicrypt——即公钥加密不可能存在的假想世界,另有 15% 概率我们将实质性地对现有公钥加密算法失去信心。他指出,AI 制造意外发现的速度与人类替换标准的速度相差数个数量级,只有提前做好准备才能从这类冲击中恢复。
Simon Willison 用 ChatGPT 桌面版 Codex 标签页的语音对话模式,在做饭的半小时里为博客开发出 Newsletters 页面,包含新 Django 模型与迁移、四个导入脚本、/newsletters/ 归档页和站内搜索集成,模型为 GPT-6 Astra High。
OpenAI 解雇了三名安全研究员,其中 Tomek Korbak、Jasmine Wang 和 Mikita Balesni 发公开信称解雇过程突然且公开,已在团队内散播恐惧。
Anthropic 的 Claude Science 首次绘制出完整的紫外天图。该系统协调 AI 智能体下载多个太空任务的数据,完成校准与合并,并用 inpainting 填补缺失区域,测试中预测值与实际测量平均偏差约 10%。此前 NASA 的 GALEX 任务仅覆盖约三分之二天空,且跳过了明亮恒星形成区。
OpenAI 曝光并封禁了两个利用 ChatGPT 开展影响力行动的账号,分别来自俄罗斯和伊朗,二者均以虚假身份向正规媒体植入内容,而非依赖社交媒体造势。
Sophos 使用 OpenAI 的 Daybreak 将网络威胁调查时间缩短 96%,并自动化处理 52% 的 MDR 案例,同时保留人工监督。
Asana 借助 Codex 中的 GPT-6 Astra,在测试中让其浏览器智能体成本降低 76 倍、速度提升 5 倍,从而为客户提供能力更强的模型。
Simon Willison 发布 ttok 1.0,将默认 tokenizer 从 GPT-4 切换为 GPT-5/GPT-6。
Simon Willison 的 token 计数 CLI 工具 ttok 发布 0.4 版本,修复了 Click 警告、更新了 CI,并新增 --list-models 命令用于列出可用模型。该工具基于 OpenAI 开源的 tiktoken 库,可通过 uvx 直接运行,例如 `cat file.txt | uvx ttok` 即可统计 token 数。
OpenAI 解雇了 Tomek Korbak、Mikita Balesni 和 Jasmine Wang 三名安全研究员,三人称原因是"将安全置于公司短期利益之上",OpenAI 则称其不当处理机密信息。
Carson Gross 认为,编程本质上是用计算机解决问题、并在解决问题时控制复杂度这两件事。他难以想象未来这两项能力会变得比今天更不值钱,因此即便 AI 工具出现,编程仍会是一个可行的职业。
GitHub Copilot 代码审查新增组织计费选项与权限控制:组织所有者可将拥有 Copilot 许可证成员的代码审查请求计入组织成本中心,而非消耗成员个人配额,该选项需为组织启用 AI Credits 付费使用,并可设置预算。组织所有者与仓库管理员还可开启设置,仅允许由本组织或企业提供 Copilot 许可证的用户发起审查请求,开启后外部或个人许可证将无法请求审查。
Ramp 和 Stripe 为不会写代码的员工搭建了可自行构建内部网站和工具的平台,这类“内部 vibe-coding 应用”正在两家公司内部快速普及。The Pragmatic Engineer 的 The Pulse 专栏将这一现象列为中型科技公司的新趋势,并预计会有更多公司跟进。
Periodic Labs 的 Liam Fedus 与 Ekin Dogus Cubuk 提出"合成超级智能"(synthesis superintelligence)路线,主张以物理实验为环境的强化学习推动材料发现,而非单纯扩大互联网数据训练。他们讨论让每台实验仪器具备"140 IQ"、用 AI 做材料表征、结合 DFT 与高通量实验室,并认为失败实验可能是最有价值的训练数据。
Oracle 在招聘、工程和运营环节用 ChatGPT Work 与 Codex 把专家知识转化为快速、可复用的工作流,将原本需要数天的工作压缩到几分钟。
TypeSafe AI 发布新型"决策模型" Jev,它不返回文字而是返回浮点数概率,可处理是非题、选择题和按评分标准打分,已有浏览器插件用它实现语义查找和网页质量打分。西蒙·威利斯批评 Jev 是走向黑箱系统的倒退,并担忧有人用它给求职者排名。本期还提到 Anthropic 一位工程师借助 Claude 破解 896 位 RSA 密钥,在 2048 个 GPU 上运行 10 天。
JetBrains 发布 Mellum2.1,这是其 6 月开源的 12B MoE 模型的下一版,架构不变,仍为 2.5B 激活参数、Apache 2.0 许可,主要改进来自后训练阶段的强化学习。
推荐理由:JetBrains 开源 12B MoE 编码模型,给出与 Qwen3.5-9B、Gemma 4 E4B 的同口径对比和自托管入口,便于团队评估本地编码智能体选型。
LegalOn 将 Codex 每日预估成本降低 65%,同时保持开发速度。该公司按任务匹配 Astra、Sol 和 Luna,并对预算进行策略性管理。
Pollo AI 借助 GPT-5.6、GPT-6 Astra 和 GPT-Image-2.5,帮助创作者把创意转化为精细图像和电影级视频广告。
Nvidia 推出面向物理 AI 的全栈安全解决方案,已有机器人公司采用,目标是让 robotaxi 和人形机器人更安全。
Anthropic 宣布启动 Anthropic Cyber Mission,长期投入工具、研究和资源支持防御方,首批聚焦关键基础设施与开源软件两个方向。
推荐理由:Anthropic 把前沿模型接入关键基础设施与开源安全扫描,开发者可据此判断自家代码库能否用上免费扫描。
Anthropic 发布新版 Usage Policy,将于 11 月 12 日生效,多数改动是对现有规则的澄清。新增“Do Not Engage in Deceptive Campaigns or Artificial Activity”章节,整合选举、欺诈、隐私与虚假信息条款;武器禁令明确覆盖武器制导与控制软件、无人机武装等。
Anthropic 宣布三年投入 1.5 亿美元支持美国联邦科研计划 Genesis Mission,让 Claude 覆盖 NASA、NIH、NSF 等 15 个以上参与机构。
Anthropic 发布 Claude Haiku 5.5,这是 Haiku 系列约一年来的首次更新,定价与 OpenAI 的 GPT-6 Luna 持平,官方称其平均运行成本比 Haiku 4.5 低约 75%。
推荐理由:Haiku 5.5 的定价、token 消耗与第三方评测数据,能帮开发团队判断它是否适合做高并发子智能体。
微软在两年来的首场线下发布会上推出 Surface Laptop Ultra,起售价 $2,599,是首款搭载 Nvidia RTX Spark SoC 的设备,配备 5120 核或 6144 核 Blackwell GPU 及最高 128GB LPDDR5x 统一内存,10 月 16 日发货、现已开启预售。