跳到正文

全部动态

今日 35 条
10月3日周六
  1. TechCrunch · AI42

    Circuit Breaker Labs 希望让 AI 对孩子(和你)更安全

    Circuit Breaker Labs 入选 TechCrunch 2026 Startup Battlefield 200,其打造的 AI 智能体模拟不同年龄、背景、语言和文化的用户,对模型进行“红队”测试,以识别危险及心理有害的互动。公司每天运行数万至数十万次模拟交互,并通过专有评分方法生成可审计、可解释的分数,目前面向 AI 辅导、日记等心理健康类高风险应用提供安全测试服务。

  2. MIT Technology Review · AI29

    自主 AI 如何重塑企业智能

    全球 AI 投资预计 2026 年达 2.5 万亿美元,同比增长 44%,但多数企业仍未通过 AI 实现营收增长。报告提出“智能体转型”需重构数据基础设施与可组合架构,并解决 AI 主权问题。领先企业将流程再造置于模型选择之前,数据就绪度而非数据量决定 AI 的复利效应。

  3. OpenAI News18

    GPT-6 家族模型选用指南

    OpenAI 发布 GPT-6 家族模型选用指南,面向初创企业讲解如何按需选择 GPT-6 系列模型、调节推理强度、优化提示词与技能、协调工具调用,并为生产环境准备 AI 工作流。指南覆盖从模型选型到部署落地的完整路径,帮助开发团队在真实业务场景中更高效地使用 GPT-6。

  4. AWS Machine Learning Blog38

    在 Amazon SageMaker AI 上用多轮强化学习微调搜索智能体

    Amazon SageMaker AI 推出多轮强化学习(MTRL)能力,用于微调搜索智能体。该方法以 Qwen3.6-27B 为基座模型,通过 BM25 与向量搜索两种工具,在 FRAMES、BRIGHT 和 Enterprise RAG 数据集上训练,支持 PPO、CISPO 等算法及无服务器按 token 计费,旨在以小型模型的成本获得接近前沿模型的检索可靠性。

10月2日周五
  1. TechCrunch · AI35

    教皇利奥十四世反对AI生成艺术

    教皇利奥十四世在X平台发文,呼吁保护人类艺术免受AI侵蚀,称算法生成的作品与人类艺术存在“本体论差异”,“缺乏人性的火花”。他曾在5月的通谕中强调自动化时代维护人类尊严的重要性。据《纽约时报》报道,Anthropic曾游说梵蒂冈重新考虑其对非人类意识的立场,但收效甚微。

  2. GitHub Blog · AI & ML23

    AI 正在改变开发者工作方式,GitHub 建议强化三项技能

    GitHub 发文指出,AI 正在改变开发者工作方式,开发者需学会指挥 AI、评估其输出并做出技术决策。文章建议三项技能:学会指挥 AI 智能体而非仅使用工具、不轻信 AI 首次回答(可用第二模型交叉评审)、利用 AI 节省的时间解决更大问题。文中提及 GitHub Copilot 内置 Rubber Duck 智能体可调用第二模型评审代码。

  3. The Verge · AI58

    微软数据中心扩建引发社区争议,仿生学设计能否缓解矛盾?

    微软正通过仿生学设计,如增加绿植和修复生态系统,试图让数据中心更好地融入当地社区,以应对居民对噪音、污染和砍伐树木的抗议。然而,批评者认为这些措施只是表面功夫,无法解决数据中心带来的能源消耗、水资源使用和碳排放等根本问题。微软承诺在2030年前实现水正效益和碳负排放,但其2025年碳排放增长了25%,且AI业务的扩张正威胁这些目标。

    推荐理由:本文通过多个案例与专家观点,呈现微软数据中心扩建与社区环保诉求之间的张力,帮助读者理解科技扩张的代价。

  4. The Verge · AI40

    AI 音乐工具 Suno 新增语音生成功能

    Suno 推出 Speech 功能,可根据脚本或提示描述生成语音,并支持同时生成配音与背景音乐,现已面向网页和移动端开放公测。该功能提供 Simple 和 Advanced 两种模式,可调节音色、语音风格等,最长约八分钟。Suno 表示将根据用户反馈持续改进。

  5. eSchool News69

    丹佛公立学校新增28间自闭症专用教室,应对自闭症学生数量增长

    丹佛公立学校在过去两年新增了28间自闭症专用教室,以应对自闭症学生数量的增长。这些教室通常容纳8至12名学生,配备多达四名成人,每间教室成本超过23万美元。过去五年,该校需要特殊教育服务的自闭症学生数量增长了近75%,从2021年的1315人增至去年的2280人。尽管学生总数下降,学区仍面临财政压力,并计划在11月投票中提出增税以资助特殊教育。

    推荐理由:丹佛公立学校两年新增28间自闭症教室,可了解特殊教育扩张背后的成本与争议。

  6. 量子位64

    arXiv 发布每月最多提交 2 篇论文的新规,拒稿不退额度

    arXiv 自 2026 年 10 月 1 日起实施新规,每位提交者每月最多提交 2 篇论文,且无论是否通过审核均占用额度,所有分类共享此限制。arXiv 表示此举旨在应对 AI 工具导致论文数量激增、审核压力过大的问题,并计划未来升级审核工具与流程。

    推荐理由:arXiv 新规直接改变论文投稿节奏,读者可借此判断 AI 时代科研产出与审核的平衡走向。

  7. 量子位65

    丘成桐新论文致谢 GPT 和 Claude,AI 辅助解决 44 年前悬而未决的怪球问题

    丘成桐参与的最新论文在致谢中感谢了 GPT 6 Astra 和 Claude Pro 在部分证明策略探索和计算中的帮助。该论文宣称解决了七维空间中 27 种怪球能否配备正截面曲率度量的经典猜想,该问题自 1982 年被丘成桐列入问题清单以来悬而未决。论文附带 SageMath 验证代码,计算机验证成为证明可信度的重要支撑。

    推荐理由:丘成桐从质疑到使用 AI 辅助证明的转变,为理解 AI 在尖端数学研究中的角色提供了真实案例。

  8. The Decoder38

    Black Forest Labs 发布 Flux 3 Image,支持多步编辑且不改变图像其他部分

    Black Forest Labs 发布 Flux 3 模型家族的图像模型 Flux 3 Image,支持多步编辑且不改变图像其他部分,覆盖文生图、图生图、文本渲染和照片级真实感。用户可用边界框构图、最多引用十张参考图,输出最高 4K 分辨率。API 访问在 10 月 8 日前享五折优惠,商业权重可授权企业自建基础设施运行和微调,开源权重版本预计数周内推出。

  9. MIT Technology Review · AI66

    AlphaGo 核心成员 Thore Graepel:LLM 并不真正推理

    前 AlphaGo 核心成员、UCL 机器学习教授 Thore Graepel 撰文指出,当前 LLM 的链式思考仍属系统 1 直觉,缺乏显式认知状态与知识操作分离,不构成真正推理。他主张借鉴 AlphaGo 的搜索架构,构建可审计的推理系统,并为此离开 Google DeepMind。

    推荐理由:作者以 AlphaGo 核心成员身份对比 AlphaGo 搜索与 LLM 推理,提出可审计的推理架构方向,适合关注 AI 可靠性的读者。

  10. Latent Space31

    Pi 1.0 与 Pi Durable 发布:Pi 迁移至 TypeScript 并支持崩溃恢复与并发

    Pi 1.0 与 Pi Durable 双双登上 Hacker News 首页。Pi 1.0 新增 Codemode,原生支持 MCP、Jev 和图像模型,并引入缓存预热、对话中系统消息等功能。Pi Durable 将 Pi 移植到 TypeScript,外部化所有有状态组件,支持崩溃后从最后状态自动恢复、多分支并发对话、热插拔工具与扩展,以及多用户状态同步。

  11. AWS Machine Learning Blog38

    用 Amazon Bedrock AgentCore 上的智能体扩展云迁移:四智能体模式将 IaC 开发从 3-4 周压缩至分钟级

    AWS 在 Amazon Bedrock AgentCore 上提出四智能体模式,将云迁移中基础设施即代码(IaC)开发时间从每应用 3-4 周缩短至分钟级。该模式与 AWS Transform 及 AWS DMS 协同,通过 MCP 工具连接内部系统,覆盖迁移与运维两大流程,适用于 300+ 应用的大型迁移项目。

  12. Ars Technica · AI45

    美国法官驳回 Chegg 与 Penske 针对 Google AI 搜索的反垄断诉讼

    美国联邦法官驳回 Chegg 与 Penske Media 对 Google 的反垄断诉讼,认定 Google 在 AI 概览等产品中的行为不违反反垄断法。Chegg 指控 Google 抓取其教育内容供 Gemini 模型重现并导致流量下降,Penske 旗下媒体亦指控流量损失且无法退出 AI 抓取,但法官认为网站免费提供内容的“期望”不构成法律协议。

  13. The Verge · AI47

    Google 在 Gemini Live 推出 Guided Vision,用 AI 实时语音描述镜头画面

    Google 今日在兼容 Android 设备的 Gemini Live 中推出 Guided Vision,通过共享摄像头让 AI 实时语音描述画面,帮助阅读小字、识别物体与描述环境。该功能面向盲人、低视力用户及特定场景需求者,并可在 Google TalkBack 或 Android 9 及以上设备的辅助功能快捷方式中使用。Google 提醒用户勿将其用于导航、安全出行或障碍物检测。

  14. AWS Machine Learning Blog38

    Amazon Quick 为 AI 构建的应用引入实时受管数据查询

    Amazon Quick 推出 Live Data in Apps 功能,使 AI 构建的 Quick Apps 能实时查询受管 QuickSight 数据集,取代发布时冻结的静态快照。应用每次打开都会重新执行 SQL,查询以查看者身份运行,并自动沿用行级与列级安全规则。支持 SPICE 和 Direct Query 数据集,查看者需为已认证 Quick 用户,且首次使用需按数据集同意。

  15. TechCrunch · AI38

    Google 认为 SpaceX 的 Starship 需发射约 1,800 次才能让太空数据中心落地

    Google 的轨道计算卫星原型今日搭载 SpaceX 火箭升空,将验证其 TPU 芯片能否在太空运行。Google 发布的白皮书预计,Starship 需在未来十年完成约 1,800 次发射(每年 180 次)才能以低成本将计算送入轨道。测试显示芯片在辐射环境下推理错误率约为百万分之一,但大规模训练仍面临挑战。

  16. TechCrunch · AI38

    ChatGPT 推出虚拟试衣与收藏功能,基于 ChatGPT Images 2.5 模型

    OpenAI 面向全球用户推出 ChatGPT 两项购物新功能:虚拟试衣和收藏(Favorites)。虚拟试衣基于新发布的 ChatGPT Images 2.5 模型,用户上传自拍或全身照即可预览服装与配饰上身效果,购物结果中新增“try on”按钮;收藏功能可将商品保存至应用内 Library 供后续查看。此前 OpenAI 曾放弃即时结账功能,而 Google 已于去年推出虚拟试衣。

  17. AWS Machine Learning Blog42

    在 AWS 上为 Claude Platform 实现多环境访问

    AWS 机器学习博客发布分步指南,为 Claude Platform on AWS(CPonAWS)配置多环境访问。方案采用专用 AI Services 账户模式,通过跨账户 SigV4 支持 AWS 工作负载、工作区级 API 密钥供开发者本地使用、OIDC 联合认证支持外部环境,实现生产与开发流量隔离并共享单一订阅。