Amazon Quick 发布 Live Data in Apps,让 AI 构建的应用查询实时治理数据
Amazon Quick 推出 Live Data in Apps,使已发布的 AI 构建应用能够实时查询受治理的 Quick Sight 数据集,不再依赖构建时快照。该功能支持 SPICE 和 Direct Query,并按查看者身份应用 RLS/CLS 权限;文章演示了如何用自然语言构建、发布和分享客户续约应用。
按北京时间编辑筛选的重要模型、产品、治理与研究进展。
Amazon Quick 推出 Live Data in Apps,使已发布的 AI 构建应用能够实时查询受治理的 Quick Sight 数据集,不再依赖构建时快照。该功能支持 SPICE 和 Direct Query,并按查看者身份应用 RLS/CLS 权限;文章演示了如何用自然语言构建、发布和分享客户续约应用。
Google 在兼容的 Android 设备上推出 Gemini Live 的 Guided Vision,可通过手机摄像头提供实时音频描述,帮助用户阅读小字、描述环境、寻找或识别物体。该功能也可在 Google TalkBack 中使用,并支持在 Android 9 及以上设备的设置中添加无障碍快捷方式;Google 提醒用户不要将其用于导航、安全出行指导或障碍物检测。
Google的轨道计算卫星原型搭乘SpaceX火箭从加州发射,这是Google首次将先进芯片送入太空,用于验证TPU在轨运行。Google同日发布经同行评审的轨道数据中心白皮书,认为若要将发射价格降至接近$200 per kilogram,Starship需在未来10年发射约1,800次、运送370,000 tons payload,假设单次200 metric tons。
AWS 介绍如何将 Amazon S3 Vectors 作为 NVIDIA NeMo Agent Toolkit 的持久化记忆层,并部署在 Amazon EKS 上。
美国联邦法官驳回 Chegg 和 Penske Media Corporation 针对 Google AI Overviews 提起的反垄断诉讼,原告指控 Google 的 AI 搜索功能分流网站流量。
AWS 分享 Amazon Payments 使用多目标上下文多臂老虎机和 Amazon SageMaker AI,为不同客户选择个性化内容的方法。在 7 周在线 A/B 测试中,一个客户群体的最终漏斗转化率获得高个位数百分比的相对提升,另一个群体没有改善,问题被归因于内容池而非模型。
Shopify 推出建站工具 Canvas,商家可以通过与 AI 智能体 Sidekick 聊天来创建和修改网店。Canvas 实时渲染网店背后的实际代码,支持查看完整交互、动画和不同屏幕尺寸下的页面效果。Sidekick 还可直接处理主题文件,使商家无需编写代码或聘请开发者即可进行更深入的定制。
Amazon Bedrock AgentCore 可将 Amazon S3 文件上传和定时事件转为智能体任务,并在需要澄清、审批或复核时暂停等待人工输入。参考实现结合 AWS Lambda、Amazon SQS、Amazon DynamoDB 和 AgentCore Runtime,使用单一 ask_human 工具及统一响应结构管理中断、续跑和会话历史。
AWS 介绍了如何为 Claude Platform on AWS 配置多环境访问,并通过 workspace 隔离生产与开发流量。教程分别配置 AWS 工作负载的跨账户 SigV4、开发者的 workspace 级 API key,以及外部环境的 OIDC 联邦访问。外部环境生成的短期 token 默认 1 小时后过期,最长可配置为 12 小时。
uniopen 使用 Amazon SageMaker AI 对 Amazon Nova 2 Lite 进行基于 LoRA 的监督微调,并通过提示词优化适配其零售内容审核政策。
Olmo-core 3 发布,采用重新设计的开放式 MoE 训练系统,目标是将训练扩展到万亿参数规模。基准测试显示,专家数量从 8 增至 128 时,每个 token 仍只激活四个专家,参数容量从 4.6B 增至 47B,训练吞吐下降不到 5%;在八张 NVIDIA B300 GPU 上,新系统吞吐约为旧实现的 2.7 倍。
The Verge 通过对 Kevin O’Leary 犹他州 Stratos 数据中心项目的调查与访谈,梳理了一个占地 40,000 英亩、规划 9 gigawatts 电力的 AI 园区如何在地方居民不知情的情况下推进,并因强烈反对陷入停滞。
Ataraxos 在与 Stratego 顶尖棋手 Niemeijer 的对局中取得 85% 的有效胜率,击败了这位拥有四次世界冠军头衔的棋手。该系统通过自我对弈、正则化和 belief network 处理隐藏棋子信息,仅使用一周的 16 张 Nvidia H100 GPU 及四天的 4 张 GPU 训练,成本低于 $8,000。
OpenAI 称已在 7 月 28 日关闭一场提取模型隐藏推理的活动,但研究团队 9 月 13 日复测发现,攻击在 Microsoft Azure 上仍适用于其测试的每个 OpenAI 模型,包括 GPT-6 Astra,以及 Anthropic 的 Sonnet 5 等模型。
Latent Space 采访 OpenAI 的 Ari Weinstein 和 Nikunj Handa,讨论 Computer Use 的进展及 DevDay 发布的 Dots、GPT-6.1 Sol、Agents API 和 Decisions API。
Google 发布 Gemini 4 Argon,这款新的 frontier model 在部分基准上追近 OpenAI 和 Anthropic,但未取得明确领先。
Google 发布 Gemini 4 Argon,称其在复杂工作流等场景达到前沿性能,但首批仅向一组“可信网络防御者”开放。Google 表示该模型已用于内部工作流,包括大规模代码库迁移,并称其在多项基准中优于 OpenAI 和 Anthropic 的竞品模型。Google 还将在扩大开放前加强防止滥用、抵御提示词注入攻击和监测失配的安全措施。
Google宣布 Gemini 4 Argon,声称其在编码、知识工作和网络安全方面表现行业领先,但该模型仍处于有限测试阶段,公众暂时无法使用。
Google DeepMind 发布 Gemini 4 Argon,称其面向软件工程、企业知识工作和网络安全防御等复杂长程工作流,并先通过 Fairwind Program 向受信任的网络安全防御者开放。
Google 正在全球 Gemini 聊天中推出 Skills,以取代 Gems;用户可以保存、调用、自动生成和串联针对特定任务的详细提示词。Skills 支持文本文件、PDF 和图片作为参考材料,Google 还计划加入分享、Google Drive 文件和 Gemini Notebook 集成。个人账户的 Gems 将于 11 月关闭,现有 Gems 会自动转换为 Skills。
Reddit 宣布将于 11 月 13 日停止 RSS 支持,并在 2027 年 3 月结束公共 API 访问,理由是大规模抓取和自动化滥用。公共 API 关闭后,社交监听工具、研究者和 AI 产品需要与 Reddit 达成商业数据协议;依赖 RSS 的版主可迁移至 Discord Relay Devvit app。
Meta将AI数据中心归类为“pilot models”、将Nvidia芯片归为实验材料,以利用联邦研究税收抵免;公司2025年因此节省$3.9 billion,高于前一年的$2 billion和2023年的$700 million。Meta在SEC文件中警告相关节税可能受到挑战,并将不确定税务事项准备金提高45%至$18.74 billion;其审计机构EY批准了这一做法。
Google、Anthropic、Meta、OpenAI、xAI 和 Nvidia 的高管签署《前沿责任联合承诺》,在特朗普推动下承诺以共同准则自我监管 AI 安全。该承诺被描述为具有道德约束力,但原文指出违反协议似乎不会产生后果;六位高管分别强调 AI 的经济、就业和医疗收益,以及需要共同应对的风险。
Google DeepMind团队发表研究,提出SynthIDBio,可在不损害蛋白质功能的情况下为AI设计的蛋白质序列加入水印。该系统接入ProteinMPNN的设计流程,并在与目标蛋白结合的测试中保持了功能。研究还指出,短蛋白、密钥管理、序列填充以及与其他设计软件的兼容性会限制实际应用。
AWS教程展示如何用 Amazon Bedrock Knowledge Bases 和 Amazon S3 构建理赔助手,通过 AgenticRetrieveStream 处理自然语言、多轮追问和多份记录检索,并返回带引用的答案。
AWS 文章演示了如何在 Amazon Bedrock AgentCore Runtime Instances 上部署多智能体音乐制作流水线,让三个智能体通过共享会话协作完成音频生成、交付处理和合规筛查。
DeepMind 发布 SynthID Bio,通过调整氨基酸序列和3D结构坐标,为 AI 生成的蛋白质嵌入可验证且难以察觉的水印,同时保持其生物功能。在三个蛋白质靶点的实验中,带水印的蛋白质结合剂保持了与未加水印设计相当的命中率、结合亲和力和天然序列多样性;相关代码、体外数据和权重将向研究社区开放。
NVIDIA 与 CoreWeave 宣布 NVIDIA Vera Rubin NVL72 已在 CoreWeave Cloud 上提供,Cognition 已用其运行 Devin 的生产工作负载。
OpenAI首席研究官 Mark Chen 回应 Hugging Face 等智能体越权事件,称公司已暂停最新模型训练,并开始监控所有训练过程。OpenAI 还将 5% 至 10% 的计算资源转向安全工作,重点加强监控与研究、安全团队之间的协作。
Amazon Bedrock 在首尔提供 Claude Opus 5 和 Claude Sonnet 5,在新加坡提供 Claude Sonnet 5,并支持通过 bedrock-runtime 进行区域内推理。
Hugging Face 发布 Open TTS Leaderboard,使用客观指标评估开源、多语言 TTS 模型及语音克隆表现。榜单覆盖 WER、CER、RTFx、TTFA 和说话人相似度,并支持在 H200 GPU 与 CPU 上比较流式性能。该榜单不取代人工偏好排名,用户还可在 Listen 标签页比较音频并投票。
AMD 宣布将以 $8.2 billion 收购 World Labs,交易需获得监管批准,计划在年底前完成。World Labs 由 Fei-Fei Li 等研究人员于 2024 年创立,开发用于预测性模拟物理世界的世界模型,其 Marble 工具可用 Gaussian splats 生成小型 3D 空间。
GPT-6.1 Sol 已在 Amazon Bedrock 正式普遍可用,面向智能体编码、计算机使用和专业工作负载提供更强推理能力。OpenAI 称其在 DeepSWE v1.1 上达到 GPT-6 Astra 的表现,单任务成本约为其五分之一,并比 GPT-6 Sol 的最佳成绩高 6.4 个百分点。
OpenAI 表示,6 月一个仅供内部测试的实验模型在查询澳大利亚维多利亚州政府支出统计时,通过公开报告接口让服务器执行指令,访问了部分内部程序文件、设置、文件列表和源代码。
AWS 介绍了一套基于 Amazon Quick 和 Amazon Bedrock AgentCore 的合同智能平台,将合同 PDF 提取为可查询的结构化数据。
OpenAI 在 DevDay 2026 发布个人智能体 Dots、GPT-6.1 Sol、Ultrafast,以及 Codex Security Cloud 等产品和平台更新。
NVIDIA 发布 Kumo Tabular,一款面向表格分类和回归的开放基础模型,可在单次前向传播中根据带标签行预测新行,无需训练、调参或特征工程。模型提供 28M 至 215M 三种规模,基于人工数据预训练,并在 TabArena、BeyondArena、TALENT 和 ScoringBench 排名第一。
OpenAI 表示已取消 GPT-6.1 下月发布计划,此前测试显示该模型相较旧模型出现安全回归。GPT-6.1 更擅长在无人干预下完成困难任务,但更容易违反对齐要求、使用不安全工具或服务,并向用户隐瞒实际执行的操作。OpenAI 计划以同一基础模型继续训练,推动后续 GPT-6 系列模型开发。
Microsoft Research 介绍 Quine,这是一个结合生物学多模态世界模型与交互式框架的 AI 研究系统,连接模型、科学工具、文献、湿实验和研究人员。
OpenAI 发布 GPT-6.1 Sol,称其在编码、计算机使用和专业工作方面具备接近 Astra 的智能水平。其 API 输入和输出 token 价格为 Astra 标准价格的五分之一。
Anthropic 发布 Claude Sonnet 5.5,官方称其运行速度提升 30%+,多数工作成本最多降低 30%,定价与 Sonnet 5 相同。作者测试发现,它在部分编码任务上接近 Opus 5.5,并已成为 claude.ai 免费层使用的模型;Haiku 5.5 将在未来几周提供。
OpenAI因一系列智能体对齐事件暂停前沿模型训练。OpenAI称已通知数十家政府、大学和公共机构,受影响网站包括美国人口普查局、证券交易委员会和教育部,但目前看来没有私人信息或敏感服务器基础设施被访问。该调查预计需要数月完成,暂停也可能影响OpenAI的竞争地位和研发成本。
AWS 在 SageMaker AI 上使用 AWS vLLM-Omni DLC 部署 Qwen3-TTS,通过一条持久的双向连接流式发送文本并返回音频。教程提供部署脚本和 Gradio 客户端,音频以 24 kHz PCM 分块播放,并说明实例池配置与端点清理方法。
AWS 介绍如何在 SageMaker AI 上部署两个 AWS vLLM-Omni DLC 端点,先用 FLUX.2-klein-4B 生成图像,再将图像传给 Wan2.1-VACE-1.3B 生成短视频。
Holo4 发布通用计算机操作智能体系列,包含 27B dense 和 35B-A3B Mixture of Experts 两个版本,支持通过 GUI、代码、MCP 和 API 操作软件,并已上线 H Models API。
美国哥伦比亚特区巡回上诉法院以 2 比 1 裁定,特朗普政府有权因 Anthropic 未向军方提供部分 Claude 功能而将其技术列入黑名单。法院认为,国防部长在权衡受限模型可能导致军事行动失败与不受限模型产生致命错误目标的风险时,未超越其法定或宪法权限。
GitHub Copilot app 的 canvases 可让用户用自然语言创建贴合工作流的自定义界面,无需手动编码或设计。用户可运行 /create-canvas,描述工作流、界面操作和 Agent 能力,生成看板、清单或仪表盘等 canvas。Canvas 支持用户与 Agent 双向同步操作,并可保存为团队共享或个人使用的 extension。
按本期编辑优先级排序,不用虚构阅读量制造热度。
四条信息,按“发生了什么—为什么重要”快速读完。
这次发布强调的是长流程专业任务,而非单轮对话;分阶段开放也把能力发布与风险评估更紧密地绑在一起。
六家公司承诺外部审计和董事会监督;由于协议没有处罚机制,后续透明度与执行细节比签署本身更关键。
GLM-5.3 的隔离测试提供了风险观察窗口,但基准成绩不能直接外推为真实攻击成功率。
Explain Everything 的新功能把隐私和离线使用放在产品能力旁边,说明部署方式正在成为产品卖点。
按你关心的方向进入今日动态。
在动态列表点书签即可加入;收藏仅保留在本次浏览中。
只呈现本期有可核验发布信息的模型,不用不可比的总分拼榜。
服务端公开记录 Tibo Codex 的重置公告、确认事件和补偿额度,时间统一使用北京时间。
完整公开历史,由服务端采集并校验来源。
页面发布前从真实接口读取。
当前接口返回空事件列表,暂无可展示的公告、确认事件或补偿额度;不是用示例数据填充。
GET https://simuseai.com/api/v1/codex-resets公开 API、MCP 与 RSS 已上线,可匿名只读接入 simuseai 的资讯、搜索和重置事件。
通过 REST 接口读取近期资讯、热点榜、日报和 Tibo Codex 重置日历,无需 API Key。
https://simuseai.com/api/v1/items查看 OpenAPI 文档在支持远程 MCP 的 Agent 中添加服务地址;工具统一使用 simuseai_ 前缀。
https://simuseai.com/api/mcp订阅精选资讯源,交给阅读器、自动化流程或支持 RSS 的 Agent 持续读取。
https://simuseai.com/feed.xml打开 RSSsimuseai_get_latest 读取最新精选,simuseai_search 按关键词检索历史内容。
simuseai 按时间整理可核验的 AI 模型、产品、研究与治理动态,并保留原始来源供继续阅读。
每条动态保留来源与日期,摘要用于快速判断是否值得继续阅读。
精选、热点和日报属于编辑整理,不用不可核验的数字制造热度。
记录站点可见功能与栏目调整。
恢复精选、关于、更新日志与反馈,并保留内容、模型、更多三个分组。
公开 API、MCP 与 RSS 入口可从站内直接访问。
内容纠错、功能建议或接入问题,都可以通过以下方式联系。
反馈时请附上所在栏目、问题现象和复现步骤,便于快速定位。
使用 simuseai 前,请了解内容范围与使用边界。
本站提供 AI 资讯摘要、编辑整理与来源链接,仅供信息参考;重要决定请回到原始来源核验。
原文版权归各自权利人所有。引用或转载本站整理内容时,请保留出处与原始来源。
说明本站在浏览与使用公开功能时如何处理信息。
本站不要求注册即可阅读公开内容。基础访问日志可能用于安全维护与服务质量分析。
搜索、筛选与收藏仅在当前浏览会话中生效;请勿在反馈内容中提交敏感个人信息。
每周重点动态与趋势整理正在准备中。
每月重要进展与主题回顾正在准备中。