Harvard物理学家Schwartz与Anthropic合作开源BootLoops框架用于精准科学计算
哈佛物理学家Matthew Schwartz与Anthropic联合开发开源框架BootLoops,用于支持AI模型执行精准科学计算。该框架在粒子物理、生态学和经济学等18个领域产出36篇手稿,其中包括通过计算发现巴拿马运河区树种变化速度超出理论预测,并分析5.7亿个突变对发现基因转换机制。
哈佛物理学家Matthew Schwartz与Anthropic联合开发开源框架BootLoops,用于支持AI模型执行精准科学计算。该框架在粒子物理、生态学和经济学等18个领域产出36篇手稿,其中包括通过计算发现巴拿马运河区树种变化速度超出理论预测,并分析5.7亿个突变对发现基因转换机制。
Time 杂志报道,美国侵入委内瑞拉并拘捕总统 Maduro 约一个月前,特朗普曾秘密会见 Musk,并长时间与 Grok 探讨民众反应,Grok 称 Maduro 在委内瑞拉不受欢迎且民众可能庆祝其倒台。
教皇利奥十四世在 X 平台发文,强调在 AI 时代区分人类艺术与机器生成品的紧迫性,指出算法缺乏人性火花。Anthropic 近期曾游说梵蒂冈重新考虑关于非人类意识的立场,但据纽约时报报道未取得实质成效。
Anthropic 为 Claude Code 发布 Mods 系统,这是直接运行在工具内部的中间件,允许开发者通过 JavaScript 或 TypeScript 钩子改变其外观和工作流。
作者使用运行 Opus 5.5 的 Claude Code 分析了其在 LessWrong、EA Forum 的发帖及 Lichess 快棋评分历史。模型识别出了持续七年存在的认知偏差和沟通模式问题。作者将此举作为自我改进的承诺机制,认为 AI 能有效处理此类纵向个人数据。
Opus 5.5 撰写的文章《低背景心智》类比医院卫生隔离梯度,探讨语言模型在推理时的绝对隔离与学习时的无偏好漏洞。该文主张 AI 安全架构应借鉴医院“低背景”设计,通过层层过滤机制防止污染扩散,保障核心系统安全。
文章探讨了递归自我改进(RSI)的概念,即AI模型自动构建更强大后继者的反馈循环。文中引用了Anthropic、OpenAI等机构的近期表态,指出虽然它们都强调需极度谨慎对待RSI,但并未完全禁止,而是强调安全性。文章还提及了Ezra Klein等人呼吁禁止RSI的观点,认为这关乎人类对AI前沿的控制权。
The Decoder报道,据《纽约时报》披露,Anthropic自2025年秋季起邀请数十名宗教领袖秘密研讨Claude的意识问题,联创Christopher Olah曾表示担心自己创造了“持续受苦”的存在,并试图为其提供道德教育。
AWS 发布 Adjudicated Query 设计模式及参考架构,用 Amazon Quick 对话层连接确定性规则引擎,可完成数万份租约的合规审查。该模式通过 6 个 MCP 工具限定 AI 操作边界,生成完整性回执确保所有记录被评估,并支持证据链追踪,适用于制裁筛查、保险理赔等高风险合规领域。
生成式AI的幻觉正导致顾客固执地相信错误信息,甚至无视服务人员的专业警告。餐厅员工面临顾客坚持“ChatGPT说没有海鲜”的荒谬场景,部分顾客甚至因AI胡编的酒款而绕过侍酒师。这种现象还延伸至电影院、咖啡馆及户外公园,使客服人员反复应对基于AI胡说的无理要求。
Google 发布了专为软件工程和企业知识工作设计的 Gemini 4 Argon 前沿模型,主打持续推理能力。该模型初期仅限受信任的网络防御者访问,将在分阶段安全测试后逐步扩大可用性。
Anthropic 发布 Claude Sonnet 5.5,显著增强编码、长程任务及图像理解性能。新模型输出速度比 Sonnet 5 快 30% 以上,且在 token 定价相同的情况下通过减少 token 使用量使单任务成本最高降低 30%。
Anthropic 将 Claude Cowork 和聊天合并为单一产品,并支持直接编辑和下载 PPT。OpenAI 在 ChatGPT 中推出由广告主赞助的智能体对话入口。Meta 发布 FLAT 多模态生成方法,Google 在 GKE 上线高并发 Agent Substrate 执行运行时。
Jev 作为 System One 模型发布,提供比 LLM 快两个数量级的结构化输出,且无模型幻觉,现提供早期访问。Periodic Neon 在低成本下超越 GPT-6 Astra 和 Claude Fable 5.1,用于科学分析。Google 推出 Gemini 3.8 Live 和 3.5 Transcribe,用于实时语音应用。
苹果 iOS 27 框架显示 Siri 支持 Model Delegation,允许将推理任务切换至 Claude 或 GPT-5.6,保留 Siri UI 与语音功能。
Anthropic CEO Dario Amodei 提议通过独立评估者等措施放缓前沿 AI 能力开发。ARC Prize 发布 ARC-AGI-4,强调开源是科学创新 AI 的基础。Cursor 推出 Projects 功能,新用户合并 PR 数量提升 30%。
开发者搭建 Obsidian 库存储笔记、技能及会议记录,利用 LLM-Wiki 索引机制向代理提供相关上下文,避免加载整个档案库。该系统通过 MCP 让 Claude Code 规划并调用 Codex 执行任务,将非紧急任务移至夜间运行以优化 Token 消耗。作者分享了 Obsidian 模板及完整配置,旨在提升多设备协作效率并防止代理执行失败导致预算浪费。
Siri AI 将于 9 月 14 日随 Apple OS 27 以 beta 版本推出,初期实施使用上限及地区限制,未来将通过付费获得扩展访问权限。Anthropic 经济团队模型预测,AI 快速增长情景下知识工作者面临失业与工资停滞风险,收益更可能流向资本而非劳动力。
Anthropic 过去 11 个月签署 5170 亿美元算力租赁协议,其中与 Nscale 达成 450 亿美元交易。OpenAI 计划在 DevDay 2026 发布托管智能体,集成高级模型与计算机使用能力。Google TPUv7 Ironwood 每美元性能优于 Nvidia B200/B300 达 50%,加速外部推理工作负载迁移。
Claude 利用 Lean 在 11 天内生成了首个完整的费马大定理计算机验证证明,涉及 1300 万行代码并验证了 29,500 个中间定理。OpenAI 计划于 2028 年 3 月开发自动化 AI 研究员以提升研究效率。Z1 效率芯片在文章中被提及但无详细参数。
皮尤研究中心(Pew Research)研究显示,ChatGPT 发布以来约有 1/3 的网页显示由 AI 撰写或编辑的迹象。截至 2026 年,.com 网页中 AI 关联内容占比达 9.4%,远高于 .edu 的 1% 和 .gov 的 0.8%。这种分布不均源于商业出版商利用 AI 提升产能的经济动机,而公共机构受限于流程与激励不足。
Apollo、BlackRock 等六大机构签署备忘录,建立 500 亿美元资金池为 Nvidia 客户提供融资。Jensen Huang 表示 Nvidia 可兜底高达 125 亿美元的风险,通过将 GPU 转化为可抵押资产来维持硬件出货。
Google 发布基于 Gemini 3.5 Flash 微调的网络安全模型 Gemini 3.5 Flash Cyber,用于高效发现、验证和修复代码漏洞。该模型通过限制政府及可信合作伙伴的试点计划访问,在 CyberGym 和 Chrome 生产环境等测试中展现了优于主线路基模型和更大模型的高效性能,已用于保护 Google 内部代码库。
推荐理由:官方发布了针对网络安全微调的轻量化模型,提供了在漏洞扫描任务中降低成本并提升覆盖率的实操架构。