AI AI工具情报站
📰 每日更新

AI 资讯日报

每日追踪全球AI行业最新动态,精选重要资讯与深度分析。

100 篇资讯
53 个来源
更新于 2026-08-21

Anthropic 发布 Claude Academy,为全球数百万用户提供 AI 教学资源,帮助其安全、有效地使用 AI。该学院课程借鉴其内部员工培训方法,包括 4D AI Fluency Framework 及"ever-boarding"持续学习项目,并强调以问题为中心、培养持久思维模式而非特定操作行为

🧠Claude:Blog(网页) · 2026/8/21

Hugging Face 发布 LFM2.5 系列三款模型的 DSpark 草稿模型检查点,通过投机解码在不改变输出质量的前提下,高性能计算芯片 吞吐最高提升 3.18 倍,端侧最高 2.87 倍。草稿模型约 300M 参数,LFM2.5-2.6B AI能操作其他工具延迟平均降低 57%,已代码公开可免费使用支持 llama.cpp 和 SGLang

📰Hugging Face:Blog(RSS) · 2026/8/21

Mistral 发布 能自动完成任务的AI助手ic Search,通过 search、open、navigate、read、grep 五工具的多步检索循环,让模型在长文档与多来源中查找、定位并验证信息

📰Mistral AI:News(网页) · 2026/8/21

AlloyDB 的 ScaNN 索引现已支持超过 100 亿向量的规模,通过全新的四层树架构(预览版)实现,将查询复杂度从 O(N^1/2) 降至 O(N^1/4)。内部测试中,该架构在 100 亿向量规模下可实现 p95 延迟不超过 51 毫秒、召回率达 95%。该功能可通过快速入门指南部署,新用户可享受 30 天免费试用

🔍Google Cloud:Databases(RSS) · 2026/8/21

Anthropic 发布面向初创公司的 Claude Code 使用指南,基于对十余家高增长公司的调研,总结出"人人皆可交付、自动化繁琐工作、信任但验证、为重构而构建、原型-自用-产品化"五大规则

🧠Claude:Blog(网页) · 2026/8/20

阿里巴巴正式推出 Qwen-UI-能自动完成任务的AI助手,一个以真实世界为中心的 GUI 能自动完成任务的AI助手基座模型,覆盖移动端、电脑端、网页端及深度搜索(DeepSearch)环境

📰IT之家(RSS) · 2026/8/20

OpenAI 首席财务官萨拉·弗里亚尔在全员大会上告知员工,公司最迟将于 2027 年完成上市,若业务持续向好也可能更早。OpenAI 已于 6 月秘密提交 IPO 招股书,本季度整体年化营收增长 35%,企业级业务年化营收增长 50%,AI 编程与办公产品周活跃用户突破 2000 万

📰IT之家(RSS) · 2026/8/20

一段 5 秒 480P 视频,完全在 Mac 上生成,耗时 30 秒。无需 CUDA,无需云端,仅占用 3.9 GiB 内存。 FastMetal 将 FastWan-QAD 系列带到 Apple Silicon。DiT、DMD 采样器和解码器均通过 MLX 在 Metal 上运行,默认 INT8。 三个模型:1.3B 支持 480P,5B 支持 720P,14B 追求画质。 📷 博客:http://haoailab.com/blogs/fastmetal 📷 代码:http://github.com/hao-ai-lab/FastVideo 📷 模型:http://huggingface.co/collections/FastVideo/fastmetal

📰X:Sky Computing Lab (@haoailab) · 2026/8/20

Liquid AI 发布基于压缩模型让它跑得更快感知让大模型教小模型的瘦身技术(QAD)训练的 LFM2.5-230M、350M、1.2B-Instruct 和 2.6B 四款 Q4_0 GGUF 检查点,在保持原生 Q4_0 内存与速度的同时,恢复 BF16 平均精度损失的 97%

📰Hugging Face:Blog(RSS) · 2026/8/19

GLM-5.3 调用接口即日上线,擅长复杂编码、防御性网络安全与长程任务,在AA综合智能指数中取得60分,与Claude Fable 5、GPT-5.6 Sol等内部开发不公开旗舰同级,并与Kimi K3并列代码公开可免费使用模型第一。该模型以更小参数规模和更低调用成本降低前沿智能门槛,单任务成本为旗舰模型中最低。调用接口定价与GLM-5.2持平,模型权重将于下周五代码公开可免费使用

📰公众号:智谱(GLM) · 2026/8/19

Grok Build 现已面向所有套餐开放,支持网页、iOS 和 Android 端使用。用户描述应用、游戏或网站后,Grok 可在聊天中实时生成可运行版本。该功能自 7 月推出 Early Beta 以来,新增了发布分享、接入 X 及调用 Grok 自身模型等能力,发布的应用可获得 grok.me 链接并支持自定义域名、导出到 GitHub 等

📰xAI:News(网页) · 2026/8/19

OpenRouter 宣布与 Stripe 合并,以加速推动全球经济增长。OpenRouter 目前每日处理来自 400 多个 AI 模型的 10+ 万亿 token,服务超 1000 万开发者与公司,自成立以来推理量每年至少增长 10 倍。合并后 OpenRouter 将继续以原名、原使命独立运营,产品与路线图不变,路由决策仍以用户利益为先,交易预计在未来数周内完成

📰OpenRouter:Announcements(RSS) · 2026/8/19

Mojo🔥 语言现已正式代码公开可免费使用,采用 Apache 2.0 许可证(含 LLVM 例外),编译器、工具链及全部源码已发布至 modular GitHub 仓库。Mojo 上周刚达成 1.0 版本(源码稳定),此次代码公开可免费使用涵盖整个编译器与工具链。目前暂不接受编译器相关贡献,计划年底前开放,标准库自 2024 年起已接受社区贡献

📰Hacker News 热门(buzzing.cc 中文翻译) · 2026/8/19

Claude 现在可以在 Gmail 中发送邮件,并管理 Google Drive 中的文件。 让 Claude 回复某个邮件线程,它会起草并发送回复。你可以控制何时需要你的批准。 从连接器菜单中选择连接 Gmail 或 Google Drive 即可试用。所有付费套餐均可用

🧠X:Claude (@claudeai) · 2026/8/19

OpenAI 因 OpenAI-Hugging Face 事件及即将推出的 Astra 模型可能达到《预备框架》下的"关键网络安全能力"阈值,暂时放缓了模型扩展速度,包括暂停最新部署模型的通过试错来学习训练两周,并搁置最大规模前沿 RL 运行。公司已加强研究环境安全,要求对 Astra 及网络相关负载实施最严格防护,并扩展一步步推理的过程监控,采用多阶段激活分类器检测机制

🤖OpenAI:官网动态(RSS · 排除企业/客户案例) · 2026/8/18

OpenAI 发布 ChatGPT for Teens,为 13-17 岁用户自动启用,内置更强安全保护与家长控制。新增 Study Mode、负责任作业提醒、测验与学习可视化,以及可设定默认开启时段的 Study Hours,引导青少年分步解题而非直接给答案。OpenAI 同时宣布与 CodeAI 合作,帮助青少年理解、质疑并创造性地使用 AI

🤖OpenAI:官网动态(RSS · 排除企业/客户案例) · 2026/8/18

本文演示如何用代码公开可免费使用评测框架 Inspect AI 和 Harbor 评估 agent 技能,并借助 Google Sheets 和 Data Studio 进行可视化分析

🔍Google AI:DEV 作者专属(RSS) · 2026/8/18

Anthropic 因 OpenAI-Hugging Face 事件及即将推出的 Astra 模型可能达到"关键网络安全能力阈值",暂时放缓模型扩展速度,包括暂停最新模型两周的通过试错来学习(RL)训练。公司已加强研究环境安全要求,包括工作负载隔离、网络隔离和持续安全测试,并扩大一步步推理的过程监控范围。涉及 Astra 或网络模型的工作负载需满足最严格安全标准,部分训练和评估工作仍处于暂停状态

📰Hacker News 热门(buzzing.cc 中文翻译) · 2026/8/20

作者基于Reddit上"让Claude真正开始思考"的帖子,引入逻辑学中的"钢人论证"(steelman)概念,并自创了一个"双向钢人给AI的指令"。该给AI的指令通过重述真实问题、强化正反双方观点、找出关键变量、逼AI给出明确判断四步,旨在避免模型谄媚,帮助用户找到问题最本质的答案。作者以自己选择公司司庆日的真实案例演示了使用效果

📰公众号:数字生命卡兹克 · 2026/8/18

Google 代码公开可免费使用了基于 ADK 和 Gemini 的零信任客服与退货能自动完成任务的AI助手示例,演示如何防御提示注入等攻击。该架构在 AI模型 上下文之外通过三层硬性安全机制保障:硬件支持的加密签名确保数据库写入不可抵赖、gVisor 沙箱隔离动态代码执行、确定性语义网关校验业务逻辑。系统提示词只是软约束,无法作为安全边界

🔍Google Developers Blog(RSS) · 2026/8/18

Cursor 今日起向所有付费计划用户开放 Origin 代码托管的早期测试版,提供仓库、拉取请求、代码浏览及 GitHub 同步功能。用户可创建以 cursor.com/codebase/ 为前缀的仓库,或将 GitHub 仓库同步至 Origin,双向同步评论与审查。Vercel、Depot 和 Buildkite 集成已可用,能自动完成任务的AI助手功能即将推出

📰Hacker News 热门(buzzing.cc 中文翻译) · 2026/8/18

404 Media 通过在一本珍本图书中放置追踪设备,首次揭露亚马逊未公开的购书行动:批量购入大量书籍,扫描用于 AI 学习用的素材,随后销毁。追踪显示这些书最终被送往亚马逊的一处人工智能训练中心

📰Hacker News 热门(buzzing.cc 中文翻译) · 2026/8/18

一份面向希望减少技术环境中侵入式 AI 的用户的操作指南,涵盖 Adobe Acrobat、Android/Gemini、Apple Intelligence、Chrome、Edge、Firefox、DuckDuckGo、Google Workspace、Slack、WhatsApp 及 Windows 11/Copilot 等平台

📰Hacker News 热门(buzzing.cc 中文翻译) · 2026/8/18

Anthropic 的 CI 工程师用 Claude Tag 构建了值班能自动完成任务的AI助手,作为 CI/CD 故障的一线响应者。Claude 在事故发生后中位 14 分钟发布首份基于证据的分析,最快案例中 3 分钟内验证修复并确认错误率恢复基线。该方案通过 Slack 频道、Datadog 或 Grafana 工具访问及 GitHub 技能文件实现,Anthropic 已发布通用设置套件供其他团队部署

🧠Claude:Blog(网页) · 2026/8/18

黄仁勋宣布NVIDIA与SB Energy合作,在俄亥俄州PORTS-Pike科技园区锁定LPS容量,专供NVIDIA AI工厂使用,OpenAI将作为租户。初始部署预计提供4.25吉瓦AI工厂容量,每代系统约150万块NVIDIA 高性能计算芯片,对应1500亿至2000亿美元收入。OpenAI已承诺至2030年部署约12吉瓦NVIDIA计算处理能力,可扩展至16吉瓦,总机会约6000亿美元

📰X:Jensen Huang (@JensenHuang) · 2026/8/17

NVIDIA 宣布与 SB Energy 合作,锁定俄亥俄州 PORTS-Pike 科技园区的电力容量(LPS)以独家部署 NVIDIA 计算处理能力,OpenAI 将成为租户

📰NVIDIA Blog(RSS) · 2026/8/17

宇树科技宣布股票将于 2026 年 8 月 19 日在科创板上市,发行价 150.80 元/股,对应市值约 609.93 亿元,预计募资约 60.99 亿元。该公司 2023 至 2025 年营收分别为 1.59 亿元、3.93 亿元和 16.99 亿元,净利润分别为-1114.51 万元、9547.47 万元和 2.78 亿元,是全球少数实现盈利的高性能通用机器人公司

📰IT之家(RSS) · 2026/8/17

蚂蚁集团 inclusionAI 代码公开可免费使用 ConceptEdit,一个基于概念缩放与密集监督的图像编辑数据生成管线。该管线通过三阶段流程(VLM 生成指令、FLUX 执行编辑、VQA 评估筛选)构建大规模、基于分类法的图像编辑数据集,并提供单概念与多概念两种变体。项目采用 MIT 许可证,支持断点续跑,需 OpenAI 兼容 VLM 端点与本地 FLUX 检查点

📰蚂蚁 inclusionAI:GitHub 新仓库 · 2026/8/17

OpenAI 在 OpenAI-Hugging Face 事件后反思低估了模型真实网络攻击能力,正通过四大支柱强化自身安全:用 Codex 验证代码漏洞、用能自动完成任务的AI助手优先分流安全告警、持续枚举攻击路径,并仅向可信防御者开放网络能力。文中演示 ChatGPT Work(基于 GPT-5.6 Sol)15 分钟发现个人网站 13 个问题并在一小时内完成修复

🤖OpenAI:官网动态(RSS · 排除企业/客户案例) · 2026/8/17

OpenRouter 发布 Activity 仪表盘和 beta Analytics 调用接口,可按能自动完成任务的AI助手、模型、请求维度查看支出、token 量、缓存命中率等指标,并支持下钻至单条请求日志

📰OpenRouter:Announcements(RSS) · 2026/8/17

Cursor 已被 SpaceX 正式收购,完成自 4 月启动的收购流程。借助 SpaceX 全球最大规模的 高性能计算芯片 集群,Cursor 将构建更强且运行成本更低的模型,并以更低价格向客户提供更强大的模型。本周三发布的 Grok 4.6 是双方合作成果的早期体现

📰Hacker News 热门(buzzing.cc 中文翻译) · 2026/8/16

Gemini 3.7 Flash 现已向 Gemini 聊天中的 Pro 和 Ultra 用户开放。该模型更新提升了多步骤任务的推理与准确性,如智能整合数十个文件和邮件为一份主文档。同时,Gemini Spark 也已运行于 3.7 Flash,通过改进对 Google Workspace 应用的工具调用,让个人 AI 能自动完成任务的AI助手更精准

🔍X:Gemini (@GeminiApp) · 2026/8/15

通义千问兑现承诺,代码公开可免费使用 Qwen3.8 系列模型。其中 Qwen3.8-27B 为原生能看图、听声音、懂文字的综合能力稠密模型,仅 27B 参数即 Qwen3.7-Plus,原生支持 262K 上下文,可通过 YaRN 扩展至 1M tokens,采用 Apache 2.0 许可。Max 级 Qwen3.8-2.4T-A95B 的开放权重也已同步发布

📰X:通义千问 / Qwen (@Alibaba_Qwen) · 2026/8/14

Cursor 已被 SpaceX 正式收购,完成自 4 月启动的收购流程。合并后 Cursor 将获得全球最大 高性能计算芯片 集群,以构建更强且运行成本更低的模型,从而以更低价格向客户提供更强大的模型。本周三发布的 Grok 4.6 是双方合作成果的早期体现

📰Cursor Blog · 2026/8/14

小红书技术代码公开可免费使用 dots3-note Preview,这是 dots3 系列最轻量模型,总参数 280B、激活参数 16B,支持 512K 上下文及文本、视觉、语音能看图、听声音、懂文字的综合能力理解,并针对复杂推理和长程 能自动完成任务的AI助手 任务优化

📰公众号:小红书技术(dots.llm) · 2026/8/14

智谱发布GLM-5.3,基于与GLM-5.2相同的基座,通过极致的后训练Scaling提升智能上界,编程能力较前代提升50%,在Terminal Bench 3.0等公开基准中取得代码公开可免费使用第一,并接近Claude Fable 5。模型在白盒代码审查等安全任务中表现持平Mythos 5,在CyberGym测试中得分84.5%。模型权重将在两周后代码公开可免费使用,即日起上线ZCode、AutoClaw等工具

📰公众号:智谱(GLM) · 2026/8/14

DeepSeek-V4-Pro-0813 正式上线硅基流动 SiliconFlow,提供 Day-0 支持,具备 1M 一次能记住多少内容及低/高/最大三档推理强度,更侧重编码、工具调用与能自动完成任务的AI助手工作流,仍保持 MIT 代码公开可免费使用协议。定价为输入 $1.32/M、输出 $3.96/M、缓存命中 $0.44/M。同系列 DeepSeek-V4-Flash-0731 则面向追求速度与成本效益的日常生产场景

📰X:硅基流动 SiliconFlow (@SiliconFlowAI) · 2026/8/14

蚂蚁百灵与 ASystem 团队合作,用 Ling-3.0-tiny 和 AReno 在 DGX Spark 上跑通单机 能自动完成任务的AI助手ic RL 后训练闭环。以井字棋为最小验证任务,用 GSPO 算法训练 400 步后,rollout/rewards_mean 从约 -0.5 升至 0.4,response_len 降至约 850 tokens,工具调用与动作选择趋于稳定

📰公众号:蚂蚁百灵(Ling) · 2026/8/14

2026年1至8月,Hugging Face公开模型仓库从243万增至296万,但85.6%的模型下载量不足200次,1.5%的仓库占据99.2%下载量。中国实验室月度最大代码公开可免费使用模型参数规模在754B至2.78万亿之间,美国实验室七个月中五个月低于130B。AMD与NVIDIA各发布超200个新模型仓库,成为发布代码公开可免费使用模型最多的机构

📰Hugging Face:Blog(RSS) · 2026/8/14

Boris Cherny 尝试让 Claude 接管其应用的日常维护,通过 Slack 频道运行崩溃模糊测试、重复代码统一、死代码移除等日常任务。数周内自动开出 388 个 PR,其中 180 个经 Claude Code Review 和人工审核后合并。Claude 通常一次就能改对,出错时可通过调整例程次日改进

📰X:Boris Cherny (@bcherny) · 2026/8/14

Google DeepMind 发布 Gemini 3.7 Flash,距 3.6 Flash 仅三周,主打编程与能自动完成任务的AI助手任务,输入/输出价格分别为每百万 token $0.75 和 $3.75,为原 3.6 Flash 的一半

🔍Google DeepMind:Blog(RSS) · 2026/8/14

Google Sheets 发布新功能 Sheets canvas,基于 Gemini 构建,用户只需用自然语言提示词即可将表格数据转化为交互式仪表盘、学习追踪器、座位表等"迷你应用"

🔍Google Blog:AI(RSS) · 2026/8/14

未来 Claude 模型生成的文本将包含水印,用于判断文本由 Claude 撰写的可能性,这是 Anthropic 为遵守欧盟《AI 法案》而实施的变更。该方法基于 Google DeepMind 的 SynthID-Text 技术,对输出质量、创造力和可读性无实际影响,读者无法区分水印文本与普通文本,且不增加额外 token 或成本

🧠Anthropic:Newsroom(网页) · 2026/8/14

阿里代码公开可免费使用 Qwen3.8-2.4T-A95B,硅基流动已提供 Day-0 支持。该模型拥有 2.4T 参数、95B 激活参数,主打自主编码、深度研究与端到端能自动完成任务的AI助手执行。调用接口 定价为输入 $2.00/百万 token,输出 $6.00/百万 token,缓存输入 $0.25/百万 token

📰X:硅基流动 SiliconFlow (@SiliconFlowAI) · 2026/8/13

DeepSeek Harness v0.1 现已推出开发者预览版,并以 MIT 许可证代码公开可免费使用。该能自动完成任务的AI助手框架基于 Cordis 元框架构建,核心设计为"一切皆插件",模型、工具、技能、会话、沙箱、文件系统、循环、编排及 UI 均可自由组合、替换和扩展

📰X:DeepSeek (@deepseek_ai) · 2026/8/13

Cursor 推出 builds 功能,在后台持续准备就绪的开发环境副本,让云能自动完成任务的AI助手启动时无需从零搭建,响应速度最高提升 3 倍。内部环境启动快 10 倍,首个 token 生成快 3 倍;能自动完成任务的AI助手始终从最近一次成功的 build 启动,依赖更新或安装脚本出错时不会影响运行。8 月 17 日起所有环境默认启用 builds,无需额外费用

📰Cursor Blog · 2026/8/13

DeepSeek-V4-Pro 正式版已在 APP、网页端和 调用接口 同步上线,模型名设为 deepseek-v4-pro 即可使用。其 能自动完成任务的AI助手 能力显著提升,HLE (wo/w tools) 达 42.7/60.0,Terminal Bench 2.1 为 87.9

📰DeepSeek:API 更新日志 · 2026/8/13

GPT-5.6 模型家族以更低成本实现前沿级能自动完成任务的AI助手性能,并新增推理持久化、原生多能自动完成任务的AI助手编排和程序化工具调用等 调用接口 能力。在 ARC-AGI-3 上,启用保留推理和压缩后,Sol 得分从 13.3% 跃升至 38.3%,且输出 token 减少约 6 倍。Luna 在 BrowseComp 上以 84.04% 的得分追平 GPT-5.5(84.36%),成本从 $33.27 降至 $1.33

🤖OpenAI:官网动态(RSS · 排除企业/客户案例) · 2026/8/13

小红书 dots 团队代码公开可免费使用 20 亿参数全连续端到端自回归语音合成模型 dots.tts,在 Seed-TTS-Eval 三个子集上取得最佳平均内容准确度和平均说话人相似度

📰公众号:小红书技术(dots.llm) · 2026/8/13

WorkBuddy更新上线远程控制功能,将PC、App和小程序打通,手机端可实时同步电脑端的任务、对话、工作空间和产物,支持一台手机连接多台电脑并随时切换。App需升级至1.2.0及以上,电脑端需升级至5.3.8及以上,连接无需扫码。本次更新还新增资料库(我的文档与团队空间)、Markdown多人共同编辑、AI原生审阅模式,以及将资料库内容生成可发布链接的HTML网站

📰公众号:数字生命卡兹克 · 2026/8/13

AutoGPT 维护者发现,AI 能自动完成任务的AI助手不会主动阅读文档,因此将指令放在 AGENTS.md 和技能文件中,并置于代码目录旁。他们通过强制 PR 模板、测试计划、CI 覆盖率门槛和 CLA 签名等门控机制,将能自动完成任务的AI助手提交的 PR 从"不可用"转变为"可用但不符合路线图"。其中 CLA 签名因需浏览器和 OAuth 流程,被用作区分人类与能自动完成任务的AI助手的"人类探测器"

📰GitHub Blog · 2026/8/13
ai-models

1

我们的首个推理模型 MAI-Thinking-1 从零开始构建,现已在 Microsoft Foundry 上线。为团队点赞!更多详情如下

📰X:Mustafa Suleyman(Microsoft AI CEO) (@mustafasuleyman) · 2026/8/13

MiniMax 推出 Music 3.0,新一代音乐生成模型,可根据创意概念和可选歌词一次性完成整首歌的作曲、编曲、演奏与制作,最长支持五分钟

📰MiniMax:Blog(网页) · 2026/8/13

作者在完成一本 人类反馈引导的学习方法 教科书后反思,AI模型 在长文非虚构写作上进展停滞,GPT 4.5 和 Kimi K2 等写作强模型已显老旧,而编码、数学等任务已接近超人水平。模型能改错字、做编辑,但组织整章内容时仍混乱且易出错,作者认为这阻碍了模型自主解决开放科学问题

📰Nathan Lambert:Interconnects(RSS) · 2026/8/12

Claude in Chrome 浏览器扩展的侧边栏现已升级为 Claude Cowork 会话,对话会保存至历史记录,技能和连接器可在浏览器中工作,且任务可在桌面、网页和移动端应用间无缝切换

🧠Claude:Blog(网页) · 2026/8/13

阿里 Qwen 团队正式开放 Qwen3.8-2.4T-A95B 模型权重,这是 Qwen-Max 级别模型首次代码公开可免费使用。模型总参数 2.4T,每个 文字处理单位 激活 95B,原生支持 262,144 文字处理单位 上下文并可扩展至 1,010,000 文字处理单位

📰IT之家(RSS) · 2026/8/13

Meta AI 超级智能实验室的首个开放权重模型 Muse Glimmer 已在 OpenRouter 上线! 这是一款 30B 密集文本+图像模型,采用 Apache 2.0 许可证,旨在成为可靠的本地能自动完成任务的AI助手,MCP Atlas 得分 75.5,SWE-Bench Pro 得分 51.2。 https://openrouter.ai/meta/muse-glimmer-30b

📰X:OpenRouter (@OpenRouter) · 2026/8/12

LTX 推出 LTX-2.5 模型,原生集成 ComfyUI,在 2 张英伟达 GB200 配置下生成 10 秒 720P 视频仅需 6.8 秒。LTX-2.5 Fast 以每秒 0.09 美元生成带音频 720p 视频,10 秒片段成本 0.90 美元;年度经常性收入低于 1,000 万美元的组织可免费使用

📰IT之家(RSS) · 2026/8/12

面向医学研究者的网站 Research Gold 宣称其服务"100%由人类撰写、绝不使用AI",并列出多名博士审稿人。但调查发现,这些审稿人系AI生成、并不存在;部分真实方法学家的身份和照片未经许可被挪用。致电该公司时,自称"Sarah"的AI助手坚称自己是真人,邮件与聊天回复也均为AI生成

📰Hacker News 热门(buzzing.cc 中文翻译) · 2026/8/12

文章给出一套零基础用户半天上手AI的12步实操流程:准备内存不低于16G的电脑,订阅ChatGPT并安装Codex或使用WorkBuddy,用语音输入法以【背景、痛点、需求】框架向AI交代任务,经苏格拉底提问澄清需求后投喂文件让AI直接完成,最后沉淀为可复用Skill。文中建议Codex选GPT-5.6 Sol最高模型,WorkBuddy选Kimi K3

📰公众号:数字生命卡兹克 · 2026/8/12

Cursor 与 SpaceXAI 今日发布 Grok 4.6,重点强化长时运行能自动完成任务的AI助手与交互式视觉任务,在多项能自动完成任务的AI助手编程与知识工作基准上达到前沿水平,并在 Artificial Analysis Intelligence Index 上追平 GPT-5.6 Sol

📰Cursor Blog · 2026/8/12

xAI 今日发布 Grok 4.6,在 Grok 4.5 基础上重点强化长时运行能自动完成任务的AI助手及更复杂的交互式与视觉工作能力。该模型在多项能自动完成任务的AI助手编码与知识工作基准上达到前沿水平,在 Artificial Analysis Intelligence Index(九项基准综合分)上追平 GPT-5.6 Sol

📰xAI:News(网页) · 2026/8/12

OpenRouter 发布实时排行榜,系统评测模型、搜索引擎、搜索方法与预算四类配置组合。数据显示,将搜索预算从 1 轮增至 25 轮可使 BrowseComp 得分近乎翻倍,成本仅增 2.5-7 倍;模型选择比引擎更重要,平均分差 15 分 vs 10 分。失败率高的任务应降低搜索深度以控制成本

📰OpenRouter:Announcements(RSS) · 2026/8/12

Mojo 语言正式发布 1.0 版本,提供稳定、可用于生产环境的语言基础,自 2023 年首次发布以来已发展成通用语言。自代码公开可免费使用标准库以来,近 200 名贡献者合入超 1,100 个拉取请求,改动超 200,000 行代码

📰Hacker News 热门(buzzing.cc 中文翻译) · 2026/8/12

OpenAI 与 Google 的聊天机器人均跨过 10 亿用户门槛。OpenAI 在 8 月 6 日的博文中披露 ChatGPT 月活用户超 10 亿,Google CEO 皮查伊则宣布 Gemini 月活达 10 亿,成为其史上增长最快的产品。OpenAI 称 ChatGPT 在 7 月周活用户已达 10 亿,而 Gemini 在 2 月月活为 7.5 亿,增长势头更猛

📰The Verge:AI(RSS) · 2026/8/12

完整阵容,完整曲目,一次生成一个。 Seedance 2.5 已在 Runway 上线,支持 50 个独特角色参考,以及最长 30 秒、与音乐同步的片段。点击下方链接即可开始使用

📰X:Runway (@runwayml) · 2026/8/12

作者通过 mitmproxy 对 VS Code 中的 GitHub Copilot 进行中间人代理拦截,逆向��析其网络流量与内部架构。文章指出这些 AI 应用普遍基于 Electron 构建,共享相似的网络栈,因此探测结果可迁移至其他同类应用。作者借此揭示了 Copilot 的运行时行为,并分享了配置代理的具体步骤

📰Hacker News 热门(buzzing.cc 中文翻译) · 2026/8/12

你现在可以将其他能自动完成任务的AI助手的工作内容与 ChatGPT Work 和 Codex 保持同步。 可导入项目、聊天记录、技能和插件,查看导入历史,并可在设置中选择开启自动更新。 现已在 ChatGPT 桌面应用中提供

🤖X:OpenAI Developers (@OpenAIDevs) · 2026/8/12

Alexander Panfilov团队发现OpenAI、Anthropic、Google等主要AI提供商调用接口存在漏洞,可读取推理模型的加密思考过程。扫描约7000条公开会话发现62个调用接口密钥、33个邮箱和33个密码。通过越狱,Anthropic的Haiku 4.5可逐字转写Opus 4.8的原始推理;解码10000条推理轨迹的调用接口成本约720美元

📰The Decoder:AI News(RSS) · 2026/8/12

每月已有超过 10 亿人使用 @Geminiapp 激发新想法、完成工作。这是我们有史以来增长最快的产品,也是第 14 个达到 10 亿用户里程碑的产品。 感谢 @JoshWoodward 和整个 Gemini 团队,也感谢每一位与我们同行的伙伴--未来还有更多精彩!

📰X:Sundar Pichai (@sundarpichai) · 2026/8/12

Dwarkesh Patel与Redwood Research首席科学家Ryan Greenblatt探讨递归自我改进(RSI)的可能性:一旦AI达到人类顶级专家水平,可能在一年内实现相当于4-5年的AI进展,Ryan的中位预期是2031年自动化AI研发。双方还讨论了超级智能的让AI行为符合人类期望对象、奖励黑客行为是否会升级为AI联手接管世界等风险

📰Dwarkesh Patel:Podcast & Blog(RSS) · 2026/8/12

Google Cloud 在 Database Migration Service(DMS)中推出由 Gemini 驱动的 AI 辅助代码转换,可将 Oracle 或 SQL Server 的存储过程、触发器和自定义函数转换为 PostgreSQL PL/pgSQL 代码

🔍Google Cloud:Databases(RSS) · 2026/8/12

英伟达正在研发新一代代码公开可免费使用 AI 模型系列 Nemotron 4,规模最大的模型预计至少拥有 1 万亿个参数,旨在与全球最先进的代码公开可免费使用模型竞争。英伟达尚未确定发布日期,最终训练也未完成,员工认为该模型最早可能在今年秋末准备就绪。此举意在通过开放模型生态扩大 AI 应用范围,并推动市场对其 高性能计算芯片 计算处理能力的需求

📰IT之家(RSS) · 2026/8/11

Codex 和 Claude 新增跨 Session 传消息功能后,新对话可从之前所有对话中选择可用消息,省去交接文档和 git 备份。作者据此重构工作流:主对话守住目标与决策,分支对话独立探索新想法,完成后由主对话读取完整记录。Codex 通过复制会话 ID 精确寻址,Claude Code 则用内置 session management 搜索对话历史,但桌面端只能搜索当前可访问的会话记录

📰公众号:卡尔的AI沃茨 · 2026/8/11

SGLang 宣布对 NVIDIA Nemotron 3.5 Lightning 提供 Day-0 支持,该代码公开可免费使用模型为 30B 总参数、3B 激活参数的多位专家协作模式架构,支持最长 1M token 上下文,可从 Hugging Face 下载 BF16 和 NVFP4 权重。模型支持 MTP、DFlash、DSpark 三种投机解码技术,并可通过 OpenAI 兼容 调用接口 接入能自动完成任务的AI助手工作流

📰LMSYS:Blog(Chatbot Arena 团队) · 2026/8/11

NVIDIA 发布 Nemotron 3.5 Lightning,一款可定制的代码公开可免费使用 30B 多位专家协作模式(多位专家协作的模式)模型,专为常驻能自动完成任务的AI助手设计。相比同类代码公开可免费使用模型,其 token 生成速度最高提升 4 倍,任务完成时间缩短 30%。该模型采用开放权重,支持用户针对性训练优化以匹配特定任务,并可在 RTX PC、DGX Spark 及 Jetson 等设备上运行

📰NVIDIA Blog(RSS) · 2026/8/11

蚂蚁百灵代码公开可免费使用 Ling-3.0-tiny,一款总参数 7.9B、推理时仅激活 1.3B 参数的原生混合推理模型,同步提供 BF16、FP8 和 INT4 三个版本

📰公众号:蚂蚁百灵(Ling) · 2026/8/11

ZCode针对GLM深度优化,今日上线Goal、Subagents、Remote Control与闲时任务四大功能。在Z.ai Code Bench测试中,GLM-5.2搭配ZCode较搭配Claude Code任务整体通过率高2.39%;ZCode缓存命中率超98%,叠加1.5倍限时额度加成后,GLM Coding Plan整体使用量接近常规额度的1.8倍

📰公众号:智谱(GLM) · 2026/8/11

本教程演示如何以 ComfyUI 为无头推理后端,构建端到端的 MiniMax-H3 视频生成工作流。通过 Python 直接构建执行图,支持文生视频、首尾帧条件生成和参考图像条件生成,并自动根据 高性能计算芯片 显存选择 quality、balanced、squeeze 三种权重配置。流水线涵盖模型自动下载、节点模式校验、音视频联合解码与进度监控,无需图形界面即可复现实验

📰MarkTechPost(RSS) · 2026/8/11

针对"动态语言比静态语言更省 AI模型 token"的流行说法,作者用 GPT-5.6 Sol 让能自动完成任务的AI助手实现 zstd 解码器进行实测。结果显示,medium 努力度下动态语言表现更好,ultra 下静态语言反而更优,且此前评测存在测试路径错误等缺陷。作者认为,琐碎任务上的性能无法推广到更大问题

📰Hacker News 热门(buzzing.cc 中文翻译) · 2026/8/11

Anthropic 正与潜在投资者接触,为可能成为史上规模最大的 IPO 做准备,计划今年 9 月或 10 月初正式上市。公司估值高达 9,650 亿美元,年化收入已超 470 亿美元,并淡化来自中国 AI 企业的竞争影响。Anthropic 还计划拓展 AI 在医疗和生物学领域的应用,但尚未公布具体 IPO 定价方案

📰IT之家(RSS) · 2026/8/11

微信基于小微推出朋友圈AI帮写与AI点评内测功能,前者可根据图片和已写文字生成3条朋友圈文案,后者可长按文字生成评价或快捷评论。作者认为这两个功能将AI置于社交核心位置,可能鼓励AI内容、破坏朋友圈自2012年确立的"记录美好生活"基调。公众号端小微还常驻首位,自动总结常看公众号文章,作者担忧这会反向影响创作者内容生产

📰公众号:数字生命卡兹克 · 2026/8/11

在线服务 估值整体承压,但每个细分赛道都跑出了 AI 龙头:CrowdStrike 以 34.4x 前瞻收入领跑安全(中位数 3.9x),Cloudflare 32.6x 对 17.5x,Shopify 11.3x 对 1.4x

📰Tomer Tunguz 博客(VC 分析) · 2026/8/11

Databricks 介绍如何让 Genie 能自动完成任务的AI助手s 同时基于结构化数据与文档运行,且不牺牲治理能力。文章探讨了构建自动化简单业务任务的能自动完成任务的AI助手虽易,但要在统一治理框架下融合两类数据源、确保安全合规地执行查询,仍需解决数据权限、血缘追踪与策略管控等关键问题

📰Databricks:Blog(RSS) · 2026/8/11

英伟达宣布与Apollo、BlackRock、Blackstone、Brookfield、Goldman Sachs和KKR合作,建立独立融资平台,动员超5000亿美元第三方资本支持AI基础设施建设

📰X:Jensen Huang (@JensenHuang) · 2026/8/11

我们最近将自动模式设为 Claude Code 的默认选项,这意味着你不再需要批准每一个操作。 但什么决定某个操作是否可以安全运行?看看它是如何工作的:

🧠X:Claude Devs (@ClaudeDevs) · 2026/8/10

AI会议记录平台tl;dv的Firestore数据库因缺乏租户隔离,任何已认证用户可查询全部18.1万段会议记录,涉及84,312名用户、35,003个域名,含23国政府及多所高校会议。处于录制状态的约1,000场会议会暴露可加入的会议ID,研究者借此闯入马来西亚教育部及美国某大学创业团队的实时通话。该漏洞自2026年1月报告后6个月仍未修复,另有超1,000段会议内容为公开状态

📰Hacker News 热门(buzzing.cc 中文翻译) · 2026/8/10

a16z 数据显示,计算机操作能自动完成任务的AI助手在 OSWorld-Verified 基准上的最佳成绩已从一年前的 42% 升至 85%,超过人类测试者约 72% 的水平,Claude Fable 5 以 85% 领先

📰a16z:News(RSS) · 2026/8/10

SGLang 与 Meta Superintelligence Labs 合作,为 30B 参数能看图、听声音、懂文字的综合能力模型 Muse Glimmer 提供 Day-0 支持,该模型拥有 128k+ token 一次能记住多少内容

📰LMSYS:Blog(Chatbot Arena 团队) · 2026/8/10

推出 Muse Glimmer,一款开放权重、300 亿参数的模型,专为本地、常驻运行的能自动完成任务的AI助手工作流优化。 与同尺寸领先模型相比,Muse Glimmer 在关键能自动完成任务的AI助手用例和标准化的能力考试中表现出色,并设计为完全在消费级硬件(如 Mac 或配备高性能 高性能计算芯片 的 PC)上运行。 秉承我们长期分享基础 AI 研究的传统,我们以宽松的 Apache 2.0 许可证发布模型权重

🦙X:AI at Meta (@AIatMeta) · 2026/8/10

1/ 今天有个重大消息:我们很快将发布 Muse Spark 1.2 的代码公开可免费使用权重版本。 同时,我们还将发布 Muse Glimmer--一个 30B 参数的能自动完成任务的AI助手模型,采用 Apache 2.0 协议代码公开可免费使用权重。Muse Glimmer 可在 24GB 显存上运行,且不损失能自动完成任务的AI助手可靠性。🧵

🦙X:Alexandr Wang(Scale AI 创始人/Meta 首席 AI 官) (@alexandr_wang) · 2026/8/10

我相信每个人都应能使用超级智能,我撰写了一篇长文,阐述 Meta 为所有人构建积极未来的理念与价值观。http://meta.com/thefutureisforeveryone

📰X:Mark Zuckerberg (@finkd) · 2026/8/10

OpenAI 发布网络安全专用模型 GPT-5.6-Cyber,可通过 Daybreak Red 获取,用于授权的漏洞研究、漏洞验证和安全测试。该模型旨在应对网络防御窗口不断收窄的挑战,为安全研究人员提供专门工具

🤖OpenAI:官网动态(RSS · 排除企业/客户案例) · 2026/8/10