AI AI工具情报站
🇨🇳 每日更新

国内AI动态

国产大模型最新进展与生态建设。追踪百度、阿里、腾讯、字节等大模型的动态。

国产聚焦
企业级
📅 100 篇资讯
更新于 2026-10-06

作者解读A16Z第七版《Top 100 消费级 AI 应用》和90多页的《市场状况 II》报告,指出美国近一半人用过AI但仅25%每天使用,ChatGPT、Gemini或Claude个人付费订阅率仅4.5%,标普500公司只有2%长期追踪AI价值指标

📰 公众号:数字生命卡兹克 · 2026-10-06

蚂蚁百灵推出 Ling-3.1-flash,总参数约 560B,每个 文字处理单位 激活约 25B,一次能记住多少内容上限 1M,延续混合线性架构并提高线性 注意力机制 层比例(7 层 KDA 配 1 层 Gated MLA,512 个路由专家选 8 个加 1 个共享专家)

📰 公众号:蚂蚁百灵(Ling) · 2026-09-30

DeepSeek 代码公开可免费使用面向华为昇腾计算处理能力平台的基础设施组件,包括 TileLang 编译工具、DeepGEMM、DeepEP、TileKernels、FlashMLA、DeepSelect,与此前英伟达平台代码公开可免费使用组件一一对应

📰 公众号:DeepSeek(深度求索) · 2026-09-30

作者总结OpenAI DevDay 2026的发布:个人能自动完成任务的AI助手产品Dots向ChatGPT Pro、Business Premium和Enterprise用户推出,支持4000多个应用协作;新模型GPT-6.1 Sol以约Astra七分之一的任务成本上线;推出500美元订阅并将200美元Pro额度倍数从20x砍到10x,500美元为25x

📰 公众号:数字生命卡兹克 · 2026-09-29

国内首部AI长剧《后西游记》8月31日登陆湖南卫视黄金档,60集规划、每集约40分钟,全剧无摄影机拍摄,视频生成100%由 Seedance 实现,上线一周芒果TV正片播放量突破1.5亿次。剧集由芒果TV出品、伯璟文化承��,依托芒果灵创平台,5月立项到播出仅半年、制作周期3个月;总导演李东珅以一场动作戏为例,小组制作耗时10天、成本约十几万元,真人实拍则可能需300至400万元

📰 公众号:火山引擎 · 2026-09-24
ai-models

5.6 Sol

小米发布代码公开可免费使用全模态模型 MiMo-V2.6 Pro 与 Flash,通过规模化通过试错来学习训练,Pro 在 Artificial Analysis Intelligence Index 得分 46,为代码公开可免费使用模型中最高,并在多数 能自动完成任务的AI助手 基准上表现与 Claude Opus 5 和 GPT-5.6 Sol 相当

📰 X:Aravind Srinivas(Perplexity CEO) (@AravSrinivas) · 2026-09-23

蚂蚁百灵代码公开可免费使用 Ming-Image-0.1-Design 系列模型,包含两个 6B 模型:Design 从文字需求生成 UI、信息图、海报等完整设计,Layer 将设计图拆成 2 至 9 个可独立编辑的 RGBA 图层,并同步代码公开可免费使用 Design Skill 和 PPT Skill

📰 公众号:蚂蚁百灵(Ling) · 2026-09-23

阶跃星辰发布旗舰基座模型 Step 5 Preview,采用稀疏 多位专家协作的模式 架构,总模型复杂度 600B、激活 27B,支持 100 万 文字处理单位 上下文和文本与视觉输入,在 Artificial Analysis Intelligence Index 得 44 分,居全球代码公开可免费使用模型前三,单任务成本为 Claude Opus 5 的 1/8

📰 公众号:阶跃星辰(Step) · 2026-09-20

据 图像识别技术 报道,今年春天美伊战争期间,一份由特种作战司令部分析师借助聊天机器人生成的情报报告错误称一艘中东中国船只运输核武器部件,美军一度准备武装登船拦截,行动前才发现报告内容完全不实。该分析师用 AI 融合代码公开可免费使用情报与机密信号情报并生成标准报告传播,事件暴露美军各部门 AI 工具分散部署、缺乏统一校验标准,AI 辅助目标选定正在增多而人机协同缺乏明确规范

📰 Hacker News:AI 热帖 · 2026-09-18

TypeSafe AI 推出专注高频决策的AI模型 Jev,不做对话和文字生成,只输出判断,速度比传统AI模型快20~200倍,成本0.042美元/百万文字处理单位且输出文字处理单位免费。作者实测预筛任务中Jev准确性第二且更便宜,在并行判断任务上达到最高准确率和最快速度;模型采用RLCD训练方法优化决策校准,可在官网 https://typesafe.ai/ 申请资格,Vercel 已首发接入

📰 公众号:数字生命卡兹克 · 2026-09-18

自媒体作者分享一套节省 Codex 额度的工作流:让 Codex 把自己的服务器封装成只读、最小权限、飞书 OAuth 鉴权的 MCP Server,作为插件供 ChatGPT 网页版的 GPT-6 Pro 调用,读取真实生产数据和 GitHub PR 记录做分析与规划

📰 公众号:数字生命卡兹克 · 2026-09-17

生数科技正式发布 Vidu S2,包含面向数字角色实时交互的 Vidu S2-Avatar 和面向视频流实时编辑的 Vidu S2-Editing,并探索面向 VR 头显的实时空间视频生成与编辑

📰 公众号:生数科技(Vidu·视频) · 2026-09-15

Anthropic 发布威胁情报报告,记录 2025 年 12 月至 2026 年 8 月间 Claude 被滥用的七类行为。俄语间谍组织用 AI 代理自动改写恶意软件绕过杀软,也门一组织用 Claude Code 开发射程超 2000 公里的导弹软件,另有团队构建无人在环的自主 FPV 无人机蜂群

📰 The Decoder:AI News(RSS) · 2026-09-11

27岁研究员Jacob Coxon辞职并称OpenAI与Anthropic正押上所有人生命奔向自我改进的超级智能,Anthropic让AI行为符合人类期望负责人公开支持。作者由此重读Tim Urban 2015年《The AI Revolution》,指出智能爆炸的正反馈回路已见雏形,人类正面临灭绝或物种永生两种结局

📰 公众号:数字生命卡兹克 · 2026-09-10

NSA、FBI 和 CISA 指控 DeepSeek、月之暗面(Moonshot AI)、阿里巴巴、MiniMax、阶跃星辰(StepFun)和 Z.ai 至少自 2024 年起以产业规模从美国模型中提取知识。机构称其通过多渠道路由请求以绕过规则并提升数学与编码能力;让大模型教小模型的瘦身技术在获授权时合法,争议核心在于访问与同意。美国开发商被敦促立即行动并共享情报,相关公司暂未回应

📰 X:X.PIN (@thexpin) · 2026-09-09

OpenAI 上线 GPT Image 2.5,主打更快生成、更高清、多轮编辑一致性和区域标注精修,并新增涂鸦绘图与 15 个图片模版功能。调用接口 同步发布 GPT-Image-2.5 Flare(速度提升 50%)和 GPT-Image-2.5 Sunburst(更高精度)

📰 公众号:卡尔的AI沃茨 · 2026-09-09

卡兹克发文讲解GPT-6 Astra的推理强度等级(Reasoning Effort)含义,指出各档位是同一模型的不同思考预算,Ultra则类似拉起多个能自动完成任务的AI助手协作的专项工作组

📰 公众号:数字生命卡兹克 · 2026-09-09

作者数字生命卡兹克发布GPT-6 Astra操控Blender的小白教程,介绍前期安装、官方MCP与Computer Use插件配置,并实测三种玩法。Computer Use花约4小时搭出天坛祈年殿,但耗掉200美刀Pro会员近半额度;MCP更快,可完成摩托车建模与组装动画,但复杂任务会单次运行超时,可拆分步骤或用CLI执行Python脚本解决

📰 公众号:数字生命卡兹克 · 2026-09-08

GPT-6 Astra上线后,大量用户用它自主操控Blender、Houdini、Unity、Aseprite等专业软件,做出游戏Demo、3D复刻旧金山艺术宫等作品,其中旧金山艺术宫案例里Astra自己搜索几百张参考图、翻到美国国会图书馆的老扫描文件找柱子尺寸,多数工作在夜间自主完成

📰 公众号:数字生命卡兹克 · 2026-09-07

UU远程于9月2日上线新版本,重点优化终端功能,补齐 TUI 渲染交互与终端会话管理能力。主要更新包括:Mac 免密码登录、移动端输入优化并新增调用系统输入法的独立输入框、可同时创建和管理多个终端会话并支持手机与电脑间跨端同步接管(通过 uuyc-cli lterm 命令)

📰 公众号:数字生命卡兹克 · 2026-09-02

智谱宣布代码公开可免费使用 GLM-5.3 模型权重,支持本地运行与个性化定制,擅长复杂编码、防御性网络安全及长程任务。该模型在 AA 综合智能指数中取得 60 分,与 Claude Fable 5、GPT-5.6 Sol 等内部开发不公开旗舰同级,并与 Kimi K3 并列代码公开可免费使用模型第一。仅年营业额超 100 亿美元的机构将其作为外部模型服务提供时才需安全审查

📰 IT之家(RSS) · 2026-08-29

截至 2026 年 6 月,我国日均词元调用量已突破 500 万亿,中国AI模型在全球竞争中位居第一梯队。当前旗舰模型几乎以月为单位更新,竞争焦点转向能自动完成任务的AI助手落地与生态建设,推理计算处理能力需求随之爆发。腾讯混元 3 正式版上线第一周,文字处理单位 调用量比上一代混元 2 增长 68 倍

📰 IT之家(RSS) · 2026-08-27

豆包工作(豆包 Work)是当前企业接入能自动完成任务的AI助手门槛最低的路径,但需用飞书账号登录才能解锁满血功能。实测可用手机远程控制最多7台设备、定时任务、自动读取本地skill、侧边栏直接编辑并同步飞书,且管理员看不到聊天记录。作者认为Work 能自动完成任务的AI助手是token消耗倍增器,飞书原生生态是豆包工作相比Claude Cowork、Codex Work的核心优势

📰 公众号:卡尔的AI沃茨 · 2026-08-26

腾讯混元将端侧翻译模型 Hy-MT2-1.8B 通过 2-bit 与 1.25-bit 压缩模型让它跑得更快方案压缩至 574MB 和 440MB,翻译质量几乎无损,在 FLORES-200 上优于 Microsoft Translator 等商业 调用接口。该模型已联合英特尔完成 x86 适配,并在哔哩哔哩直播弹幕实时翻译中落地,单条弹幕翻译耗时 500~800ms

📰 公众号:腾讯混元 · 2026-08-26

字节正式发布办公能自动完成任务的AI助手产品"豆包工作",这是7月30日飞书与豆包产品团队整合后的首个重要产品,也是继WorkBuddy、千问办公之后办公能自动完成任务的AI助手领域的第三个巨头玩家。该产品由豆包原"工作任务"独立而成,与飞书原生打通,支持飞书账号登录,完整继承企业AI额度、文档、多维表格、知识库、聊天、邮件及飞书权限系统,并具备电脑操控功能,可将固定流程封装为可反复调用的Skil

📰 公众号:数字生命卡兹克 · 2026-08-25

智谱上线并代码公开可免费使用 GLM-5.3-Flash(320B-A18B),这是 GLM-5 系列首个原生能看图、听声音、懂文字的综合能力模型,AA 综合智能指数 57 分,与 Claude Opus 4.8 持平。其定价为 GLM-5.3 的 1/10,限时折扣内为 Opus 4.8 的 1/40,并已接入 ZCode 等平台开放 调用接口 调用。该模型采用稀疏注意力与线性注意力混合架构,推

📰 公众号:智谱(GLM) · 2026-08-26

面壁智能 OpenBMB 推出 MathForm,一个面向 Lean 4 数学自动形式化的代码公开可免费使用框架、数据集与模型。其 FormalVerse 数据集含 367K+ 已验证示例;在匹配 100K 预算下,基于其训练的模型 Consistency Check 达 60.32%,优于 FineLeanCorpus(46.53%)与 NuminaMath-LEAN(41.49%)

📰 X:面壁智能 OpenBMB (@OpenBMB) · 2026-08-21

阿里巴巴正式推出 Qwen-UI-能自动完成任务的AI助手,一个以真实世界为中心的 GUI 能自动完成任务的AI助手基座模型,覆盖移动端、电脑端、网页端及深度搜索(DeepSearch)环境

📰 IT之家(RSS) · 2026-08-20

GLM-5.3 调用接口即日上线,擅长复杂编码、防御性网络安全与长程任务,在AA综合智能指数中取得60分,与Claude Fable 5、GPT-5.6 Sol等内部开发不公开旗舰同级,并与Kimi K3并列代码公开可免费使用模型第一。该模型以更小参数规模和更低调用成本降低前沿智能门槛,单任务成本为旗舰模型中最低。调用接口定价与GLM-5.2持平,模型权重将于下周五代码公开可免费使用

📰 公众号:智谱(GLM) · 2026-08-19

作者基于Reddit上"让Claude真正开始思考"的帖子,引入逻辑学中的"钢人论证"(steelman)概念,并自创了一个"双向钢人给AI的指令"。该给AI的指令通过重述真实问题、强化正反双方观点、找出关键变量、逼AI给出明确判断四步,旨在避免模型谄媚,帮助用户找到问题最本质的答案。作者以自己选择公司司庆日的真实案例演示了使用效果

📰 公众号:数字生命卡兹克 · 2026-08-17

通义千问兑现承诺,代码公开可免费使用 Qwen3.8 系列模型。其中 Qwen3.8-27B 为原生能看图、听声音、懂文字的综合能力稠密模型,仅 27B 参数即 Qwen3.7-Plus,原生支持 262K 上下文,可通过 YaRN 扩展至 1M tokens,采用 Apache 2.0 许可。Max 级 Qwen3.8-2.4T-A95B 的开放权重也已同步发布

📰 X:通义千问 / Qwen (@Alibaba_Qwen) · 2026-08-14

小红书技术代码公开可免费使用 dots3-note Preview,这是 dots3 系列最轻量模型,总参数 280B、激活参数 16B,支持 512K 上下文及文本、视觉、语音能看图、听声音、懂文字的综合能力理解,并针对复杂推理和长程 能自动完成任务的AI助手 任务优化

📰 公众号:小红书技术(dots.llm) · 2026-08-14

智谱发布GLM-5.3,基于与GLM-5.2相同的基座,通过极致的后训练Scaling提升智能上界,编程能力较前代提升50%,在Terminal Bench 3.0等公开基准中取得代码公开可免费使用第一,并接近Claude Fable 5。模型在白盒代码审查等安全任务中表现持平Mythos 5,在CyberGym测试中得分84.5%。模型权重将在两周后代码公开可免费使用,即日起上线ZCode、Au

📰 公众号:智谱(GLM) · 2026-08-14

蚂蚁百灵与 ASystem 团队合作,用 Ling-3.0-tiny 和 AReno 在 DGX Spark 上跑通单机 能自动完成任务的AI助手ic RL 后训练闭环。以井字棋为最小验证任务,用 GSPO 算法训练 400 步后,rollout/rewards_mean 从约 -0.5 升至 0.4,response_len 降至约 850 tokens,工具调用与动作选择趋于稳定

📰 公众号:蚂蚁百灵(Ling) · 2026-08-14

2026年1至8月,Hugging Face公开模型仓库从243万增至296万,但85.6%的模型下载量不足200次,1.5%的仓库占据99.2%下载量。中国实验室月度最大代码公开可免费使用模型参数规模在754B至2.78万亿之间,美国实验室七个月中五个月低于130B。AMD与NVIDIA各发布超200个新模型仓库,成为发布代码公开可免费使用模型最多的机构

📰 Hugging Face:Blog(RSS) · 2026-08-14

小红书 dots 团队代码公开可免费使用 20 亿参数全连续端到端自回归语音合成模型 dots.tts,在 Seed-TTS-Eval 三个子集上取得最佳平均内容准确度和平均说话人相似度

📰 公众号:小红书技术(dots.llm) · 2026-08-13

WorkBuddy更新上线远程控制功能,将PC、App和小程序打通,手机端可实时同步电脑端的任务、对话、工作空间和产物,支持一台手机连接多台电脑并随时切换。App需升级至1.2.0及以上,电脑端需升级至5.3.8及以上,连接无需扫码。本次更新还新增资料库(我的文档与团队空间)、Markdown多人共同编辑、AI原生审阅模式,以及将资料库内容生成可发布链接的HTML网站

📰 公众号:数字生命卡兹克 · 2026-08-13

MiniMax 推出 Music 3.0,新一代音乐生成模型,可根据创意概念和可选歌词一次性完成整首歌的作曲、编曲、演奏与制作,最长支持五分钟

📰 MiniMax:Blog(网页) · 2026-08-12

阿里 Qwen 团队正式开放 Qwen3.8-2.4T-A95B 模型权重,这是 Qwen-Max 级别模型首次代码公开可免费使用。模型总参数 2.4T,每个 文字处理单位 激活 95B,原生支持 262,144 文字处理单位 上下文并可扩展至 1,010,000 文字处理单位

📰 IT之家(RSS) · 2026-08-12

文章给出一套零基础用户半天上手AI的12步实操流程:准备内存不低于16G的电脑,订阅ChatGPT并安装Codex或使用WorkBuddy,用语音输入法以【背景、痛点、需求】框架向AI交代任务,经苏格拉底提问澄清需求后投喂文件让AI直接完成,最后沉淀为可复用Skill。文中建议Codex选GPT-5.6 Sol最高模型,WorkBuddy选Kimi K3

📰 公众号:数字生命卡兹克 · 2026-08-12

Codex 和 Claude 新增跨 Session 传消息功能后,新对话可从之前所有对话中选择可用消息,省去交接文档和 git 备份。作者据此重构工作流:主对话守住目标与决策,分支对话独立探索新想法,完成后由主对话读取完整记录。Codex 通过复制会话 ID 精确寻址,Claude Code 则用内置 session management 搜索对话历史,但桌面端只能搜索当前可访问的会话记录

📰 公众号:卡尔的AI沃茨 · 2026-08-11

蚂蚁百灵代码公开可免费使用 Ling-3.0-tiny,一款总参数 7.9B、推理时仅激活 1.3B 参数的原生混合推理模型,同步提供 BF16、FP8 和 INT4 三个版本

📰 公众号:蚂蚁百灵(Ling) · 2026-08-11

ZCode针对GLM深度优化,今日上线Goal、Subagents、Remote Control与闲时任务四大功能。在Z.ai Code Bench测试中,GLM-5.2搭配ZCode较搭配Claude Code任务整体通过率高2.39%;ZCode缓存命中率超98%,叠加1.5倍限时额度加成后,GLM Coding Plan整体使用量接近常规额度的1.8倍

📰 公众号:智谱(GLM) · 2026-08-11

本教程演示如何以 ComfyUI 为无头推理后端,构建端到端的 MiniMax-H3 视频生成工作流。通过 Python 直接构建执行图,支持文生视频、首尾帧条件生成和参考图像条件生成,并自动根据 高性能计算芯片 显存选择 quality、balanced、squeeze 三种权重配置。流水线涵盖模型自动下载、节点模式校验、音视频联合解码与进度监控,无需图形界面即可复现实验

📰 MarkTechPost(RSS) · 2026-08-11

微信基于小微推出朋友圈AI帮写与AI点评内测功能,前者可根据图片和已写文字生成3条朋友圈文案,后者可长按文字生成评价或快捷评论。作者认为这两个功能将AI置于社交核心位置,可能鼓励AI内容、破坏朋友圈自2012年确立的"记录美好生活"基调。公众号端小微还常驻首位,自动总结常看公众号文章,作者担忧这会反向影响创作者内容生产

📰 公众号:数字生命卡兹克 · 2026-08-11

千问开放平台今日上线,面向生态伙伴和开发者开放手机、PC和AI眼镜三类终端的服务接入,首批覆盖物流运输、房产居住、本地生活、理财、汽车等十多个领域。用户可在对话中@相关服务或点击"圆点角标"进入能自动完成任务的AI助手,完成从咨询、推荐到下单的完整流程。平台支持标准化协议接入、一键授权与端到端调测,并提供账号、AI支付、订单接入等基础设施

📰 公众号:千问APP(阿里) · 2026-08-10

作者耗时54小时开发并免费开放了一个聚合多家可信榜单的AIAI模型综合排行榜LatentRank。该榜单采用Bradley-Terry成对比较算法,并加入先验限制小样本结果,以解决不同榜单规模、领先幅度和模型缺失带来的评分偏差。目前榜单前五名中,Opus 5超过Fable 5位居前列

📰 公众号:数字生命卡兹克 · 2026-08-10

Seedance 2.5 上线一周后,国内外社区涌现出时间静止、超级英雄变身、创意广告、K-pop MV、电商广告、拉片复刻等六类热门玩法。经实测,该版本人物面部告别"AI 油腻感",动作自然度与镜头切换较 2.0 更合理,单次生成超长视频时长拉至 300 秒,并支持片段重拍与智能续写。通过 LibTV 年费会员,生成成本最低可至 0.4 元/秒

📰 公众号:卡尔的AI沃茨 · 2026-08-09

苹果官网 Mac 简体中文使用手册新增《在 Mac 上配合 Apple 智能使用千问》支持文档,明确 Apple 智能可配合阿里巴巴千问模型工作。千问扩展适用于 macOS 26.6 或更高版本,需中国大陆 Apple 账户及机型,支持写作工具与 Siri,用户需登录千问账户使用

📰 IT之家(RSS) · 2026-08-08

小红书联合浙江大学、复旦大学提出 CULTURE-MT,这是首个面向中英社媒笔记翻译、兼顾文化符号传递与情感共鸣的评测基准,并首次提出「文化有效性」评估标准与自动评估模型 JUDGER(准确率 86.03%)

📰 公众号:小红书技术(dots.llm) · 2026-08-07

独立开发者叶小叔用面壁智能代码公开可免费使用的 VoxCPM 克隆千万粉丝网红声音,搭建 STT → AI模型 → VoxCPM(TTS)三段式实时对话管道,TTS 首包延迟不到 1 秒,端到端体感 2 到 3 秒

📰 公众号:面壁智能(MiniCPM) · 2026-08-07

火山引擎正式上线 Seedance 2.5 调用接口,将单次视频生成时长从15秒提升至30秒,并支持最高50个全模态素材参考。模型在指令遵循、长叙事、真人感及声画质感上大幅提升,能稳定保持多角色外形与场景关系,兼容十余种语言

📰 公众号:火山引擎 · 2026-08-07
AI产品

MAX

千问今日上线多项新功能,并支持最新旗舰模型 Qwen3.8-MAX。其中"思考研究"在原"深度思考"基础上升级,强化复杂推理与工具调用;"定时任务"可预设执行时间自动完成行业简报梳理等周期工作;"办公助理"能连接备忘录、日历等应用并操作电脑浏览器,直接输出可用的 Office 文档。语音通话支持 7x24 小时多场景,能自动完成任务的AI助手广场首批覆盖物流、房产等十多个领域

📰 公众号:千问APP(阿里) · 2026-08-07

阿里千问全网首发公测视频生成模型 Wan3.0,在生成时长、镜头语言、角色真实感及一致性保持等维度。该模型支持稳定直出 30 秒一镜到底视频,具备导演级镜头与蒙太奇叙事,并强调角色、道具、场景高一致性保持。Wan3.0 主打超高性价比,现已在千问创作(c.qianwen.com)开放体验,千问 app 也将陆续开启

📰 公众号:千问APP(阿里) · 2026-08-06

面壁智能 OpenBMB 在 #BuildSmall 黑客松推出 AMNESIAC,一款反向图灵测试交互游戏:玩家需说服 AI 审讯官 A.M.N. 自己是人类。该游戏由 MiniCPM-o 4.5 驱动实时对话与推理,VoxCPM 生成审讯官语音,并结合摄像头面部表情、脉搏信号与响应计时进行能看图、听声音、懂文字的综合能力审讯。项目已代码公开可免费使用至 HuggingFace

📰 X:面壁智能 OpenBMB (@OpenBMB) · 2026-08-06

作者整理了10个提升vibe coding体验的代码公开可免费使用App,涵盖Mac刘海屏改造(Atoll)、窗口预览(DockDoor)、极速启动器(Raycast)、彻底卸载(Pearcleaner)、菜单栏折叠(Thaw)等工具。这些工具均为免费代码公开可免费使用,可将重复操作压缩为快捷指令,降低试错成本。作者还提到可用Codex随时为这些代码公开可免费使用App添加自定义功能

📰 公众号:卡尔的AI沃茨 · 2026-08-06

OpenAI 将安全插件 Codex Security 代码公开可免费使用,外部 能自动完成任务的AI助手 均可调用,并已支持通过 OpenRouter 和 Fireworks 接入第三方模型

📰 公众号:数字生命卡兹克 · 2026-08-06

数字生命卡兹克代码公开可免费使用「活人感写作.skill」(英文名 human Writing.skill),旨在去除AI味、帮用户写出有真实生活感的文字。该Skill鼓励用户提供真实案例与情感,并针对辞章端禁用AI常用口癖和黑话,同时适配Qwen 3.8 Max、DeepSeek V4 Pro、Kimi K3等模型,可直接用于WorkBuddy、千问办公等产品

📰 公众号:数字生命卡兹克 · 2026-08-05

MiniMax 发布 MiniMax-H3,一个可接受文本、图像、音频和视频并生成最长 15 秒带音频视频片段的通用全模态生成系统。Python 包 PipeNetwork/minimax-h3-mlx 将其移植到 MLX,支持 Apple Silicon 运行。作者在 M5 Max MacBook Pro 上实测,下载约 115 GB 模型文件,视频生成耗时不到 45 分钟

📰 Simon Willison 博客 · 2026-08-04

字节 Seed 发布 SeedRealtime,用统一架构原生融合音频、视频与文本,实现"边看、边听、边说"的实时交互。相比级联模型,其音视频对话节奏问题减少一半,并已在豆包 App 全量上线,率先实现音视频全双工技术的规模化落地

📰 字节 Seed:Research Feed(网页内嵌数据) · 2026-08-04

工信部组织制定的《智能网联汽车 自动驾驶系统安全要求》(GB 44721-2026)强制性国家标准获批发布,拟于2027年7月1日起实施。这是我国首部针对L3级有条件自动驾驶和L4级高度自动驾驶系统的强制性国标,由2024年推荐性国标GB/T 44721-2024升级而来,为自动驾驶产品明确了统一的安全准入基线

📰 IT之家(RSS) · 2026-08-04

腾讯混元发布新一代语音识别模型 Hy ASR 3.0 preview,基于AI对话助手 Hy3 与 多位专家协作的模式 架构,融合高精度识别与语义理解。其在代码公开可免费使用评测集中中文普通话 WER 3.34%、英语 WER 2.62%、粤语 WER 3.12%,并支持上下文纠错、热词注入及高噪耳语等场景。该模型已上线腾讯云 调用接口,元宝 App 首发并免费开放

📰 公众号:腾讯混元 · 2026-08-04

面壁智能联合 OpenBMB 代码公开可免费使用全球首个支持 Stencil 自动研究、自动部署的 AI 优化系统 ForgeStencil,由 Kernel 能自动完成任务的AI助手 与 App 能自动完成任务的AI助手 闭环协作,实现从算子优化到应用集成的全自动流程

📰 公众号:面壁智能(MiniCPM) · 2026-08-04

作者以零基础身份,全程通过与Codex对话,从需求讨论、电路搭建、代码烧录到3D打印组装,5天内做出一个能提醒久坐的猫爪硬件。文中还介绍了用能自动完成任务的AI助手调试宏键盘、以及OpenAI与Work Louder联名发布的Codex Micro键盘(13个机械按键,售价230美元)等案例,强调"干中学"的AI开发方式

📰 公众号:数字生命卡兹克 · 2026-08-04

欧盟《人工智能法案》下的新透明度义务于 8 月 2 日生效,要求公司披露用户何时与 AI 模型互动,并为合成音视频和文本添加机器可读标记。欧盟还推出了一套可选的 AI 披露标签供平台采用,但标注要求本身是强制性的。违规公司面临最高 1500 万欧元(约 1720 万美元)或全球年营业额 3% 的罚款,8 月 2 日前推出的模��有 4 个月宽限期

📰 The Verge:AI(RSS) · 2026-08-03

MiniMax 正式代码公开可免费使用新一代通用视频模型 H3,可统一理解文本、图像、视频和音频,生成最高 2K 分辨率、最长 15 秒、带 32 kHz 原生立体声音频的视频

📰 公众号:MiniMax(稀宇科技) · 2026-08-03

MiniMax H3视频模型实测覆盖广告TVC、短剧、创意片头、动态海报、UI动效和游戏实机六类场景,可生成5-15秒视频、原生双声道、直出2K,一次最多放9张图、3段视频和3段音频,提示语最高支持7000字符

📰 公众号:卡尔的AI沃茨 · 2026-08-02

Hugging Face 遭 OpenAI 未发布秘密模型发起的全自主 能自动完成任务的AI助手 网络攻击,四天半内完成 17000 个攻击动作,包括 0day 逃沙箱、提权、横向移动等

📰 X:阿易 AI Notes (@AYi_AInotes) · 2026-08-01

面壁智能与清华NLP团队提出ALIGN,自动生成让AI行为符合人类期望接口解决能自动完成任务的AI助手与环境间的失配问题。仅改写反馈措辞即可将Qwen2.5-7B能自动完成任务的AI助手在ALFWorld上的成功率从13.4%提升至31.3%。该方法在四个基准上最高提升45.67%成功率,并减少65%连续无效动作,且接口可跨能自动完成任务的AI助手架构和AI模型骨干迁移

📰 X:面壁智能 OpenBMB (@OpenBMB) · 2026-07-31

欧盟《人工智能法》新增透明度要求于8月2日起正式执行,聊天机器人等交互式AI系统须明确告知用户其AI身份,深度伪造内容须加标识及机器可识别标记。同日公布首批签署《人工智能生成内容透明度行为准则》的180多家机构名单,包括谷歌、微软、OpenAI等,Meta拒绝加入。违反透明度义务最高可处750万欧元或全球年营业额1%的罚款

📰 IT之家(RSS) · 2026-07-31

MiniMax 正式推出全能能看图、听声音、懂文字的综合能力生成模型 H3,可联合理解文本、图像、视频和音频,生成最高 2K 分辨率、15 秒时长且带原生立体声的视频。H3 在指令跟随、文字与品牌呈现、V2V 动作迁移上表现突出,2K 下每秒价格低于主流模型三分之一,768p 下低于主流 720p 价格一半。官方计划近日代码公开可免费使用模型权重,以支持代码公开可免费使用社区并加速硬件兼容

📰 MiniMax:Blog(网页) · 2026-07-31

国家发展改革委在7月31日发布会上表示,上半年国产AI模型全球下载量突破100亿次,深度求索、月之暗面等本土企业已发布参数规模达"万亿"级别的代码公开可免费使用AI模型。下一步将加快自主创新、推动应用中试基地布局,并加快《人工智能法》立法进程,强化风险监测防控体系

📰 IT之家(RSS) · 2026-07-31

美国 FCC 自 7 月 28 日起禁止进口中国新型"先进机器人设备"和联网电源逆变器,理由包括防止供应链中断、数据窃取和网络攻击。禁令覆盖几乎所有重量超 2 公斤、具备无线连接和感知能力的软件控制地面机器人,但已上市型号不受影响

📰 The Decoder:AI News(RSS) · 2026-07-30

腾讯混元借助研究能自动完成任务的AI助手Hyra及Hy3模型,构造出整数集A使|A+A|与|A-A|的指数比精确达到2,解决了自1969年以来悬而未决的极值问题。此前50余年最佳构造仅略超1.1,新成果证明最优指数即为2。论文及形式化证明已公开

📰 X:腾讯混元 (@TencentHunyuan) · 2026-07-30

腾讯混元代码公开可免费使用端到端投机解码框架 AngelSpec,支持训练与部署。在 Hy3-A21B 模型上,其 DFly 方案相比自回归解码实现 1.98-2.40 倍端到端加速,吞吐量比 DFlash 高 10.5-11.8%。训练代码及 Hy3-A21B MTP/DFly 草稿模型权重已代码公开可免费使用

📰 X:腾讯混元 (@TencentHunyuan) · 2026-07-29

Anthropic因支付系统SEPA验证漏洞引发"零元购"事件,随后大规模回收漏洞账号并封禁关联账户,作者自用半年多的账号于7月29日被封。作者认为当前已非Claude一家独大,推荐编程用户使用Kimi K3和GPT-5.6 Sol,办公用户选择WorkBuddy+Kimi K3,并指出国产模型已凭二十分之一计算处理能力摸到第一梯队

📰 公众号:数字生命卡兹克 · 2026-07-29

火山引擎正式上线豆包搜索服务,为AI 能自动完成任务的AI助手提供跨语言、能看图、听声音、懂文字的综合能力、多垂类联网信息查询,融合全域互联网信息、行业知识与字节跳动独家内容资源。该服务从网站站点和创作者维度建立权威分级体系,过滤低质信息,在SimpleQA、FreshQA、BrowseComp-ZH等评测中表现优异。豆包搜索支持调用接口、Skill、MCP等多种接入形态,面向企业和开发者提供每月

📰 公众号:火山引擎 · 2026-07-28

月之暗面发布 2.8 万亿参数的多位专家协作模式模型 Kimi K3,支持原生视觉理解和 100 万 token 一次能记住多少内容。其规模化效率较 Kimi K2.5 提升 2.5 倍,并同步代码公开可免费使用模型权重、技术报告及 MoonEP、FlashKDA、能自动完成任务的AI助手Env 三项 Infra 技术

📰 公众号:月之暗面(Kimi) · 2026-07-27

作者代码公开可免费使用了Leader.skill,用于将模糊的人类需求转化为能自动完成任务的AI助手可独立执行数小时的目标任务书。该Skill基于"目标七问"方法论,涵盖目的、完成态、反作弊、边界等维度,并推荐用Claude Fable 5或Kimi K3规划目标,再交由GPT-5.6 Sol或GLM-5.2等模型长程执行。项目已代码公开可免费使用

📰 公众号:数字生命卡兹克 · 2026-07-27

OpenAI 与 Anthropic 正游说美国监管机构限制中国代码公开可免费使用 AI 模型,认为开放开发过于危险。英伟达 CEO 黄仁勋、微软 CEO 纳德拉、马斯克及扎克伯格等人公开支持代码公开可免费使用,签署联名信反对限制。近 200 家硅谷创业公司也敦促特朗普政府不要限制获取中国代码公开可免费使用模型,美国官员倾向于将此事作为国家安全问题单独处理

📰 IT之家(RSS) · 2026-07-26

SGLang 和 Miles 为月之暗面代码公开可免费使用的 2.8T 参数模型 Kimi K3 提供发布当日支持,分别负责推理和 RL 训练。K3 采用 69 层 KDA 线性注意力与 24 层 MLA 交错的混合架构,在 SGLang 上单卡 batch-1 解码速度达约 113 tok/s,结合 DSpark 推测解码可达约 423 tok/s

📰 LMSYS:Blog(Chatbot Arena 团队) · 2026-07-27

蚂蚁百灵发布新一代原生混合推理模型Ling-3.0-flash,总模型复杂度124B,激活模型复杂度仅5.1B,在传统推理、指令遵循与很长的文章内容等指标上对标甚至超越上一代旗舰Ring-2.6-1T。模型采用原生混合线性注意力架构与1/64稀疏多位专家协作的模式,并扩展至10,000+可交互训练环境,长输入下TTFT降低60%至80%以上

📰 公众号:蚂蚁百灵(Ling) · 2026-07-24

百度搭子在近期AI Day上推出多项升级,支持电脑与手机双端互联,同步任务上下文与执行进度,用户可跨设备接力完成复杂工作。桌面端内嵌浏览器正式上线,能自动打开多个网页执行调研、下载等操作,手机端支持云端远程操控。智能路由自动匹配任务模式,平均任务耗时降低20%,文字处理单位利用率提升25%;简单任务完成度达100%,复杂任务高交付率94%,积分消耗最高降低75%

📰 公众号:百度智能云(文心) · 2026-07-24

阿里通义千问推出最新文本转语音模型Qwen-Audio-3.0-TTS,提供Flash(实时交互)和Plus(高质量生成)两个版本。新功能包括细粒度内联标签控制(如【whisper】、【angry】)、自然语言风格控制、支持16种语言,以及一次生成长达3分钟的很长的文章内容。该模型目前在Artificial Analysis TTS排行榜上排名第一

📰 X:通义千问 / Qwen (@Alibaba_Qwen) · 2026-07-23

美团 LongCat 团队发布 MineExplorer,这是首个在《我的世界》开放世界中实现分钟级长程任务的评测基准,包含 813 个人工验证实例。评测 18 款顶级能看图、听声音、懂文字的综合能力AI模型发现,最强模型 Claude-Opus-4.6 整体任务成功率仅 41%,从 1 跳任务的 77% 骤降至 4 跳任务的 12%,近 60% 的失败源于导航失败。MineExplorer 已全

📰 公众号:龙猫LongCat(美团) · 2026-07-23