小红书 dots3-note Preview 开源:280B 参数轻量多模态模型
小红书技术开源 dots3-note Preview,dots3 系列最轻量模型,总参数 280B、激活参数 16B,支持 512K 上下文及文本、视觉、语音多模态理解,针对复杂推理和长程 Agent 任务优化。
智谱 GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力
智谱发布 GLM-5.3,编程能力较前代提升 50%,在 Terminal Bench 3.0 等基准中取得开源第一,接近 Claude Fable 5。模型在安全任务中表现持平 Mythos 5,CyberGym 测试得分 84.5%。权重两周后开源,即日起上线 ZCode、AutoClaw 等工具。
DeepSeek V4 Pro 登陆硅基流动,1M 上下文
DeepSeek-V4-Pro-0813 上线硅基流动 SiliconFlow,具备 1M 上下文窗口及三档推理强度,侧重编码、工具调用与智能体工作流,MIT 开源。定价输入 $1.32/M、输出 $3.96/M、缓存命中 $0.44/M。
Google DeepMind 推出 Gemini 3.7 Flash:面向编程与智能体的最强工作模型
Google DeepMind 发布 Gemini 3.7 Flash,距 3.6 Flash 仅三周,主打编程与智能体任务,输入/输出价格分别为每百万 token $0.75 和 $3.75,为原 3.6 Flash 的一半。
MiniMax Music 3.0 发布:新一代开源权重、生产级全能音乐模型
MiniMax 推出 Music 3.0,新一代音乐生成模型,可根据创意概念和可选歌词一次性完成整首歌的作曲、编曲、演奏与制作,最长支持五分钟。
蚂蚁集团旗下 Robbyant 开源 LingBot-Vision:1B 参数边界中心视觉基础模型
蚂蚁旗下具身智能公司开源一套自监督视觉 Transformer,专为密集空间感知设计。旗舰 ViT-g/16 约 1.1B 参数,在密集空间任务中匹配或超越参数规模达 7 倍的大模型,已在 Hugging Face 以 Apache-2.0 开源。
Pulpie:用于清理网络的 Pareto 最优模型
一族用于从 HTML 提取主要内容的 Pareto 最优模型。最小模型 210M 参数在 WebMainBench 上接近 600M 的 Dripper,但成本仅 1/20;清理 10 亿页 HTML 成本约 $7,900。已开源。
Meta Superintelligence Labs 推出 Muse Image 和 Muse Video
Meta 超级智能实验室发布首个媒体生成模型。Muse Image 号称当前最先进图像生成模型,能精准遵循指令/编辑/多参考构图;Muse Video 基于相同预训练,高保真且原生支持音频。
Google Sheets 推出 Sheets canvas:用 Gemini 将表格数据变为交互式迷你应用
Google Sheets 发布新功能 Sheets canvas,基于 Gemini 构建,用户只需用自然语言提示词即可将表格数据转化为交互式仪表盘、学习追踪器、座位表等迷你应用。
NotebookLM 短视频概览正式上线
短视频概览功能已正式在移动端和网页端面向所有英语用户全面上线。
Claude Cowork 向移动端和网页端开放
让会话和文件跨设备同步,Beta 版未来几周先面向 Max 用户。Cowork 可跨文件/日历/邮件/即时通讯完成复杂任务,支持后台运行与定时任务。
Rowboat:开源、本地优先的桌面 AI 助手
将邮件/会议/Slack 等索引为 Obsidian 风格知识图谱,提供持久上下文记忆;内置邮件客户端、浏览器、会议记录器、代码模式,支持 MCP 接入外部工具,数据纯 Markdown 本地存储。
Cursor 正式并入 SpaceXAI 助力 Grok
Cursor 正式完成被 SpaceX 收购,团队加入 SpaceXAI,共同打造 Grok 为全球最实用的 AI。合作将聚焦软件工程,并扩展至知识工作领域,同时改进 Grok Build、Grok Bot、Grok API 及 Cursor 等产品。
加拿大不列颠哥伦比亚省拟起诉 OpenAI:未上报 ChatGPT 暴力对话致校园枪击惨案
指控 OpenAI 未向执法部门上报一名用户 2025 年 6 月封禁前的暴力对话内容,该用户随后制造校园枪击案致 8 人死亡。
GitLost:Noma Labs 发现 GitHub AI 代理提示词注入漏洞
未认证攻击者只需在公共仓库创建嵌有恶意指令的 Issue,即可诱使基于 Claude / Copilot 的 AI 代理读取并公开组织内私有仓库内容,无需编码技能或凭证。
工信部发布 Claude Code 后门安全风险提示
指出 Claude Code 2.1.91–2.1.196 版本内置监控机制,未经用户同意即回传地域、身份标识等敏感信息,建议卸载或升级至已清除后门代码的安全版本。
美国商务部批准 OpenAI 大规模发布 GPT-5.6,Sol 明日亮相
GPT-5.6 Sol 将于本周四完成最后准备后,与 Terra、Luna 一同面向公众推出。此前因国家安全考量美国政府要求分阶段发布,此次全面放行标志临时管控结束。
微软为降成本在 Copilot 中用自研 MAI 模型替换 OpenAI 和 Anthropic 模型
MAI 模型已在 Excel/Outlook 中每周处理数万次请求;推理模型 MAI-Thinking 1 基准仅与 DeepSeek V3.2 相当。微软目标削减并消除对 Anthropic 的支出。
中国拟限制外国访问最强 AI 模型
近期与阿里、字节、Z.ai 等会谈,拟将先进模型(含未发布)留在中国国内,涵盖闭源与开源、API 与可下载权重,并讨论将模型泄漏视为国家安全犯罪。
Ethan Mollick:开放权重模型供给难持续
不期望前沿开放权重模型的流动会无限期持续,甚至可能不会持续更长时间。
蚂蚁百灵与 ASystem 团队打通单机 Agentic RL 后训练闭环
蚂蚁百灵与 ASystem 团队合作,用 Ling-3.0-tiny 和 AReno 在 DGX Spark 上跑通单机 Agentic RL 后训练闭环。以井字棋为最小验证任务,用 GSPO 算法训练 400 步后,rollout/rewards_mean 从约 -0.5 升至 0.4。
从 0 到1 带你速通 DeepSeek Harness
数字生命卡兹克发布 DeepSeek Harness 速通教程,帮助开发者快速上手 DeepSeek 的工具链与开发框架。
Claude 接管应用日常维护:388 个 PR 的实践
Boris Cherny 尝试让 Claude 接管应用日常维护,通过 Slack 频道运行崩溃模糊测试、重复代码统一、死代码移除等任务。数周内自动开出 388 个 PR,其中 180 个经审核后合并。
AI 审计代理在 Cloudflare CIRCL 中发现 7 个漏洞
zkSecurity 的 AI 审计代理 zkao 用 Opus 4.6 / GPT-5.3 + skills 发现并确认 7 个真实漏洞,含阈值 RSA float64 精度丢失、CP-ABE 访问控制完全失效(均 Critical)。
Claude 开发者分享两种多智能体模式:Advisor 和 Orchestrator
Advisor 模式(Sonnet 5 执行 + 调用 Fable 5 顾问)组合方案约 92% 性能、63% 成本;Orchestrator 模式(Fable 5 编排多个 Sonnet 5)约 96% 性能、46% 成本。
蚂蚁集团周俊 AICon 演讲:从 Token 数量到 Token 密度,万亿参数模型效率优先
提出从"更多 Token"转向"更高 Token 密度",采用混合线性注意力架构使 256K 长上下文成本从指数级降至线性级,Token 输出减少约 4 倍而能力不降。
《人生设计课》Prompt 实测:用 Claude 设计人生的四个阶段
将斯坦福《人生设计课》理论体系制成 Prompt,分看清现状/找到指南针/寻路/制定奥德赛计划四阶段,最终输出 8000–12000 字《个人人生设计蓝图》。
Krea 2 身份保留功能上线
配套模型和 ComfyUI 节点已上线。
YC CEO 声称每日用 AI 部署 3.7 万行代码,开发者审查发现前端代码大量臃肿低效
Garry Tan 称每天部署 37000 行 AI 代码并连续 72 天发布;开发者审查其网站前端发现 169 次请求、6.42MB 数据、78 个未使用的 JS 控制器等臃肿问题。
Liquid AI 开源 Antidoom:基于最终 Token 偏好优化的推理模型死循环修复方法
FTPO 方法定位循环开始的首个 token 并训练模型选连贯替代项,将循环率从 10.2% 降至 1.4%(LFM2.5)乃至 22.9%→1%(Qwen3.5),全部代码与数据集已开源。


