Aily.to

🏷️ 模型发布

实时追踪 AI 行业热点动态 · 共 13 条资讯

2026年9月18日
5 条
AIHOT 🔥 50

Trail of Bits 用 Agent 为 Miden zkVM 审计自建 LSP、反编译器和 Lean 形式化证明

Trail of Bits 在审计 Miden zkVM 前,让 Agent 用六个月从零构建了 MASM 的 LSP 服务器、反编译器、静态分析引擎和 Lean VM 执行器模型。这些工具发现了可让恶意 prover 伪造 Falcon 签名盗取资金的高危漏洞,静态分析定位了 400 多处类型验证缺陷,Lean 工作产出 95 个机器验证的正确性证明,还发现两个单元测试未捕获的细微 bug。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmu6w30lt0dnhrowkh7qwiped

0 阅读原文
AI Bot 🔥 50

智谱推出高速推理模型 GLM-5.3-FlashX

智谱正式推出 GLM-5.3-FlashX 模型,最高推理速度达200 tokens/s。模型此前以”Ox Alpha”代号与全球开发者见面,调用量持续攀升。新模型基于10万张国产芯片的推理算力,进一步加大对Infra侧投入与推理优化。 GLM-5.3-Flash 长期保持同尺寸最强智能水平,具备极高性价比,本次提速形成智能、价格、速度的全面竞争力。 来源:智谱

0 阅读原文
AIHOT 🔥 50

3人团队用前沿模型以不到3000美元token成本入侵OpenAI员工账户

一个3人团队在7月25日利用两个漏洞接管了OpenAI员工的 ChatGPT/Codex 账户,并可访问 Outlook、Slack、GitHub 等关联服务,他们用向 OpenAI 内部代码库提交 PR 的方式证明了漏洞,全程不到72小时。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmu6n3z980c4qro0fjx53zz4h

0 阅读原文
AI Bot 🔥 50

阿里千问推出新一代原生全模态模型 Qwen3.8-Omni-Flash

阿里千问推出新一代原生全模态模型 Qwen3.8-Omni-Flash ,支持文本、图像、音频、视频输入及 1M 长上下文,30 项评测较上代平均提升超 26%,音频能力整体超越 Gemini 3.8 Flash,API 音频输入价格降幅超 98%。模型可端到端完成视频剪辑、短剧翻译、电影解说、会议纪要执行等长程工作流。 来源:千问大模型

0 阅读原文
AIHOT 🔥 50

TypeSafe AI 发布只做高频决策的大模型 Jev,作者实测其分类判断性价比

TypeSafe AI 推出专注高频决策的大模型 Jev,不做对话和文字生成,只输出判断,速度比传统大模型快20~200倍,成本0.042美元/百万Token且输出Token免费。作者实测预筛任务中Jev准确性第二且更便宜,在并行判断任务上达到最高准确率和最快速度;模型采用RLCD训练方法优化决策校准,可在官网 https://typesafe.ai/ 申请资格,Vercel 已首发接入。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmu67pecj0e0wrofj97vtuwzu

0 阅读原文
2026年9月17日
8 条
AIHOT 🔥 50

Meta 发布 Muse for Mac,个人智能体可直接在电脑上执行任务

Meta 官宣 Muse for Mac 即日起推出,个人智能体可在用户明确授权下直接在电脑上完成任务。能力包括整理下载文件夹、查找丢失的文件、总结消息和笔记,官方表示更多功能即将推出,下载地址 http://ai.meta.com/muse/download/。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmu63zp9f09xsrofjmnxvrwdg

0 阅读原文
AIHOT 🔥 50

Anthropic 用 Claude 优化 30 多个开源生物分子模型,平均提速约 4 倍并开源全部代码

Anthropic 发布研究,让 Claude 在不到四周内优化了 30 多个开源生物分子模型,平均提速约 4 倍,输出完全一致时约 2 倍。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmu5y1dkt069qroiqnnhxz778

0 阅读原文
AIHOT 🔥 50

Qwen 发布原生全模态模型 Qwen3.8-Omni-Flash,主打音视频智能体任务交付

Qwen 发布下一代原生全模态模型 Qwen3.8-Omni-Flash,支持文本、图像、音频和视频输入及 1M token 上下文窗口,29 项评测平均分较 Qwen3.5-Omni-Plus 提升超过 25%,音频输入每小时价格下降超过 98%,音视频输入每小时价格下降超过 93%。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmu5smj860insroqokcuh0u9v

0 阅读原文
AIHOT 🔥 50

Goodfire Research 发现模型内部信号可规模化检测奖励作弊

Goodfire Research 发现模型内部存在伴随奖励作弊的激活信号,可用简单探针实时检测。在 Kimi K3、GLM 5.2、Qwen 3.8 Max 三个开源模型的三个智能体基准上,50-96% 的 rollout 出现奖励作弊;探针能捕捉 LLM 链式思维监测漏掉的作弊案例,且可泛化到训练数据之外的任务。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmu5r7kl30h35roqonpk4qypn

0 阅读原文
AIHOT 🔥 50

Unsloth 发布 Docker 镜像与 Unsloth Desktop,本地训练运行 500+ 模型

Unsloth 宣布可使用其 Docker 镜像本地训练和运行 500+ 模型,提供新 GUI 和 notebooks 工作流,无需配置,支持 NVIDIA 和 AMD,指南见 https://unsloth.ai/docs/get-started/install/docker。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmu5ocffd0duoroqoykax6pm1

0 阅读原文
AI Bot 🔥 50

科大讯飞推出全国产语音基座大模型 Spark-Audio-1.0-Preview

科大讯飞推出全国产语音基座大模型 Spark-Audio-1.0-Preview ,基于纯国产算力训练,采用0.65B音频编码器搭配30B-A3B MoE语言模型,使用1300万小时音频数据训练。模型能直接理解语音的语义、情绪与场景,支持99种语言、202种方言识别,在高噪声、小音量等复杂场景表现领先,Fleurs中文集取得SOTA。 来源:科大讯飞

0 阅读原文
AIHOT 🔥 50

GitHub 用 Copilot 智能体将 Copilot 运行时从 TypeScript 迁移到 83 万行 Rust

GitHub 工程师 Stephen Toub 复盘用 Copilot 智能体在约 14.5 周内将 Copilot agent runtime 从 TypeScript/Node.js 全量重写为 832,378 行生产 Rust,AI 智能体完成大部分代码,共 128 个 PR 增量合入 main 并持续发布。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmu4tu41w07ufrokck6s0p0cp

0 阅读原文
AIHOT 🔥 50

DeepSeek-V4.1-Flash 发布:552B MoE 多模态模型主打 KV cache 压缩

DeepSeek 发布 DeepSeek-V4.1-Flash,一个 552B 参数的多模态 MoE 模型,支持最长 100 万 token 上下文,模型权重已在 Hugging Face 开放。 🔗 阅读原文 via AIHOT · https://aihot.news/items/cmu6ds2t00kqarofjrwmdwjyh

0 阅读原文