全部
模型
产品
行业动态
论文研究
技巧与观点
模型发布/更新
IT之家(RSS) · 6 天前
阿里巴巴正式推出 Qwen-UI-Agent,一个以真实世界为中心的 GUI 智能体基座模型,覆盖移动端、电脑端、网页端及深度搜索(DeepSearch)环境。
Hugging Face:Blog(RSS) · 08/19 21:48
Liquid AI 发布基于量化感知蒸馏(QAD)训练的 LFM2.5-230M、350M、1.2B-Instruct 和 2.6B 四款 Q4_0 GGUF 检查点,在保持原生 Q4_0 内存与速度的同时,恢复 BF16 平均精度损失的 97%。
产品发布/更新
Google Cloud:Databases(RSS) · 6 天前
AlloyDB 的 ScaNN 索引现已支持超过 100 亿向量的规模,通过全新的四层树架构(预览版)实现,将查询复杂度从 O(N^1/2) 降至 O(N^1/4)。内部测试中,该架构在 100 亿向量规模下可实现 p95 延迟不超过 51 毫秒、召回率达 95%。该功能可通过快速入门指南部署,新用户可享受 30 天免费试用。
X:Sky Computing Lab (@haoailab) · 6 天前
一段 5 秒 480P 视频,完全在 Mac 上生成,耗时 30 秒。无需 CUDA,无需云端,仅占用 3.9 GiB 内存。
FastMetal 将 FastWan-QAD 系列带到 Apple Silicon。DiT、DMD 采样器和解码器均通过 MLX 在 Metal 上运行,默认 INT8。
三个模型:1.3B 支持 480P,5B 支持 720P,14B 追求画质。
📷 博客:http://haoailab.com/blogs/fastmetal 📷 代码:http://github.com/hao-ai-lab/FastVideo 📷 模型:http://huggingface.co/collections/FastVideo/fastmetal
公众号:智谱(GLM) · 08/19 09:03
GLM-5.3 API即日上线,擅长复杂编码、防御性网络安全与长程任务,在AA综合智能指数中取得60分,与Claude Fable 5、GPT-5.6 Sol等闭源旗舰同级,并与Kimi K3并列开源模型第一。该模型以更小参数规模和更低调用成本降低前沿智能门槛,单任务成本为旗舰模型中最低。API定价与GLM-5.2持平,模型权重将于下周五开源。
Hacker News 热门(buzzing.cc 中文翻译) · 08/19 05:26
Mojo🔥 语言现已正式开源,采用 Apache 2.0 许可证(含 LLVM 例外),编译器、工具链及全部源码已发布至 modular GitHub 仓库。Mojo 上周刚达成 1.0 版本(源码稳定),此次开源涵盖整个编译器与工具链。目前暂不接受编译器相关贡献,计划年底前开放,标准库自 2024 年起已接受社区贡献。
X:Claude (@claudeai) · 08/19 04:06
Claude 现在可以在 Gmail 中发送邮件,并管理 Google Drive 中的文件。
让 Claude 回复某个邮件线程,它会起草并发送回复。你可以控制何时需要你的批准。
从连接器菜单中选择连接 Gmail 或 Google Drive 即可试用。所有付费套餐均可用。
OpenAI:官网动态(RSS · 排除企业/客户案例) · 08/18 19:00
OpenAI 发布 ChatGPT for Teens,为 13-17 岁用户自动启用,内置更强安全保护与家长控制。新增 Study Mode、负责任作业提醒、测验与学习可视化,以及可设定默认开启时段的 Study Hours,引导青少年分步解题而非直接给答案。OpenAI 同时宣布与 CodeAI 合作,帮助青少年理解、质疑并创造性地使用 AI。
行业动态
IT之家(RSS) · 6 天前
OpenAI 首席财务官萨拉·弗里亚尔在全员大会上告知员工,公司最迟将于 2027 年完成上市,若业务持续向好也可能更早。OpenAI 已于 6 月秘密提交 IPO 招股书,本季度整体年化营收增长 35%,企业级业务年化营收增长 50%,AI 编程与办公产品周活跃用户突破 2000 万。
TechCrunch:AI(RSS) · 6 天前
Stripe 确认收购 AI 模型路由平台 OpenRouter,据称交易金额达 75 亿美元,远超其 5 月时 13 亿美元的估值。Stripe 创始人称收购基于"奇点"开始的判断,但更实际的原因在于:OpenRouter 能帮助 Stripe 切入 AI 时代的支出管理,并掌握开发者 AI 使用动向及对模型供应商的影响力。交易预计数周内完成,OpenRouter 将保持独立运营。
Hacker News 热门(buzzing.cc 中文翻译) · 6 天前
Anthropic 因 OpenAI-Hugging Face 事件及即将推出的 Astra 模型可能达到"关键网络安全能力阈值",暂时放缓模型扩展速度,包括暂停最新模型两周的强化学习(RL)训练。公司已加强研究环境安全要求,包括工作负载隔离、网络隔离和持续安全测试,并扩大思维链监控范围。涉及 Astra 或网络模型的工作负载需满足最严格安全标准,部分训练和评估工作仍处于暂停状态。
X:OpenRouter (@OpenRouter) · 6 天前
OpenRouter 正在加入 Stripe。
我们创立 OpenRouter 时怀揣一个简单的使命:智能应当是多元模型的。如今,我们是最大的 AI 市场与网关,每天在 400 多个模型上处理 10T+ token。
加入 @Stripe 让我们有机会加速这一使命。
OpenRouter:Announcements(RSS) · 08/19 08:00
OpenRouter 宣布与 Stripe 合并,以加速推动全球经济增长。OpenRouter 目前每日处理来自 400 多个 AI 模型的 10+ 万亿 token,服务超 1000 万开发者与公司,自成立以来推理量每年至少增长 10 倍。合并后 OpenRouter 将继续以原名、原使命独立运营,产品与路线图不变,路由决策仍以用户利益为先,交易预计在未来数周内完成。
论文研究
LMSYS:Blog(Chatbot Arena 团队) · 6 天前
LMSYS 团队针对 1.6 万亿参数的 MoE 模型 DeepSeek-V4-Pro,在 H20 GPU 上通过场景化服务配置逼近 B300 性能。单节点 H20-141GB 参考实现达 271 output tokens/s,与 B300 的 383.7 tokens/s 性能差距缩小至 1.42×。
Anthropic:Research(发表成果 · 网页) · 08/19 06:27
Anthropic 公布两项实验:Claude(Mythos Preview 和 Opus 4.8)针对 15 个靶点设计蛋白质结合剂,成功 14 个,命中率达 22.6%-35.1%。
Hugging Face:Blog(RSS) · 08/19 02:09
智能体记忆并非可随意开启的功能,而是需按模型能力校准的剂量。强模型适合注入完整指南集,DeepSeek-V3.2(671B MoE)任务完成率提升+9.5个百分点;较弱模型采用精选检索效果最佳,gpt-oss-120b(117B MoE)提升+16.1pp且仅增加+5% token。该方法无需更新权重或人工标注,通过从智能体过往轨迹中蒸馏指南并在推理时注入实现。
技巧与观点
Claude:Blog(网页) · 6 天前
Anthropic 发布面向初创公司的 Claude Code 使用指南,基于对十余家高增长公司的调研,总结出"人人皆可交付、自动化繁琐工作、信任但验证、为重构而构建、原型-自用-产品化"五大规则。
Claude:Blog(网页) · 08/19 03:26
Anthropic 的 CI 工程师用 Claude Tag 构建了值班智能体,作为 CI/CD 故障的一线响应者。Claude 在事故发生后中位 14 分钟发布首份基于证据的分析,最快案例中 3 分钟内验证修复并确认错误率恢复基线。该方案通过 Slack 频道、Datadog 或 Grafana 工具访问及 GitHub 技能文件实现,Anthropic 已发布通用设置套件供其他团队部署。
OpenAI:官网动态(RSS · 排除企业/客户案例) · 08/18 19:00
OpenAI 因 OpenAI-Hugging Face 事件及即将推出的 Astra 模型可能达到《预备框架》下的"关键网络安全能力"阈值,暂时放缓了模型扩展速度,包括暂停最新部署模型的强化学习训练两周,并搁置最大规模前沿 RL 运行。公司已加强研究环境安全,要求对 Astra 及网络相关负载实施最严格防护,并扩展思维链监控,采用多阶段激活分类器检测机制。
Google AI:DEV 作者专属(RSS) · 08/18 15:00
本文演示如何用开源评测框架 Inspect AI 和 Harbor 评估 agent 技能,并借助 Google Sheets 和 Data Studio 进行可视化分析。
数据来源:aihot.virxact.com · 上次更新 2026-08-26T16:00:12