月之暗面旗下Kimi团队于7月19日发布说明,因过去48小时用户请求量远超预估并逼近集群承载极限,决定即日起暂停C端新用户订阅,以保障现有订阅用户的体验和权益。
现有算力将全部用于服务已订阅用户,团队同时全速推进算力扩容,待新算力到位后会逐步恢复新用户订阅并回归正常。
后续对新订阅用户将拆分Kimi主权益(包括Kimi Web、Kimi App、Kimi Work)与Kimi Code权益,以便更精准匹配算力并维持服务质量。
AI 日报 · 2026年07月20日
2026年07月20日日报
今日 AI 日报总结:根据当期推送内容整理,推荐优先关注的方向与热点。向下滚动左侧列表可浏览近半个月往期。
今日导读
今日AI领域热点集中在两大方向:一是大模型产品动态,阿里巴巴预览了2.4万亿参数的多模态模型Qwen3.8-Max,而月之暗面Kimi K3因需求火爆暂停新用户订阅,凸显出当前算力资源的瓶颈。 二是AI对现实世界的影响引发深刻反思,多项研究和一线观察披露了AI依赖如何抑制批判性思维、侵蚀企业决策,相关讨论值得关注。
今日要点速览
点击左侧任意资讯,切换到具体文章阅读。
月之暗面Kimi因算力紧缺暂停新用户订阅
摘要
国产头部大模型服务因算力瓶颈主动限流,反映AI应用需求爆发与基础设施挑战,对从业者具风向标意义。
- 发布时间
- 2026-07-20 6 天前
- 来源
- 36kr.com
- 字数
- 208
AI 摘要
正文
阿里预览 2.4 万亿参数多模态模型 Qwen3.8-Max
摘要
超大规模参数的多模态模型官方预览,对行业生态有重要影响。
- 发布时间
- 2026-07-20 6 天前
- 来源
- marktechpost.com
- 字数
- 591
AI 摘要
正文
阿里Qwen团队于2026年7月19日在上海世界人工智能大会期间预览了下一代旗舰多模态模型Qwen3.8-Max-Preview,该模型据称拥有2.4万亿参数,采用稀疏混合专家架构,可处理文本、图像、视频和文档。预览版已可通过阿里Token Plan等渠道购买,定价为标准价格的10%,但官方尚未公布基准测试表、模型卡及开源许可。
阿里宣称该模型在编程、全栈开发、数据分析及办公流程方面将超越前代Qwen3.7-Max,并声称其性能“仅次于Fable 5”。然而,这些排名均基于内部评估,未提供公开基准数据支撑。团队开发者表示,这是其首个超万亿参数的多模态模型,并兼容OpenAI与Anthropic协议。
模型总参数量与实际计算量存在关键差异。作为稀疏MoE模型,Qwen3.8每词元激活的参数量并未披露。推算显示,若以4-bit精度加载完整2.4万亿参数,仅权重就需约1.2TB显存,远超单卡或八卡H200 GPU的承载能力,因此业界更关注其是否会推出更小的激活参数版本或蒸馏版。
社区反响分化,在X、Reddit及Hacker News上,既有对中国开源模型竞赛的期待,也有对未经验证的基准说法的质疑。Reddit用户集中讨论2.4万亿模型的部署成本,并寄望于更易本地运行的小型变体。阿里此前的优势在于性价比而非榜单排名,此次预览恰逢Moonshot AI发布2.8万亿参数模型Kimi K3两天之后。
AI 狂潮正在侵蚀全球企业决策:来自一线顾问的辛辣观察
摘要
讨论了 AI 浪潮对企业管理的真实冲击与荒诞现象,是既有话题性又紧扣 AI 行业的有深度分析。
- 发布时间
- 2026-07-19 7 天前
- 来源
- simonwillison.net
- 字数
- 369
AI 摘要
正文
管理顾问 Nik Suresh 撰文揭露 AI 热潮正在严重侵蚀大型企业的决策理性。他通过匿名一线案例指出,AI 狂热已导致许多高层做出脱离现实的判断。一个极端案例显示,某位年收入超 20 亿美元公司的高管,在制定完全围绕 AI 的技术战略后,竟私下承认自己从未使用过 ChatGPT 或任何 AI 工具。
另一个案例来自一家设有“AI 代币排行榜”的公司。一名工程师为了保住工作,在从事其他任务时,偷偷让 AI 将公司的整个 Go 语言代码库用 Zig 语言重写,以此维持自己的排名。
文章还揭示了一种扭曲的商业生态:当客户方高管公开宣称 AI 能实现“百倍生产力”等荒谬目标时,供应商方面即使明知不切实际也不敢反驳。因为任何质疑都会被视作对客户高管的攻击或异端,可能导致企业合同被取消,而直言者更可能因此被解雇。这种沉默螺旋使得浮夸的销售话术和狂热氛围不断自我强化,压制了理性的声音。
阿里云发布 Token Plan 个人版,可抢先体验 Qwen3.8-Max 模型
摘要
阿里云官方发布新的模型体验套餐,涉及最新旗舰模型 Qwen3.8-Max,对关注大模型进展的从业者具有直接价值。
- 发布时间
- 2026-07-19 7 天前
- 来源
- ithome.com
- 字数
- 377
AI 摘要
正文
阿里云正式发布 Token Plan 个人版,用户可抢先体验参数量达 2.4T 的 Qwen3.8-Max-Preview 模型。该模型在代码工程和专业办公等场景表现出色,官方称其可能是除 Fable 5 外最强大的模型,正式版将于近期发布并开源。同时,Qoder 和 QoderWork 已首发支持该模型,千问 PC 端可免费体验。
Token Plan 个人版提供三档月费方案:Lite 版 39 元,提供 2,500 Credits/7 天,支持 1-2 个 Agent 并发;Standard 版 139 元,提供 10,000 Credits/7 天,支持 3-4 个 Agent 并发;Pro 版 499 元,提供 40,000 Credits/7 天,支持 6-8 个 Agent 并发。
针对 Qwen3.8-Max-Preview,官方推出限时活动:白天 Credits 消耗为 1 折,夜间(每日 22:00 至次日 08:00)在此基础上再享 2 折,即 0.2 折。
长文剖析:AI狂热正在摧毁全球决策能力
摘要
观点犀利的深度分析文章,信息密度高,直击AI应用中的核心风险,值得从业者反思。
- 发布时间
- 2026-07-19 7 天前
- 来源
- ludic.mataroa.blog
- 字数
- 421
AI 摘要
正文
AI狂热正在导致全球公共与私营机构的决策能力普遍衰退。作者基于一年多来与数百名从业者的交流及亲历的项目观察指出,从银行、医院到政府,许多组织已被狂热的AI情绪所裹挟,理性的声音反而处于恐惧与挫败之中。
当前企业界的AI投资普遍处于彻底失败的状态。作者团队在过去一年半中观察到的所有AI项目成功率为零,无论是否参与其中。管理层、员工、供应商和咨询方都有动机掩盖项目的真实成效,许多公司仅购买许可证便对外宣称实现了AI驱动的生产力提升。
常见失败项目包括内部或对外的聊天机器人。内部聊天机器人因企业文档质量低下而无人使用,对外客服机器人虽能模拟自然对话,但实际解决率堪忧,且项目负责人倾向于回避或操纵关键使用指标。AI项目不仅承受传统软件工程的失败风险,还因技术的新颖性面临额外的不确定性。
总体而言,尽管AI工具在特定场景下能提升效率,但当前的投资规模和方式缺乏理性基础。多数机构既缺乏成功交付软件的能力,也未能正确认识大语言模型在现实业务中的局限。
Anthropic《代码与Claude》研讨会材料:选择模型与代理开发
摘要
Anthropic官方发布的AI开发实战材料,涵盖模型选择与代理进阶技巧,信息密度和时效价值高。
- 发布时间
- 今日收录
- 来源
- github.com
- 字数
- 744
AI 摘要
正文
研讨材料围绕 Claude 模型选型和代理开发展开多个实战工作坊。rightmodel 模块演示如何用 Claude Code SKILL 审计 LLM 评估套件,跨模型与推理参数(如扩展思考)扫描,寻找性价比和速质比最优配置。agent-decomposition 模块将 400 行提示词库存代理拆解为技能、代码执行和可调用代理,并用评估验证每一步。
how-we-claude-code 呈现三阶段 AI 辅助产品流程:从访谈到规范、四种静态 HTML 设计探索,再到生成可机读 DOM 合约的 Vite+React 应用,供代理或 CI 运行时验证。ship-your-first-managed-agent 通过实现七个托管代理 API 调用函数,让 Streamlit 仪表板中的离线 SRE 代理面板上线,最终可在沙箱中搜索 7 万行日志、调用本地工具并定位错误提交。
agent-battle 是 45 分钟竞赛,配置托管代理驱动本地游戏机器人,以钻石最多、Token 最少决胜负,提供约 30 秒决策循环快速测试配置。agents-that-remember 从失忆代理开始,逐步加入跨会话记忆存储和 Dreaming 服务,在 45 分钟内将其变为有记忆 “同事”。
eval-driven-agent-development 通过六种变体迭代 PPTX 生成代理,使用程序化 XML 指标加 LLM 评分双层评估体系,量化每次提示词变更效果。production-ready-agent 构建基于聊天的多代理并购研究团队,协调器委派四个并行研究子代理,结合记忆存储和 Linear 集成,实时流式输出分级投资论点。research-desk 则在自托管 Next.js 控制台上搭建 SEC 申报研究台,逐步将裸代理升级为研究主管,按股票代码分派分析会话,集成 edgartools 技能、评分卡和共享记忆,最终输出周度备忘录。
研究:AI建议使准确度降3倍但自信度增2倍
摘要
揭示AI对认知影响的实证研究,对理解AI的局限性有重要价值。
- 发布时间
- 2026-07-20 6 天前
- 来源
- thenextweb.com
- 字数
- 375
AI 摘要
正文
法国和意大利三所大学的研究发现,AI建议显著抑制了人们表达“我不知道”的意愿,比例从44%骤降至3%。与此同时,答题准确率从27%下降至9%,但自信度却从30%升至76%。研究人员指出,人们变得更差,准确度仅为原来的三分之一,自信度却翻倍。
研究故意选取AI模型通常出错的题目,如电影细节。即使部分参与者原本能答对,在询问AI后也转而给出错误答案。金钱激励虽有一定作用,但效果有限,承认无知的比例仅回升至8%,准确率也仅升至16%,仍远低于无AI时的基准线。
米兰比可卡大学副教授Valerio Capraro强调,对人类而言,说“我不知道”的能力至关重要,它代表着认知自身知识局限。他尤其担忧在批判性思维形成前就接触这些系统的儿童。此前宾夕法尼亚大学沃顿商学院学者用“认知投降”描述该现象,此次研究则进一步表明,AI的可用性本身会压制认识无知的认知习惯。
单卡微调 Qwen3 实操教程:使用 NVIDIA NeMo AutoModel 在 Colab 运行 LoRA
摘要
面向开发者的实操教程,详细展示了在免费单卡环境下微调最新大模型的完整流程,实用性强。
- 发布时间
- 2026-07-19 7 天前
- 来源
- marktechpost.com
- 字数
- 397
AI 摘要
正文
本教程展示在 Google Colab 单 GPU 环境下,使用 NVIDIA NeMo AutoModel 对 Qwen3-0.6B 进行 LoRA 微调的完整流程。首先验证 GPU CUDA 可用性及 bfloat16 支持,从源码安装 NeMo AutoModel 并确认导入正常。
从仓库加载官方 LoRA 微调配方的 YAML 文件,针对 Colab 环境适配精度、批次大小、训练步数等参数:若 GPU 不支持 bf16 则转为 float32,本地批次限制为 4,全局批次限制为 8,并将最大训练步数设为 40,启用检查点保存。
通过 automodel 命令行界面启动 LoRA 微调,数据集使用 HellaSwag,生成 LoRA 检查点。最后利用 NeMoAutoModelForCausalLM 的 Python API 加载检查点,对比原始模型与微调模型的输出,展示 NeMo AutoModel 如何集成 NVIDIA 优化执行路径同时保持 Hugging Face 模型接口的兼容性。
从“炼模型”到“拼落地”,一级市场重估AI投资逻辑
摘要
一线AI投资人视角的深度观察,揭示了行业从模型军备竞赛转向应用落地的关键拐点,对从业者极具参考价值。
- 发布时间
- 2026-07-20 6 天前
- 来源
- 36kr.com
- 字数
- 322
AI 摘要
正文
2026世界人工智能大会(WAIC)与两年前相比,一级市场AI投资逻辑发生根本性转变。此前投资人聚焦大模型参数与融资规模,如今核心定价因素已转向推理成本、量产交付与上市时间表。
- 这一变化的直接体现是应用落地取代“炼模型”成为项目评估关键,长线资本和产业生态正加速入场,为技术产业化架桥铺路。
- 同期公募基金2026年二季报显示,基金经理对AI板块是否出现泡沫分歧显著。部分观点认为局部资产估值透支未来,出现泡沫特征;另一方则强调本轮行情有真实产业需求和订单支撑,与历史科技泡沫存在本质区别,产业景气仍有望延续。
- 这种分歧已体现在调仓操作上,一部分基金经理选择兑现收益、降低仓位,另一部分继续加码算力、芯片等核心赛道,围绕AI产业链的投资博弈进一步升温。
wigolo:AI 编码代理的本地优先网络智能工具,支持 MCP
摘要
零成本、本地优先的 MCP 网络工具,直击 AI 编码代理获取实时网络信息的痛点,实用性极高。
- 发布时间
- 今日收录
- 来源
- github.com
- 字数
- 443
AI 摘要
正文
wigolo 是一个面向 AI 代理的本地优先网络智能工具,支持 MCP 协议,无需 API 密钥、云服务或按量计费。它可集成到 Claude Code、Cursor、Codex、Gemini CLI、VS Code、Windsurf、Zed 等编码代理,以及 LangChain、CrewAI 等框架和自托管代理中。初始安装通过一条命令完成,要求 Node ≥20 及约 1.5 GB 磁盘空间,自动下载浏览器引擎和本地模型,并生成 MCP 配置。
核心工具集涵盖搜索、抓取、爬取、提取、缓存、相似页面发现、自主研究和代理循环。搜索结果返回带精确引文编号、字节级来源定位和置信度评分的结构化证据,而非简单摘要。所有工具无需密钥即可使用,数据保留在本地 ~/.wigolo/ 目录。
若添加免费的 Gemini API 密钥或配置其他 LLM 提供商(如 Anthropic、OpenAI、Ollama),可启用研究和代理功能的合成引用回答,显著提升体验。工具支持命令行、交互式 Shell、REST 端点及 SDK 调用,并具备差分检测和页面变更监控能力。
阿里凭揭示 AI Agent 专家能力鸿沟研究获 ACL 2026 最佳资源论文奖
摘要
顶会获奖论文,深度剖析 AI Agent 能力边界,对研究者和从业者有前瞻性思考价值。
- 发布时间
- 今日收录
- 来源
- mp.weixin.qq.com
- 字数
- 80
AI 摘要
正文
正文暂无法抓取(如微信验证页拦截),请点击上方「查看原文」。
ui-skills:面向 AI 代理的 UI 设计技能集与 CLI 工具
摘要
将 UI 设计模式封装为 AI 可调用的技能,可直接提升 AI 编码代理的前端开发质量。
- 发布时间
- 今日收录
- 来源
- github.com
- 字数
- 290
AI 摘要
正文
UI Skills 是一个面向设计工程师的工具集,提供一个名为 ui-skills 的命令行界面(CLI)工具,帮助将 AI 代理引导到适合当前任务的 UI 技能组合。
用户可以通过 npx ui-skills start 启动路由,快速匹配与任务相对应的 UI 设计技能。
该 CLI 支持多个命令,例如 npx ui-skills categories 可列出所有技能类别,npx ui-skills list --category motion 可以查看特定类别(如 motion)下的技能列表,以及 npx ui-skills get baseline-ui 用于获取基线 UI 技能集。
项目采用 MIT 许可证发布,详细信息可访问 ui-skills.com 查看。
Claude Code现已使用基于Rust的Bun运行时
摘要
重要AI开发工具技术栈变更,来自权威AI技术博主一手深度分析,对从业者极具参考意义。
- 发布时间
- 2026-07-19 7 天前
- 来源
- simonwillison.net
- 字数
- 400
AI 摘要
正文
Claude Code v2.1.181(2026年6月17日发布)及之后版本已开始内置基于 Rust 重写的 Bun 运行时。Bun 作者 Jarred Sumner 表示,这一变更在 Linux 上将启动速度提升了 10%,但总体变化“无聊”,几乎无人察觉。
通过检查本地 Claude Code 二进制文件可发现证据:strings 命令显示内部绑定的 Bun 版本为 v1.4.0,高于 Bun 当前公开的最新正式版 v1.3.14,表明其搭载的是尚未正式发布、仅以 canary 渠道提供的 Rust 预览版。
另一个 strings 命令提取出 563 个 .rs 源文件路径,如 src/runtime/bake/dev_server/mod.rs 等,进一步证实基于 Rust 的 Bun 已在数百万设备上生产运行。
用户还可通过设置 BUN_OPTIONS 预加载脚本直接打印内嵌 Bun 版本,输出确认为 1.4.0。该版本号自 5 月 17 日提交后未再变动,但至今未正式打标签发布。
Netflix首席产品与技术官谈AI对产品和技术的未来影响
摘要
来自Netflix高管的AI时代产品与团队管理一手深度访谈,信息密度高,对AI从业者和产品经理有直接参考价值。
- 发布时间
- 2026-07-19 7 天前
- 来源
- lennysnewsletter.com
- 字数
- 276
AI 摘要
正文
Netflix首席产品与技术官伊丽莎白·斯通在播客中深入探讨了AI对产品与技术岗位的未来影响。她将“系统思维”列为当前最重要的技能,强调在AI大量生成输出的时代,团队必须提升辨别信号与噪音的能力,以保持质量。
斯通指出,Netflix已将AI流畅度视为适用于所有层级员工的普遍期望,而非特定岗位的专属要求。她进一步阐释了“卓越即操作系统”的理念,即通过构建坚实的文化、流程和工具体系来持续产出高水平成果。
对话还涉及了如何管理AI驱动的产品团队,以及借鉴布莱恩·切斯基的新方法论、克劳德模型相关产品等外部实践,来应对从传统设计流程到AI辅助创作的模式转变。
SigNoz:为AI代理和团队打造的开源可观测性平台
摘要
专为AI代理设计的开源可观测性工具,直接服务于AI应用开发,实用性强。
- 发布时间
- 今日收录
- 来源
- github.com
- 字数
- 728
AI 摘要
正文
SigNoz 是一款基于 OpenTelemetry 构建的开源可观测性平台,旨在替代分散的监控工具栈,将日志、指标、链路追踪、告警和仪表板整合在单一平台中。它提供三种运行方式:全托管的 SigNoz Cloud(30 天免费试用,按用量计费,起价 49 美元/月,支持区域数据托管)、面向企业的云或自托管方案(含合规、支持、RBAC 等高级功能),以及完全免费、可在自有基础设施上部署的社区版。
平台可监控应用性能(APM,如服务延迟、错误率、吞吐量)、日志管理(采集、搜索、关联日志与追踪)、指标与仪表板(支持 Query Builder、PromQL、ClickHouse SQL),以及基础设施监控(Kubernetes 集群、主机级 CPU、内存等)。其特色能力包括 LLM 与 AI 可观测性(跟踪大模型应用、RAG 流水线的 token、延迟和成本),以及面向 AI 代理的原生可观测性与 MCP 服务器集成。此外,还提供分布式追踪、追踪漏斗、异常与告警监控等功能。
SigNoz 的核心优势在于:OpenTelemetry 原生,一次插桩即可拥有数据所有权;相关信号关联,无需切换工具即可从服务图表下钻到追踪、日志和基础设施指标;单一列式数据库支持高基数、高吞吐量的可观测性负载;定价可预测,不按主机或用户席位数计费;具备 SOC 2 Type II 和 HIPAA 合规等企业就绪特性。
在与常见工具对比中,SigNoz 将 Prometheus 的指标能力与日志、追踪等合并以提供相关上下文;相较仅做分布式追踪的 Jaeger,它增加了指标、日志和分析能力;对比 Elastic,其列式数据库在数据摄入阶段所需的资源最多可降低 50%;而在基准测试中,SigNoz 索引了所有键,Loki 则在添加更多标签时遇到最大流错误。
Firecrawl 发布 Open Lovable:通过 AI 对话快速克隆与生成 React 应用
摘要
将 AI 对话与网页克隆、代码生成相结合的创新实用工具,上手门槛低,是 AI 辅助开发的直观体现。
- 发布时间
- 今日收录
- 来源
- github.com
- 字数
- 339
AI 摘要
正文
Open Lovable 是 Firecrawl 团队发布的开源工具,允许用户通过 AI 对话即时构建 React 应用。这是一个本地开发版本,对应的完整云服务为 Lovable.dev。
使用流程:克隆 GitHub 仓库后,通过 pnpm 等包管理器安装依赖,并配置 .env.local 环境变量文件。必须提供 FIRECRAWL_API_KEY,并从 Gemini、Anthropic、OpenAI 或 Groq 中选择至少一个作为 AI 模型供应商,填入相应 API 密钥。
应用提供两种沙箱环境选项,默认为 Vercel Sandbox(支持 OIDC 令牌或个人访问令牌认证),也可选用 E2B Sandbox。可选配置 MORPH_API_KEY 以启用快速编辑功能。
启动开发服务器后,访问本地 3000 端口即可使用。项目采用 MIT 许可证。
蔡磊获“2026年度AI特别贡献人物”,其团队用AI搭建渐冻症科研大脑
摘要
展示了AI在医疗科研领域的突破性应用,故事具有话题性和重大社会意义,符合深度资讯收录标准。
- 发布时间
- 2026-07-19 7 天前
- 来源
- ithome.com
- 字数
- 360
AI 摘要
正文
在2026中国AI盛典上,蔡磊获颁“2026年度AI特别贡献人物”。他和团队搭建了渐冻症“AI科研大脑”,大幅提升研发效率,并在动物模型中验证了治愈渐冻症的可能路径。
其团队推动的新药RAG-17受试者、29岁患者小刘来到现场,在两年前还需轮椅出行的她如今已能站立和完成日常活动。蔡磊通过眼动打字连线表示,身体虽艰难,但心中希望因AI时代的科技爆发而越来越大。
2025年,蔡磊团队与全球60多个科研团队、50多家生物科技公司及十余家医院合作,推动近百个科研项目,助力15个药物管线及治疗技术实现临床转化突破。团队借助AI首次发现并通过临床前实验重复验证了治愈渐冻症的可能路径,包括骨髓移植彻底免疫重建等方法。
盛典还揭晓了10位“年度AI人物”,包括王兴兴、王鹤、朱秋国、闫俊杰、李宏伟、汪玉、沈亦晨、张林峰、曾国洋、魏少军。
Claude Code Router:一站式 AI 智能体模型路由与控制面板
摘要
开源实用工具,集中管理多模型路由与编排,对 AI 开发者具有高实操价值。
- 发布时间
- 今日收录
- 来源
- github.com
- 字数
- 574
AI 摘要
正文
Claude Code Router(CCR)是一款本地桌面控制面板,为 Claude Code、Codex、Grok CLI、ZCode 等编程智能体提供统一且稳定的本地端点。用户可在单一界面集中管理模型选择、路由策略、凭证池、后备链、工具集和账户用量,无需手动为每个智能体逐一配置多个模型服务。
CCR 内置多种提供商预设,包括对 Kimi K2.7 Code 的一键导入支持。Kimi K2.7 Code 是月之暗面推出的开源编程模型,在长周期真实编程任务和复杂软件工程流程上取得显著提升,且推理 token 消耗较 K2.6 减少约 30%。导入后,订阅端点原生直通,无需协议转换,余额和用量可直接在 CCR 仪表板查看。
路由引擎支持基于请求条件的动态路由、请求改写、模型前缀路由、重试和有序后备。此外,Fusion 模型可在基础模型上添加视觉、网页搜索或 MCP 工具能力;ToolHub 能将多个 MCP 服务器合并为一个动态入口,便于智能体按需调用工具。
CCR 提供请求日志与可观察性功能,可追踪延迟、token 用量、预估成本及代理执行轨迹,并支持本地 HTTP/HTTPS 代理和凭证池配额控制。同时支持将代理配置桥接到微信、钉钉、飞书等即时通讯平台,并通过扩展插件提供进一步集成。
平台已发布 macOS、Windows 和 Linux 安装包,完整文档和 Docker 部署指南见 ccrdesk.top。
微软发布 4-bit 量化版 Phi-4-mini 指令模型
摘要
主流大厂的轻量级量化指令模型更新,兼顾性能与效率,对开发者有直接的使用价值。
- 发布时间
- 今日收录
- 来源
- huggingface.co
- 字数
- 227
AI 摘要
正文
微软扩展了 Phi-4 系列,发布了 4 比特量化版的 Phi-4-mini 指令模型,其原始版本参数为 3.8B。此次发布使该系列模型总数增至 17 个,页面于 2025 年 7 月 10 日进行了更新,获得 215 次收藏。
Phi-4 系列定位于小型语言模型,同时覆盖多模态和推理能力。Phi-4-mini 作为其中的轻量指令模型,经过 4-bit 量化处理,旨在降低计算资源需求并提升部署效率,适用于边缘设备或资源受限环境。
该量化版本的推出,延续了微软在高效小型模型上的迭代,为开发者提供了更灵活的选择。
Allen AI发布开源OCR模型olmOCR-7B-0225
摘要
实用的开源文档解析模型,直接面向PDF等非结构化数据提取,信息密度高。
- 发布时间
- 今日收录
- 来源
- huggingface.co
- 字数
- 67
AI 摘要
正文
正文暂无法抓取(如微信验证页拦截),请点击上方「查看原文」。
实战:使用谷歌ADK与A2A协议构建跨语言多智能体团队
摘要
官方发布的跨语言多智能体协作实践教程,对正在探索A2A协议的开发者有极高参考价值。
- 发布时间
- 8 天前
- 来源
- developers.googleblog.com
- 字数
- 451
补充自 2026年07月18日
AI 摘要
正文
生产环境中 AI 系统常由不同团队用不同语言构建,整合这些异构智能体成为现实挑战。本文展示了一个合同合规多智能体流水线:Python 智能体利用 Gemini 提取合同条款,Go 智能体基于确定性逻辑验证合规性,两者通过 Agent2Agent (A2A) 协议互联,并由谷歌的 Agent Development Kit (ADK) 编排。
A2A 协议是开放标准,通过 Agent Card 实现能力发现(在 /.well-known/agent.json 中声明名称、技能、输入输出格式等元数据),通过 JSON-RPC 2.0 的 message/send 等方法通信,并将交互封装为有状态的任务(提交、工作、完成、失败),支持同步和异步工作流。
文章强调了将单体提示拆解为多个专职智能体的三个理由:工具超过10-15个时模型注意力分散导致上下文退化;单点异常会扩大故障范围;纠缠的职责使单元测试困难。这与将单体后端拆分为微服务的思想一致。
ADK 的 RemoteA2aAgent 抽象可将远程 A2A 兼容服务作为本地子智能体调用,无需重写代码,实现跨语言协作。
AI 编程术语词典:用大白话解释行业黑话
摘要
高质量科普资源,由知名技术作者编写,有效降低 AI 编程领域理解门槛,信息密度高。
- 发布时间
- 8 天前
- 来源
- github.com
- 字数
- 402
补充自 2026年07月18日
AI 摘要
正文
AI编程领域的术语常被有意复杂化,但核心概念可在短时间内掌握。本文档是一份AI编程词汇词典,用通俗语言解释行业黑话,解释为何上下文会退化、账单为何高昂、同一提示为何表现不一致等现象。
模型是只做“下一个token预测”的无状态参数集合,本身无法读取文件或执行命令,所有智能体行为都是由调用模型的工具框架编排多次预测实现的。“AI”一词并非固定技术标签,其指向随时代变化,当前主要指大语言模型。
模型参数是训练时调整的数值,存储了模型全部“知识”,推理时不作改变。上下文窗口容纳输入token,会话和轮次体现交互结构,系统提示设定基本规则。工具与环境包括文件系统、工具调用及结果、权限请求等机制,支持代理执行具体操作。
常见失败模式包括谄媚、幻觉、参数知识截止与注意力预算导致的注意力退化。交接、内存系统与技能等设计用于管理任务传递、知识保持和子代理协作。工作模式涵盖人机循环、自动化检查与审查、氛围编程等实践。