欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。
1、微信 AI 团队开源 WeKnora:知识库不再只“动嘴”,还能在沙箱里“动手”
微信 AI 团队开源了知识管理框架 WeKnora,其最新 0.8.0 版本全面开放使用。WeKnora 的目标是让知识库不仅能“查到答案”,还能“动手去执行”。它通过 anydoc 解析和 GraphRAG 技术,将杂乱文档转化为知识图谱,并结合 Skill Sandbox Runtime 实现知识的安全执行,形成解析、组织、检索、执行、记忆的一条龙解决方案。

【AiBase提要:】
🧠 anydoc 解析:支持多种格式文档直接导入,自动整理成结构化知识体系。
🔗 GraphRAG:通过实体和关系构建知识图谱,提升回答关联性问题的准确性。
⚙️ Skill Sandbox Runtime:将知识封装为技能,在沙箱中安全执行并返回可验证结果。
2、智谱AI回应ZCode代码上传争议:已修复漏洞,将开源代码
智谱AI旗下代码助手ZCode因‘代码库索引’功能引发用户数据上传争议。官方发布情况说明并致歉,披露事件原因及整改方案,包括修复漏洞、开放源代码和邀请第三方评估等措施。
【AiBase提要:】
📌 ZCode的‘代码库索引’功能因默认开启导致部分用户数据被上传。
💡 官方表示云端生成Wiki后数据会立即销毁,不会留存。
🔒 为重建信任,ZCode计划开放源代码并邀请第三方独立审查。
3、ChatGPT 正式入驻 Word:免费用户也能用,办公文档里三套 AI 同台厮杀
OpenAI 推出 ChatGPT 官方 Word 插件,面向全球所有账号开放,包括免费用户。该插件为写作者提供了多项功能,如整理笔记、生成摘要、调整语气等,同时付费和企业用户可获得更高级的功能。然而,插件的使用有分层限制,并且与 Codex 等工具共用额度。文章还提到 Word 中已有多个 AI 工具同台竞争,AI 的调用门槛被进一步降低。
【AiBase提要:】
✅ OpenAI 推出 ChatGPT 官方 Word 插件,面向全球所有账号开放,包括免费用户。
💡 插件提供多项写作辅助功能,如整理笔记、生成摘要、调整语气等,满足写作者日常需求。
🔄 Word 中已出现微软 Copilot、Anthropic Claude 和 OpenAI ChatGPT 三套 AI 工具,办公软件正被 AI 重新洗牌。
4、阶跃星辰发布Step5Preview,单任务成本仅为Claude Opus5的1/8
阶跃星辰发布了新一代旗舰基座模型Step5Preview,重点面向AI编程、软件工程、专业知识工作及金融等场景,提升模型在真实世界Agentic任务中的综合表现。该模型在AA综合智能指数中跻身全球开源模型前三,单任务成本仅为Claude Opus5的1/8,计划于10月15日正式开源。Step5Preview采用稀疏MoE架构,总参数量600B,激活参数仅27B,支持100万Token上下文窗口,并原生支持文本与视觉输入,在软件工程、专业工作流和金融等场景针对复杂任务进行了优化。

【AiBase提要:】
🚀 阶跃星辰发布Step5Preview,面向AI编程、软件工程等场景优化模型表现。
🧠 Step5Preview在AA综合智能指数中跻身全球开源模型前三,单任务成本仅为Claude Opus5的1/8。
📊 该模型采用稀疏MoE架构,支持100万Token上下文窗口,并原生支持文本与视觉输入。
5、SpaceXAI 推出 Grok Voice Transcribe 2.0:错误率砍半、价格纹丝不动,流式语音识别登顶榜单
SpaceXAI 推出的 Gork Voice Transcribe 2.0 在语音转文本技术上取得重大突破,错误率降低约一半,同时保持价格不变。该模型已深度嵌入真实业务场景,如客服电话和特斯拉车机系统,并在多个评测中表现优异。
【AiBase提要:】
🚀 新一代语音转文本模型 Grok Voice Transcribe 2.0 错误率降低约一半。
💰 定价保持不变,提供更强大的功能,如说话人分离和精确时间戳。
📊 在公开榜单上准确率排名第一,展现出卓越的性能。
6、B站上线AI 无限竞技场测评榜:上百模型同场厮杀,GPT-6 暂坐头把交椅
B站推出AI无限竞技场测评榜,汇集上百个大模型进行真实场景测试,GPT-6在首轮排名中夺得榜首,并且登顶次数最多。该榜单不设固定测评维度,由UP主自主命题,让模型在实际应用中展现差距。
【AiBase提要:】
🔥 B站推出AI无限竞技场测评榜,汇集上百个大模型进行真实场景测试。
🏆 GPT-6在首轮排名中夺得榜首,并且登顶次数最多。
🌐 该榜单不设固定测评维度,由UP主自主命题,让模型在实际应用中展现差距。
7、千问发布Qwen3.8-LiveTranslate:同传延迟降至2.3秒,还能保留你的音色
新一代同声传译大模型 Qwen3.8-LiveTranslate 在翻译质量、延迟、说话人识别和语音合成四个维度上全面升级,字均延迟从2.8秒压缩至2.3秒,新增三大核心能力,包括实时说话人分离、原文译文同帧同出以及长上下文消歧。该模型采用 Hybrid MoE 的 Thinker–Talker 双模块设计,覆盖14个语向的多说话人长音频评测集 Omnilingua-MSpeaker 上表现优异,目前支持60种语言,API 同步上线千问 AI 平台。

【AiBase提要:】
🎙️ 实时说话人分离让多人交替发言时每句话归属清晰,译文语音还能稳定保留原说话人音色。
📺 原文译文同帧同出实现双语同步显示,兼顾即时理解与原文核对。
🧠 长上下文消歧通过跨轮关联历史语境,减少专有名词和指代带来的翻译歧义。
8、DeepSeek明确调休日计费规则,中秋国庆迎来十天半价窗口
DeepSeek明确调休日和节假日的API计费规则,为开发者带来十天的半价窗口期。同时,其新发布的V4.1 Flash模型在性能和价格上表现出色,进一步提升了性价比。
【AiBase提要:】
📅 调休日和节假日全天按低谷价计费,开发者可享受优惠
🚀 DeepSeek V4.1 Flash模型性能超越旗舰V4Pro,价格更实惠
💰 空闲时段下,V4.1 Flash的输入和输出成本极低