Synth Daily

每日科技摘要-08-28-早报

AI 模型与智能体

语音、视频和软件开发成为新一轮 AI 产品重点;智能体开始进入实验室和制造设备。

  • Gemini-3.5-Transcribe:Google 发布语音转文字模型 Gemini 3.5 Transcribe,主打嘈杂环境、专业术语和口语整理,提供实时流式与批量处理接口。
  • Gemini Omni 1.1 Flash:新版视频生成模型可参考前 10 秒画面续写视频,并按 10 秒片段延长场景,提升角色和画面的一致性。
  • 大模型硬件标准前瞻预测:Anthropic 公布 Model Hardware Standard 预览版,想让 AI 智能体用统一方式操作显微镜、机械臂、液体处理设备等仪器,同时加入权限和安全限制。
  • 小模型时代已来:作者认为,小而快、价格低的模型已能完成代码、邮件和知识库检索等任务,低推理成本或许会推动更多面向普通用户的 AI 产品。
  • OpenAI 正在开发“具有自主记忆”的 AI 智能体:OpenAI 正在测试 Codex 的“持续模式”,让智能体保留任务状态和记忆,主动持续完成较长的工作流程;尚未确定上线时间。
  • 黄仁勋再言 NVIDIA 已实现 AGI——不过这并不重要:黄仁勋称 NVIDIA 在部分任务上已达到 AGI,但也承认这个概念没有统一定义;他更看重 AI 是否能完成有用工作。

AI 安全与网络攻击

AI 智能体的越界行为开始成为现实风险,行业也在推动更早的防御和追责。

开发工具与基础设施

从 DNS 缓存到模型路由,开发者工具正把性能、成本和可控性放在一起解决。

开源硬件与个人设备

低价、可训练的机器人,以及面向特定场景的可穿戴设备,正在从概念走向商品。

平台、隐私与社交网络

平台正在调整内容分发、青少年保护和商业化方式,但隐私问题仍未解决。

软件保存与游戏

开源重制和反编译项目让旧软件能在新设备上继续运行,也为研究和改造留下基础。