Navigate to WaytoAGI Wiki →

知识库精选- 7 月 27 日

·2024-07-27·#知识库精选
知识库精选- 7 月 27 日
  • 为什么AI数不清Strawberry里有几个 r?Karpathy:我用表情包给你解释一下》来自机器之心,文章讨论了大型语言模型(LLM)在处理基本问题时的低级错误,如无法正确统计 “Strawberry” 中 “r” 的数量,认为这是由于 Token 化过程导致的。Karpathy 提出,模型缺乏自我认知,未能灵活运用其能力。通过明确提示,模型能更有效思考。文章引入 “Jagged Intelligence” 概念,强调模型在不同领域的参差表现,建议让模型仅回答擅长的问题,并引用 Meta 在 Llama 3 中的相关方法。

https://assets.waytoagi.com/usercontent/Xnapper_2024_07_27_17_12_10_97d743f59f.png

https://assets.waytoagi.com/usercontent/Xnapper_2024_07_27_17_10_35_e34930a606.png

  • Voice Agent:AI 时代的交互界面,下一代 SaaS 入口》来自海外独角兽,本文探讨了语音代理(Voice Agent)作为下一代人机交互界面的潜力,强调其在陪伴、心理疗愈、客服等领域的应用前景。分析了不同场景对实时性、准确性和创造性的需求,提出了关注开发者工具、企业工作流和消费者应用等创业投资机会。语音代理凭借其低能耗和直观交互方式,有望在未来实现更广泛的应用和价值。

https://assets.waytoagi.com/usercontent/Xnapper_2024_07_27_17_08_38_68d92569d9.png

  • 星空:提示词攻防技术探索》本文探讨了提示词在人工智能应用中的重要性及其安全隐患,包括提示词攻击和知识库攻击。提示词攻击是黑客利用特定指令诱导 AI 执行有害操作,可能导致敏感信息泄露或系统崩溃。为了保障 AI 应用的安全性,必须了解和防范这些攻击。
  • Runway 公司因其视频生成模型 Gen-3 引发关注,全员在互联网上收集视频资源,特别是大量 YouTube 视频和盗版网站内容,用于训练模型。其泄露的 Runway训练素材源文件列表 包含详细的关键词和视频链接,甚至能生成与知名油管博主风格相似的视频。

https://assets.waytoagi.com/usercontent/Xnapper_2024_07_27_16_40_31_56e486a38f.png

知识库精选
相关推荐
知识库精选-2026年8月7日
知识库精选-2026年8月7日
- 《看了这么多Vibe Coding,我被B站这些产品整不会了》很多人的Vibe Coding还停在“让 AI 帮我写代码、做提效工具”。B站这批作品已经玩到更生活化的方向:督学官、大狗叫模拟器、AI 小镇、弹幕创世、时空电话、AI 猫娘。想做 AI 小产品、找灵感或理解“产品内容化”的人可以打开看看。
知识库精选
知识库精选-2026年8月6日
知识库精选-2026年8月6日
- 《重磅!Wan3.0开启公测》全新一代视频生成模型Wan3.0开启公测。Wan3.0在生成时长、万能创作、全能参考与真实感等维度全面升级,单次可生成30秒视频;在文本、图片、音频、视频四种基础模态之外,首次支持doc、xls、ppt、pdf、md等文档格式输入,让“万物皆可生视频”。快来体验一下!
知识库精选
知识库精选-2026年8月5日
知识库精选-2026年8月5日
- 《Higgsfield 开源了他们95分钟的AI长片《 Hell Grind》所有提示词及相关资料》这部作品制作成本为50万美元,曾在戛纳电影市场展映,并获得《华尔街日报》、Variety及BBC新闻的报道。一起来看看他们的制作流程!
知识库精选
知识库精选-2026年8月4日
知识库精选-2026年8月4日
- 《Vibe Coding 视觉词典(上篇):布局、页面结构、导航与常用组件》这篇Vibe Coding 新手视觉宝典,把网页拆成四层:布局、页面结构、导航和组件。针对 卡片、瀑布流、Bento、分屏、CSS Grid/Flexbox、Hero、Landing Page、Sticky Navbar、Drawer、Tabs、Modal、Toast、表单、Command Palette都讲了各自的适用场景,还配了对应的提示词。如果你想用AI搭个人网站、作品集、产品页,可以参考一下。
知识库精选
知识库精选-2026年8月3日
知识库精选-2026年8月3日
- 《开放通用智能,MiniMax H3 正式开源》MiniMax H3正式开源,能统一理解文本、图片、视频、音频输入等构成的多模态上下文,生成最长 15 秒、最高 2K、带原生立体声音频的视频;还支持首尾帧、参考图/视频/音频等多种模式。更关键的是,H3-Base已开放本地部署,支持SGLang、vLLM、diffusers、ComfyUI;官方还给了 768p 本地验证和 2K 完整工作流。快来部署到自己的工作流里试一试!
知识库精选
知识库精选-2026年8月2日
知识库精选-2026年8月2日
- 《一文读懂 Agent 的三层工程:Harness、Loop 与 Graph》这篇文章带你厘清Agent工程中三个常被混为一谈的结构:Harness Engineering可以理解成运行环境,负责给模型工具、记忆、权限、工作空间和可观测性;Loop Engineering负责让任务能根据证据反复检查、修正和停止;Graph Engineering则把复杂流程里的分支、并行、审批和人工关口画清楚。
知识库精选
知识库精选-2026年8月1日
知识库精选-2026年8月1日
- 《阿k:烧5w积分看sd2.5、H3双雄对垒: 全面测评MiniMax H3篇 (附30+案例) 》阿K烧了5w积分,用30+案例全面测试了MiniMax H3,覆盖商用级多场景、多模态参考、原生音画生成、精准编辑、复杂复合内容生成等等。结果发现H3在UI 动效、产品广告、片头字体、拼贴动画、短剧上表现比较突出。
知识库精选
知识库精选-2026年7月31日
知识库精选-2026年7月31日
- 《活动总结|上个周末,我们和全国52城小伙伴们在博物馆玩AI》7月26日,我们和全国52个城市的小伙伴们,在博物馆过了个周末。这期AI切磋大会的主题是「博物馆奇妙日」。上午先去逛逛自己城市的博物馆,看文物、记故事、拍照片,下午回来,用 AI 把它做成一件作品,不管是网页、视频、海报,还是3D 交互都行。最终我们收到了160多件作品,并把它摆上了线上展厅,欢迎来逛👏🏻
知识库精选