Navigate to WaytoAGI Wiki →
Home/Question List/Question Detail

GitHub发布的ai软件叫什么

Answer

以下是一些在 GitHub 发布的 AI 软件:

  • AIdea:集成了主流大语言模型以及绘图模型的 AI 应用。
  • go-proxy-bing:无需登录即可直接使用 New Bing,拥有与 Bing 一致的 UI 体验,并支持 ChatGPT 提示词。
  • Background Remover:开源的命令行工具,借助 AI 能力快速移除图像和视频背景。
  • open-chat-video-editor:短视频生成和编辑工具,结合 ChatGPT、Stable Diffusion 和多模态搜索实现多种功能。
  • Chat-with-GitHub-Repo:可以跟 GitHub 仓库进行对话的 Python 工具。
  • Chatbot Arena:在线测试多种开源大语言模型的工具。
  • KeepChatGPT:让 ChatGPT 不再报错的插件。
  • MiniGPT-4:拥有类似 GPT-4 图像对话能力的项目。
  • Animated Drawings:借助人工智能技术让绘画作品动起来的有趣 AI 工具。
  • CodeWhisperer:集成到 VSCode 和 IntelliJ IDEA 等代码编辑器上使用的 AI 编程助手,个人版对所有开发者免费开放。

此外,GitHub 发布的还有:

  • GitHub Spark 新产品,类似 Bolt 或者 V0 这种输入需求直接生成。新增对多个 AI 模型的支持,如 Claude 3.5 Sonnet、Gemini 1.5 Pro、o1-preview 和 o1-mini。开发者可以自由选择最适合的模型,组织和企业可以控制团队使用的模型范围。增强了 AI 原生开发体验,如 Copilot Workspace、Copilot Code Review 等。
  • AnythingLLM:可打造成企业内部知识库的私人专属 GPT。
  • chatgpt_system_prompt:有获取 GPTs 的 Prompt、Knowledge 以及防护教程,对破解官方 GPTs 的 Prompt 进行分类。
  • GPTs:收集了超级多被破解的 GPTs Prompt。
  • Awesome assistants:精心收集整理的优秀 AI 助手列表。
  • Animate Anyone:只需一张角色图片,即可生成与角色一致且动作可控的生动视频。
  • SillyTavern:可以安装在电脑(和安卓手机)上的用户界面,与文本生成的人工智能互动,并与社区创建的角色聊天/玩角色扮演游戏。
  • Prompt flow:微软开源的用于简化大模型应用开发周期的工具。
  • supervision:开源的计算机视觉 AI 工具箱。
Content generated by AI large model, please carefully verify (powered by aily)

References

GitHubDaily 开源项目列表

|名称|简述||-|-||[AIdea](https://github.com/mylxsw/aidea)|一个在GitHub开源的AI应用,集成了主流大语言模型以及绘图模型。||[go-proxy-bing](https://github.com/adams549659584/go-proxy-bingai)|让你无需登录,即可直接使用New Bing。拥有与Bing一致的UI体验,并支持ChatGPT提示词。||[Background Remover](https://github.com/nadermx/backgroundremover)|一个开源的命令行工具,,可借助AI能力,快速移除图像和视频背景。||[open-chat-video-editor](https://github.com/SCUTlihaoyu/open-chat-video-editor)|一款短视频生成和编辑工具,结合ChatGPT,Stable Diffusion和多模态搜索,实现短句转短视频、网页链接转短视频、长视频转短视频功能。||[Chat-with-GitHub-Repo](https://github.com/peterw/Chat-with-Github-Repo)|一个让你可以跟GitHub仓库进行对话的Python工具||[Chatbot Arena](https://chat.lmsys.org/)|一个可以在线测试多种开源大语言模型的工具||[KeepChatGPT](https://githubdaily.gitee.io/posts/2023-04-21-keepchatgpt/)|一个插件,让你的ChatGPT不再报错!||[MiniGPT-4](https://githubdaily.gitee.io/posts/2023-04-17-minigpt-4/)|一个拥有类似GPT-4图像对话能力的项目。||[Animated Drawings](https://githubdaily.gitee.io/posts/2023-04-16-animated-drawings/)|一款很有趣的AI工具,可以借助人工智能技术,让绘画作品动起来。||[CodeWhisperer](https://aws.amazon.com/cn/codewhisperer/)|一款AI编程助手,可集成到VSCode和IntelliJ IDEA等代码编辑器上使用,个人版对所有开发者免费开放。|

AIGC Weekly #95

Github发布会的主要内容,GitHub Spark新产品类似Bolt或者V0这种输入需求直接生成。GitHub Copilot多模型支持新增对多个AI模型的支持:Claude 3.5 Sonnet、Gemini 1.5 Pro、o1-preview和o1-mini。开发者可以自由选择最适合的模型组织和企业可以控制团队使用的模型范围AI原生开发体验增强Copilot Workspace:在Pull Request中快速优化和验证代码,与Copilot Code Review、Autofix和第三方扩展集成Copilot Code Review:PR创建后即可获得AI反馈,支持C#、Java、JavaScript、Python、TypeScript、Ruby、Go和Markdown,可配置团队规则以保证代码质量GitHub Spark(技术预览版)面向个人的软件创作工具使用自然语言创建微型应用支持实时历史记录、预览和直接代码编辑目标是帮助10亿人成为开发者GitHub Models不再需要等待名单,直接可用模型并排比较支持多模态模型保存和分享提示词与参数新的Codespaces支持CLI扩展:可直接在终端中使用和测试模型

GitHubDaily 开源项目列表

|名称|简述||-|-||[AnythingLLM](https://github.com/Mintplex-Labs/anything-llm)|一个可打造成企业内部知识库的私人专属GPT!可以将任何文档、资源或内容转换为大语言模型(LLM)知识库,使得在对话过程中可引用到里面的内容。||[chatgpt_system_prompt](https://github.com/LouisShark/chatgpt_system_prompt)|有获取GPTs的Prompt、Knowledge以及如何防护的教程,另外单独对破解官方GPTs的Prompt进行分类。||[GPTs](https://github.com/linexjlin/GPTs)|收集了超级多被破解的GPTs Prompt||[Awesome assistants](https://github.com/awesome-assistants/awesome-assistants)|一份精心收集整理的优秀AI助手列表。||[Animate Anyone](https://github.com/HumanAIGC/AnimateAnyone)|只需一张角色图片,即可生成与角色一致且动作可控的生动视频。||[SillyTavern](https://github.com/SillyTavern/SillyTavern/)|一个可以安装在电脑(和安卓手机)上的用户界面,让你可以与文本生成的人工智能互动,并与社区创建的角色聊天/玩角色扮演游戏。||[Prompt flow](https://github.com/microsoft/promptflow)|微软在GitHub开源的一套AI工具,可用于简化大模型应用的开发周期。打通了从项目构思、原型设计、测试、评估到生产部署和监控的全流程,让开发者可以快速构建出高质量的大语言模型应用。||[supervision](https://github.com/roboflow/supervision)|一个在GitHub开源的计算机视觉AI工具箱,安装简便,可供开发者重复使用,大幅提升效率。|

Others are asking
ai视频
以下是 4 月 11 日、4 月 9 日和 4 月 14 日的 AI 视频相关资讯汇总: 4 月 11 日: Pika 上线 Pika Twists 能力,可控制修改原视频中的任何角色或物体。 Higgsfield Mix 在图生视频中,结合多种镜头运动预设与视觉特效生成视频。 FantasyTalking 是阿里技术,可制作角色口型同步视频并具有逼真的面部和全身动作。 LAM 开源技术,实现从单张图片快速生成超逼真的 3D 头像,在任何设备上快速渲染实现实时互动聊天。 Krea 演示新工具 Krea Stage,通过图片生成可自由拼装 3D 场景,再实现风格化渲染。 Veo 2 现已通过 Gemini API 向开发者开放。 Freepik 发布视频编辑器。 Pusa 视频生成模型,无缝支持各种视频生成任务(文本/图像/视频到视频)。 4 月 9 日: ACTalker 是多模态驱动的人物说话视频生成。 Viggle 升级 Mic 2.0 能力。 TestTime Training在英伟达协助研究下,可生成完整的 1 分钟视频。 4 月 14 日: 字节发布一款经济高效的视频生成基础模型 Seaweed7B。 可灵的 AI 视频模型可灵 2.0 大师版及 AI 绘图模型可图 2.0 即将上线。
2025-04-20
ai视频教学
以下是为您提供的 AI 视频教学相关内容: 1. 第一节回放 AI 编程从入门到精通: 课程安排:19、20、22 和 28 号四天进行 AI 编程教学,周五晚上穿插 AI 视频教学。 视频预告:周五晚上邀请小龙问露露拆解爆火的 AI 视频制作,视频在视频号上有大量转发和播放。 编程工具 tree:整合多种模型,可免费无限量试用,下载需科学上网,Mac 可拖到文件夹安装,推荐注册 GitHub 账号用于代码存储和发布,主界面分为工具区、AI 干活区、右侧功能区等。 网络不稳定处理:网络不稳定时尝试更换节点。 项目克隆与文件夹:每个项目通过在本地新建文件夹来区分,项目运行一轮一轮进行,可新建会话,终端可重开。 GitHub 仓库创建:仓库相当于本地项目,可新建,新建后有地址,可通过多种方式上传。 Python 环境安装:为方便安装提供了安装包,安装时要选特定选项,安装后通过命令确认。 代码生成与修改:在 tree 中输入需求生成代码,可对生成的代码提出修改要求,如添加滑动条、雪花形状、颜色等,修改后审查并接受。 2. AI 视频提示词库: 神秘风 Arcane:Prompt:a robot is walking through a destroyed city,,League of Legends style,game modelling 乐高 Lego:Prompt:a robot is walking through a destroyed city,,lego movie style,bright colours,block building style 模糊背景 Blur Background:Prompt:a robot is walking through a destroyed city,,emphasis on foreground elements,sharp focus,soft background 宫崎骏 Ghibli:Prompt:a robot is walking through a destroyed city,,Spirited Away,Howl's Moving Castle,dreamy colour palette 蒸汽朋克 Steampunk:Prompt:a robot is walking through a destroyed city,,fantasy,gear decoration,brass metal robotics,3d game 印象派 Impressionism:Prompt:a robot is walking through a destroyed city,,big movements
2025-04-20
ai写程序
以下是关于使用 AI 写程序的相关内容: 1. 对于技术纯小白: 从最基础的小任务开始,让 AI 按照最佳实践写一个 say hello 的示例程序,并解释每个文件的作用及程序运行的逻辑,以学会必备的调试技能。 若学习写 chrome 插件,可让 AI 按照最佳实践生成简单的示范项目,包含全面的典型文件和功能,并讲解每个文件的作用和程序运行的逻辑。若使用 o1mini,可在提示词最后添加生成创建脚本的要求,并请教如何运行脚本(Windows 机器则是 create.cmd)。 2. 明确项目需求: 通过与 AI 的对话逐步明确项目需求。 让 AI 帮助梳理出产品需求文档,在后续开发时每次新起聊天将文档发给 AI 并告知在做的功能点。 3. 在独立游戏开发中的经验: 单独让 AI 写小功能没问题,但对于复杂的程序框架,可把不方便配表而又需要撰写的简单、模板化、多调用 API 且牵涉小部分特殊逻辑的代码交给 AI。 以 Buff 系统为例,可让 AI 仿照代码写一些 Buff。但目前 Cursor 生成复杂代码需要复杂的前期调教,ChatGPT 相对更方便。 教 AI 时要像哄小孩,及时肯定正确的,指出错误时要克制,不断完善其经验。 4. 相关资源和平台: AI 写小游戏平台:https://poe.com/ 图片网站:https://imgur.com/ 改 bug 的网站:https://v0.dev/chat 国内小游戏发布平台:https://open.4399.cn/console/ 需要注意的是,使用 AI 写程序时,对于技术小白来说,入门容易但深入较难,若没有技术背景可能提不出问题,从而影响 AI 发挥作用。
2025-04-19
有哪些好用的法律ai
以下是一些好用的法律 AI 应用场景和示例: 1. 诉讼策略制定: AI 将基于商标法等相关条款和案例法,为商标侵权案件提供诉讼策略,包括对原告商标权利的分析、被告侵权行为的评估、关键证据搜集建议、法律抗辩点及和解或调解策略。 其他例子: 为专利侵权案件制定诉讼策略,分析专利有效性、被告侵权行为及抗辩理由,提出证明侵权和计算损害赔偿的建议。 针对劳动合同纠纷案件,分析员工权益和雇主责任,提出诉讼策略,包括主张权益、证据收集重点及证明雇主违约行为。 在知识产权许可诉讼中,分析许可协议条款和双方权利义务,提出诉讼策略,包括证明许可协议违反、计算损失赔偿及可能的合同解除条件。 模拟法庭,如模拟商业合同违约的法庭审理,分析双方论点、证据和法律依据,预测判决结果,给出优化法庭陈述和证据呈现的建议。 2. 法律意见书撰写: AI 根据案件背景、证据材料和法律法规,自动撰写初步法律意见书,包含案件事实梳理、法律分析和结论。 其他例子: 针对商业秘密泄露案件,分析法律责任和赔偿范围,撰写法律意见书,提供应对策略。 为计划上市的公司提供关于公司治理结构的法律意见书,确保符合相关法规要求。 就消费者权益保护案件提供法律意见,分析商家赔偿责任和消费者维权途径,制定应对措施。 起草股权转让协议,包括转让方和受让方信息、股权转让份额、价格、支付方式和时间表、先决条件、双方权利义务、保密、违约责任和争议解决条款等。 3. 指令风格和技巧: 可指定 AI 模仿某位资深律师的逻辑严谨和言简意赅的风格,使其提供的信息更符合专业律师的沟通和表达习惯。 运用 PEMSSC 方法,如选择个性化的风格、给出参考或逻辑结构、从多个角度思考、进行总结概括、使用分隔符号区分等。 个性化风格:选择幽默且富有洞察力的风格,融入创新视角。 参考和逻辑结构:在提供法律建议时,采用 SWOT 分析法或 4P 原则等逻辑结构。 多角度思考:在分析商事诉讼时,从市场趋势、竞争对手行为、战略规划、财务状况和市场前景等角度思考诉讼策略。
2025-04-18
有没有能根据描述,生成对应的word模板的ai
目前有一些可以根据描述生成特定内容的 AI 应用和方法。例如: 在法律领域,您可以提供【案情描述】,按照给定的法律意见书模板生成法律意见书。例如针对商业贿赂等刑事案件,模拟不同辩护策略下的量刑结果,对比并推荐最佳辩护策略,或者为商业合同纠纷案件设计诉讼策略等。 在 AI 视频生成方面,有结构化的提示词模板,包括镜头语言(景别、运动、节奏等)、主体强化(动态描述、反常组合等)、细节层次(近景、中景、远景等)、背景氛围(超现实天气、空间异常等),以及增强电影感的技巧(加入时间变化、强调物理规则、设计视觉焦点转移等)。 一泽 Eze 提出的样例驱动的渐进式引导法,可利用 AI 高效设计提示词生成预期内容。先评估样例,与 AI 对话让其理解需求,提炼初始模板,通过多轮反馈直至达到预期,再用例测试看 AI 是否真正理解。 但需要注意的是,不同的场景和需求可能需要对提示词和模板进行针对性的调整和优化,以获得更符合期望的 word 模板。
2025-04-18
可以增强图片清晰的的ai
以下是一些可以增强图片清晰度的 AI 工具: 1. Magnific:https://magnific.ai/ 2. ClipDrop:https://clipdrop.co/imageupscaler 3. Image Upscaler:https://imageupscaler.com/ 4. Krea:https://www.krea.ai/ 更多工具可以查看网站的图像放大工具库:https://www.waytoagi.com/category/17 此外,PMRF 也是一种全新的图像修复算法,它具有以下特点: 擅长处理去噪、超分辨率、着色、盲图像恢复等任务,生成自然逼真的图像。 不仅提高图片清晰度,还确保图片看起来像真实世界中的图像。 能够应对复杂图像退化问题,修复细节丰富的面部图像或多重损坏的图片,效果优质。 详细介绍: 在线体验: 项目地址: 这些 AI 画质增强工具都具有不同的特点和功能,可以根据您的具体需求选择合适的工具进行使用。
2025-04-18
人工智能软件现在有哪些
以下是一些常见的人工智能软件: 1. 在自然语言处理和神经科学应用方面,大型语言模型取得了进展,拥有更先进的工具用于解码大脑状态和分析复杂脑部活动。 2. 在艺术创作领域,有涉及知识产权保护的相关软件,如软件工程师在设计时应确保生成内容合法合规、注重用户知识产权保护等。创作者使用此类软件时,应了解自身权利并做好保护。 3. 在线 TTS 工具方面,如 Eleven Labs(https://elevenlabs.io/)、Speechify(https://speechify.com/)、Azure AI Speech Studio(https://speech.microsoft.com/portal)、Voicemaker(https://voicemaker.in/)等。这些工具可将文本转换为语音,具有不同的特点和适用场景。但请注意,相关内容由 AI 大模型生成,请仔细甄别。
2025-04-15
AI办公相关的课程、软件教学
以下是为您提供的 AI 办公相关的课程和软件教学资源: 1. 90 分钟从 0 开始打造您的第一个 Coze 应用: 课程包含从零开始的应用界面教学,涉及过年相关应用。 介绍了当前承接的业务,包括辅导、培训、定制及企业 AI 落地等。 提到 11 月底应用推出背后的情况,包括社区对 AI 应用的呼声和功能需求挖掘。 2. AI 视频的软件教程: 涵盖了众多工具,如剪映、Dreamina、Pika、StableVideo、Pixverse、morphstudio、Runway Gen3、Adobe Firefly 以及清影等。 3. 张翼然:用 AI 为教师减负(3H).pdf: 包括教师的 AI 减负指南,生成式人工智能在教学中的应用。 介绍了教师使用 AI 的小技巧,如提示词设计公式之——RTFC。 涉及使用 AI 生成图片的方法与注意事项,AI 自动生成 PPT 功能。 展示了通过小程序实现文字与声音、视频的转化,自定义数字人形象进行教学。 展示了便捷的课堂教学工具与 Ai 课件制作,探讨了 A 生成视频与手工制作视频的教学效果差异。 强调了教育资源与版权问题,教师能力重塑,极简思维的教育应用,生成式 AI 教学策略。 包括 AI 技术助力教育管理和辅助教学实践,如班级与学校管理中的行政职日流程简化、听课记录自动化等。
2025-04-12
grok API能用在什么软件上
Grok API 可以用在以下软件上: 1. 扣子工作流:可以用代码模块进行 HTTP 访问,实现 0 token 脱离扣子模型来使用 Groq 作为 LLM,还能参考相关教程将扣子接入微信机器人,但有微信封号风险。 2. 沉浸式翻译:由于 Groq 的 API 与 OpenAI 的 API 几乎兼容,可以适配到任何 APP 产品可以用来填 APIKEY 调用的场景,比如沉浸式翻译这个网页翻译工具。 3. 手机类 APP:比如通过快捷方式接入 Siri。 此外,xAI 发布的 Grok 3 API 提供了多个模型版本,如 grok3beta、mini、fast 等,满足不同场景需求,上下文窗口达 131K,支持图像输入输出,但当前不支持联网或实时访问外部网页与数据。
2025-04-12
人脸识别软件
以下是为您整合的关于人脸识别软件的相关信息: 在“【已结束】AI 创客松 参与同学自我介绍和分类”中,Dylan 擅长人脸识别算法和动作捕捉产品。 在“SmartBotX 模块化桌面机器人——说明文档”中,桌面客户端提供面部识别或跟踪功能的展示,可能用于安全监控、用户识别或交互式体验。 在“14、LayerStyle 副本”中,使用 YoloV8 模型可以检测人脸、手部 box 区域或者人物分割,支持输出所选择数量的通道。同时,Mediapipe 模型可以检测人脸五官,分割左右眉、眼睛、嘴唇和牙齿。
2025-04-12
文章配图的智能体或者软件
以下是为您整理的关于文章配图的智能体或软件的相关内容: 在《智变时代/全面理解机器智能与生成式 AI 加速的新工业革命》中提到,智能时代,智能应用会从有形界面消失,变成无所不在的助理或智能体,辅助甚至直接完成任务。文中还配有图 2.10:智能代理将改变企业组织架构。 在《XAIR:AI 智能体平台对决:腾讯元器与字节扣子的创新之路》中,个人实操案例部分提到为本篇文章配图的相关情况,但生成结果显示问题描述不够清楚。之后换提示词“那你给我生成搞笑图片吧,让人一看就有继续看下去的动力那种,需要一张公众号封面和一张配图”,得到了相应结果。同样的提示词,元器某应用也有生成。此外,文中还提到在搭建 bot 过程中存在工作流未成功触发导致访谈记录未成功存储入库的问题。
2025-04-11
和manus差不多的软件
以下是与 Manus 模式类似的软件: 1. Same.dev:像素级 UI 还原,自动生成对应代码,云端运行,支持自定义编码,但免费额度使用快,需输入 API,目前网站被标记危险。相关链接: 2. Genspark Super Agent:作为世界上首个 MixtureofAgents 系统,集多种功能于一体,能自动完成复杂任务。在 GAIA 基准测试的三个级别中得分均高于 Manus,具有近乎即时的结果、执行过程中错误和幻觉显著减少、让用户掌控一切并能指导和优化输出等优势。它是世界上第一个 MixtureofAgents 系统,利用最佳模型、工具和数据集来执行不同的任务,比如基础智能体的对话、图片、视频生成以及翻译。
2025-04-11
如何将智能体发布为网页
要将智能体发布为网页,您可以按照以下步骤进行操作: 1. 在相关平台(如阿里云百炼)创建智能体应用,准备好相关知识库文件,设定人设与回复逻辑。 2. 将已经发布的工作流添加到创建好的智能体,并进行测试。 3. 测试完成后,选择智能体的右上角,填写发布信息,选择发布渠道为网页,确认发布,等待审核完成。 4. 发布成功后,点击分享,复制访问链接即可。 需要注意的是,大模型存在一定局限性,智能体应用能够弥补这些不足,适用于有企业官网等渠道期望为客户提供产品咨询服务、缺少技术人员开发大模型问答应用等场景。智能体应用的典型场景包括私有领域知识问答、个性化聊天机器人、智能助手等。
2025-03-31
扣子设置了微信客服机器人,如何实现机器人按时自动向微信群发布图片或文档等信息。
要实现微信客服机器人按时自动向微信群发布图片或文档等信息,您可以按照以下步骤进行操作: 前提条件: 1. 已开通了。 2. 已搭建了 Bot。 步骤一:获取微信客服配置信息 1. 登录平台。 2. 单击企业信息,然后复制企业 ID。 3. 单击开发配置,然后再单击开始使用。 4. 单击随机获取按钮分别生成并保存 Token 和 EncodingAESKey。复制 Token 和 EncodingAESKey 后,先不要关闭该页面。 步骤二:在扣子中配置微信客服信息 1. 在 Bots 页面,选择需要发布的 Bot。 2. 在 Bot 编排页面,单击发布。 3. 找到微信客服渠道,然后单击配置。 4. 输入步骤一中复制的企业 ID,然后单击下一步。 5. 输入步骤一中复制的 Token 和 EncodingAESKey,然后单击下一步。 6. 复制 webhook 地址。复制 webhook 地址后,先不要关闭该配置窗口。 步骤三:配置回调地址 1. 回到步骤一中的开始企业接入页面,输入上一步中复制的 webhook 地址。单击完成。确保粘贴回调地址时没有引入空格,空格会导致校验失败。 2. 在开发配置页面,复制 secret。 3. 单击客服账号,复制账号。 步骤四:发布 Bot 1. 回到扣子平台的微信客服渠道配置页面,输入复制的 secret 和客服名称。 2. 单击保存。 3. 在发布记录中输入发布信息,然后勾选微信客服渠道,再单击发布。 4. 发布完成后,单击立即对话登录微信客服,体验 Bot 效果。 常见问题: 1. 收不到机器人回复消息怎么办? 可尝试通过以下方法解决: 查看微信客服的启用状态:登录,在应用管理页面,点击微信客服。确保没有启用微信客服功能。如果已经开启了微信客服功能,需要关闭。关闭后,该应用在工作台入口将被隐藏,员工不可使用。请谨慎评估。 检查近期是否有登录企业微信应用。确保企业至少有一个成员通过手机号验证/微信授权登录过企业微信应用。 如果还是有问题,可以发送邮件至 [email protected] 反馈。
2025-03-30
COZE智能体全自动制造视频发布媒体
以下是关于 COZE 智能体全自动制造视频发布媒体的相关内容: 概述: 基于其他博主开源的视频生成工作流进行功能优化,实现视频全自动创建。感谢开源,还提供了相关教程。 先看效果: 可查看 功能: 通过表单输入主题观点,提交后自动创建文案短视频,创建完成后推送视频链接到飞书消息。 涉及工具: 1. Coze 平台(工作流、DeepSeek R1、文生图、画板、文生音频、图+音频合成视频、多视频合成) 2. 飞书(消息) 3. 飞书多维表格(字段捷径、自动化流程) 大体路径: 1. 通过 coze 创建智能体,创建工作流,使用 DeepSeek R1 根据用户观点创建文案,再创建视频。 2. 发布 coze 智能体到飞书多维表格。 工作流调试完成后,加入到智能体中,可选择工作流绑定卡片数据。 选择发布渠道为飞书多维表格,填写上架信息等待审核,审核通过后即可使用。 3. 在多维表格中使用字段捷径,引用该智能体。 创建飞书多维表格,添加相关字段,配置后使用字段捷径功能,自动调用工作流生成视频。 进行表单分享,实现填写表单自动创建文案短视频的效果。 4. 在多维表格中创建自动化流程,推送消息给指定飞书用户。 【智能体】让 Coze 智能体机器人连上微信和微信群详细配置文档 创建智能体: 1. 知识库 本次创建知识库使用手动清洗数据。 在线知识库:点击创建知识库,创建一个画小二课程的 FAQ 知识库,飞书在线文档中每个问题和答案以分割。 本地文档:注意拆分内容,提高训练数据准确度,按章节进行人工标注和处理。 2. 发布应用:点击发布,确保在 Bot 商店中能够搜到。
2025-03-28
0基础,我需要ai剪辑学习,方便我更快更高效的发布视频
以下是为您提供的 0 基础学习 AI 剪辑的指导: 团队分工: 制片人:负责影片的制作管理,包括团队组建、日程安排、信息收集、资料整理、各处岗位工作缺失时及时补上等。 图像创意:负责用 AI 生成富有想象力的角色和场景等所有出现在视频中的画面,并为每个角色赋予人物小传。 视频制作:将做好的角色场景等图像素材进行 AI 图生文的工作,需要擅长运营工具的笔刷等控制工具,更好的契合剧本。 编剧:负责撰写剧本,包括故事情节、角色串联、人物台词等。 配音和配乐:涉及背景音乐、音效、角色配音、声音克隆,用各种声音类 AI 工具捏出来。 剪辑师:负责把后期剪辑,包括镜头选择、节奏控制和音效配合。 相关技术及工具: MMVid:一个集成的视频理解系统,能处理和理解长视频内容并进行问答。应用场景包括快速的视频剪辑、图生视频、快速诊断等。 工具准备: 文案生成:DeepSeek。 古人形象定制:即梦 AI。 鬼畜视频合成: 声音克隆:fishAudio,用于克隆声音并生成对应文案的音频。 视频合成:Viggle.ai。 视频剪辑:剪映,用于合成音频与视频、添加字幕和背景图。 团队高效协作的方法在于每个人员分工明确,形成了一个最高效的 SOP,可以快速产出。
2025-03-24
我要从哪里了解特定领域的agent发布的信息
以下是一些了解特定领域 agent 发布信息的途径: 1. 飞书:可以在飞书上建机器人,并添加知识库或多维表格编辑权限,通过获取机器人的 app_id 和 app_secret 获得租用 token:tenant_access_token 来获取多维表格数据和编辑能力。然后通过 Coze 搭建定时任务,执行工作流,添加分析文章和搜索文章等能力,变成消息情报官的 Agent,并发布到飞书等平台使用。 2. 微信:可以通过微信公众号、微信小程序等渠道获取特定领域 agent 发布的信息。 3. Coze 商店:特定领域的 agent 可能会在 Coze 商店发布相关信息。 4. 相关比赛网站:例如 2025AGENT 智能体全球创作大赛网站(http://agentga.me),可以了解比赛报名、作品提交、奖项设置等信息,还能获取关于参赛作品知识产权归属等常见问题的解答。 此外,如果您对特定领域 agent 相关的招聘信息感兴趣,可关注序智科技的招聘信息,如算法/后端/前端正式&实习岗位,了解其职责和要求等。
2025-03-20
现在是2025年3月18日,我现在要整理一份AI行业的最新动态,在每天早上十点发布,请你整理今天的最新动态,10条左右
以下是 2025 年 3 月 18 日 AI 行业的最新动态: 1. 3 月 AI 发展持续升温。 2. 3 月潞晨科技发布 OpenSora。 3. 3 月 Suno 发布 V3 版本爆火。 4. OpenAI CPO Kevin Weil 访谈亮点:GPT5 近在眼前,将融合多个模型能力,快速推进,AI 代码自动化将在今年内达到 99%,强化推理能力和大规模预训练是关键方向,AI 不仅会写代码,还将让人人都能成为软件创造者。 5. 2025 年职场思考与建议:高管们面临“经验贬值”与“转型焦虑”,非 AI 公司的估值与融资变难,软件开发方式正被重构,“等风来”的代价越来越高,加入 AI 公司也并非万能,市场冷却下招聘更挑剔。 6. 你的孩子可能已经在用 AI“作弊”。 7. 过去一年,头部 AI 应用的品类变化不显著,创意工具仍占据最大比重。 8. 2024 年 9 月,OpenAI 发布新一代语言模型 o1,采用全新训练与推理方案,结合强化学习技术,显著增强推理能力,可能通过生成内部“思维链”模拟人类系统 2 思维方式。 9. 5 月伊莉雅离开 OpenAI,AI 竞争白热化。 10. 5 月伊利亚成立新公司,估值超五亿美金。
2025-03-18