github 第45页 - AIGC资讯

LLaMa、Qwen、ChatGLM、ChatGLM2的区别

LLaMa、Qwen、ChatGLM、ChatGLM2的区别以下比较的前提是首先和BERT(transfomer 的对比感谢帮忙给我github repository的star，更多最新模型长期更新：https://github.com/zysN...

人工智能 2023-12-27 人工智能

1716阅读

全参数finetune Ziya-LLaMA-13B相关模型，目前支持数据并行+张量并行+ZeRO

全参数Finetune 这个示例主要用于全参数finetune Ziya-LLaMA-13B相关模型，目前支持数据并行+张量并行+ZeRO step0 环境安装 git clone git@github.com:IDEA-CCNL/Fengshenb...

生成式AI 2023-12-27 人工智能

827阅读

在 Apple Silicon Mac 上部署 StableDiffusion 的分步指南，释放 Apple Silicon 芯片及其神经引擎的全部潜力

任何使用AI模型生成图像的服务都在涌现。这些服务中的大多数都提供基于积分的定价系统，您可以在其中购买积分以用于服务，并且每项服务都有自己的每张图片积分等级。另一种选择是直接在您自己的机器上部署文本到图像模型，这样可以避免任何使用成本，除了操作机器的成本。事...

生成式AI 2023-12-26 人工智能

880阅读

又是阿里，通义灵码免费平替GitHub Copilot

毫无疑问，人工智能已经在影响着我们日常生活的方方面面，同样的在软件开发领域，AI正在改变我们的开发方式。在软件开发领域，尽管有许多强大的AI编码工具，但国产，免费，使用门槛低，用起来顺手，效率又高的AI辅助编程工具并不多，国外的大多使用门槛高，需要科学上网...

生成式AI 2023-12-26 人工智能

1632阅读

国内AI大模型的封神榜&死亡笔记；奥特曼首次公开谈宫斗；我有PDF翻译秘诀, 8种！2023年中国AIGC产业全景报告；GitHub Copilot官方入门课 | ShowMeAI日报

?日报&周刊合集 | ?生产力工具与行业应用大全 | ? 点赞关注评论拜托啦！ ? Heygen 注销中国公司主体，探索出海新范式 https://www.heygen.com/ HeyGen 是什么？简单来说，H...

人工智能 2023-12-26 人工智能

1095阅读

打造「专属arXiv」！德国高校顶级视觉团队推出「论文定制化」推荐系统，免费开放

10毫秒生成一张图像，1分钟6000张图像，这是什么概念？下图中，就可以深刻感受到AI的超能力。图片甚至，当你在二次元小姐姐图片生成的提示中，不断加入新的元素，各种风格的图片更迭也是瞬间闪过。图片如此惊人的图片实时生成速度，便是来自UC伯克利、...

人工智能 2023-12-26 人工智能

894阅读

AI绘画：快速上手stable diffusion

点击↑上方↑蓝色“编了个程”关注我~ 这是Yasin的第 89 篇原创文章 mj vs sd 最近随着Chat GPT的大火，AI绘画也火了起来。尤其是midjourney（以下简称mj），能够通过文本关键词生成AI图片，还能...

大数据 2023-12-26 人工智能

1151阅读

单张4090，1秒100张二次元小姐姐！UC伯克利等新模型霸榜Github，吞吐量提升近60倍

10毫秒生成一张图像，1分钟6000张图像，这是什么概念？下图中，就可以深刻感受到AI的超能力。甚至，当你在二次元小姐姐图片生成的提示中，不断加入新的元素，各种风格的图片更迭也是瞬间闪过。如此惊人的图片实时生成速度，便是来自UC伯克利、日本筑波大学...

生成式AI 2023-12-26 人工智能

844阅读

AI绘画：SDXL1.0正式版+2款软件+多种在线体验方式！

万众期待的最强开源AI模型SDXL1.0终于开源了！ SDXL1.0 是什么？简单来说，它是目前最强大的开源AI绘画模型，开源当然也意味着免费。单纯从模型的角度来看，肯定比SD1.5，SD2.x这种强很多。如果你要寻找...

AIGC 2023-12-26 人工智能

1723阅读

DrivingGaussian：逼真环视数据，驾驶场景重建SOTA

本文经自动驾驶之心公众号授权转载，转载请联系出处。原标题：DrivingGaussian: Composite Gaussian Splatting for Surrounding Dynamic Autonomous Driving Scenes...

大数据 2023-12-26 人工智能

921阅读

AI绘画黑科技Stable Diffusion WebUI在线部署使用教程

AI绘画黑科技Stable Diffusion，能够根据文字描述生成精美图像，开源且在消费级GPU上就能运行。 Stable Diffusion WebUI是Stable Diffusion的Web版，提供了便捷的WebUI交互界面，部署使用方便，支持中文...

大数据 2023-12-26 人工智能

1362阅读

基于Gradio/Stable Diffusion/Midjourney的AIGC自动图像绘画生成软件 - Fooocus

0.参考本项目：GitHub - lllyasviel/Fooocus: Focus on prompting and generating 作者：Lvmin Zhang 编辑 lllyasviel 另一杰作 ContorlNet https...

大数据 2023-12-26 人工智能

2561阅读

【人话版】关于“AI替代程序员“的7点碎碎念

都说AI替代这个替代那个，不用浪费时间为这种问题焦虑，因为答案已经越来越明显了... 关键是，什么时候？怎么替？。 1 设想一个场景，有个需求要用某个技术或某个框架实现，有两个程序员对这些都不是很熟。有一个疯狂谷歌、Stackov...

AIGC 2023-12-26 人工智能

1002阅读

基于whisper模型的在线添加视频字幕网站（持续更新）

1.什么是whisper Whisper 是一个自动语音识别（ASR，Automatic Speech Recognition）系统，OpenAI 通过从网络上收集了 68 万小时的多语言（98 种语言）和多任务（multitask）监督数据对 Whi...

大数据 2023-12-26 人工智能

1432阅读

InsCode Stable Diffusion使用教程（非常详细）从零基础入门到精通，看完这一篇就够了

记录一下如何使用 InsCode Stable Diffusion 进行 AI 绘图以及使用感受。一、背景介绍目前市面上比较权威，并能用于工作中的 AI 绘画软件其实就两款。一个叫 Midjourney（简称 MJ），另一个叫 Stable Di...

生成式AI 2023-12-26 人工智能

1485阅读

安装stable-diffusion-webui踩坑经历

软件下载在b站up秋葉aaaki up很贴心有一个整合包可以直接运行。在github下载的原始版本sd-webui ，下载过程遇到clip包安装失败，参考了这两个文章可以解决打开stable diffusion webui时，提示缺少cl...

AIGC 2023-12-26 人工智能

1021阅读

谷歌Bard更新中文支持；GPT-4：1.8万亿参数、混合专家模型揭秘； Meta推出商用版本AI模型

? AI新闻 ? 谷歌的AI聊天工具Bard更新，增加中文支持摘要：谷歌的AI聊天工具Bard新增中文环境，用户可以使用简体和繁体中文进行交流。然而，与竞品相比，Bard的回复略显生硬，语义理解还有待提升。此外，谷歌还更新了Bard的日志页面，新...

大数据 2023-12-26 人工智能

965阅读

stable-diffusion画图

1、在python官网下载python3 安装 2、安装 CUDA 在安装 CUDA 之前查看nvidia版本我的版本是11.6就在nvidia官网下载对应版本 3、在github中下载stable-diffusion-webui git clon...

人工智能 2023-12-25 人工智能

830阅读

LLM微调（四）| 微调Llama 2实现Text-to-SQL，并使用LlamaIndex在数据库上进行推理

Llama 2是开源LLM发展的一个巨大里程碑。最大模型及其经过微调的变体位居Hugging Face Open LLM排行榜（https://huggingface.co/spaces/HuggingFaceH4/open_llm_lea...

AIGC 2023-12-25 人工智能

920阅读

Stable-Diffusion|从图片反推prompt的工具：Tagger（五）

stable-diffusion-webui-wd14-tagger 前面几篇：Stable-Diffusion|window10安装GPU版本的 Stable-Diffusion-WebUI遇到的一些问题（一）【Stable-Diffusion|入门怎...

生成式AI 2023-12-25 人工智能

996阅读

AI视野：必应推出GPT-4Turbo模型；抖音测试“AI搜”功能；小红书内测AI聊天机器人；OpenAI计划新一轮融资

????大模型动态必应推出GPT-4Turbo模型微软推出Bing Chat的最新模型，GPT-4Turbo，为用户提供更准确和最新的信息。目前仅限部分用户试用，使用方法需通过检查资格确认。阿里团队推新AI模型I2VGen-XL 视频合成领域迎来...

人工智能 2023-12-25 人工智能

851阅读

挑战Transformer的Mamba是什么来头？作者博士论文理清SSM进化路径

在大模型领域，Transformer 凭一己之力撑起了整个江山。但随着模型规模的扩展和需要处理的序列不断变长，Transformer 的局限性也逐渐凸显，比如其自注意力机制的计算量会随着上下文长度的增加呈平方级增长。为了克服这些缺陷，研究者们开发出了很多...

生成式AI 2023-12-25 人工智能

1152阅读

AI绘画：Roop插件的特性与安装！

交叉”学科”来了！我们之前讲过可以实现单图换脸的Roop，也讲过可以通过文字描述画画的项目Stable-Diffusion-WebUI。现在这两者要通过sd-webui-roop产生交汇。我们先来简单的看一下这个插件可以干什么！功能特点...

生成式AI 2023-12-25 人工智能

1140阅读

Stable Diffusion - Easy Diffusion 图像生成工具的环境配置

欢迎关注我的CSDN：https://spike.blog.csdn.net/ 本文地址：https://blog.csdn.net/caroline_wendy/article/details/131524075 版本v2.5.41 Stab...

大数据 2023-12-25 人工智能

1358阅读

LLaMA-Adapter: Efficient Fine-tuning of Language Models with Zero-init Attention

Paper name LLaMA-Adapter: Efficient Fine-tuning of Language Models with Zero-init Attention Paper Reading Note Paper URL: htt...

人工智能 2023-12-25 人工智能

914阅读

发现【Stable-Diffusion WEBUI】的神奇插件：离线自动翻译中文提示词

文章目录（零）前言（一）提示词翻译（Prompt Translator）（1.1）尚需改进（零）前言本篇主要提到了WEBUI的提示词翻译插件，之前我说不喜欢联网的插件，而它是离线翻译。更多不断丰富的内容参考：?《...

人工智能 2023-12-25 人工智能

1245阅读

LLama Factory 安装部署实操记录（二）

1. 项目地址 GitHub - hiyouga/LLaMA-Factory: Easy-to-use LLM fine-tuning framework (LLaMA, BLOOM, Mistral, Baichuan, Qwen, ChatGLM E...

人工智能 2023-12-25 人工智能

1776阅读

Tracking Any Object Amodally ：让AI像人一样可以追踪任何对象

Tracking Any Object Amodally是由卡内基梅隆大学和丰田研究所开发的项目使得人工智能能够像人一样追踪物体的整体，即使在部分遮挡或不完全可见的情况下也能理解其完整结构。在这个项目中，计算机被训练成能够“理解”并追踪到部分遮挡物体的完...

人工智能 2023-12-25 人工智能

827阅读

“私密离线聊天新体验！llama-gpt聊天机器人：极速、安全、搭载Llama 2，尽享Code Llama支持！”

“私密离线聊天新体验！llama-gpt聊天机器人：极速、安全、搭载Llama 2，尽享Code Llama支持！” 一个自托管的、离线的、类似chatgpt的聊天机器人。由美洲驼提供动力。100%私密，没有数据离开您的设备。 Demo http...

AIGC 2023-12-25 人工智能

923阅读

Point Transformer V3：更简单、更快、更强!

本文经自动驾驶之心公众号授权转载，转载请联系出处。原标题：Point Transformer V3: Simpler, Faster, Stronger 论文链接：https://arxiv.org/pdf/2312.10035.pdf 代码链接：h...

生成式AI 2023-12-25 人工智能

1122阅读

阿里团队推新AI模型I2VGen-XL：单张静止图像就能生成高质量视频

视频合成最近取得了显著的进步，这得益于扩散模型的快速发展。然而，它在语义准确性、清晰度和时空连续性方面仍然存在挑战。它们主要源于文本-视频数据的稀缺性和视频的复杂固有结构，使得模型难以同时确保语义和定性的卓越性。阿里巴巴、浙江大学和华中科技大学的研究人员...

AIGC 2023-12-25 人工智能

832阅读

Github Copilot绑定Jetbrains IDE无效的解决方案

在Github中进行教育认证后不会自动开通Copilot功能，因此，在进行了Github教育认证之后，在使用之前要进入Github Copilot官网开通Coplilot，如果忽略了这一点，绑定Jetbrains IDE时就会产生绑定无效并卡在“Waiti...

生成式AI 2023-12-25 人工智能

905阅读

Llama 2 with langchain项目详解（三）

Llama 2 with langchain项目详解（三） 17.3 Llama 2 with langchain基础本节讲解在LangChain中使用Llama 2模型的基础知识，展示如何运行LangChain的代码，及在云端运行Llama 2的700...

生成式AI 2023-12-25 人工智能

765阅读

紧跟潮流，抓住趋势，跟上全民AI的节奏，开源IM项目OpenIM产品介绍，为AIGC贡献力量

开源价值高度自主、安全可控、开放自由，私有化部署，一切皆可控透明度和可信度：开源软件的源代码是公开的，任何人都可以查看和检查代码，从而增强了软件的透明度和可信度。用户可以了解软件的内部结构和运作方式，发现和修复潜在的安全漏洞和错误。自由度和可定...

生成式AI 2023-12-25 人工智能

1034阅读

使用llama.cpp在本地搭建vicuna 13B语言模型

有人做了windows下的脚本放到github上了，直接运行就可以了。我在本机试了一下13B的模型能运行，但生成速度非常慢，回复一个问题基本上要花5分钟以上的时间。我的机器配置 3900X 32G内存。 https://github.com/mps2...

大数据 2023-12-25 人工智能

758阅读

文字识别表格识别，这个库直接调用

PaddleOCR是一个基于PaddlePaddle深度学习框架开发的开源OCR（Optical Character Recognition）工具。除了光学字符识别（OCR）功能外，最新版本的PaddleOCR还引入了表格识别功能。表格识别是一种将图像...

人工智能 2023-12-24 人工智能

1155阅读

Novel ai(stable-diffusion-webui)的本地部署经历

整体思路整体参考的就是下面的网站的内容，采用的里面是Anaconda搭建虚拟环境部署的步骤（网站里面用的Miniconda其实上和Anaconda整体思路是一样的） tip：Anaconda的配置是比较简单的，可以直接在网上搜索，需要注意的是建议先卸...

人工智能 2023-12-24 人工智能

933阅读

AI绘画中CLIP文本-图像预训练模型

介绍 OpenAI 在 2021 年提出了 CLIP（Contrastive Language–Image Pretraining）算法，这是一个先进的机器学习模型，旨在理解和解释图像和文本之间的关系。CLIP 的核心思想是通过大规模的图像和文本对进行...

AIGC 2023-12-24 人工智能

1048阅读

OpenAI Whisper + FFmpeg + TTS：动态实现跨语言视频音频翻译

本文作者系360奇舞团前端开发工程师摘要：本文介绍了如何结合 OpenAI Whisper、FFmpeg 和 TTS（Text-to-Speech）技术，以实现将视频翻译为其他语言并更换声音的过程。我们将探讨如何使用 Ope...

生成式AI 2023-12-24 人工智能

1170阅读

Ubuntu 22.04安装英特尔显卡驱动玩转AIGC

作者：英特尔网路与边缘计算事业部开发者关系经理李翊玮本文将介绍如何使用EIV 用5行指令在快速搭建含英特尔显卡及OpenVINO的AI开发环境, 并简洁说明如何使用OpenVINO 及英特尔显卡优化文生图模型Stable Diffusion 的速度。...

AIGC 2023-12-24 人工智能

1201阅读

baichuan-7B-chat微调报错及解决记录使用的仓库：LLaMA-Factory 2023年11月27日

我所使用的代码仓库是LLaMA-Factoryhiyouga/LLaMA-Factory: Easy-to-use LLM fine-tuning framework (LLaMA, BLOOM, Mistral, Baichuan, Qwen, Chat...

大数据 2023-12-24 人工智能

1720阅读

CMU权威对比Gemini，GPT-3和Mistral8×7B！GPT-3.5依旧拿捏Gemini，开源模型差距依然不小

谷歌最近发布的Gemini掀起了不小的波澜。毕竟，大语言模型领域几乎是OpenAI的GPT一家独大的局面。不过作为吃瓜群众，当然希望科技公司都卷起来，大模型都打起来！所以，作为科技巨无霸谷歌的亲儿子，Gemini自然承受了很高的期待。虽然Gemi...

大数据 2023-12-24 人工智能

1021阅读

工具：Copilot实战经验分享

在人工智能（AI）和机器学习（ML）领域，Copilot已经成为一个备受瞩目的工具。它是由微软和OpenAI联合开发的，以帮助开发者更高效地完成编程任务。在这篇文章中，我将分享一些关于Copilot的实战经验，以及如何利用它来提高编程效率。 Copil...

人工智能 2023-12-24 人工智能

978阅读

stable-diffusion安装和简单测试

参考：https://github.com/CompVis/stable-diffusion理解DALL·E 2， Stable Diffusion和 Midjourney的工作原理Latent Diffusion Models论文解读【生成式AI】淺談圖...

人工智能 2023-12-24 人工智能

959阅读

Stable Diffusion 深度图像库插件使用小记

前言 Controlnet 横空出世以来，Stable Diffusion 从抽卡模式变为引导控制模式，产生了质的飞跃，再也不用在prompt中钻研如何描述生成人物的动作模式，他对AI画师来说生产力提高不知道多少倍，文末...

大数据 2023-12-24 人工智能

1158阅读

window安装Stable-Diffusion-WebUI详细教程

直接上效果图，这是通过stable diffusion webui 利用古风模型生成的图片，实在是太好看了！！！看了这些图，有没有心痒痒的？今天就来带大家入个门！先把软件搞起来！【前言】 Stable Diffusion是2022年发布的深度学...

生成式AI 2023-12-24 人工智能

1095阅读

【stable-diffusion使用扩展+插件和模型资源（下）】

插件模型魔法图片等资源：https://tianfeng.space/1240.html 书接上文：（上）插件推荐 1.lobe theme lobe theme是一款主题插件，直接可以在扩展安装界面进行了重新布局，做了一些优化，...

AIGC 2023-12-24 人工智能

1031阅读

Install Stable Diffusion WebUI on Ubuntu 22.04.2 LTS

1. Environment OS：Ubuntu 22.04 LTS Kernel：5.15.0-60-generic CPU: Intel(R Xeon(R Gold 6278C CPU @ 2.60GHz, 8vCPUs GPU: 1 * N...

人工智能 2023-12-24 人工智能

922阅读

精讲stable diffusion的controlNet插件

controlNet插件是stable diffusion的一个重要插件，甚至可以说正是因为有了controlNet插件，stable diffusion才会具有midjourney所不具备的独特魅力！我们今天就一起来学习下controlNet插件的安...

生成式AI 2023-12-24 人工智能

1061阅读

【AIGC】Chatglm2-lora微调

ChatGLM2介绍 ChatGLM2-6B源码地址：https://github.com/THUDM/ChatGLM2-6B ChatGLM2-6B 是开源中英双语对话模型 ChatGLM-6B 的第二代版本，在保留了初代模型对话流畅、部署门槛较低...

AIGC 2023-12-24 人工智能

980阅读