我必须下载一个 250mb~ ZIP 文件,密码通过 FTP 加密。下载后,我必须使用通用密码解压缩它,Zip 文件将包含一个 1.5GB 的 MS Access 数据库,我必须读取它并与我的数据库 Oracle 中的一些表进行一些连接,并将该数据转换并加载到该 Oracle 数据库中。
我正在寻找执行此过程的最佳方法。 我是 c# 开发人员,所以我的第一个想法是使用 c#,通过 FtpClient 下载文件。或 FtpWebRequest , 然后使用类似 DotNetZip 的 zip 库并通过 ODBC 打开 MS Access 数据库并使用 ODP.NEt 将记录加载到 Oracle 中,我认为这是我的“简单方法”,因为我知道如何去做。
但由于这是一个大文件,而且我知道这可能需要很长时间,所以我很关心时间和效率以及如何减少这个过程的时间。
所以我认为将所有请求直接处理到 oracle(从那里下载 FTP,在那里解压缩,然后直接在那里处理信息会减少时间,比如从 c# 到 oracle 逐条记录传递)应该减少这个过程的时间,但我不确定这是否是正确的方法。
所以我开始研究 oracle 中的库,它们可以完成我想要实现的目标,我发现了 PLSQL-utils似乎他们可以做我需要的一切,除了阅读 MS Access 数据库,我开始寻找它并找到了 Heterogeneous Services但我从未使用过它们,所以对此我一点也不迷茫。
还有一次听说我可以直接从 Oracle 使用 Java,而且我知道 java 可以通过 JDBC 连接到 MS Access。所以我搜索了一下,发现了一些关于 Calling Java Methods in Oracle Database 的东西
这就是我目前所知道的,但我不知道我应该使用哪种方法,我的意思是,据我所知,RDBMS 用于处理数据,而不是用于编程,例如下载文件或类似的东西,这就是我们拥有 OOP 语言的原因。
作为附加信息,这个过程将在一个月内执行一次或两次,所以我必须安排它,如果它在 oracle 中,可以很容易地通过计划作业完成,或者在 c# 中使用计划任务或 Windows服务(那些是我知道的工具)
我有一些限制
综上所述,我怎样才能有效地完成所有这些过程,我应该使用 .net 并在我的 Oracle 数据库中逐条加载记录吗?我应该在 oracle 中做所有事情吗?还是什么都不做?有更好的方法吗?
最佳答案
我认为您使用 C# 控制台应用程序使其成为一个可重复的过程是正确的。 Here是很棒的免费图书馆,我在许多项目中都使用过它来压缩。
using (var client = new WebClient())
using (var stream = client.OpenRead(@"ftp://mysite.com/mydb.zip"))
using (var file = File.Create(@"c:\temp\mydb.zip"))
{
stream.CopyTo(@"c:\temp\mydb.zip", 32000);
}
using (ZipFile zip = ZipFile.Read(@"c:\temp\mydb.zip"))
{
ZipEntry e = zip["bigdb.mdb"];
e.Password = "yourpassword";
e.Extract("c:\temp\bigdb.mdb");
}
解压后,您可以创建到访问数据库和数据读取器对象的数据连接。然后使用 dbreader 读取行并写入平面文件(避免大数据集出现内存不足异常)。
private constr = "Provider=Microsoft.Jet.OLEDB.4.0;Data Source=yourdbfile.mdb;Jet OLEDB:Database Password=yourpassword;";
OleDbConnection conn = new OleDbConnection(constr);
string query = "SELECT * FROM [YourTable]";
OleDbCommand cmd = new OleDbCommand(query, conn);
OleDbDataReader reader = cmd.ExecuteReader();
int rowNum = 0;
StringBuilder sb = new StringBuilder();
while (reader.Read())
{
// write rows to flat file in chunks of 10K rows.
sb.Append(reader["FieldA"].ToString() + "|");
sb.Append(reader["FieldB"].ToString() + "|");
sb.Append(reader["FieldC"].ToString() + System.Environment.NewLine);
if (rowNum % 10000 == 0)
{
File.AppendText(@"c:\temp\data.psv", sb.ToString());
sb = new StringBuilder();
}
rowNum++;
}
File.AppendText(@"c:\temp\data.psv", sb.ToString());
reader.Close();
填写数据表后,您可以将其导出到平面文件。 我不建议逐行插入数据,那会非常慢并且会使您的 Oracle 数据库事务日志膨胀。我不相信 Oracle 10g 有支持批量加载的 .Net 驱动程序,所以您可能需要通过平面文件批量加载。
接下来,通过命令行导入Oracle,you can invoke this from your C# console app .在执行此操作之前,您需要创建一个 control file, ctl.ldr ,首先由 Oracle 用于批量加载操作。
options (skip=1)
load data
INFILE 'c:\temp\data.psv'
INTO table tblTest
APPEND
FIELDS TERMINATED BY "|" optionally enclosed by '"'
( fielda,fieldb,etc...)
and then
run it in as follows via command line
sqlldr username/pswd@oracle_sid control=ctl.ldr
希望这对您有所帮助,祝您好运!
[编辑]
您还可以查看 .Net Oracle Bulk copy class .这是随 Oracle 11g 客户端 驱动程序一起提供的。也许它仍然适用于您的 10g 服务器。那里的一个潜在问题是,同一应用程序服务器上的所有其他应用程序也需要与这些更新的 11g 客户端驱动程序一起工作。另一种选择是构建一个使用 Jena framework 的 Java 应用程序。支持批量加载。
关于c# - 下载和处理要在 Oracle 中加载的超大压缩 MS Access 文件的最佳方法,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/19391601/
我有一个Ruby程序,它使用rubyzip压缩XML文件的目录树。gem。我的问题是文件开始变得很重,我想提高压缩级别,因为压缩时间不是问题。我在rubyzipdocumentation中找不到一种为创建的ZIP文件指定压缩级别的方法。有人知道如何更改此设置吗?是否有另一个允许指定压缩级别的Ruby库? 最佳答案 这是我通过查看rubyzip内部创建的代码。level=Zlib::BEST_COMPRESSIONZip::ZipOutputStream.open(zip_file)do|zip|Dir.glob("**/*")d
我试图在一个项目中使用rake,如果我把所有东西都放到Rakefile中,它会很大并且很难读取/找到东西,所以我试着将每个命名空间放在lib/rake中它自己的文件中,我添加了这个到我的rake文件的顶部:Dir['#{File.dirname(__FILE__)}/lib/rake/*.rake'].map{|f|requiref}它加载文件没问题,但没有任务。我现在只有一个.rake文件作为测试,名为“servers.rake”,它看起来像这样:namespace:serverdotask:testdoputs"test"endend所以当我运行rakeserver:testid时
我的目标是转换表单输入,例如“100兆字节”或“1GB”,并将其转换为我可以存储在数据库中的文件大小(以千字节为单位)。目前,我有这个:defquota_convert@regex=/([0-9]+)(.*)s/@sizes=%w{kilobytemegabytegigabyte}m=self.quota.match(@regex)if@sizes.include?m[2]eval("self.quota=#{m[1]}.#{m[2]}")endend这有效,但前提是输入是倍数(“gigabytes”,而不是“gigabyte”)并且由于使用了eval看起来疯狂不安全。所以,功能正常,
Rails2.3可以选择随时使用RouteSet#add_configuration_file添加更多路由。是否可以在Rails3项目中做同样的事情? 最佳答案 在config/application.rb中:config.paths.config.routes在Rails3.2(也可能是Rails3.1)中,使用:config.paths["config/routes"] 关于ruby-on-rails-Rails3中的多个路由文件,我们在StackOverflow上找到一个类似的问题
对于具有离线功能的智能手机应用程序,我正在为Xml文件创建单向文本同步。我希望我的服务器将增量/差异(例如GNU差异补丁)发送到目标设备。这是计划:Time=0Server:hasversion_1ofXmlfile(~800kiB)Client:hasversion_1ofXmlfile(~800kiB)Time=1Server:hasversion_1andversion_2ofXmlfile(each~800kiB)computesdeltaoftheseversions(=patch)(~10kiB)sendspatchtoClient(~10kiBtransferred)Cl
我正在寻找执行以下操作的正确语法(在Perl、Shell或Ruby中):#variabletoaccessthedatalinesappendedasafileEND_OF_SCRIPT_MARKERrawdatastartshereanditcontinues. 最佳答案 Perl用__DATA__做这个:#!/usr/bin/perlusestrict;usewarnings;while(){print;}__DATA__Texttoprintgoeshere 关于ruby-如何将脚
Rackup通过Rack的默认处理程序成功运行任何Rack应用程序。例如:classRackAppdefcall(environment)['200',{'Content-Type'=>'text/html'},["Helloworld"]]endendrunRackApp.new但是当最后一行更改为使用Rack的内置CGI处理程序时,rackup给出“NoMethodErrorat/undefinedmethod`call'fornil:NilClass”:Rack::Handler::CGI.runRackApp.newRack的其他内置处理程序也提出了同样的反对意见。例如Rack
使用带有Rails插件的vim,您可以创建一个迁移文件,然后一次性打开该文件吗?textmate也可以这样吗? 最佳答案 你可以使用rails.vim然后做类似的事情::Rgeneratemigratonadd_foo_to_bar插件将打开迁移生成的文件,这正是您想要的。我不能代表textmate。 关于ruby-使用VimRails,您可以创建一个新的迁移文件并一次性打开它吗?,我们在StackOverflow上找到一个类似的问题: https://sta
好的,所以我的目标是轻松地将一些数据保存到磁盘以备后用。您如何简单地写入然后读取一个对象?所以如果我有一个简单的类classCattr_accessor:a,:bdefinitialize(a,b)@a,@b=a,bendend所以如果我从中非常快地制作一个objobj=C.new("foo","bar")#justgaveitsomerandomvalues然后我可以把它变成一个kindaidstring=obj.to_s#whichreturns""我终于可以将此字符串打印到文件或其他内容中。我的问题是,我该如何再次将这个id变回一个对象?我知道我可以自己挑选信息并制作一个接受该信
我正在编写一个小脚本来定位aws存储桶中的特定文件,并创建一个临时验证的url以发送给同事。(理想情况下,这将创建类似于在控制台上右键单击存储桶中的文件并复制链接地址的结果)。我研究过回形针,它似乎不符合这个标准,但我可能只是不知道它的全部功能。我尝试了以下方法:defauthenticated_url(file_name,bucket)AWS::S3::S3Object.url_for(file_name,bucket,:secure=>true,:expires=>20*60)end产生这种类型的结果:...-1.amazonaws.com/file_path/file.zip.A